La capacità vocale di Saj Sense
Intelligenza vocale che non lascia mai il dispositivo.
Trascrizione, sintesi vocale, parole di attivazione e altro ancora. Ogni motore, dal rilevamento della parola di attivazione alla sintesi vocale, gira sul dispositivo senza alcuna dipendenza dal cloud. Arabo, hindi e urdu sono integrati nelle fondamenta insieme all'inglese.
Sviluppato in Rust da SGH WLL, con centinaia di test superati e un portafoglio di brevetti depositato.
Una wake word per lingua. Scegline una e segui il suo filo lungo la pipeline.
saj-wakeInferenza sotto 1 ms, modello sotto 1 MBFunziona in Inglesesaj-detectFunziona in Inglesesaj-listenFunziona in Inglesesaj-intentFunziona in Inglesesaj-speak-ttsFunziona in IngleseIl filo passa nell'occhio di ogni fase che gira nella sua lingua e sotto tutte le altre.
Intelligenza vocale che rispetta i tuoi utenti.
Privato dalla prima parola
La tua voce non lascia mai il dispositivo. Nessuna elaborazione nel cloud, nessuna conservazione dei dati e nessuna telemetria. La conformità a GDPR, HIPAA e NESA nasce dall'architettura stessa.
L'arabo dalle fondamenta
Arabo, hindi e urdu sono integrati nelle fondamenta insieme all'inglese. Nessuno di essi è stato aggiunto in seguito come livello di traduzione.
Su ogni piattaforma
iOS, Android, Linux, Windows, macOS, Raspberry Pi, WASM e MCU. Un core in Rust con binding nativi ti permette di distribuire su telefoni, altoparlanti, dispositivi embedded e browser.
Ogni motore gira sul dispositivo.
Non c'è alcun passaggio dal cloud, quindi le funzioni vocali che rilasci continuano a funzionare offline, ovunque. Ogni motore è un crate Rust a sé, e insieme contengono più di 70 modelli addestrati.
Ascolto
saj-wakeRilevamento di parole chiave personalizzate su un'architettura neurale leggera, con modelli sotto 1 MB.
saj-detectRilevamento neurale dell'attività vocale con latenza inferiore al millisecondo.
saj-listenTrascrizione in tempo reale.
saj-scribeTrascrizione di file con encoder e decoder separati.
saj-intentEstrazione diretta dell'intento che trasforma i comandi vocali in azioni senza passare dal testo.
Parlato
saj-speak-ttsSintesi vocale naturale sul dispositivo.
saj-cloneClona una voce a partire da alcuni campioni, sul dispositivo.
Chi parla
saj-voiceEmbedding vocali per la verifica e l'identificazione.
saj-whoSegmentazione dei parlanti in tempo reale che indica chi ha parlato e quando.
saj-cleanRimozione neurale leggera del rumore.
Connettività
saj-pipelineUna sola interazione vocale che esegue parola di attivazione, attività vocale, speech-to-text, intento e text-to-speech in una sola riga.
saj-codecCodec vocale neurale con profili di qualità da 1.2 a 6.0 kbps, in tempo reale su CPU.
saj-senseFlussi di token unificati con cifratura per ogni modalità.
saj-linkMessaggistica cifrata end-to-end con mittente sigillato.
saj-serverREST e WebSocket con un'API compatibile con OpenAI e Deepgram. Multi-tenant, e gira in Docker.
L'arabo nelle fondamenta, dialetto per dialetto.
Più di 420 milioni di persone parlano arabo, e 1.09 miliardi parlano arabo, hindi o urdu.
| Dialetto | Copertura | Stato |
|---|---|---|
| الفصحىArabo standard moderno | Wake word, STT, TTS e intento. Il registro formale di oltre 420 milioni di parlanti. | Supportato |
| الخليجيGolfo | Wake word, STT e TTS. Ottimizzato per Emirati Arabi Uniti, Arabia Saudita, Bahrein, Kuwait, Qatar e Oman. | Supportato |
| المصريEgiziano | Oltre 100 milioni di parlanti, e il dialetto arabo più compreso al mondo. | Pianificato |
| الشاميLevantino | Siria, Libano, Giordania e Palestina, con oltre 30 milioni di parlanti. | Pianificato |
Wake word disponibili in arabo
- يا ساجYa Saj
- يا بيلاYa Bella
- اوكي ساجOk Saj
- Personalizzata
Voice AI enterprise per il MENA
Banche, telco e agenzie governative di tutto il Golfo hanno bisogno di voice AI che elabori l'arabo sul dispositivo, con consapevolezza dei dialetti, trattamento sovrano dei dati e conformità NESA inclusa.
Contatta le vendite enterprisePerché sul dispositivo?
Le API vocali nel cloud costano al minuto, fanno trapelare i dati e aggiungono latenza. L'esecuzione sul dispositivo risolve tutti e tre i problemi.
Privacy totale
Nessun dato audio lascia il dispositivo. Nessuna elaborazione nel cloud e nessuna conservazione dei dati.
Parola di attivazione sotto il millisecondo
Inferenza della parola di attivazione in meno di un millisecondo, contro un round-trip nel cloud da 200 a 500 ms, così l'interazione vocale avviene in tempo reale senza attendere la rete.
Nessun costo al minuto
Nessuna fatturazione a ore di audio. I tuoi modelli girano sul tuo hardware.
Come ottenere Saj Speak.
Saj Link è l'applicazione che usa ogni giorno. Saj Speak, Saj See e Saj Codec sono moduli di capacità interni che si rendono disponibili tramite Saj Sense Business+, l'API ospitata per sviluppatori e gli accordi OEM o Embedded. Non vengono mai venduti come brand separati.
Saj Speak
Saj Sense Business+
Saj Speak compare nel tier Saj Sense Business+.
API ospitata per sviluppatori
Saj Speak è disponibile anche tramite l'API ospitata per sviluppatori.
OEM / Embedded
Saj Speak dentro il suo dispositivo o prodotto, tramite un accordo OEM o Embedded.
Costruito su Saj Speak
Ottieni Saj Link.
Comunicazione di squadra cifrata con Bella AI integrata. Il protocollo post-quantistico è pronto ed è in distribuzione. Disponibile ora per macOS e per il web.
iOS su TestFlightAndroid e Windows arrivano presto.
- Cifratura end-to-end
- Mittente sigillato e cifratura end-to-end per messaggi e media condivisi. L'audio delle chiamate passa da un relay e non è ancora cifrato end-to-end.
- Intelligenza vocale
- Trascrizione, traduzione e ricerca sul dispositivo che capiscono il dialetto.
- Design arabo-first
- Layout nativo da destra a sinistra, consapevolezza dei dialetti e messaggi vocali presentati come card ricche.