Vai al contenuto
Saj Speak
Lingua: Italiano
Apri Saj Link

La capacità vocale di Saj Sense

Intelligenza vocale che non lascia mai il dispositivo.

Trascrizione, sintesi vocale, parole di attivazione e altro ancora. Ogni motore, dal rilevamento della parola di attivazione alla sintesi vocale, gira sul dispositivo senza alcuna dipendenza dal cloud. Arabo, hindi e urdu sono integrati nelle fondamenta insieme all'inglese.

Sviluppato in Rust da SGH WLL, con centinaia di test superati e un portafoglio di brevetti depositato.

Una wake word per lingua. Scegline una e segui il suo filo lungo la pipeline.

Wake wordsaj-wakeInferenza sotto 1 ms, modello sotto 1 MBFunziona in Inglese
Attività vocalesaj-detectFunziona in Inglese
Ascoltosaj-listenFunziona in Inglese
Intentosaj-intentFunziona in Inglese
Vocesaj-speak-ttsFunziona in Inglese

Il filo passa nell'occhio di ogni fase che gira nella sua lingua e sotto tutte le altre.

Intelligenza vocale che rispetta i tuoi utenti.

  • Privato dalla prima parola

    La tua voce non lascia mai il dispositivo. Nessuna elaborazione nel cloud, nessuna conservazione dei dati e nessuna telemetria. La conformità a GDPR, HIPAA e NESA nasce dall'architettura stessa.

  • L'arabo dalle fondamenta

    Arabo, hindi e urdu sono integrati nelle fondamenta insieme all'inglese. Nessuno di essi è stato aggiunto in seguito come livello di traduzione.

  • Su ogni piattaforma

    iOS, Android, Linux, Windows, macOS, Raspberry Pi, WASM e MCU. Un core in Rust con binding nativi ti permette di distribuire su telefoni, altoparlanti, dispositivi embedded e browser.

Ogni motore gira sul dispositivo.

Non c'è alcun passaggio dal cloud, quindi le funzioni vocali che rilasci continuano a funzionare offline, ovunque. Ogni motore è un crate Rust a sé, e insieme contengono più di 70 modelli addestrati.

Ascolto

Parola di attivazionesaj-wake

Rilevamento di parole chiave personalizzate su un'architettura neurale leggera, con modelli sotto 1 MB.

IngleseAraboHindiUrdu
Attività vocalesaj-detect

Rilevamento neurale dell'attività vocale con latenza inferiore al millisecondo.

Speech-to-text in streamingsaj-listen

Trascrizione in tempo reale.

IngleseAraboHindiUrdu
Speech-to-text batchsaj-scribe

Trascrizione di file con encoder e decoder separati.

Intent vocalesaj-intent

Estrazione diretta dell'intento che trasforma i comandi vocali in azioni senza passare dal testo.

IngleseArabo

Parlato

Text-to-speechsaj-speak-tts

Sintesi vocale naturale sul dispositivo.

IngleseAraboHindi
Clonazione vocalesaj-clone

Clona una voce a partire da alcuni campioni, sul dispositivo.

IngleseArabo

Chi parla

Identificazione del parlantesaj-voice

Embedding vocali per la verifica e l'identificazione.

Diarizzazionesaj-who

Segmentazione dei parlanti in tempo reale che indica chi ha parlato e quando.

Soppressione del rumoresaj-clean

Rimozione neurale leggera del rumore.

Connettività

Pipelinesaj-pipeline

Una sola interazione vocale che esegue parola di attivazione, attività vocale, speech-to-text, intento e text-to-speech in una sola riga.

Codec neuralesaj-codec

Codec vocale neurale con profili di qualità da 1.2 a 6.0 kbps, in tempo reale su CPU.

Sensing multimodalesaj-sense

Flussi di token unificati con cifratura per ogni modalità.

Comunicazioni cifratesaj-link

Messaggistica cifrata end-to-end con mittente sigillato.

Server self-hostedsaj-server

REST e WebSocket con un'API compatibile con OpenAI e Deepgram. Multi-tenant, e gira in Docker.

L'arabo nelle fondamenta, dialetto per dialetto.

Più di 420 milioni di persone parlano arabo, e 1.09 miliardi parlano arabo, hindi o urdu.

Copertura dei dialetti arabi
DialettoCoperturaStato
الفصحىArabo standard modernoWake word, STT, TTS e intento. Il registro formale di oltre 420 milioni di parlanti.Supportato
الخليجيGolfoWake word, STT e TTS. Ottimizzato per Emirati Arabi Uniti, Arabia Saudita, Bahrein, Kuwait, Qatar e Oman.Supportato
المصريEgizianoOltre 100 milioni di parlanti, e il dialetto arabo più compreso al mondo.Pianificato
الشاميLevantinoSiria, Libano, Giordania e Palestina, con oltre 30 milioni di parlanti.Pianificato

Wake word disponibili in arabo

  • يا ساجYa Saj
  • يا بيلاYa Bella
  • اوكي ساجOk Saj
  • Personalizzata

Voice AI enterprise per il MENA

Banche, telco e agenzie governative di tutto il Golfo hanno bisogno di voice AI che elabori l'arabo sul dispositivo, con consapevolezza dei dialetti, trattamento sovrano dei dati e conformità NESA inclusa.

Contatta le vendite enterprise

Perché sul dispositivo?

Le API vocali nel cloud costano al minuto, fanno trapelare i dati e aggiungono latenza. L'esecuzione sul dispositivo risolve tutti e tre i problemi.

Sul dispositivoParola di attivazione in meno di 1 ms
Round-trip nel cloudda 200 a 500 ms
Riprodotto dieci volte più lento, così puoi vederlo.
  • Privacy totale

    Nessun dato audio lascia il dispositivo. Nessuna elaborazione nel cloud e nessuna conservazione dei dati.

  • Parola di attivazione sotto il millisecondo

    Inferenza della parola di attivazione in meno di un millisecondo, contro un round-trip nel cloud da 200 a 500 ms, così l'interazione vocale avviene in tempo reale senza attendere la rete.

  • Nessun costo al minuto

    Nessuna fatturazione a ore di audio. I tuoi modelli girano sul tuo hardware.

Come ottenere Saj Speak.

Saj Link è l'applicazione che usa ogni giorno. Saj Speak, Saj See e Saj Codec sono moduli di capacità interni che si rendono disponibili tramite Saj Sense Business+, l'API ospitata per sviluppatori e gli accordi OEM o Embedded. Non vengono mai venduti come brand separati.

Saj Speak

  • Saj Sense Business+

    Saj Speak compare nel tier Saj Sense Business+.

  • API ospitata per sviluppatori

    Saj Speak è disponibile anche tramite l'API ospitata per sviluppatori.

  • OEM / Embedded

    Saj Speak dentro il suo dispositivo o prodotto, tramite un accordo OEM o Embedded.