Parla la tua lingua.
Fatti sentire in quella dell'altro.

La tua voce esce nella loro lingua. Quello che dicono torna come sottotitoli nella tua. Sokuji è un microfono virtuale fra te e la tua app di riunione, così la configurazione resta dalla tua parte — loro parlano normalmente, senza installare nulla e senza link da aprire.

Libero e open source · IA sul dispositivo · nessun abbonamento
Sokuji

Installa l’app, o aggiungila al browser

L’app desktop non dipende da un elenco di siti supportati. Si registra come microfono sul tuo computer, quindi qualunque cosa possa scegliere un microfono può usarla.

App desktop — a livello di sistema

Sokuji compare come un normale microfono nel sistema operativo. App di riunione, browser, registratori, software di streaming, giochi: se puoi sceglierci un microfono, sente la tua voce tradotta.

Nel senso opposto non chiede il permesso a nessuno: Sokuji legge quello che il computer sta riproducendo, audio di sistema compreso, così un video, una diretta o una registrazione vengono sottotitolati come una chiamata.

Linux / integrato, su PulseAudio o PipeWire
macOS / il driver è incluso nell’app · Windows / tramite VB-CABLE

Estensione per browser

Niente installato nel sistema e nessun routing audio da configurare. Fatta per i siti di riunione che supporta.

Zoom · Google Meet · Microsoft Teams · Slack · Discord · Jitsi Meet · Whereby · Gather · Yandex Telemost

Dentro quelle pagine la tua voce tradotta viene offerta al sito come microfono, e l’audio della scheda è ciò che viene tradotto di ritorno. Altrove — un’altra app, un video fuori dal browser, l’audio di sistema — il compito è dell’app desktop.

Che cosa vuoi fare?

Sokuji è costruito perché il costo di attraversare una lingua ricada su chi vuole farsi capire. È la prima cosa che abbiamo costruito. Ma non sei sempre tu quella persona — a volte sei a una lezione, stai ascoltando una registrazione, o sei in una call organizzata da qualcun altro.

Capire quello che dicono gli altri

Riunioni, lezioni, conferenze, video, dirette: leggi una traduzione dal vivo di ciò che senti.

loro parlano → tu leggi

Sottotitolare quello che dico

Conferenze, dirette, presentazioni: il pubblico legge sottotitoli tradotti, senza voce sintetica.

tu parli → loro leggono

Conversazione nei due sensi

Sentono la tua voce tradotta; tu leggi i sottotitoli di quello che dicono.

in entrambi i sensi · voce in uscita, testo in entrata

Due sensi, solo sottotitoli

Sottotitoli bilingue e verbali: entrambe le parti come testo, senza alcuna voce sintetica.

in entrambi i sensi · solo testo

Che cosa fa durante una chiamata

Far passare la voce in un modello lo sa fare chiunque. Restare comprensibili per un’intera riunione — tenere il passo, capire quando un pensiero è finito, non rimandarti la tua stessa voce — è ingegneria audio.

Parla con la tua voce

Registra una volta un breve clip e il parlato tradotto avrà la tua voce invece di una voce di serie, oppure scegline una dalla libreria del fornitore. Quali voci puoi scegliere dipende dal fornitore che usi.

Velocità di eloquio adattiva

La stessa frase dura di più in certe lingue, quindi a velocità fissa la traduzione resta indietro a ogni frase. Sokuji accelera quel tanto che basta per stare al passo.

Rilevamento semantico dei turni

Aspetta un pensiero concluso, non una semplice pausa, così non vieni interrotto a metà frase.

Le tue parole, i tuoi termini

Le istruzioni di sistema evitano che nomi, termini di prodotto e gergo interno finiscano tradotti in poltiglia.

Sovrimpressione dei sottotitoli

Una finestra separata che puoi spostare e ridimensionare, oppure sottotitoli sopra la pagina della riunione.

Funziona con la rete spenta

Sokuji rileva la tua GPU, scarica il motore di inferenza costruito per essa ed esegue riconoscimento, traduzione e voce sulla tua macchina: nessuna chiave, nessun account, nessun contatore. Qui l’esecuzione sul dispositivo è un percorso di prima classe, non un ripiego per quando cade la connessione.

Inoltre: traduzione premi-e-parla, soppressione del rumore, cancellazione dell’eco, traduzione delle trascrizioni parziali, regolazione del buffer audio, cambio dei dispositivi audio a sessione avviata, il microfono virtuale stesso ed esportazione di una conversazione in .txt o .json.

Che cosa portiamo noi — e che cosa resta tuo

Sokuji è gratuito e open source, e resterà così. A parte questo, un account Kizuna AI può tenere la chiave e pagare la fattura presso alcuni fornitori di IA, per chi preferisce non avere a che fare con le console per sviluppatori. Non eseguiamo i modelli, ed è un servizio che potresti non toccare mai. Accanto a ogni comodità c’è un’uscita.

questo lo portiamo noi

Un account, niente console

Emettiamo la credenziale e paghiamo la fattura. Il modello lo esegue sempre OpenAI, Doubao o Soniox.

Una fattura, a consumo

Ci occupiamo dell’idraulica dei pagamenti e ti addebitiamo quello che hai davvero usato.

Modelli cloud quando servono

La traduzione più veloce e accurata disponibile oggi, quando ti serve.

Un’app pronta

Build desktop e un’estensione per browser, in un paio di clic.

questo puoi sempre farlo tu

La tua chiave

Più di dieci fornitori supportati, ciascuno con guida e schermate.

Paga il fornitore direttamente

Lasciaci completamente fuori. Sokuji funziona senza alcun account Kizuna AI.

Eseguilo sulla tua macchina

Inferenza locale, gratuita, funzionante offline e distribuita come prima scelta.

Compilalo dai sorgenti

Clona, leggi, modifica, distribuisci la tua build. AGPL-3.0.

35+
lingue di traduzione
30
lingue dell’interfaccia
9
siti di riunione nell’estensione
10+
provider di IA, più il tuo endpoint

Il tuo audio non passa da noi

Anche quando la chiave arriva dal tuo account Kizuna AI, l’audio va dal tuo dispositivo direttamente al fornitore che esegue il modello — e se il modello che hai scelto è quello locale, non va da nessuna parte. Noi emettiamo la credenziale e contiamo la spesa; l’unica cosa che conserviamo di te è un indirizzo email.

Ogni piattaforma, e cosa ti chiede ciascuna

Windows

Firmato, quindi si installa senza i soliti avvisi — grazie a SignPath Foundation, che lo firma gratis. L’instradamento usa VB-CABLE.

Scarica →

macOS

Il driver audio è incluso nell’installer. L’app non è firmata, quindi Gatekeeper ti fermerà — un progetto gratuito non può sostenere la quota annuale di Apple.

Scarica →

Linux

Il microfono virtuale lo crea Sokuji stesso tramite PulseAudio o PipeWire — non c’è altro da installare.

Scarica →

Se volessi donare un account Apple Developer per firma e notarizzazione, lo useremmo → support@kizuna.ai

Perché funziona così

Quasi tutte le domande che riceviamo riguardano in realtà le scelte dietro il prodotto. Eccole, con risposte dirette.

Ricevete il mio audio o il contenuto delle mie riunioni?

No. Il tuo audio va dal tuo dispositivo direttamente al provider di IA che hai scelto. Vale anche quando la chiave viene da un account Kizuna AI: noi la emettiamo e contiamo il consumo, il resto lo fa il provider. L’unico dato utente che conserviamo è un indirizzo email, usato per verificarti e assegnare il credito di prova.

Perché dovrei crederci?

In parte non dovresti — ecco quindi la linea. L’app è sotto licenza AGPL-3.0, ed è l’app a decidere dove va il tuo audio: è tutta su github.com/kizuna-ai-lab/sokuji, puoi compilarla da solo e osservarla sulla rete. Il nostro servizio di account non è open source, quindi ciò che fa di un indirizzo email e di un contatore di consumo è una promessa, non una prova. Preferiamo segnare quella linea che sfumarla.

Perché l’altra persona non deve installare niente?

Perché pensiamo che attraversare una lingua sia compito di chi vuole farsi capire, non di tutti quelli che ascoltano. Sokuji traduce dalla tua parte e parla attraverso un microfono virtuale, così a loro arriva normalissimo audio di chiamata.

Posso usarlo per tradurre YouTube in tempo reale?

Puoi, e niente te lo impedisce — Sokuji traduce qualunque audio arrivi alla tua macchina, video compreso. Semplicemente non è ciò per cui lo costruiamo. Un video visto da centomila persone, tradotto in diretta, è lo stesso lavoro fatto centomila volte; tradotto una volta da chi lo pubblica, è fatto una volta. I creatori usano Sokuji proprio per produrre quelle traduzioni.

Devo per forza usare il vostro servizio di IA?

No. Porta la tua chiave di qualunque provider supportato, punta Sokuji a un endpoint compatibile con OpenAI, oppure eseguilo sul dispositivo gratis. L’account Kizuna AI esiste per chi preferisce non avere a che fare con le console per sviluppatori — non per legare nessuno.

L’IA locale è solo un ripiego per quando sei offline?

No — è un percorso di prima classe ed è sempre stato gratuito. I modelli continuano a rimpicciolirsi, i runtime a migliorare, gli acceleratori di consumo a velocizzarsi. Nessuno dovrebbe consegnare la propria conversazione a una grande azienda di IA solo per usare l’IA.

Quanto costa Sokuji?

Sokuji è libero e open source, e l’inferenza sul dispositivo è gratuita insieme a lui. L’unica cosa che costa è l’account Kizuna AI, facoltativo, ed è misurato su quel che usi davvero: mai un abbonamento mensile, e un mese tranquillo non costa nulla. Il credito ricaricato vale un anno: quel limite è contabilità, non una spinta a spendere. Con la tua chiave o in locale non ci paghi proprio niente.

Perché macOS mi avvisa e Windows no?

Entrambe le cose si riducono alla firma del codice, che costa. Windows è firmato grazie a SignPath Foundation, che firma software libero senza costi. Apple non ha un programma simile e chiede una quota annuale che un progetto senza ricavi non può sostenere — la build per macOS non è firmata, Gatekeeper lo dice, e l’aggiramento è documentato anziché nascosto. Le donazioni di un account Apple Developer sono benvenute.

Parla la tua lingua.
Fatti sentire in quella dell'altro.

libero e open source · IA sul dispositivo inclusa · nessun abbonamento