Fale a sua própria língua.
Seja ouvido na língua do outro.

Sua voz sai no idioma deles. O que eles dizem volta como legendas no seu. O Sokuji é um microfone virtual entre você e seu app de reunião, então a configuração fica do seu lado — eles falam normalmente, sem instalar nada e sem link para entrar.

Livre e de código aberto · IA no dispositivo · sem assinatura
Sokuji

Instale o app ou adicione-o ao seu navegador

O app de desktop não depende de uma lista de sites compatíveis. Ele se registra como um microfone na sua máquina, então qualquer coisa que possa escolher um microfone consegue usá-lo.

App de desktop — nível de sistema

O Sokuji aparece como um microfone comum no seu sistema operacional. Apps de reunião, navegadores, gravadores, software de streaming, jogos — se dá para escolher um microfone, ele ouve a sua voz traduzida.

No sentido inverso ele não pede permissão a ninguém: o Sokuji lê o que a sua máquina estiver tocando, incluindo o áudio do sistema, então um vídeo, uma transmissão ou uma gravação ganham legenda igual a uma chamada.

Linux / integrado, em PulseAudio ou PipeWire
macOS / o driver acompanha o app · Windows / via VB-CABLE

Extensão de navegador

Nada instalado no sistema e nenhum roteamento de áudio para configurar. Feita para os sites de reunião que ela suporta.

Zoom · Google Meet · Microsoft Teams · Slack · Discord · Jitsi Meet · Whereby · Gather · Yandex Telemost

Dentro dessas páginas a sua voz traduzida é oferecida ao site como microfone, e o áudio da própria aba é o que volta traduzido. Em qualquer outro lugar — outro app, um vídeo fora do navegador, o áudio do sistema — o trabalho é do app de desktop.

O que você quer fazer?

O Sokuji é feito para que o custo de atravessar um idioma recaia sobre quem quer ser entendido. Foi o primeiro que construímos. Mas você nem sempre é essa pessoa — às vezes está numa aula, ouvindo uma gravação, ou numa chamada que outra pessoa marcou.

Entender o que os outros dizem

Reuniões, aulas, palestras, vídeos, transmissões — leia uma tradução ao vivo do que você ouve.

eles falam → você lê

Legendar a minha própria fala

Palestras, transmissões, apresentações — seu público lê legendas traduzidas, sem voz sintética.

você fala → eles leem

Conversa nos dois sentidos

Eles ouvem a sua voz traduzida; você lê legendas do que eles dizem.

nos dois sentidos · voz na saída, texto na entrada

Dois sentidos, só legendas

Legendas bilíngues e atas de reunião — os dois lados como texto, sem nenhuma voz sintética.

nos dois sentidos · apenas texto

O que ele faz durante uma chamada

Qualquer um consegue jogar voz dentro de um modelo. Continuar inteligível por uma reunião inteira — acompanhar o ritmo, saber quando você terminou uma ideia, não devolver a sua própria voz — isso é engenharia de áudio.

Fale com a sua própria voz

Grave um clipe curto uma vez e a sua fala traduzida sai com a sua voz em vez de uma voz de catálogo, ou escolha uma da biblioteca do fornecedor. Quais vozes você pode escolher depende do fornecedor que usa.

Velocidade de fala adaptativa

A mesma frase leva mais tempo em algumas línguas, então em ritmo fixo a tradução atrasa a cada frase. O Sokuji acelera só o suficiente para acompanhar.

Detecção semântica de turno

Ele espera um pensamento concluído, não uma simples pausa, para não te cortar no meio da frase.

Suas palavras, seus termos

Instruções de sistema impedem que nomes, termos de produto e jargão interno virem papa na tradução.

Sobreposição de legendas

Uma janela separada que dá para arrastar e redimensionar, ou legendas sobre a própria página da reunião.

Funciona com a rede desligada

O Sokuji detecta a sua GPU, baixa o motor de inferência feito para ela e roda reconhecimento, tradução e voz na sua máquina — sem chave, sem conta, sem medidor. Aqui, rodar no dispositivo é um caminho de primeira classe, não um recurso para quando a conexão cai.

Também: traduzir enquanto pressiona, supressão de ruído, cancelamento de eco, tradução de transcrições parciais, ajuste do buffer de áudio, troca de dispositivos de áudio no meio da sessão, o próprio microfone virtual e exportar uma conversa como .txt ou .json.

O que carregamos por você — e o que continua seu

O Sokuji é gratuito e de código aberto, e vai continuar assim. Separadamente, uma conta Kizuna AI pode guardar a chave e pagar a fatura de alguns fornecedores de IA, para quem prefere não mexer em consoles de desenvolvedor. Não executamos os modelos, e é um serviço que talvez você nunca toque. Toda conveniência tem uma saída ao lado.

isto nós carregamos

Uma conta, sem consoles

Emitimos a credencial e pagamos a fatura. Quem executa o modelo continua sendo a OpenAI, a Doubao ou a Soniox.

Uma fatura, medida

Cuidamos do encanamento do pagamento e cobramos o que você realmente usou.

Modelos na nuvem quando precisar

A tradução mais rápida e precisa disponível hoje, sob demanda.

Um app empacotado

Builds de desktop e uma extensão de navegador, em alguns cliques.

isto você sempre pode fazer sozinho

Use a sua própria chave

Mais de dez fornecedores suportados, cada um com passo a passo e capturas.

Pague o fornecedor direto

Deixe a gente completamente de fora. O Sokuji funciona sem nenhuma conta Kizuna AI.

Rode na sua própria máquina

Inferência local, gratuita, capaz de funcionar offline e entregue como primeira escolha.

Compile a partir do código

Clone, leia, modifique, publique o seu próprio build. AGPL-3.0.

35+
idiomas de tradução
30
idiomas da interface
9
sites de reunião na extensão
10+
provedores de IA, mais o seu próprio endpoint

O seu áudio não passa por nós

Mesmo quando a chave vem da sua conta Kizuna AI, o áudio vai do seu dispositivo direto para o fornecedor que executa o modelo — e se o modelo escolhido for o local, ele não vai a lugar nenhum. Nós emitimos a credencial e medimos o gasto, e a única coisa que guardamos sobre você é um endereço de e-mail.

Todas as plataformas, e o que cada uma pede de você

Windows

Assinado, então instala sem os avisos de sempre — graças à SignPath Foundation, que assina de graça. O roteamento usa VB-CABLE.

Baixar →

macOS

O driver de áudio acompanha o instalador. O app não é assinado, então o Gatekeeper vai barrar você — um projeto gratuito não consegue arcar com a taxa anual da Apple.

Baixar →

Linux

O microfone virtual é criado pelo próprio Sokuji via PulseAudio ou PipeWire — não há mais nada para instalar.

Baixar →

Se você doar uma conta Apple Developer para assinatura e notarização, nós a usaríamos → support@kizuna.ai

Por que funciona assim

A maioria das perguntas que recebemos são, na verdade, perguntas sobre as escolhas por trás do produto. Aqui estão, respondidas sem rodeios.

Vocês recebem meu áudio ou o conteúdo das minhas reuniões?

Não. Seu áudio vai do seu dispositivo direto para o provedor de IA que você escolheu. Isso vale também quando a chave vem de uma conta Kizuna AI: nós a emitimos e contamos o uso, e o provedor faz o resto. O único dado de usuário que guardamos é um endereço de e-mail, usado para verificar você e conceder crédito de teste.

Por que eu deveria acreditar nisso?

Em parte, você não deveria — então aqui está a linha. O app é licenciado sob AGPL-3.0, e é o app que decide para onde vai o seu áudio: está todo em github.com/kizuna-ai-lab/sokuji, você pode compilá-lo e observá-lo na rede. Nosso serviço de contas não é de código aberto, então o que ele faz com um endereço de e-mail e um contador de uso é uma promessa, não uma prova. Preferimos marcar essa linha a borrá-la.

Por que a outra pessoa não precisa instalar nada?

Porque achamos que atravessar um idioma é tarefa de quem quer ser entendido, não de todo mundo que ouve. O Sokuji traduz do seu lado e fala por um microfone virtual, então o que chega a eles é áudio de chamada comum.

Posso usá-lo para traduzir o YouTube em tempo real?

Pode, e nada o impede — o Sokuji traduz qualquer áudio que chegue à sua máquina, vídeo incluído. Só não é para isso que o construímos. Um vídeo assistido por cem mil pessoas, traduzido ao vivo, é o mesmo trabalho feito cem mil vezes; traduzido uma vez por quem publica, é feito uma vez. Criadores usam o Sokuji justamente para produzir essas traduções.

Sou obrigado a usar o serviço de IA de vocês?

Não. Traga sua própria chave de qualquer fornecedor suportado, aponte o Sokuji para qualquer endpoint compatível com OpenAI, ou rode no dispositivo de graça. A conta Kizuna AI existe para quem prefere não lidar com consoles de desenvolvedor — não para prender ninguém.

A IA local é só um recurso para quando estou offline?

Não — é um caminho de primeira classe e sempre foi gratuito. Os modelos continuam encolhendo, os runtimes melhorando e os aceleradores de consumo ficando mais rápidos. Ninguém deveria ter de entregar sua conversa a uma grande empresa de IA só para usar IA.

Quanto custa o Sokuji?

O Sokuji é livre e de código aberto, e a inferência no dispositivo é gratuita junto com ele. A única coisa que custa é a conta opcional da Kizuna AI, medida pelo que você realmente usa — nunca uma assinatura mensal, e um mês parado não custa nada. O saldo recarregado vale um ano: esse limite é contabilidade, não um empurrão para gastar. Com sua própria chave ou rodando local, você não nos paga nada.

Por que o macOS me avisa e o Windows não?

As duas coisas se resumem à assinatura de código, que custa dinheiro. O Windows é assinado graças à SignPath Foundation, que assina software livre sem custo. A Apple não tem um programa assim e cobra uma taxa anual de desenvolvedor que um projeto sem receita não consegue arcar — por isso o build de macOS não é assinado, o Gatekeeper diz isso, e o contorno está documentado em vez de escondido. Doações de uma conta Apple Developer são bem-vindas.

Fale a sua própria língua.
Seja ouvido na língua do outro.

livre e de código aberto · com IA no dispositivo · sem assinatura