Reconhecimento, tradução, voz
A cadeia inteira roda local: o ASR transforma sua voz em texto, o MT traduz, o TTS fala. Nenhuma parte precisa de rede.
O Sokuji traz reconhecimento, tradução e síntese de voz no dispositivo, de graça. Não é para quando a rede cai — é um caminho de primeira classe, e esperamos que se torne o padrão.
A cadeia inteira roda local: o ASR transforma sua voz em texto, o MT traduz, o TTS fala. Nenhuma parte precisa de rede.
O Sokuji detecta sua GPU e baixa o pacote de motor feito para ela, e depois diz qual escolheu e o tamanho.
Nada para registrar e nada para gastar. Seu próprio hardware é o custo inteiro.
Preferimos dizer isso claramente a vender demais.
Um modelo grande hospedado ainda está à frente em precisão e latência, e para uma chamada importante você provavelmente vai querer um. A saída no dispositivo já basta para muitíssimas conversas — e é a única configuração que não envolve ninguém além de você.
Os modelos continuam encolhendo, os runtimes melhorando e os aceleradores dos notebooks comuns ficando mais rápidos. Não esperamos que a diferença dure, e não vamos esperar que ela feche para tratar o local como primeira escolha. Ninguém deveria ter de entregar sua conversa a uma grande empresa de IA só para ter IA.
É a única das três em que a resposta não precisa de ressalvas.