Reconocimiento, traducción, voz
Toda la cadena corre en local: el ASR convierte tu voz en texto, el MT la traduce, el TTS la dice. Ninguna parte necesita red.
Sokuji trae reconocimiento, traducción y síntesis de voz en el dispositivo, gratis. No está ahí para cuando se cae la red: es una vía de primera clase, y esperamos que llegue a ser la predeterminada.
Toda la cadena corre en local: el ASR convierte tu voz en texto, el MT la traduce, el TTS la dice. Ninguna parte necesita red.
Sokuji detecta tu GPU y descarga el paquete de motor construido para ella, y luego te dice cuál eligió y cuánto ocupa.
Nada que registrar y nada que gastar. Tu propio hardware es todo el coste.
Preferimos decirlo claro antes que venderlo de más.
Un modelo grande alojado sigue por delante en precisión y latencia, y para una llamada importante probablemente querrás uno. La salida en el dispositivo es suficiente para muchísimas conversaciones — y es la única configuración en la que no interviene nadie más que tú.
Los modelos siguen encogiendo, los runtimes siguen mejorando y los aceleradores de los portátiles corrientes siguen acelerando. No esperamos que la brecha dure, y no vamos a esperar a que se cierre para tratar lo local como primera opción. Nadie debería tener que entregar su conversación a una gran empresa de IA solo para poder usar IA.
Es la única de las tres en la que la respuesta no necesita matices.