Reconnaissance, traduction, voix
Toute la chaîne tourne en local : l’ASR transforme votre voix en texte, la MT la traduit, la TTS la dit. Aucune étape n’a besoin du réseau.
Sokuji embarque gratuitement reconnaissance, traduction et synthèse vocale sur l’appareil. Ce n’est pas pour quand le réseau tombe : c’est une voie de première classe, et nous pensons qu’elle deviendra la voie par défaut.
Toute la chaîne tourne en local : l’ASR transforme votre voix en texte, la MT la traduit, la TTS la dit. Aucune étape n’a besoin du réseau.
Sokuji détecte votre GPU et télécharge le paquet moteur conçu pour elle, puis vous dit lequel il a choisi et quelle taille il fait.
Rien à créer, rien à dépenser. Votre matériel est tout le coût.
Nous préférons le dire clairement plutôt que de le survendre.
Un grand modèle hébergé garde l’avantage en précision et en latence, et pour un appel à enjeu vous en voudrez sans doute un. La sortie locale suffit pour énormément de conversations — et c’est la seule configuration où personne d’autre que vous n’intervient.
Les modèles rétrécissent, les runtimes s’améliorent, et les accélérateurs des ordinateurs portables ordinaires accélèrent. Nous ne pensons pas que l’écart durera, et nous n’attendons pas qu’il se referme pour traiter le local comme premier choix. Personne ne devrait avoir à confier sa conversation à une grande entreprise d’IA simplement pour avoir de l’IA.
C’est la seule des trois dont la réponse n’appelle aucune nuance.