Escenarios

¿Qué quieres hacer?

Son preajustes, no modos que te aten: todo lo que configuran se puede cambiar después.

Qué fija cada uno

Todos son las mismas tres decisiones, respondidas de otra manera: de quién se traduce el audio, si el resultado se dice en voz alta, y qué acaba en tu pantalla.

understand-others

Entender lo que dicen los demás

Reuniones, clases, charlas, vídeos, directos: lee una traducción en vivo de lo que oyes. No se dice nada de vuelta.

Quién lo elige: Tú eres quien escucha, y quien habla no va a encontrarse contigo a mitad de camino.

qué fija
qué audio
la otra parte
se dice en voz alta
no
en pantalla
la traducción de lo que dicen
be-heard

Que te entiendan en una reunión

Oyen tu voz traducida por el micrófono virtual y siguen hablando con normalidad: sin instalar nada, sin plugin, sin subtítulos que leer.

Quién lo elige: Quien habla en un idioma que la sala no comparte, en una llamada que no montó necesariamente él.

qué fija
qué audio
tu micrófono
se dice en voz alta
sí — una voz sintética hacia la llamada
en pantalla
tus palabras y la traducción juntas
subtitle-myself

Subtitular lo que digo

Charlas, directos, presentaciones: tu público lee subtítulos traducidos mientras tú hablas con normalidad. No se genera ninguna voz sintética.

Quién lo elige: Ponentes y streamers, donde una segunda voz sobre la tuya sería peor que los subtítulos.

qué fija
qué audio
tu micrófono
se dice en voz alta
no
en pantalla
la traducción, para tu público
two-way-voice

Conversación en ambos sentidos

Ellos oyen tu voz traducida; tú lees subtítulos hechos de lo que dicen.

Quién lo elige: Una conversación de ida y vuelta de verdad, donde ninguna parte comparte idioma.

qué fija
qué audio
ambas partes
se dice en voz alta
sí — solo tu lado
en pantalla
original y traducción, ambas partes
two-way-text

Ambos sentidos, solo subtítulos

Subtítulos bilingües y actas de reunión: ambas partes como texto, sin ninguna voz sintética.

Quién lo elige: Reuniones grabadas, toma de actas, o cualquier sala donde añadir audio no sería bienvenido.

qué fija
qué audio
ambas partes
se dice en voz alta
no
en pantalla
original y traducción, ambas partes

«Cualquier app» es literal. A la salida Sokuji es un micrófono corriente, así que cualquier cosa que te deje elegir uno puede llevar tu voz traducida: una pestaña del navegador, una grabadora, software de streaming, un juego. A la entrada trabaja con lo que tu máquina esté reproduciendo, audio del sistema incluido, así que un vídeo, un directo o una grabación se comportan igual que una llamada.

No todos los proveedores pueden con todos los escenarios

Depende de una sola propiedad: si el proveedor puede producir voz, y si se le puede mantener callado. Algunos devuelven solo texto, así que no pueden hablar tu lado dentro de la llamada. Otros siempre responden con audio, así que no se les puede limitar a subtítulos. Sokuji lo comprueba cuando eliges el proveedor, así que un escenario que no puede servir queda cerrado antes de la llamada en vez de descubrirse durante ella.

disponible · no disponible con ese proveedor

solo devuelve textosiempre hablapuede las dos
Entender lo que dicen los demás
Que te entiendan en una reunión
Subtitular lo que digo
Conversación en ambos sentidos
Ambos sentidos, solo subtítulos

Entender lo que dicen los demás es el que funciona en todas partes: ese lado solo se convierte en texto, así que si el proveedor tiene voz o no nunca llega a plantearse.

Habla tu propio idioma.
Que te oigan en el del otro.

libre y de código abierto · con IA en el dispositivo · sin suscripción