Audio del otro

Traduce el audio del otro en tiempo real mientras hablas.

Resumen

La función «Audio del otro» permite la traducción en tiempo real de lo que dice el otro. Mientras hablas y tu voz se traduce al «Idioma del otro», Sokuji puede capturar simultáneamente al otro y traducirlo de vuelta a «Mi idioma».

Cuándo usar esta función

  • Videoconferencias donde los participantes hablan diferentes idiomas
  • Reuniones en línea donde necesitas entender las respuestas en tiempo real
  • Sesiones de colaboración internacional
  • Sesiones de aprendizaje y práctica de idiomas

Cómo funciona

Sokuji utiliza una arquitectura de doble cliente para manejar la traducción bidireccional sin bucles de retroalimentación de audio:

Canal «Yo» (tu voz)

Captura la entrada de tu micrófono y traduce de «Mi idioma» al «Idioma del otro». El audio traducido se reproduce en tu reunión.

Canal «Otro» (la voz del otro)

Captura el audio del sistema o de la pestaña y traduce del «Idioma del otro» de vuelta a «Mi idioma». La traducción aparece como texto en la vista de conversación.

Soporte de plataformas

«Audio del otro» está disponible en todas las plataformas compatibles con Sokuji:

PlataformaCompatibleMétodo de captura
Windows (Electron)✅Loopback de audio del sistema
macOS (Electron)✅Loopback de audio del sistema
Linux (Electron)✅Monitor PulseAudio/PipeWire
Extensión de navegador✅Captura de pestaña de Chrome

Cómo activar

Aplicación de escritorio (Electron)

  1. Abre el panel de configuración
  2. Busca la sección «Audio del otro»
  3. Activa el interruptor para habilitar la captura del otro
  4. En Linux, selecciona el dispositivo de salida de audio del cual capturar
  5. Inicia tu sesión de traducción
Nota para macOS: En macOS, necesitarás otorgar permiso de Grabación de pantalla al activar esta función por primera vez. Ve a Preferencias del sistema > Seguridad y privacidad > Privacidad > Grabación de pantalla.

Extensión de navegador

  1. Abre el panel de la extensión Sokuji
  2. Busca la sección «Audio del otro»
  3. Activa el interruptor para habilitar la captura de audio de la pestaña
  4. Selecciona el dispositivo de salida para la reproducción de audio
  5. Inicia tu sesión de traducción

Guía de selección de dispositivos

La interfaz de selección de dispositivos varía según la plataforma. Aquí te mostramos lo que verás y qué significa cada opción:

Windows y macOS (aplicación de escritorio)

  • UI: Opción única de "Audio del sistema" (sin selección desplegable)
  • What it captures: Todo el audio de salida del sistema se captura automáticamente
  • Permissions:
    • Windows: No se requieren permisos especiales
    • macOS: Se requiere permiso de Grabación de pantalla (para loopback de audio)
Note: La selección de audio individual por aplicación no está disponible en estas plataformas.

Linux (aplicación de escritorio)

  • UI: Menú desplegable con múltiples sinks de audio + botón Actualizar
  • Options shown: Las opciones muestran descripciones de sinks de PulseAudio/PipeWire
  • Example options:
    • "Built-in Audio Analog Stereo" - Altavoces internos
    • "HDMI Output" - Audio del monitor externo
    • "USB Audio Device" - Auriculares/altavoces USB conectados
  • What it captures: Se captura la salida de audio del sink seleccionado
Tip: Si tu dispositivo de audio no aparece en la lista, haz clic en el botón Actualizar.

Extensión de navegador

  • UI: Menú desplegable con dispositivos de salida + botón Actualizar
  • What the dropdown controls: El menú desplegable controla dónde se reproduce el audio de paso (NO lo que se captura)
  • What gets captured: El audio de la pestaña actual del navegador se captura automáticamente cuando está habilitado
  • Example options:
    • "Predeterminado" - Salida predeterminada del sistema
    • "Altavoz integrado" - Altavoces del portátil
    • "Auriculares USB" - Dispositivo de audio USB conectado
Important: El audio de la pestaña se captura automáticamente; el menú desplegable solo selecciona dónde escuchas el audio original (reproducción).

Diferencias entre plataformas

La experiencia del usuario varía ligeramente entre plataformas:

AspectoAplicación de escritorioExtensión de navegador
Alcance de capturaTodo el audio del sistemaSolo la pestaña actual
Selección de dispositivoLinux: Múltiples fuentes disponibles; Windows/macOS: Opción única de "Audio del sistema"Dispositivo de salida para reproducción
Reproducción de audioNo necesario (el audio ya se está reproduciendo)Automático (la pestaña se silencia durante la captura)

Consejos para mejores resultados

  • Usa auriculares para evitar la retroalimentación de audio entre los altavoces y el micrófono
  • Asegúrate de que el audio del otro sea claro y sin distorsión
  • El otro se traduce solo como texto para evitar eco
  • Los canales «Yo» y «Otro» usan el mismo proveedor de IA
  • Cierra aplicaciones de audio innecesarias para reducir la captura de ruido de fondo

Preguntas frecuentes

¿Por qué el otro se traduce solo como texto?

Para evitar bucles de retroalimentación de audio, la traducción del otro se muestra como texto en lugar de audio hablado. Esto garantiza que puedas leer la traducción sin crear eco en la reunión.

¿Puedo capturar audio de una aplicación específica?

Actualmente, la aplicación de escritorio captura todo el audio del sistema. El enrutamiento de audio específico por aplicación no es compatible. La extensión del navegador solo captura audio de la pestaña actual.

¿Por qué necesito permiso de Grabación de pantalla en macOS?

macOS requiere permiso de Grabación de pantalla para cualquier aplicación que capture audio del sistema. Esta es una característica de seguridad del sistema operativo.

¿Qué pasa si uso el mismo dispositivo para la salida de altavoz y la captura del audio del otro?

Sokuji mostrará una advertencia si seleccionas dispositivos en conflicto, ya que esto podría crear retroalimentación de audio. Elige dispositivos diferentes o usa auriculares para evitar este problema.