Audio del otro
Traduce el audio del otro en tiempo real mientras hablas.
Resumen
La función «Audio del otro» permite la traducción en tiempo real de lo que dice el otro. Mientras hablas y tu voz se traduce al «Idioma del otro», Sokuji puede capturar simultáneamente al otro y traducirlo de vuelta a «Mi idioma».
Cuándo usar esta función
- Videoconferencias donde los participantes hablan diferentes idiomas
- Reuniones en línea donde necesitas entender las respuestas en tiempo real
- Sesiones de colaboración internacional
- Sesiones de aprendizaje y práctica de idiomas
Cómo funciona
Sokuji utiliza una arquitectura de doble cliente para manejar la traducción bidireccional sin bucles de retroalimentación de audio:
Canal «Yo» (tu voz)
Captura la entrada de tu micrófono y traduce de «Mi idioma» al «Idioma del otro». El audio traducido se reproduce en tu reunión.
Canal «Otro» (la voz del otro)
Captura el audio del sistema o de la pestaña y traduce del «Idioma del otro» de vuelta a «Mi idioma». La traducción aparece como texto en la vista de conversación.
Soporte de plataformas
«Audio del otro» está disponible en todas las plataformas compatibles con Sokuji:
| Plataforma | Compatible | Método de captura |
|---|---|---|
| Windows (Electron) | ✅ | Loopback de audio del sistema |
| macOS (Electron) | ✅ | Loopback de audio del sistema |
| Linux (Electron) | ✅ | Monitor PulseAudio/PipeWire |
| Extensión de navegador | ✅ | Captura de pestaña de Chrome |
Cómo activar
Aplicación de escritorio (Electron)
- Abre el panel de configuración
- Busca la sección «Audio del otro»
- Activa el interruptor para habilitar la captura del otro
- En Linux, selecciona el dispositivo de salida de audio del cual capturar
- Inicia tu sesión de traducción
Extensión de navegador
- Abre el panel de la extensión Sokuji
- Busca la sección «Audio del otro»
- Activa el interruptor para habilitar la captura de audio de la pestaña
- Selecciona el dispositivo de salida para la reproducción de audio
- Inicia tu sesión de traducción
Guía de selección de dispositivos
La interfaz de selección de dispositivos varía según la plataforma. Aquí te mostramos lo que verás y qué significa cada opción:
Windows y macOS (aplicación de escritorio)
- UI: Opción única de "Audio del sistema" (sin selección desplegable)
- What it captures: Todo el audio de salida del sistema se captura automáticamente
- Permissions:
- Windows: No se requieren permisos especiales
- macOS: Se requiere permiso de Grabación de pantalla (para loopback de audio)
Linux (aplicación de escritorio)
- UI: Menú desplegable con múltiples sinks de audio + botón Actualizar
- Options shown: Las opciones muestran descripciones de sinks de PulseAudio/PipeWire
- Example options:
- "Built-in Audio Analog Stereo" - Altavoces internos
- "HDMI Output" - Audio del monitor externo
- "USB Audio Device" - Auriculares/altavoces USB conectados
- What it captures: Se captura la salida de audio del sink seleccionado
Extensión de navegador
- UI: Menú desplegable con dispositivos de salida + botón Actualizar
- What the dropdown controls: El menú desplegable controla dónde se reproduce el audio de paso (NO lo que se captura)
- What gets captured: El audio de la pestaña actual del navegador se captura automáticamente cuando está habilitado
- Example options:
- "Predeterminado" - Salida predeterminada del sistema
- "Altavoz integrado" - Altavoces del portátil
- "Auriculares USB" - Dispositivo de audio USB conectado
Diferencias entre plataformas
La experiencia del usuario varía ligeramente entre plataformas:
| Aspecto | Aplicación de escritorio | Extensión de navegador |
|---|---|---|
| Alcance de captura | Todo el audio del sistema | Solo la pestaña actual |
| Selección de dispositivo | Linux: Múltiples fuentes disponibles; Windows/macOS: Opción única de "Audio del sistema" | Dispositivo de salida para reproducción |
| Reproducción de audio | No necesario (el audio ya se está reproduciendo) | Automático (la pestaña se silencia durante la captura) |
Consejos para mejores resultados
- Usa auriculares para evitar la retroalimentación de audio entre los altavoces y el micrófono
- Asegúrate de que el audio del otro sea claro y sin distorsión
- El otro se traduce solo como texto para evitar eco
- Los canales «Yo» y «Otro» usan el mismo proveedor de IA
- Cierra aplicaciones de audio innecesarias para reducir la captura de ruido de fondo
Preguntas frecuentes
¿Por qué el otro se traduce solo como texto?
Para evitar bucles de retroalimentación de audio, la traducción del otro se muestra como texto en lugar de audio hablado. Esto garantiza que puedas leer la traducción sin crear eco en la reunión.
¿Puedo capturar audio de una aplicación específica?
Actualmente, la aplicación de escritorio captura todo el audio del sistema. El enrutamiento de audio específico por aplicación no es compatible. La extensión del navegador solo captura audio de la pestaña actual.
¿Por qué necesito permiso de Grabación de pantalla en macOS?
macOS requiere permiso de Grabación de pantalla para cualquier aplicación que capture audio del sistema. Esta es una característica de seguridad del sistema operativo.
¿Qué pasa si uso el mismo dispositivo para la salida de altavoz y la captura del audio del otro?
Sokuji mostrará una advertencia si seleccionas dispositivos en conflicto, ya que esto podría crear retroalimentación de audio. Elige dispositivos diferentes o usa auriculares para evitar este problema.