Audio des Gegenübers
Übersetzt das Audio Ihres Gegenübers in Echtzeit, während Sie sprechen.
Übersicht
Die Funktion „Audio des Gegenübers“ ermöglicht die Echtzeit-Übersetzung dessen, was Ihr Gegenüber sagt. Während Sie sprechen und Ihre Stimme in die „Sprache des Gegenübers“ übersetzt wird, kann Sokuji gleichzeitig Ihr Gegenüber erfassen und zurück in „Meine Sprache“ übersetzen.
Wann diese Funktion nutzen
- Videokonferenzen, bei denen Teilnehmer verschiedene Sprachen sprechen
- Online-Meetings, in denen Sie Antworten in Echtzeit verstehen müssen
- Internationale Zusammenarbeitssitzungen
- Sprachlernen und Übungssitzungen
Funktionsweise
Sokuji verwendet eine Dual-Client-Architektur für bidirektionale Übersetzung ohne Audio-Rückkopplungsschleifen:
Kanal „Ich“ (Ihre Stimme)
Erfasst Ihre Mikrofoneingabe und übersetzt von „Meine Sprache“ in die „Sprache des Gegenübers“. Das übersetzte Audio wird in Ihr Meeting wiedergegeben.
Kanal „Gegenüber“ (die Stimme Ihres Gegenübers)
Erfasst System- oder Tab-Audio und übersetzt von der „Sprache des Gegenübers“ zurück in „Meine Sprache“. Die Übersetzung erscheint als Text in der Konversationsansicht.
Plattformunterstützung
„Audio des Gegenübers“ ist auf allen von Sokuji unterstützten Plattformen verfügbar:
| Plattform | Unterstützt | Erfassungsmethode |
|---|---|---|
| Windows (Electron) | ✅ | System-Audio-Loopback |
| macOS (Electron) | ✅ | System-Audio-Loopback |
| Linux (Electron) | ✅ | PulseAudio/PipeWire-Monitor |
| Browser-Erweiterung | ✅ | Chrome Tab-Erfassung |
Aktivierung
Desktop-App (Electron)
- Öffnen Sie die Einstellungen
- Suchen Sie den Abschnitt „Audio des Gegenübers“
- Aktivieren Sie den Schalter für die Erfassung des Gegenübers
- Unter Linux: Wählen Sie das Audioausgabegerät zur Erfassung
- Starten Sie Ihre Übersetzungssitzung
Browser-Erweiterung
- Öffnen Sie das Sokuji-Erweiterungspanel
- Suchen Sie den Abschnitt „Audio des Gegenübers“
- Aktivieren Sie den Schalter für die Tab-Audioerfassung
- Wählen Sie das Ausgabegerät für Audio-Durchleitung
- Starten Sie Ihre Übersetzungssitzung
Geräteauswahl-Anleitung
Die Geräteauswahl-Oberfläche variiert je nach Plattform. Hier sehen Sie, was angezeigt wird und was jede Option bedeutet:
Windows & macOS (Desktop-App)
- UI: Eine „Systemaudio"-Option (keine Dropdown-Auswahl)
- What it captures: Gesamte Systemaudioausgabe wird automatisch erfasst
- Permissions:
- Windows: Keine besonderen Berechtigungen erforderlich
- macOS: Bildschirmaufnahme-Berechtigung erforderlich (für Audio-Loopback)
Linux (Desktop-App)
- UI: Dropdown mit mehreren Audio-Senken + Aktualisieren-Schaltfläche
- Options shown: Optionen zeigen PulseAudio/PipeWire-Senkenbeschreibungen
- Example options:
- „Built-in Audio Analog Stereo" — Interne Lautsprecher
- „HDMI Output" — Externes Monitor-Audio
- „USB Audio Device" — Angeschlossene USB-Kopfhörer/-Lautsprecher
- What it captures: Audioausgabe der ausgewählten Senke wird erfasst
Browser-Erweiterung
- UI: Dropdown mit Ausgabegeräten + Aktualisieren-Schaltfläche
- What the dropdown controls: Das Dropdown steuert, wo das Durchleitungs-Audio abgespielt wird (NICHT was erfasst wird)
- What gets captured: Audio des aktuellen Browser-Tabs wird bei Aktivierung automatisch erfasst
- Example options:
- „Default" — Systemstandardausgabe
- „Built-in Speaker" — Laptop-Lautsprecher
- „USB Headphones" — Angeschlossenes USB-Audiogerät
Plattformunterschiede
Die Benutzererfahrung unterscheidet sich leicht zwischen den Plattformen:
| Aspekt | Desktop-App | Browser-Erweiterung |
|---|---|---|
| Erfassungsbereich | Gesamtes Systemaudio | Nur aktueller Tab |
| Geräteauswahl | Linux: Mehrere Quellen verfügbar; Windows/macOS: Eine „Systemaudio"-Option | Ausgabegerät für Durchleitung |
| Audio-Durchleitung | Nicht benötigt (Audio wird bereits abgespielt) | Automatisch (Tab wird während der Erfassung stummgeschaltet) |
Tipps für beste Ergebnisse
- Verwenden Sie Kopfhörer, um Audio-Rückkopplung zwischen Lautsprechern und Mikrofon zu vermeiden
- Stellen Sie sicher, dass das Audio Ihres Gegenübers klar und unverzerrt ist
- Das Gegenüber wird nur als Text übersetzt, um Echo zu vermeiden
- Die Kanäle „Ich“ und „Gegenüber“ verwenden denselben KI-Anbieter
- Schließen Sie unnötige Audioanwendungen, um Hintergrundgeräusche zu reduzieren
Häufig gestellte Fragen
Warum wird das Gegenüber nur als Text übersetzt?
Um Audio-Rückkopplungsschleifen zu vermeiden, wird die Übersetzung des Gegenübers als Text statt als gesprochenes Audio angezeigt. So können Sie die Übersetzung lesen, ohne ein Echo im Meeting zu erzeugen.
Kann ich Audio einer bestimmten Anwendung erfassen?
Derzeit erfasst die Desktop-App das gesamte Systemaudio. Anwendungsspezifisches Audio-Routing wird nicht unterstützt. Die Browser-Erweiterung erfasst nur Audio vom aktuellen Tab.
Warum benötige ich auf macOS die Bildschirmaufnahme-Berechtigung?
macOS erfordert die Bildschirmaufnahme-Berechtigung für jede Anwendung, die Systemaudio erfasst. Dies ist eine Sicherheitsfunktion des Betriebssystems.
Was passiert, wenn ich dasselbe Gerät für Lautsprecherausgabe und die Erfassung des Gegenübers verwende?
Sokuji zeigt eine Warnung an, wenn Sie widersprüchliche Geräte auswählen, da dies Audio-Rückkopplung verursachen könnte. Wählen Sie verschiedene Geräte oder verwenden Sie Kopfhörer, um dieses Problem zu vermeiden.