Unterstützte KI-Anbieter

Sokuji unterstützt mehrere KI-Anbieter für Echtzeit-Sprachübersetzung. Jeder Anbieter bietet unterschiedliche Funktionen, Modelle und Preisstrukturen. Der lokale (Offline-) Modus benötigt keinen API-Schlüssel oder Internetzugang — er läuft vollständig auf Ihrem Gerät und ist kostenlos.

Einrichtungsanleitung

Um einen Cloud-KI-Anbieter zu nutzen, erhalten Sie einen API-Schlüssel auf der Website des Anbieters und konfigurieren Sie ihn im Einstellungsbereich von Sokuji. Der lokale (Offline-) Modus benötigt keinen API-Schlüssel — laden Sie einfach die Modelle herunter und beginnen Sie mit dem Übersetzen.

OpenAI

Real-time Audio API
  • GPT-4o Realtime Preview-Modelle
  • 8 Premium-Stimmen
  • Erweiterte Sprechererkennung
  • Integrierte Rauschunterdrückung
  • Über 60 Sprachen unterstützt
  • Template-Modus für benutzerdefinierte Prompts

Google Gemini

Gemini Live API
  • Gemini 2.0 Flash Live-Modelle
  • 30 einzigartige Stimmpersönlichkeiten
  • Automatische Sprechererkennung
  • Über 35 Sprachen mit regionalen Varianten
  • Integrierte Transkription
  • Hohe Token-Limits (8192)

PalabraAI

WebRTC-Übersetzungsdienst
  • Echtzeit-WebRTC-Übersetzung
  • Über 60 Quellsprachen
  • Über 40 Zielsprachen
  • Streaming mit niedriger Latenz
  • Automatische Audioverarbeitung
  • Spezialisiert auf Live-Übersetzung

CometAPI

OpenAI-kompatible API
OpenAI-kompatibler Anbieter mit denselben Funktionen
  • OpenAI Realtime API-Kompatibilität
  • Gleiche Stimmen und Modelle wie OpenAI
  • Alternative Preisstruktur
  • Vollständige Funktionsparität
  • Direkter Ersatz für OpenAI

OpenAI Compatible API

Benutzerdefinierter Endpunkt
Funktioniert mit jedem OpenAI Realtime API-kompatiblen Endpunkt
  • Jeder OpenAI Realtime API-kompatible Endpunkt
  • Benutzerdefinierte Basis-URL und API-Schlüssel
  • Selbst gehostete und Drittanbieter-Dienste
  • Flexibler Anbieterwechsel
  • Unterstützung für private Bereitstellung

Doubao AST 2.0

Sprache-zu-Sprache-Übersetzung
  • End-to-End Sprache-zu-Sprache-Übersetzung
  • Automatisches Stimmenklonen
  • Simultandolmetschen mit niedriger Latenz
  • Unterstützung für zh, en, ja, id, es, pt, de, fr
  • Automatische und Push-to-Talk-Sprechererkennung
  • ByteDance Cloud-Infrastruktur

Soniox

Sprache-zu-Sprache-Übersetzung
  • Echtzeit-Sprache-zu-Sprache-Übersetzung
  • Transkribiert und übersetzt über 60 Sprachen in einem API-Aufruf
  • Automatische Spracherkennung
  • 12 mehrsprachige Stimmen
  • Gesprochene Übersetzung oder nur Untertitel
  • Soniox Cloud-Infrastruktur

Lokal (Offline)

KI auf dem Gerät (Edge)
  • Vollständig offline — kein API-Schlüssel oder Internet nötig
  • Über 40 ASR-Modelle für über 99 Sprachen
  • 55+ Übersetzungssprachpaare + Qwen LLMs
  • 136 TTS-Modelle für 53 Sprachen
  • CPU (WASM) und WebGPU-Beschleunigung
  • Datenschutz — alle Daten bleiben auf dem Gerät

Anbieter wählen

OpenAI: Beste Wahl für hochwertige Sprachsynthese und erweiterte Funktionen

Gemini: Hervorragend für mehrsprachige Unterstützung und automatische Verarbeitung

PalabraAI: Optimiert für Echtzeit-Übersetzung mit minimaler Latenz

CometAPI: Kostengünstige Alternative zu OpenAI mit identischer Funktionalität

OpenAI Compatible: Verbinden Sie sich mit jedem OpenAI Realtime API-kompatiblen Dienst über einen benutzerdefinierten Endpunkt

Doubao AST 2.0: Doubao Sprache-zu-Sprache-Simultandolmetschen mit automatischem Stimmenklonen

Soniox: Soniox Echtzeit-Sprache-zu-Sprache-Übersetzung über mehr als 60 Sprachen mit automatischer Spracherkennung

Local Inference: Alles läuft auf Ihrem Gerät, ohne dass Daten das Gerät verlassen — perfekt für datenschutzsensible Anwendungen

Brauchen Sie Hilfe?

Einrichtungsanleitungen, Fehlerbehebung und Anbietervergleiche finden Sie in unserem GitHub-Repository. GitHub Repository