Provedores de IA Compatíveis

O Sokuji suporta múltiplos provedores de IA para tradução de fala em tempo real. Cada provedor oferece diferentes capacidades, modelos e estruturas de preços. O modo Local (Offline) não requer chave de API ou internet — funciona inteiramente no seu dispositivo de graça.

Instruções de Configuração

Para usar um provedor de IA em nuvem, obtenha uma chave de API no site do provedor e configure-a no painel de configurações do Sokuji. O modo Local (Offline) não requer chave de API — basta baixar os modelos e começar a traduzir.

OpenAI

API de Áudio em Tempo Real
  • Modelos GPT-4o Realtime Preview
  • 8 opções de voz premium
  • Modos avançados de detecção de turno
  • Redução de ruído integrada
  • Suporte a mais de 60 idiomas
  • Modo de template para prompts personalizados

Google Gemini

Gemini Live API
  • Modelos Gemini 2.0 Flash Live
  • 30 personalidades de voz únicas
  • Detecção automática de turno
  • Mais de 35 idiomas com variantes regionais
  • Transcrição integrada
  • Altos limites de tokens (8192)

PalabraAI

Serviço de Tradução WebRTC
  • Tradução WebRTC em tempo real
  • Mais de 60 idiomas de origem
  • Mais de 40 idiomas de destino
  • Streaming de baixa latência
  • Processamento automático de áudio
  • Especializado em tradução ao vivo

CometAPI

API Compatível com OpenAI
Provedor compatível com OpenAI com os mesmos recursos
  • Compatibilidade com OpenAI Realtime API
  • Mesmas opções de voz e modelo do OpenAI
  • Estrutura de preços alternativa
  • Paridade completa de recursos
  • Substituto direto do OpenAI

OpenAI Compatible API

Endpoint Personalizado
Funciona com qualquer endpoint compatível com OpenAI Realtime API
  • Qualquer endpoint compatível com OpenAI Realtime API
  • URL base e chave de API personalizados
  • Serviços auto-hospedados e de terceiros
  • Troca flexível de provedores
  • Suporte a implantação privada

Doubao AST 2.0

Tradução Fala-para-Fala
  • Tradução fala-para-fala de ponta a ponta
  • Clonagem automática de voz
  • Interpretação simultânea de baixa latência
  • Suporta zh, en, ja, id, es, pt, de, fr
  • Detecção de turno automática e Push-to-Talk
  • Infraestrutura em nuvem ByteDance

Soniox

Tradução Fala-para-Fala
  • Tradução fala-para-fala em tempo real
  • Transcreve e traduz mais de 60 idiomas em uma única chamada de API
  • Detecção automática de idioma
  • 12 vozes multilíngues
  • Tradução falada ou apenas legendas
  • Infraestrutura em nuvem Soniox

Local (Offline)

IA no Dispositivo (Edge)
  • Totalmente offline — sem necessidade de chave de API ou internet
  • Mais de 40 modelos ASR cobrindo mais de 99 idiomas
  • Mais de 55 pares de idiomas para tradução + Qwen LLMs
  • 136 modelos TTS em 53 idiomas
  • Aceleração CPU (WASM) e WebGPU
  • Privacidade em primeiro lugar — todos os dados ficam no dispositivo

Escolhendo um Provedor

OpenAI: Melhor para síntese de voz de alta qualidade e recursos avançados

Gemini: Ótimo para suporte multilíngue e processamento automático

PalabraAI: Otimizado para tradução em tempo real com latência mínima

CometAPI: Alternativa econômica ao OpenAI com funcionalidade idêntica

OpenAI Compatible: Conecte-se a qualquer serviço compatível com OpenAI Realtime API usando um endpoint personalizado

Doubao AST 2.0: Interpretação simultânea fala-para-fala do Doubao com clonagem automática de voz

Soniox: Tradução fala-para-fala em tempo real do Soniox em mais de 60 idiomas com detecção automática de idioma

Local Inference: Execute tudo no seu dispositivo sem que nenhum dado saia da sua máquina — perfeito para casos de uso sensíveis à privacidade

Precisa de Ajuda?

Para guias de configuração, solução de problemas e comparações de provedores, visite nosso repositório no GitHub. GitHub Repository