مزودو الذكاء الاصطناعي المدعومون

يدعم Sokuji مزودين متعددين للذكاء الاصطناعي للترجمة الصوتية الفورية. يقدم كل مزود إمكانيات ونماذج وهياكل تسعير مختلفة. الوضع المحلي (بدون اتصال) لا يتطلب مفتاح API أو إنترنت — يعمل بالكامل على جهازك مجاناً.

تعليمات الإعداد

لاستخدام مزود ذكاء اصطناعي سحابي، احصل على مفتاح API من موقع المزود وقم بتكوينه في لوحة إعدادات Sokuji. الوضع المحلي (بدون اتصال) لا يتطلب مفتاح API — فقط حمّل النماذج وابدأ الترجمة.

OpenAI

واجهة برمجة الصوت الفوري
  • نماذج GPT-4o Realtime Preview
  • 8 خيارات صوتية متميزة
  • أوضاع متقدمة لكشف الدور
  • تقليل ضوضاء مدمج
  • دعم أكثر من 60 لغة
  • وضع القوالب للتعليمات المخصصة

Google Gemini

Gemini Live API
  • نماذج Gemini 2.0 Flash Live
  • 30 شخصية صوتية فريدة
  • كشف تلقائي للدور
  • أكثر من 35 لغة مع متغيرات إقليمية
  • نسخ نصي مدمج
  • حدود رموز عالية (8192)

PalabraAI

خدمة ترجمة WebRTC
  • ترجمة WebRTC فورية
  • أكثر من 60 لغة مصدر
  • أكثر من 40 لغة هدف
  • بث منخفض زمن الاستجابة
  • معالجة صوت تلقائية
  • متخصص في الترجمة الحية

CometAPI

واجهة برمجة متوافقة مع OpenAI
مزود متوافق مع OpenAI بنفس الميزات
  • توافق مع OpenAI Realtime API
  • نفس خيارات الصوت والنماذج كـ OpenAI
  • هيكل تسعير بديل
  • تكافؤ كامل في الميزات
  • بديل مباشر لـ OpenAI

OpenAI Compatible API

نقطة نهاية مخصصة
يعمل مع أي نقطة نهاية متوافقة مع OpenAI Realtime API
  • أي نقطة نهاية متوافقة مع OpenAI Realtime API
  • عنوان URL أساسي ومفتاح API مخصصان
  • خدمات مستضافة ذاتياً وخدمات طرف ثالث
  • تبديل مرن بين المزودين
  • دعم النشر الخاص

Doubao AST 2.0

ترجمة من كلام إلى كلام
  • ترجمة شاملة من كلام إلى كلام
  • استنساخ صوت تلقائي
  • ترجمة فورية متزامنة منخفضة زمن الاستجابة
  • يدعم zh وen وja وid وes وpt وde وfr
  • كشف دور تلقائي واضغط للتحدث
  • بنية ByteDance السحابية

Soniox

ترجمة من كلام إلى كلام
  • ترجمة فورية من كلام إلى كلام
  • نسخ وترجمة أكثر من 60 لغة في استدعاء API واحد
  • كشف تلقائي للغة
  • 12 صوتًا متعدد اللغات
  • ترجمة منطوقة أو ترجمة نصية فقط
  • بنية Soniox السحابية

محلي (بدون اتصال)

ذكاء اصطناعي على الجهاز (Edge)
  • يعمل بالكامل بدون اتصال — لا حاجة لمفتاح API أو إنترنت
  • أكثر من 40 نموذج ASR يغطي أكثر من 99 لغة
  • أكثر من 55 زوج لغوي للترجمة + نماذج Qwen LLM
  • 136 نموذج TTS عبر 53 لغة
  • تسريع CPU (WASM) وWebGPU
  • الخصوصية أولاً — جميع البيانات تبقى على جهازك

اختيار المزود

OpenAI: الأفضل لتوليف الصوت عالي الجودة والميزات المتقدمة

Gemini: ممتاز للدعم متعدد اللغات والمعالجة التلقائية

PalabraAI: محسّن للترجمة الفورية بأقل زمن استجابة

CometAPI: بديل فعال من حيث التكلفة لـ OpenAI بوظائف مطابقة

OpenAI Compatible: اتصل بأي خدمة متوافقة مع OpenAI Realtime API عبر نقطة نهاية مخصصة

Doubao AST 2.0: ترجمة فورية متزامنة من Doubao من كلام إلى كلام مع استنساخ صوت تلقائي

Soniox: ترجمة Soniox الفورية من كلام إلى كلام عبر أكثر من 60 لغة مع كشف تلقائي للغة

Local Inference: شغّل كل شيء على جهازك دون أن تغادر أي بيانات حاسوبك — مثالي لحالات الاستخدام الحساسة للخصوصية

تحتاج مساعدة؟

للاطلاع على أدلة الإعداد واستكشاف الأخطاء ومقارنات المزودين، تفضل بزيارة مستودعنا على GitHub. GitHub Repository