AI プロバイダーに戻る

OpenAI 互換 API セットアップチュートリアル

概要

Sokuji は OpenAI Realtime API 互換のエンドポイントをサポートしており、サードパーティやセルフホストのサービスを使用してリアルタイム音声翻訳を行うことができます。これにより、代替プロバイダーの選択や独自の推論サーバーの運用が柔軟に行えます。

重要:Realtime API 互換性が必要です

プロバイダーは標準の Chat Completions API だけでなく、OpenAI の Realtime API WebSocket プロトコルをサポートしている必要があります。Realtime API を実装しているエンドポイントのみが Sokuji で動作します。

1互換プロバイダーを選択

OpenAI Realtime API WebSocket プロトコルをサポートするサービスを選択します。重要:現在 Realtime API をサポートしているプロバイダーは非常に少数です。ほとんどの OpenAI 互換サービスは Chat Completions API のみをサポートしており、Sokuji では使用できません。続行する前に、プロバイダーが Realtime API を明示的にサポートしていることを必ず確認してください。

2API エンドポイントとキーを取得

選択したプロバイダーから API エンドポイント URL と API キーを取得します。エンドポイント URL は通常 https://your-provider.com の形式、セルフホストサービスの場合は http://localhost:8080 の形式です。

3Sokuji で OpenAI 互換 API を選択

Sokuji を開き、設定パネルに移動します。プロバイダーのドロップダウンから 「OpenAI Compatible API」 を AI プロバイダーとして選択します。

4設定情報を入力

カスタム API エンドポイント URL を 「API Endpoint」 フィールドに貼り付けます。「API Key」 フィールドに API キーを入力します。プロバイダーが API キーを必要としない場合(ローカルサービスなど)、空欄のままにするかプレースホルダー値を入力してください。

5モデルと音声を選択

プロバイダーがサポートするモデルと音声設定を選択します。利用可能なオプションは特定のプロバイダーによって異なります。一般的なモデルには gpt-4o-realtime-preview やプロバイダー固有のモデル名があります。

6接続をテスト

翻訳セッションを開始して、すべてが正常に動作していることを確認します。セッション開始ボタンをクリックし、マイクに向かって話し、接続が正常に確立され音声が翻訳されていることを確認します。

追加情報

OpenAI 互換 API とは?

OpenAI 互換 API は、Sokuji が OpenAI Realtime API プロトコルを実装するあらゆるサービスに接続できるようにする汎用プロバイダーオプションです:

  • カスタムベース URL で任意の OpenAI 互換エンドポイントを使用
  • クラウドホストおよびセルフホストサービスの両方をサポート
  • 異なるバックエンドプロバイダー間の柔軟な切り替え
  • プライベートデプロイ、コスト最適化、地域コンプライアンスに有用

プロバイダー互換性について

ほとんどの OpenAI 互換サービスは Chat Completions API のみをサポートしています。Realtime API(WebSocket ベース、音声ストリーミング対応)は異なるプロトコルであり、サポートしているプロバイダーは非常に少数です:

  • Azure OpenAI Service:Microsoft Azure 上でホストされる OpenAI モデルの Realtime API をサポート
  • プロバイダーのドキュメントで Realtime API の明示的なサポートを必ず確認してください
  • OpenRouter、Together AI などのサービスは通常 Realtime API をサポートしていません
  • 一部のプロキシサービス(CometAPI など)は Realtime API 互換性を提供する場合があります — 使用前に確認してください
  • セルフホストソリューションは完全な Realtime API WebSocket プロトコルを実装する必要があります

設定のヒント

  • エンドポイント URL に末尾のスラッシュを含めないでください(例:https://api.example.com/ ではなく https://api.example.com を使用)
  • ローカルサービスの場合、http://localhost:<port> をエンドポイントとして使用
  • 一部のプロバイダーでは特定のヘッダーや認証方法が必要な場合があります
  • プロキシサービスを使用する場合、WebSocket 接続が正しく転送されることを確認

トラブルシューティング

一般的な問題

接続拒否: エンドポイント URL が正しいこと、サービスが実行中であることを確認してください。ローカルサービスの場合、サーバーが起動し期待するポートでリッスンしていることを確認してください。

認証エラー: API キーを再確認してください。一部のプロバイダーでは特定のキー形式が必要です。アカウントに Realtime API へのアクセス権があることを確認してください。

モデルが見つからない: モデル名が OpenAI のデフォルトモデルと異なる場合があります。利用可能なモデル名についてプロバイダーのドキュメントを確認してください。

WebSocket 接続失敗: プロバイダーが Realtime API の WebSocket 接続をサポートしていることを確認してください。HTTP のみの標準エンドポイント(Chat Completions)は動作しません。

プロバイダー互換性の確認

  1. プロバイダーが明示的に OpenAI Realtime API プロトコルをサポートしていることを確認
  2. WebSocket 接続がサポートされていることを確認(REST API だけではなく)
  3. プロバイダーが音声入出力ストリーミングをサポートしていることを確認
  4. 可能であれば WebSocket クライアントでエンドポイント URL を直接テスト
  5. プロバイダーのドキュメントで特定の設定要件を確認

さらにヘルプが必要ですか?プロトコルの詳細については OpenAI Realtime API ドキュメントを参照するか、GitHub リポジトリでコミュニティサポートを受けてください。

OpenAI Realtime API Docs