ドキュメントに戻る

ノイズ抑制

概要

ノイズ抑制は、発言を翻訳する前にマイクの音声をクリーンにし、周囲の雑音やタイピング音、ファンの音が発話と誤認されないようにします。

1レベルを選ぶ

設定のマイクロフォンでノイズ抑制を選びます。オフ、スタンダード(軽量で遅延が最小)、エンハンスド(最も強力で既定)のいずれかです。お使いのパソコンでエンハンスドを実行できない場合、Sokuji は代わりにスタンダードを使います。セッション中でも変更できます。

レベルを選ぶ

22 つのモードのしくみ

どちらのモードもすべてお使いのパソコン上で動作し、ノイズ抑制のためにマイクの音声がどこかへ送信されることはありません。

スタンダードは、ごく小さなニューラルネットワークと従来の信号処理を組み合わせた RNNoise を使います。10 ms ごとに音を周波数帯域に分け、ノイズと判断した帯域の音量を下げます。軽量で遅延はほとんど増えず、ファンやエアコンのような一定のノイズに最も効果的です。

エンハンスドは、より大きなニューラルネットワークである GTCRN を使います。重なり合う 32 ms の区間ごとに周波数スペクトル全体を見て、どの部分があなたの声かを予測し、その部分から音声を組み立て直します。タイピング音や他の人の話し声、街の音など、変化するノイズにより強い一方で、処理が重くなり、数十ミリ秒の遅延が加わります。

ヒント

  • ヘッドセットにノイズキャンセル機能がすでにある場合や、声が途切れて聞こえる場合は、オフを試してください。
  • ノイズ抑制はあなたのマイクにのみ適用され、相手の音声には適用されません。

よくある質問

どのレベルを使えばよいですか?

問題がない限りエンハンスドのままにしてください。スタンダードは処理が軽く、オフではマイクの音声がそのまま使われます。

トラブルシューティング

それでも解決しない場合は、アカウントメニューからフィードバックを送るか、support@kizuna.ai までご連絡ください。GitHub Discussions で質問することもできます。