Hush logo

Hush

音声AIエージェント向けのオープンソースノイズ抑制

Artificial Intelligence Developer Tools GitHub Open Source

概要

Hush はリアルタイム通話のノイズ抑制と話者分離を実現するオープンソースの音声強化モデルです。競合する声や背景ノイズを排除し、主要な話者の音声だけを拾います。CPU のみで動作し、1フレームあたり約1ms未満、GPU は不要。言語非依存で多言語に対応、Apache 2.0 ライセンスの下でプロダクション利用が可能です。HuggingFace の Audio-to-Audio リーダーボード第5位の実績があり、今後の拡張も予定されています。

なぜ使うか

  • オープンソースで容易に導入
  • 高速・低遅延のリアルタイム処理
  • 言語を問わず適用可能
  • 商用利用にも安心なライセンス

実績と今後

  • 初の社内開発モデルとしての位置付け、今後の機能拡張を継続して実施
投票数: 182
← 投稿一覧に戻る