Hush
ストックにはログインが必要です
音声AIエージェント向けのオープンソースノイズ抑制
Artificial Intelligence
Developer Tools
GitHub
Open Source
概要
Hush はリアルタイム通話のノイズ抑制と話者分離を実現するオープンソースの音声強化モデルです。競合する声や背景ノイズを排除し、主要な話者の音声だけを拾います。CPU のみで動作し、1フレームあたり約1ms未満、GPU は不要。言語非依存で多言語に対応、Apache 2.0 ライセンスの下でプロダクション利用が可能です。HuggingFace の Audio-to-Audio リーダーボード第5位の実績があり、今後の拡張も予定されています。
なぜ使うか
- オープンソースで容易に導入
- 高速・低遅延のリアルタイム処理
- 言語を問わず適用可能
- 商用利用にも安心なライセンス
実績と今後
- 初の社内開発モデルとしての位置付け、今後の機能拡張を継続して実施
投票数: 182