TailAdmin Voice Core
ストックにはログインが必要です
フリーズしない、オープンソースのデスクトップAI音声スタジオ
Artificial Intelligence
Developer Tools
GitHub
Open Source
概要
- 音声合成、文字起こし、音声クローン、LLMによる文章生成を一つにまとめた、無料のデスクトップAI音声ワークステーションです。
- PyTorchの重い推論処理を独立したPythonプロセスに分離し、処理中も滑らかで応答性の高いUIを維持します。
- Windows、Linux、macOS向けのバイナリに加え、DockerでヘッドレスREST APIサーバーとしても利用できます。
主な機能
- Piper、XTTS v2、Bark、Tortoiseを使い分けられる複数のTTSエンジンと、Faster-Whisperによる90以上の言語の文字起こしに対応します。
- 3〜6秒程度の音声サンプルから、追加学習なしで声質を再現するゼロショット音声クローン機能を利用できます。
- Claude、GPT-4o、GeminiなどのLLMと連携し、音声化するテキストの作成やコンテンツ生成を支援します。
こんな人におすすめ
- 複数の音声AIモデルを一つのアプリで試したい開発者やクリエイターに適しています。
- 音声合成や文字起こしを行いながら、処理中の画面フリーズを避けたいユーザーに向いています。
- 商用利用やカスタマイズを含め、MITライセンスのオープンソース環境で音声AI基盤を構築したい人におすすめです。
投票数: 0