Inception Mercury Voice
ストックにはログインが必要です
音声エージェントのためのリアルタイム推論モデル
Artificial Intelligence
API
Audio
概要
- 音声エージェント向けに最適化された推論対応の拡散型LLMで、賢さとリアルタイム性を両立します。
- 最初の回答トークンを中央値320ミリ秒、95パーセンタイルでも750ミリ秒で返し、自然な会話テンポを実現します。
- 企業向けに一般提供されており、顧客対応、注文受付、料金回収などの電話業務に活用できます。
主な特徴
- 推論、ツール呼び出し、長いシステムプロンプトに対応し、低・中・高の3段階から推論強度を選択できます。
- 128Kコンテキストと最大5万トークンの出力に対応し、複雑な業務フローや長時間の対話を処理できます。
- OpenAI API互換で、LiveKit、Pipecat、Vapi、Retell、独自の音声基盤へ容易に組み込めます。
料金とおすすめの利用者
- 会話1分あたり約0.009ドル、入力・出力トークンは通常100万あたり0.40ドル・1.50ドルで、比較的低コストです。
- リアルタイム性と高度な判断の両方が必要な、カスタマーサポートやドライブスルー注文のチームに適しています。
- Audivi AI、Altur、OpenCallなどで導入実績があり、本番環境で音声エージェントを運用する企業に向いています。
投票数: 0