Inception Mercury Voice logo

Inception Mercury Voice

音声エージェントのためのリアルタイム推論モデル

Artificial Intelligence API Audio

概要

  • 音声エージェント向けに最適化された推論対応の拡散型LLMで、賢さとリアルタイム性を両立します。
  • 最初の回答トークンを中央値320ミリ秒、95パーセンタイルでも750ミリ秒で返し、自然な会話テンポを実現します。
  • 企業向けに一般提供されており、顧客対応、注文受付、料金回収などの電話業務に活用できます。

主な特徴

  • 推論、ツール呼び出し、長いシステムプロンプトに対応し、低・中・高の3段階から推論強度を選択できます。
  • 128Kコンテキストと最大5万トークンの出力に対応し、複雑な業務フローや長時間の対話を処理できます。
  • OpenAI API互換で、LiveKit、Pipecat、Vapi、Retell、独自の音声基盤へ容易に組み込めます。

料金とおすすめの利用者

  • 会話1分あたり約0.009ドル、入力・出力トークンは通常100万あたり0.40ドル・1.50ドルで、比較的低コストです。
  • リアルタイム性と高度な判断の両方が必要な、カスタマーサポートやドライブスルー注文のチームに適しています。
  • Audivi AI、Altur、OpenCallなどで導入実績があり、本番環境で音声エージェントを運用する企業に向いています。
投票数: 0
← 投稿一覧に戻る