OpenAIの音声モデル「GPT-Live 1」がAPIで一般提供 - 音声セッションは1分0.05ドル

OpenAIが2026年9月10日、全二重の音声モデルGPT-Live 1をAPIで一般提供にした。音声セッションは1分0.05ドルの秒課金で、裏で走らせるモデルとツールの費用は別に加算される。

OpenAIは2026年9月10日、全二重(full-duplex)の音声モデル「GPT-Live 1」をAPIで一般提供にしたとchangelogで告知した1。

  • 推論とツール実行はバックエンドのモデルやエージェントに委譲したまま音声の会話を続けられる。委譲先は、OpenAIのモデルを使うResponses委譲と、自前のバックエンドにつなぐclient委譲から選ぶ1
  • 音声セッションは1分あたり0.05ドルで、秒単位の課金。分単位への切り上げはない。バックエンドのモデル利用とツール利用は別に課金される2
  • 対応するエンドポイントは v1/live/sessions のみで、Chat Completions・Responses・従来のRealtime系はいずれも非対応。レート制限はトークンではなく同時セッション数で測り、Tier 1が25、Tier 5が500。無料ティアは対象外

このモデルは2026年7月8日にChatGPTのVoice向けとして発表されたもので、当時はAPI提供が「近日中」とされていた。今回それが一般提供になり、価格とレート制限の枠組みが確定した。音声エージェントを自社サービスに組む場合、原価の見積もりは「セッション時間 × 0.05ドル」だけでは済まず、裏で走らせる推論モデルと各ツールの費用を別に積む必要がある。同時セッション数の上限がティアで決まる点も、同時通話数を見込む用途では設計の制約になる。

Sources

  1. Changelog - OpenAI API - OpenAI公式のAPI changelog(2026年9月10日エントリ)
  2. GPT-Live 1 - OpenAI公式のモデルページ(価格・エンドポイント・レート制限)

最新のAIニュースをほぼ毎日更新しています。

RSSで購読する 更新をいち早くチェックできます。

他のキーワードで探す →