OpenAIの音声モデル「GPT-Live 1」がAPIで一般提供 - 音声セッションは1分0.05ドル
OpenAIが2026年9月10日、全二重の音声モデルGPT-Live 1をAPIで一般提供にした。音声セッションは1分0.05ドルの秒課金で、裏で走らせるモデルとツールの費用は別に加算される。
OpenAIは2026年9月10日、全二重(full-duplex)の音声モデル「GPT-Live 1」をAPIで一般提供にしたとchangelogで告知した1。
- 推論とツール実行はバックエンドのモデルやエージェントに委譲したまま音声の会話を続けられる。委譲先は、OpenAIのモデルを使うResponses委譲と、自前のバックエンドにつなぐclient委譲から選ぶ1
- 音声セッションは1分あたり0.05ドルで、秒単位の課金。分単位への切り上げはない。バックエンドのモデル利用とツール利用は別に課金される2
- 対応するエンドポイントは
v1/live/sessionsのみで、Chat Completions・Responses・従来のRealtime系はいずれも非対応。レート制限はトークンではなく同時セッション数で測り、Tier 1が25、Tier 5が500。無料ティアは対象外
このモデルは2026年7月8日にChatGPTのVoice向けとして発表されたもので、当時はAPI提供が「近日中」とされていた。今回それが一般提供になり、価格とレート制限の枠組みが確定した。音声エージェントを自社サービスに組む場合、原価の見積もりは「セッション時間 × 0.05ドル」だけでは済まず、裏で走らせる推論モデルと各ツールの費用を別に積む必要がある。同時セッション数の上限がティアで決まる点も、同時通話数を見込む用途では設計の制約になる。
Sources
- Changelog - OpenAI API - OpenAI公式のAPI changelog(2026年9月10日エントリ)
- GPT-Live 1 - OpenAI公式のモデルページ(価格・エンドポイント・レート制限)
この記事は役に立ちましたか?
ありがとうございます!
受け取りました。ありがとうございます!