Googleは2025年6月、同社の最新AIモデル「Gemini 2.5 Pro」の正式版をリリースしました。このモデルは、3月のプレビュー版発表から段階的な改良を重ね、複雑な推論タスクやコーディングにおいて業界最高水準の性能を達成しています。特に注目すべきは、デフォルトで有効化される「思考」機能により、応答前に内部的な推論プロセスを経ることで、より正確で深い洞察を提供できる点です。
Gemini 2.5 Proは、入力トークン数が104万8,576トークン、出力トークン数が6万5,536トークンという大規模な処理能力を持ち1、音声、画像、動画、テキスト、PDFといった多様な入力形式に対応しています。LMArenaのベンチマークでは1470のEloスコアでトップを維持し、WebDevArenaでも1443のスコアで首位を獲得するなど、複数の評価指標で最高評価を記録しています2。
段階的な進化を遂げた開発プロセス
Gemini 2.5 Proの開発は、2025年3月の実験版リリースから始まりました。当初から「思考型モデル」として設計され、応答前に推論プロセスを経ることで精度を向上させる仕組みが導入されていました。この初期版は、リリース直後からLMArenaで大幅な差をつけて首位を獲得し、業界に大きな衝撃を与えました。
5月のGoogle I/O 2025に先駆けて公開されたI/Oエディションでは、特にコーディング能力が大幅に強化されました。美しく機能的なWebアプリケーションを構築する能力を測定するWebDev Arenaで首位を獲得し、開発者コミュニティから高い評価を受けています。当初はI/Oでの発表を予定していましたが、開発者からの熱い要望に応え、早期リリースを決定したという経緯があります。
技術仕様と対応機能
正式版のGemini 2.5 Proは、以下の主要機能を提供しています:
- 構造化出力(Structured Outputs)のサポート
- 関数呼び出し(Function Calling)機能
- コード実行(Code Execution)機能
- 検索グラウンディング(Search Grounding)機能
- ネイティブ音声出力による自然な会話体験
これらの機能により、開発者は複雑なアプリケーションを構築する際に、より柔軟で強力なツールセットを利用できるようになりました。特に、構造化出力機能は、AIからの応答を事前定義されたスキーマに従って出力できるため、システム統合が大幅に簡素化されます。
実用性を重視した設計思想
Gemini 2.5 Proは、実際のビジネスユースケースを念頭に設計されています。推奨される用途として、複雑なコーディング、高度な推論、マルチモーダル理解、大規模データベースの分析、困難な問題への取り組みなどが挙げられています1。
モデルの知識カットオフは2025年1月となっており、最新の情報に基づいた応答が可能です。また、安定版として「gemini-2.5-pro」のモデルコードで利用でき、企業規模のアプリケーション開発に対応できる信頼性を確保しています。
プラットフォームでの利用可能性
現在、Gemini 2.5 Proは以下のプラットフォームで利用可能です:
- Google AI Studio:開発者向けの実験・プロトタイピング環境
- Gemini Advanced:一般ユーザー向けのプレミアムサービス
- Vertex AI:エンタープライズ向けクラウドAIプラットフォーム(近日対応予定)
これにより、個人開発者から大企業まで、幅広いユーザーが最新のAI技術を活用できる環境が整備されています。
モデルファミリーの拡充
Gemini 2.5 Proの正式リリースと同時に、Googleは「Gemini 2.5 Flash」と「Gemini 2.5 Flash-Lite」も一般提供を開始しました3。Flash-Liteは、コスト効率と処理速度を重視した軽量版として位置づけられ、リアルタイム処理が必要なアプリケーションに最適化されています。
これらのモデルバリエーションにより、開発者は用途や予算に応じて最適なモデルを選択できるようになりました。高精度が必要な場合はProを、高速処理が必要な場合はFlash-Liteを選ぶなど、柔軟な使い分けが可能です。
今後の展開と新機能
Googleは、Gemini 2.5シリーズに対して継続的な機能追加を計画しています。特に注目される新機能として、「Deep Think」と呼ばれる実験的な強化推論モードが発表されています。これは、より複雑な問題に対して深い思考プロセスを適用する機能で、科学研究や高度な分析タスクでの活用が期待されています。
また、Project Marinerのコンピュータ使用機能も統合される予定です。これにより、AIがユーザーインターフェースを直接操作し、より複雑なタスクを自動化できるようになる可能性があります。
実装上の注意点
開発者がGemini 2.5 Proを利用する際には、いくつかの重要な注意点があります。まず、「思考」機能がデフォルトで有効になっているため、以前のモデルから移行する際には、この動作の違いを考慮する必要があります1。思考プロセスにより応答時間が若干長くなる可能性がありますが、その分精度の高い結果が得られます。
また、現時点では画像生成、音声生成、Live API、ファインチューニングには対応していません。これらの機能が必要な場合は、他のモデルやツールと組み合わせて使用する必要があります。
開発者やビジネスユーザーにとって、Gemini 2.5 Proは複雑な課題解決のための強力なツールとなるでしょう。
Sources
- Gemini Developer API - Models - Google AI for Developers(モデル仕様とAPI詳細)
- Google Releases Upgraded Gemini 2.5 Pro in Preview - PYMNTS.com(ベンチマークスコアとリリース情報)
- We’re expanding our Gemini 2.5 family of models - Google公式ブログ(モデルファミリーの拡充について)