2026 年 7 月 21 日
最新の Gemini モデルは、優れたトークン効率、低レイテンシ、信頼性の高い性能を備え、大規模な AI Agent の構築を支援します。

開発者や顧客が本番環境向けの AI Agent を構築するには、より高いトークン効率、より低いレイテンシ、そしてより信頼性の高い性能が求められます。Flash シリーズのモデルは、効率と品質の最適なバランスを実現し、Agent ワークフローの大規模展開を支援できるよう設計されています。Gemini 3.5 Flash を基盤として、今回、新たな Gemini モデルをリリースします。
- 3.6 Flash:コード作成、知識労働、マルチモーダル性能をさらに向上させた主力モデルです。Artificial Analysis Index によると、出力トークンの使用量は 3.5 Flash と比べて 17% 削減されています。また、Datacurve の DeepSWE など一部のベンチマークでは、最大 65% の削減を確認しており、出力トークン単価も低くなっています。
- 3.5 Flash-Lite:3.5 シリーズで最も高速かつコスト効率に優れたモデルです。Artificial Analysis Index によると、出力速度は毎秒 350 トークンに達し、Agent ワークフローにおける性能も従来世代の Flash-Lite モデルを大きく上回ります。
- CodeMender の 3.5 Flash Cyber:サイバーセキュリティ分野で成果を上げるには、モデルと Agent インフラストラクチャを慎重にオーケストレーションする必要があります。今回、CodeMender のコードセキュリティ Agent と組み合わせて使用する、まったく新しい高効率の特化型サイバーセキュリティモデルをリリースします。最先端の水準で競争力のある性能を実現します。
本日リリースするモデルに加え、Gemini 3.5 Pro は現在パートナーとテストを進めており、準備が整い次第、より幅広いユーザーに提供する予定です。同時に、私たちのチームはすでに次世代モデルの研究開発に注力しています。これまでで最も野心的な事前学習タスクである Gemini 4 に着手しており、現在の進展に大きな期待を寄せています。
3.6 Flash:3.5 Flash を上回る効率と品質
Gemini 3.6 Flash は、開発者や顧客から寄せられた 3.5 Flash へのフィードバックを直接反映して開発されました。3.6 Flash は、コード作成や知識労働の性能を向上させただけでなく、トークン効率も大幅に高めています。たとえば、Artificial Analysis Index では、3.6 Flash の出力トークン使用量が 3.5 Flash より 17% 少ないことを確認しています。複数のステップから成るワークフローを完了する際に必要な推論ステップやツール呼び出しの回数も減少しています。
この効率向上に加え、3.6 Flash は 3.5 Flash よりも低価格です。料金は入力トークン 100 万個あたり 1.50 ドル、出力トークン 100 万個あたり 7.50 ドルで、Agent タスク全体のコストを削減できます。これにより、Agent の構築と運用をよりコスト効率よく行えるようになります。
3.6 Flash は、OSWorld 検証タスク(API)において、3.5 Flash より高いトークン効率と少ない冗長出力を実現しています。
効率が向上した一方で、3.6 Flash はさまざまな用途において 3.5 Flash を上回る性能を発揮します。
- DeepSWE では、不要なコード変更や実行ループを減らすことで、より高い正確性を実現しています(49% 対 37%)。MLE Bench においても、機械学習研究の性能が大幅に向上しています(63.9% 対 49.7%)。
- OSWorld-Verified では、コンピューター操作能力が向上しています(83.0% 対 78.4%)。現在、コンピューター操作は組み込みクライアントツールとして、Gemini API と Gemini Enterprise で利用できます。
- 知識労働においても、3.6 Flash は 3.5 Flash を上回り、GDPval-AA v2 などのベンチマークで 1421 対 1349 のスコアを記録しました。Hebbia や Harvey などの顧客からは、ドキュメント解析、チャートやデータの分析、レポートの草案作成といったマルチモーダルタスクに特に優れているとの評価が寄せられています。


顧客からは、3.6 Flash はコストと品質の両方を向上させ、複雑なワークフローや知識集約型タスクにおいて、トークン効率、正確性、速度を両立できるとの評価が寄せられています。




安全性を基盤とした構築
3.6 Flash には、リリース時点で強化された フロンティア安全性(Frontier Safety) の保護対策が導入されています。これらは、化学・生物・放射性物質・核(CBRN)分野や、サイバー攻撃の悪用シナリオを対象としています。こうした保護対策により、モデルはジェイルブレイク攻撃への耐性を大幅に高めています。また、有益な用途において不必要な拒否を最小限に抑えられるよう、モデルのトレーニングも行われています。
詳しくは、3.6 Flash モデルカードをご覧ください。
3.5 Flash-Lite:Agent ワークフローの大規模展開に向けた設計
Flash シリーズに加え、低レイテンシのタスクや、高いスループットが不可欠な開発者ワークフロー向けに設計された Gemini 3.5 Flash-Lite もリリースします。たとえば、Agent による検索やドキュメント処理などに適しています。
3.5 Flash-Lite は、3.5 シリーズで最も高速なモデルです。Artificial Analysis の測定によると、実行速度は毎秒 350 出力トークンに達します。料金は入力トークン 100 万個あたり 0.3 ドル、出力トークン 100 万個あたり 2.5 ドルで、3.1 Flash-Lite と比べて品質が大幅に向上しています。大規模な本番トラフィックを処理する開発者や顧客にとって、3.5 Flash-Lite は優れたコストパフォーマンスを提供します。
3.5 Flash-Lite は、大量のタスクを実行する際のレイテンシが 3.5 Flash よりも低くなっています。
3.5 Flash-Lite は、Agent システムを効率的にスケールさせることを可能にします。さまざまな思考レベルにおいて、このモデルは 3.1 Flash-Lite を大きく上回る性能を発揮します。ワークロードに応じて、最低または低い思考レベルに設定し、低レイテンシ・低コストで大量のタスクを実行することも、高い思考レベルを有効にして、複数のステップから成るサブ Agent のワークロードを処理することもできます。さらに現在では、コンピューター操作が組み込みツールとして利用でき、さまざまなシナリオでこれらの Agent タスクを安定して支援できます。
コード作成と Agent タスクでは、3.5 Flash-Lite の性能が大幅に向上しており、Terminal-Bench 2.1 では 54% 対 31% を記録しています。長いコンテキストの処理では GDM-MRCR v2 で 72.2% 対 60.1%、現実世界のタスク実行では GDPval-AA v2 で 1140 対 642 となっています。

実際、多くの Agent およびコード評価において、3.5 Flash-Lite は 3 Flash さえ上回っています。SWE-Bench Pro では 54.2% 対 49.6% を記録しました。