日本語

モデル発表GoogleGemini 3.8 Flash

GoogleがGemini 3.8 Flashの一般提供を開始、エージェント用途に最適化

Googleは、長時間のコーディングや自律型エージェント、複雑なワークフローへの活用を想定した新モデル「Gemini 3.8 Flash」の一般提供を開始しました。最大100万トークンのコンテキストウィンドウと最大6万4000トークンの出力をサポートしています。

今回のモデルは、単発の質問への回答にとどまらず、AIが目的を達成するために計画を立て、ツールを繰り返し呼び出し、結果を検証して修正するといった一連の作業を完遂させる「マルチステップ・プランニング」を特徴としています。Google Managed Agentsのデフォルトモデルにも採用されるなど、AIエージェントとしての活用が意識されています。

また、モデルの思考レベルを「low」「medium」「high」の3段階から選択できる機能を備えています。低遅延が求められるチャットにはlow、深い推論や数学的なタスクにはhighといった、用途に応じたリソース配分が可能です。デフォルトの設定はmediumとなっています。

APIの利用に関しては、従来のthinking_budgetがthinking_levelへと置き換わるなどの仕様変更があります。料金については、2026年12月31日までの特別価格が設定されており、2027年1月1日より標準料金へ移行する予定です。

出典

  1. 「Gemini 3.8 Flash」の狙いは“賢さ”ではない? 発表から見えた3つのポイント (ITmedia AI+、2026-09-08)