出来事の日付:2025年12月17日。 GoogleはGemini 3ファミリーにGemini 3 Flashを追加した。このモデルは、Gemini 3で導入された推論機能とマルチモーダル機能を、より高速かつ低コストで利用する手段として位置付けられている。同社によると、消費者向け、開発者向け、企業向けの各製品で世界規模の展開が始まった。

消費者向けでは、Gemini 3 FlashがGemini 2.5 Flashに代わり、Geminiアプリのデフォルトモデルとなった。Googleはまた、検索のAIモードでもデフォルトモデルとして導入を開始した。同社は、こうした変更により、画像、動画、音声の解釈、クイズの作成、口頭で伝えたアイデアの簡単なアプリケーションへの変換といった日常的な作業で、より高度な推論機能を利用できるようになるとしている。Googleによると、検索では、このモデルが多面的な質問を解析し、情報とリンクを組み合わせ、旅行計画や未知の分野の学習といった複雑な作業向けに回答を整理できる。

開発者は、Google AI StudioのGemini API、Gemini CLI、Googleの開発プラットフォームAntigravityを通じて利用できるようになった。このモデルはAndroid Studioでも提供され、企業顧客はVertex AIとGemini Enterpriseを通じて利用できる。Googleによると、Gemini 3ファミリーの提供開始以来、同社APIでは1日当たり1兆を超えるトークンが処理されている。

Gemini 3 Flashの料金は、入力100万トークン当たり0.50ドル、出力100万トークン当たり3ドルに設定された。音声入力は引き続き100万トークン当たり1ドルとなる。Googleによると、このモデルはArtificial AnalysisのテストでGemini 2.5 Proの3倍の速度で動作し、通常のトラフィックにおいて最高の思考レベルで稼働させた場合、2.5 Proより平均30%少ないトークンを使用した。これらの性能比較はGoogleが提示したものであり、同社が選定したテストと利用状況の測定に基づく主張として受け止める必要がある。

Googleはまた、小型で低遅延を重視したモデルでも高い推論性能を維持していることを示すためのベンチマーク結果を公表した。GPQA Diamondで90.4%、ツールを使用しないHumanity's Last Examで33.7%、MMMU Proで81.2%のスコアを記録したとしている。コーディングエージェントのベンチマークであるSWE-bench Verifiedでは、Googleは78%というスコアを報告しており、同社が示したGemini 2.5モデルおよびGemini 3 Proの結果を上回った。

今回のリリースでは、推論品質と同時に応答時間が重要となる処理に焦点が当てられた。Googleは、反復的なコーディング、ツールの利用、動画分析、視覚的な質疑応答、データ抽出を有力な用途として挙げた。また、JetBrains、Bridgewater Associates、Figmaがすでにこのモデルを利用していると述べた。発表では、ベンチマークや顧客環境での性能に関する主張のすべてについて独立した検証は示されなかったが、Gemini 3 FlashがGoogleの主要なAI提供経路全般で広く利用できるモデルとして位置付けられた。