# Google、エージェント機能と開発者向けアクセスを拡充したGemini 2.0を発表

Googleは、Gemini 2.0が同社史上最も高性能なAIモデルであり、新たなエージェント型ツール群の基盤として位置づけられているとしている。Googleは2024-12-11付の公式投稿で、Gemini 2.0ファミリー初のモデルをリリースし、システムの一部を開発者、信頼できるテスター、Geminiユーザーに開放すると発表した。

最大の変化は、単なるモデル性能の向上ではない。Googleによると、Gemini 2.0は「エージェント型」の時代に向けて構築されており、世界をより深く理解し、数手先まで考え、監督を受けながらユーザーに代わって行動できる。同社によると、このモデルは画像と音声のネイティブ出力、ツールの利用、マルチモーダルタスクでの性能向上に対応する。

Googleは、直ちに提供されるいくつかの製品も強調した。同社によると、Gemini 2.0 Flashの試験版モデルがすべてのGeminiユーザーに提供され、新たなDeep Research機能が複雑なテーマに関するレポート作成を支援するほか、検索のAI Overviewsでは、より難しい検索クエリに対するGemini 2.0の推論機能のテストが始まる。発表では、開発者向けのMultimodal Live API、ネイティブ画像生成、テキスト読み上げ機能にも言及している。

より広い戦略的メッセージは従来と同じだ。Googleは、独立したチャットインターフェースだけでなく、自社の主要製品全体でモデルを役立てたいと考えている。同社は、Geminiがすでに各種サービスの業務を支えているとし、Gemini 2.0を、さまざまなワークフロー内で推論、計画、行動ができる汎用アシスタントに向けた一歩として提示している。

この投稿はまた、今回のリリースをインフラ面から裏づけようとしている。Googleによると、Gemini 2.0は同社のTrillium TPUで訓練・稼働しており、同社独自のハードウェアスタックが性能と展開の中核であり続けている。この点が重要なのは、AIモデルの発表が、ベンチマークに関する主張だけでなく、企業がそれを大規模にどれだけうまく提供できるかによって評価されることが増えているためだ。

開発者にとって実務上の要点は、Googleがシステムを試験段階に保ちながらアクセスを拡大していることだ。これは最先端AIのリリースでよく見られるパターンである。まず機能を発表し、一部の機能を初期ユーザーに限定したうえで、フィードバックが集まるにつれて対象を拡大していく。

同社自身の説明は、際立って広範なものだ。Geminiの次の段階は、情報を単に入手しやすくするだけでなく、より有用にすることだとしている。その約束が実現するかどうかは、実際の製品でモデルがどのように動作するかにかかっているが、Googleが「エージェント型」AI市場を次なるフロンティアと見ていることは明確に示されている。

主張マップ

提供されたGoogleのブログ投稿は、Gemini 2.0が12月11日に公開されたこと、マルチモーダル出力とツールのネイティブ利用が追加されたこと、GoogleがFlash試験版へのアクセス、Deep Research、検索との初期統合を順次展開しているという主張を裏づけている。