Google DeepMind「EmbeddingGemma 2」公開

Embedding Gemma 2

Google の AI 研究部門「Google DeepMind」は現地時間 2026 年 10 月 6 日(火)、デバイス上で動作するオープンなマルチモーダル埋め込み AI モデル「EmbeddingGemma 2」を公開いたしました。

要約

  • 「EmbeddingGemma 2」では、テキストに加えてコード / 画像 / 動画 / 音声を 1 つのモデルでまとめて扱えるようになりました。
  • 音声メモをもとに特定の動画クリップを探したり、テキストで何時間分もの録音を検索したりといった処理を、インターネットに接続することなく端末上だけで実行できます。

概要

  • 開発元:Google の AI 研究部門「Google DeepMind」
  • 公開日:現地時間 2026 年 10 月 6 日(火)
  • ベースモデル:Google のオープンモデル「Gemma 4」
  • パラメータ数:7 億 4,000 万(テキストのみの場合は 2 億 7,000 万、画像用は 1 億 7,000 万、音声用は 3 億)
  • メモリ使用量(「Pixel 11 Pro」での量子化時):テキストのみで約 191MB、すべての機能を使う場合でも約 567MB
  • 処理可能データ量:初代の 4 倍となる 8K トークン(最大 5.5 分の音声、29 枚の画像、58 フレームの動画、またはそれらを組み合わせたデータ)
  • ライセンス:商用利用も可能な Apache 2.0


※当サイトではアフィリエイト広告と自動表示仕様のディスプレイ広告を活用しています