Google の AI 研究部門「Google DeepMind」は現地時間 2026 年 10 月 6 日(火)、デバイス上で動作するオープンなマルチモーダル埋め込み AI モデル「EmbeddingGemma 2」を公開いたしました。
要約
- 「EmbeddingGemma 2」では、テキストに加えてコード / 画像 / 動画 / 音声を 1 つのモデルでまとめて扱えるようになりました。
- 音声メモをもとに特定の動画クリップを探したり、テキストで何時間分もの録音を検索したりといった処理を、インターネットに接続することなく端末上だけで実行できます。
概要
- 開発元:Google の AI 研究部門「Google DeepMind」
- 公開日:現地時間 2026 年 10 月 6 日(火)
- ベースモデル:Google のオープンモデル「Gemma 4」
- パラメータ数:7 億 4,000 万(テキストのみの場合は 2 億 7,000 万、画像用は 1 億 7,000 万、音声用は 3 億)
- メモリ使用量(「Pixel 11 Pro」での量子化時):テキストのみで約 191MB、すべての機能を使う場合でも約 567MB
- 処理可能データ量:初代の 4 倍となる 8K トークン(最大 5.5 分の音声、29 枚の画像、58 フレームの動画、またはそれらを組み合わせたデータ)
- ライセンス:商用利用も可能な Apache 2.0



