Google新モデル
Google DeepMind、マルチモーダル埋め込みモデル「EmbeddingGemma 2」を公開
原題:EmbeddingGemma 2: an open, lightweight multimodal embedding model
- 公式発表
- 情報の取得
- 出典
- Google DeepMind Blog
Google DeepMindは、テキスト・画像・音声・動画などを共通の埋め込み空間に変換できるオープンなマルチモーダル埋め込みモデル「EmbeddingGemma 2」を発表した。Gemma 4アーキテクチャをベースに、Apache 2.0ライセンスで公開され、オンデバイスでの推論に適しているという。
要点
- パラメータ数は740 million。テキストのみの用途なら最小270M、画像(170M)と音声(300M)のエンコーダーを任意で追加できる
- 出力ベクトルは768次元から512・256・128次元に切り詰められ、ローカルのベクトルデータベースの保存容量を最大6x削減できる
- コンテキストウィンドウは8Kトークンで、EmbeddingGemma 1の4x。音声5.5分、画像29枚、動画58フレームなどを処理できる
- MTEB Codeのスコアは68.76から78.68へ、9.92ポイント向上
- モデルの重みはHugging FaceとKaggleで入手でき、Gemini Enterprise Agent Platform Model Gardenでは近日提供予定
※ この要約は、公式発表の本文をもとに AI が作成したものです。原文と照合し、確認できた内容のみ掲載しています。
ほかのAIニュース
Anthropic安全性・ポリシー
Anthropic、Cyber Verification Programを拡充し3段階のアクセスに
Anthropicは、高度なサイバー機能を認定されたセキュリティ専門家に提供する「Cyber Verification Program(CVP)」の拡張版を開始した。プログラムは3つのアクセス段階(tier)で構成され、各段階でClaude Opus 5.5、Claude Sonnet 5.5、Claude Mythos 5.1などの最も高性能なモデルを利用できる。
OpenAI安全性・ポリシー
OpenAI、EUのテキスト出所表示ルールへの対応方針を公開
OpenAIは、EUのルールのもとでテキストの透かし(ウォーターマーク)にどう取り組むかを公開した。透かしが適用される範囲、検出の仕組み、アクセスが研究者から始まる理由が説明されている。
OpenAI提携・ビジネス
OpenAI、ChatGPTに新しい視覚的な広告形式を導入
OpenAIは、ChatGPTに新しい視覚的な広告形式を導入したと発表した。あわせて、広告主向けの計測ツール、アトリビューション(効果測定)のパートナーシップ、ブランドの適合性を拡充する。