Google DeepMindのEmbeddingGemma 2がOllamaで利用可能に
OllamaがGoogle DeepMindのEmbeddingGemma 2に対応し、開発者がマルチモーダルなオンデバイス埋め込みモデルをローカルで実行できるようになりました。
OllamaがGoogle DeepMindのEmbeddingGemma 2に対応し、開発者がマルチモーダルなオンデバイス埋め込みモデルをローカルで実行できるようになりました。
EmbeddingGemma 2 はサーバー呼び出しを一切行わず、マルチモーダルワークロードを完全にオフラインで実行できます。未使用の画像や音声コンポーネントを切り離してメモリを節約できるモジュール設計を採用し、柔軟な次元サイズによってローカルデータベースのストレージを最大 6 分の 1 に削減できるほか、Gemma 4 と連携した効率的なオンデバイス RAG パイプラインにも対応します。
EmbeddingGemma 2は7億4000万パラメータを備え、Apache 2.0ライセンスで提供される。デバイス上でのマルチモーダル検索およびローカルでの検索拡張生成機能を実現する。
Google DeepMindは、オンデバイス埋め込み向けの初のネイティブマルチモーダルオープンモデル「EmbeddingGemma 2」を発表した。テキスト、コード、画像、音声、動画を共通の空間に統合する。