产业观察🔥8.0

DeepMind发布EmbeddingGemma 2,将五种模态映射至统一向量空间

原标题: DeepMind发布EmbeddingGemma 2,将五种模态映射至统一向量空间

unite.ai·2026/10/6 16:50:04🔗 原文

📋总体概括

Google DeepMind于2026年10月6日发布开源嵌入模型EmbeddingGemma 2,参数量7.4亿,可将文本、代码、图像、视频和音频五种模态映射进同一个768维嵌入空间,采用Apache 2.0许可证发布,主打在消费级硬件上本地运行。该模型由DeepMind研究工程师Sahil Dua和Henrique Schechter Vera在谷歌官方博客撰文介绍,官方称其为设备端多模态嵌入能力最强的模型,瞄准本地搜索、检索等隐私友好场景。

⚡关键信息

  • ▸Google DeepMind于2026年10月6日发布EmbeddingGemma 2,参数量7.4亿,以Apache 2.0开源许可证发布
  • ▸模型将文本、代码、图像、视频和音频五种模态统一映射到768维嵌入空间
  • ▸官方定位为可在消费级硬件上运行的最强设备端多模态嵌入模型
  • ▸由DeepMind研究工程师Sahil Dua与Henrique Schechter Vera在谷歌官方博客发文公布

🔥犀利点评

谷歌把五种模态压进一个768维向量空间、还要塞进消费级硬件,野心不小。7.4亿参数的开源嵌入模型,本质上是在给端侧AI检索生态铺地基——谁都明白,未来AI搜索和本地RAG的主战场在设备端而非云端。发布五模态统一嵌入是趋势所向,但真实效果如何,还得看实际检索基准,博客宣传听听就好。

本文由本站自动聚合,以下为原始来源:前往 unite.ai 阅读全文 →