行业观察

谷歌开源EmbeddingGemma 2:7.4亿参数统一多模态检索,手机可跑

发布日期 2026-10-09 作者 信息来源 腾讯研究院AI速递(搜狐转载) · https://www.sohu.com/a/1085270738_455313 · 2026-10-09 标签 AI原生组织 / 自身即产品 / 上线
谷歌10月6日开源EmbeddingGemma 2,740M参数将文本、代码、图像、视频、音频映射到同一768维空间,量化后完整模型仅约567MB。

据腾讯研究院AI速递,谷歌10月6日开源EmbeddingGemma 2。这款740M参数的嵌入模型是其首个原生多模态开源嵌入模型,可将文字、代码、图片、视频、音频映射进同一个768维向量空间,支持100多种语言,上下文长度8K、为上一代的4倍。

基准表现上,其图像检索得57.3分、视频检索50.7分,对比同类开源模型Jina v5 Omni-Nano的31.6分与31.2分优势明显;代码检索MTEB Code从上一代的68.76升至78.68。架构上,文本270M、视觉170M、音频300M三个模块可按需加载;在Pixel 11 Pro上量化后完整模型约占567MB内存,纯文本场景最低约191MB。llama.cpp已提供支持,可与Gemma 4搭配做离线RAG。

【AICOR 点评】嵌入模型是检索增强与企业知识库的地基工程,它的开源与端侧化,意味着中小企业能以极低成本自建覆盖文档、图像、音视频的全格式企业记忆,数据不出内网。多模态统一向量空间的价值在于跨格式关联检索——把图纸、会议录音与工单放进同一个搜索框,这才是知识管理从存档走向调用的分水岭。

版权声明 本文由 AI 辅助整理,基于公开报道转写,信息版权归原作者及原媒体所有;内容仅作行业信息分享,不构成任何投资或商业建议。

如涉版权问题,请联系 AICOR(400-601-8080 / 微信 aicor-ai),我们将在收到通知后及时处理。

← 返回新闻列表