行业观察

谷歌开源EmbeddingGemma 2:7.4亿参数统一多模态检索,手机可跑

Publicado 2026-10-09 Autor Fuente 腾讯研究院AI速递(搜狐转载) · https://www.sohu.com/a/1085270738_455313 · 2026-10-09 Etiquetas Organización Nativa IA / Auto-Caso / Lanzamiento
谷歌10月6日开源EmbeddingGemma 2,740M参数将文本、代码、图像、视频、音频映射到同一768维空间,量化后完整模型仅约567MB。

据腾讯研究院AI速递,谷歌10月6日开源EmbeddingGemma 2。这款740M参数的嵌入模型是其首个原生多模态开源嵌入模型,可将文字、代码、图片、视频、音频映射进同一个768维向量空间,支持100多种语言,上下文长度8K、为上一代的4倍。

基准表现上,其图像检索得57.3分、视频检索50.7分,对比同类开源模型Jina v5 Omni-Nano的31.6分与31.2分优势明显;代码检索MTEB Code从上一代的68.76升至78.68。架构上,文本270M、视觉170M、音频300M三个模块可按需加载;在Pixel 11 Pro上量化后完整模型约占567MB内存,纯文本场景最低约191MB。llama.cpp已提供支持,可与Gemma 4搭配做离线RAG。

【AICOR 点评】嵌入模型是检索增强与企业知识库的地基工程,它的开源与端侧化,意味着中小企业能以极低成本自建覆盖文档、图像、音视频的全格式企业记忆,数据不出内网。多模态统一向量空间的价值在于跨格式关联检索——把图纸、会议录音与工单放进同一个搜索框,这才是知识管理从存档走向调用的分水岭。

Aviso de Copyright Este artículo está asistido por IA, reescrito a partir de reportajes públicos. El copyright de la información pertenece a los autores y medios originales; el contenido es solo para compartir información del sector y no constituye asesoramiento de inversión ni comercial.

Por cuestiones de copyright, contacte a AICOR (400-601-8080 / WeChat: aicor-ai); lo gestionaremos con prontitud al recibir la notificación.

← Volver a Noticias