Hugging Face Blog·· 2025-09-04精选AI 评分70
Google 发布轻量多语言嵌入模型 EmbeddingGemma
Welcome EmbeddingGemma, Google's new efficient embedding model
AI 导读
Google 发布轻量多语言嵌入模型 EmbeddingGemma,参数量为 308M 并配备 2K 上下文窗口,量化后内存占用低于 200 MB。该模型基于 Gemma3 架构改造为双向注意力编码器,支持超过 100 种语言与 MRL 维度截断,已全面集成至 Sentence Transformers、LangChain、LlamaIndex 与 Transformers.js 等生态框架。
推荐理由
该模型以 308M 参数与双向注意力机制优化了端侧嵌入效率,适合作为移动端 RAG 与轻量检索系统的低成本落地参考。
来源:Hugging Face Blog · huggingface.co