Google DeepMind 发布 EmbeddingGemma 2 开放轻量多模态嵌入模型
Google DeepMind 发布 EmbeddingGemma 2,这是一个 740M 参数的开放轻量多模态嵌入模型。它基于 Gemma 4 架构,采用 Apache 2.0 许可,支持文本、代码、图像、视频和音频统一嵌入,并提供 8K token 上下文窗口。
推荐理由:原文给出 740M 参数、8K 上下文窗口、MRL 截断维度和端侧内存占用,便于判断本地多模态检索可用性。
学习方向
检索增强生成:向量数据库选型、切片与召回调优、RAG 系统搭建的全流程教程。
3 条精选近 30 天 2 条共收录 4 条
Google DeepMind 发布 EmbeddingGemma 2,这是一个 740M 参数的开放轻量多模态嵌入模型。它基于 Gemma 4 架构,采用 Apache 2.0 许可,支持文本、代码、图像、视频和音频统一嵌入,并提供 8K token 上下文窗口。
推荐理由:原文给出 740M 参数、8K 上下文窗口、MRL 截断维度和端侧内存占用,便于判断本地多模态检索可用性。
Ai2 开源 AstaBrief 8B,该模型基于 Qwen3-8B,把研究问题和检索文献片段转为带引用报告,并作为 Asta 的 Fast mode 与 Claude-powered Thinking mode 并行。
推荐理由:原文给出 AstaBrief 8B 的训练数据、评测指标、速度对比和本地部署入口,读者可判断开源小模型如何进入科学报告生成流程。
Mistral 发布 Agentic Search,作为复杂文档检索层,让模型搜索、导航和验证信息,并在 FinanceBench 与 OfficeQA Pro 上提升准确率。
推荐理由:原文给出 Mistral Agentic Search 在 FinanceBench 与 OfficeQA Pro 上相对一次性 RAG 的准确率、延迟和 token 变化,便于判断企业复杂文档检索改造的实际价值与适用边界。