跳到正文
  1. Google DeepMind75

    Google DeepMind 发布 EmbeddingGemma 2 开放轻量多模态嵌入模型

    Google DeepMind 发布 EmbeddingGemma 2,将文本、代码、图像、视频和音频映射到统一嵌入空间。该模型基于 Gemma 4 架构,采用 Apache 2.0 许可,拥有 740 million 参数,支持 8K token 上下文窗口,并可通过 MRL 将输出向量从 768 维截断到 512、256 或 128 维。

    推荐理由:原文给出参数规模、上下文窗口和端侧内存数据,可用于评估多模态嵌入在本地检索场景中的适配性。

  1. Hugging Face Blog60

    Asta 开源科学报告生成模型 AstaBrief 8B

    Asta 开源了 AstaBrief 8B,这是一个将研究问题和检索到的文献摘录转成带引用报告的开放权重模型。它已作为 Asta Generate a report 功能中的 Fast mode 提供,并与 Claude 驱动的 Thinking mode 并列;Asta 还开源训练数据,并发布可用自有 PDFs 生成报告的示例 workflow。

    推荐理由:文章披露了训练数据筛选、DPO 构造和速度对比,适合参考科学报告生成模型的工程取舍。

  1. Mistral AI71

    Mistral AI 推出 Agentic Search,用于提升企业 AI 系统检索准确性与效率

    Mistral AI 推出 Agentic Search,这是一个检索层,可让 AI 系统在复杂文档和数据源中搜索、导航、阅读并验证信息。它通过 Mistral Search Toolkit 和 Libraries 提供,使用 search、open、navigate、read、grep 五个工具,并内置于 Studio 和 Vibe。

    推荐理由:原文给出工具接口、适用场景和基准数据,可用于比较 Agentic Search 与传统 RAG 的取舍。

已经到底了