跳到正文
今天10月8日周四3 条
  1. The Decoder70

    Google 发布 EmbeddingGemma 2 多模态嵌入模型

    Google 发布开源模型 EmbeddingGemma 2,可将文本、图像、视频、音频和代码转换为数值向量,用于相似内容查找和比较。该模型有 740 million 参数,Google 称其在多模态嵌入基准上超过规模最高达两倍的竞品,并在 Massive Text Embedding Benchmark (Code) 上得分 78.68,高于前代的 68.76。

10月7日周三
  1. Google DeepMind75

    Google DeepMind 发布 EmbeddingGemma 2 开放轻量多模态嵌入模型

    Google DeepMind 发布 EmbeddingGemma 2,将文本、代码、图像、视频和音频映射到统一嵌入空间。该模型基于 Gemma 4 架构,采用 Apache 2.0 许可,拥有 740 million 参数,支持 8K token 上下文窗口,并可通过 MRL 将输出向量从 768 维截断到 512、256 或 128 维。

    推荐理由:原文给出参数规模、上下文窗口和端侧内存数据,可用于评估多模态嵌入在本地检索场景中的适配性。

10月5日周一
  1. MIT Technology Review · AI43

    将 AI 智能体连接到企业知识

    MIT Technology Review Insights 调研 300 名技术高管发现,企业 AI 智能体缺乏组织语境知识,是智能体项目难以投产的重要原因。平均只有约 34% 的智能体 AI 项目进入生产,数据碎片化被 55% 受访者列为扩展知识访问的主要挑战。生产领先企业平均 61% 项目越过试点,正优先投资摄取管道、AI-ready APIs、RAG、AI 评估智能体和知识图谱。

10月2日周五
  1. Hugging Face Blog60

    Asta 开源科学报告生成模型 AstaBrief 8B

    Asta 开源了 AstaBrief 8B,这是一个将研究问题和检索到的文献摘录转成带引用报告的开放权重模型。它已作为 Asta Generate a report 功能中的 Fast mode 提供,并与 Claude 驱动的 Thinking mode 并列;Asta 还开源训练数据,并发布可用自有 PDFs 生成报告的示例 workflow。

    推荐理由:文章披露了训练数据筛选、DPO 构造和速度对比,适合参考科学报告生成模型的工程取舍。

9月29日周二
  1. MIT Technology Review · AI25

    如何让 AI 成为资产,而不是支出

    HPE 认为,企业 AI 从试点进入生产后,应按工作负载评估继续按请求付费还是投资自有容量。Deloitte 的 2026 State of AI in the Enterprise 显示,2025 年员工 AI 访问量上升 5%,至少 40% AI 项目投产的公司占比预计在六个月内翻倍。自有容量只有在需求稳定、可预测且利用率足够高,并配合采用、治理和用例扩展时才有经济意义。

9月18日周五
8月20日周四
  1. Mistral AI71

    Mistral AI 推出 Agentic Search,用于提升企业 AI 系统检索准确性与效率

    Mistral AI 推出 Agentic Search,这是一个检索层,可让 AI 系统在复杂文档和数据源中搜索、导航、阅读并验证信息。它通过 Mistral Search Toolkit 和 Libraries 提供,使用 search、open、navigate、read、grep 五个工具,并内置于 Studio 和 Vibe。

    推荐理由:原文给出工具接口、适用场景和基准数据,可用于比较 Agentic Search 与传统 RAG 的取舍。

3月13日周五