跳到正文
今天10月8日周四4 条
  1. 钛媒体57

    90后负责人接管国产大模型关键岗位

    Tech星球梳理称,刘大一恒、陈宇森、罗福莉、周畅、姚顺雨等90后正在接手国产大模型关键岗位,分别覆盖Qwen、千问办公、MiMo、字节多模态和腾讯大语言模型及AI Infra。文章列举了他们在开源模型、多模态生成、AI Agent、基础模型和办公智能体商业化中的履历与近期成绩。作者认为,职位交接已经发生,但这些团队仍要面对能力上限、成本约束、商业化落地、组织整合和持续追赶等考验。

10月7日周三
  1. 量子位86

    OpenAI 公开 722 篇未发布内部模型生成的数学手稿

    OpenAI 公开 722 篇数学手稿,全部出自一个尚未发布的内部模型,归成 372 组结果,并上传论文、源码和部分 Lean 证明到 GitHub。材料称这些结果覆盖准黎曼猜想、霍奇猜想、BSD猜想、π的无理性指数、唯一游戏猜想等 17 个方向,模型此前尝试约 4000 个研究问题,平均每项结果消耗约相当于 ChatGPT Pro 思考 3小时。

    推荐理由:原文梳理了手稿覆盖范围、核验状态和数学界反应,可帮助理解AI产出数学成果后的同行消化压力。

10月6日周二
10月2日周五
  1. MIT Technology Review · AI21

    自主 AI 如何重塑企业智能

    MIT Technology Review Insights 报告称,企业 AI 正从工具转向运营模型,需要把人员、流程和数据实时连接并纳入治理控制。全球 AI 投资预计在 2026 年达到 $2.5 trillion,较上一年增长 44%,但许多企业仍受数据孤岛和流程割裂限制;持续获得回报的企业先重设计流程,再选择模型,并建设可组合、主权可控的数据基础设施。

  2. Hugging Face Blog60

    Asta 开源科学报告生成模型 AstaBrief 8B

    Asta 开源了 AstaBrief 8B,这是一个将研究问题和检索到的文献摘录转成带引用报告的开放权重模型。它已作为 Asta Generate a report 功能中的 Fast mode 提供,并与 Claude 驱动的 Thinking mode 并列;Asta 还开源训练数据,并发布可用自有 PDFs 生成报告的示例 workflow。

    推荐理由:文章披露了训练数据筛选、DPO 构造和速度对比,适合参考科学报告生成模型的工程取舍。

  3. Hugging Face Blog40

    AutoSynthData:为企业 AI 智能体生成训练数据

    ServiceNow CoreAI 构建 AutoSynthData,用目标模型失败和更强教师模型成功案例生成企业智能体训练任务。它将任务抽象为 system specification、user prompt、verifier,并要求任务可行、真实、能暴露当前模型弱点;在 EnterpriseOps Gym 实验中,流程会验证任务并随模型改进调整课程。

9月30日周三
9月29日周二
9月21日周一
9月19日周六
9月10日周四
9月8日周二
9月1日周二
8月24日周一
7月26日周日
7月7日周二
5月8日周五
4月20日周一
  1. Berkeley AI Research42

    GRASP:面向世界模型长时域规划的梯度式方法

    Berkeley AI Research 介绍 GRASP,一种用于学习动态系统“世界模型”的梯度式规划器,旨在让长时域规划更实用。GRASP 将轨迹提升为虚拟状态以并行优化时间维度,在状态迭代中直接加入随机性用于探索,并重塑梯度,让动作获得更清晰信号,同时避免穿过高维视觉模型的脆弱“state-input”梯度。

3月13日周五
1月10日周六
  1. Berkeley AI Research38

    基于信息驱动的成像系统设计

    Berkeley AI Research 提出一种基于互信息直接评估和优化成像系统的框架,只用含噪测量和噪声模型衡量测量区分物体的能力。其 NeurIPS 2025 论文显示,该信息指标可在彩色摄影、射电天文学、无透镜成像和显微成像中预测系统表现,优化设计可匹配 SOTA 端到端方法,同时需要更少内存和计算且无需任务特定解码器。