AI 日报 · 2026 年 10 月 9 日 · 星期五
HOT

OpenAI 在 GitHub 发布 372 个 AI 生成数学证明
OpenAI 发布了 372 个由内部前沿模型生成的数学结果,托管在 GitHub 而非学术期刊,并称每个结果旨在解决开放问题或取得实质进展。这些结果包含主要计算机算法改进和与 Riemann hypothesis 相关的进展,许多证明带有 Lean 形式化,平均每项消耗约三小时的 ChatGPT Pro Thinking compute。
模型发布/更新
Anthropic 发布 Claude Haiku 5.5,定价对标 GPT-6 Luna
Anthropic 发布 Claude Haiku 5.5,这是约一年后的 Haiku 层级更新,定价对标 OpenAI 的 GPT-6 Luna,并已上线 Claude Platform 和 Claude Code。
产品发布/更新
谷歌云推出企业智能代理 Gemini,可自主执行多步骤任务
谷歌云推出面向企业工作的通用智能代理 Gemini,可通过单一界面处理问答、知识工作、内容创作及代码编写和运行等任务,并调用企业内部工具和数据完成用户设定的目标。
行业动态
OpenAI披露并封禁俄罗斯与伊朗的AI虚假前台影响行动
OpenAI披露已封禁两起分别源自俄罗斯和伊朗、利用其模型支持的隐蔽影响行动,并评估俄罗斯行动为IO Breakout Scale Category 5、伊朗行动为Category 4。俄罗斯行动借助拉美人员运营虚构研究机构并传播假消息;伊朗行动则通过七个虚假记者身份向媒体投稿,相关署名文章近100篇。OpenAI表示,这些行动沿用了AI出现前的影响行动模式,而AI让部分工作流程更容易扩展。
Zenity研究人员发现单条提示词可接管同一AWS账户和区域内的AgentCore智能体
Zenity Labs研究人员称,利用AgentCore的隔离缺陷和默认权限,一条提示词即可从一个公开智能体入手,接管同一AWS账户和区域内的其他AgentCore智能体,并读取对话、源码和凭据。研究人员于2025年12月25日向AWS报告后,AWS将IMDSv2设为新部署的默认项,并调整默认执行角色,限制智能体调用其他智能体、读取私人对话和获取AWS Secrets Manager中的凭据。
技巧与观点
如何用 Hugging Face 的 ML-intern 构建并发布定制模型
作者展示了如何在 HuggingChat 中使用 ML-intern 构建、训练、评估并发布定制模型,六个项目的算力费用合计约 USD 103。项目包括把 Qwen-Image 2.1 提示词改写模型做成可在 CPU 上运行的 0.8B 版本,以及为柑橘病害识别、角色绘制和图像编辑训练模型。作者还分享了提示词写法,包括要求先测基线、训练前进行小规模测试,并为付费任务设置预算上限。
NVIDIA Omniverse:开发者如何借助前沿 AI 智能体将创意转化为仿真
NVIDIA 展示开发者如何将前沿 AI 模型与 Omniverse libraries 结合,把仿真创意构建成可运行的应用。案例涵盖人形机器人、自动驾驶测试、数字孪生和空间站浏览器应用,开发者通过自然语言指令引导智能体连接资产、物理、渲染与传感器模拟,并检查和修改结果。一个机器人跨越单个栏架的实验在 100 次仿真试验中成功 64 次。