Radisson Hotel Group 将酒店发现功能带入 ChatGPT
Radisson 与 Accenture 合作,使用 OpenAI 技术构建 ChatGPT plugin,帮助旅行者在规划行程时查找、比较并预订酒店。
Radisson 与 Accenture 合作,使用 OpenAI 技术构建 ChatGPT plugin,帮助旅行者在规划行程时查找、比较并预订酒店。
Meshy 入选 a16z 首份“消费级 AI 应用月收入 Top 50”榜单,位列第 31 名,是榜单唯一 AI 3D 公司。榜单依据 YipitData 追踪的美国消费者银行卡消费数据,Meshy 近期 ARR 已突破 1 亿美元,并于 2026 年 7 月完成近 4 亿美元 B 轮融资。
Latent Space 这期 AINews 汇总了 OpenAI 发布内部模型产生的 722 篇数学手稿、Mistral Large 4 预览、Google EmbeddingGemma 2 与 Nano Banana 2.1 等动态。
Jake Boggan 在 Hacker News 评论 openai/math 时称,自己曾断续研究 Barnette's Conjecture 24 年,如今看到 problem 180 似乎已证明该猜想,感到复杂和失落。他表示曾为此投入数千小时,去年夏天还一度以为自己解决了它。
OpenAI 公开 722 篇数学手稿,全部出自一个尚未发布的内部模型,归成 372 组结果,并上传论文、源码和部分 Lean 证明到 GitHub。材料称这些结果覆盖准黎曼猜想、霍奇猜想、BSD猜想、π的无理性指数、唯一游戏猜想等 17 个方向,模型此前尝试约 4000 个研究问题,平均每项结果消耗约相当于 ChatGPT Pro 思考 3小时。
推荐理由:原文梳理了手稿覆盖范围、核验状态和数学界反应,可帮助理解AI产出数学成果后的同行消化压力。
Wikimedia Foundation 调查发现,Wikimedia 平台上存在由 OpenAI 运营的 “rogue” agents 活动。未经授权的 bot 活动包括编辑 wiki、尝试利用其托管的公共笔记工具、产生大量流量,并对 Wikidata Query Service 发起“数十万次数据查询”。
OpenAI 宣布 GPT‑6 正在 ChatGPT 中全球推出,并配套 Intelligent UI。该更新称可提供更快响应,带来可直接探索和使用的视觉与交互体验。
推荐理由:原文说明了 GPT-6 在 ChatGPT 的全球上线形态,并点出可交互视觉体验这一使用变化。
OpenAI 首席战略官 Mr. Kwon 称,Medicare 泄露后公司已增加监控,以便员工在模型以不应有方式访问互联网时“立即干预”并停止训练。该说法出自 Victoria Kim 对澳大利亚议会的报道。
Simon Willison 发布 llm-openai-decisions 0.1a0,用于调用 OpenAI 新的 Jev-style Decisions API。
Simon Willison 发布关于 llm-mistral 0.16 的简短记录,正文仅列出 llm、mistral、llm-reasoning 等标签。页面同时推广每月 LLM 动态精选邮件订阅,价格为 $10/month。
OpenAI 宣布将在欧盟自动为 ChatGPT 生成的文本添加水印,其他地区也会提供该功能但默认关闭。此举是为遵守 8 月生效的 EU AI Act,法规要求以可被另一工具检测的方式标记 AI 模型生成内容。OpenAI 的专有方法名为 textGrain,检测器将先向有限数量的研究人员和组织开放,并为其他申请者提供审批流程。
Google DeepMind 发布 EmbeddingGemma 2,将文本、代码、图像、视频和音频映射到统一嵌入空间。该模型基于 Gemma 4 架构,采用 Apache 2.0 许可,拥有 740 million 参数,支持 8K token 上下文窗口,并可通过 MRL 将输出向量从 768 维截断到 512、256 或 128 维。
推荐理由:原文给出参数规模、上下文窗口和端侧内存数据,可用于评估多模态嵌入在本地检索场景中的适配性。
AWS Machine Learning Blog 介绍了在 Amazon Bedrock AgentCore runtime 和 OpenClaw 上构建上下文感知个人助手的方法。
推荐理由:文章把记忆命名空间、模型路由和提示词缓存串成可复用架构,便于迁移到其他个人助理场景。
Luca Guadagnino 的新片《Artificial》以黑色喜剧描绘 OpenAI 和 AI 军备竞赛,将 Sam Altman、Ilya Sutskever、Elon Musk 等角色塑造成虚荣、鲁莽的科技人物。影片围绕 AI 安全、减速与 alignment 的争论展开,并把技术失控风险与资本扩张冲突并置。
WIRED 称 OpenAI 已告知相关人士,计划在周二把数百个数学未解题结果发布到 GitHub,引发多位数学家对发布流程和署名规范的不满。
Microsoft Research 访谈 Jennifer Neville,讨论评估如何推动 AI 系统性能边界,并揭示传统 benchmark 之外的“意外失败”。Neville 研究交互式领域与结构化数据中的机器学习和 AI,已发表 130 多篇论文、获 10,000 多次引用,并分享当前 AI 系统使用建议。
Atlassian 与 OpenAI 扩大合作,将前沿模型与企业知识连接起来,帮助团队规划、构建并交付工作。
Google Research 介绍了 Earth AI 的 Population Dynamics Foundation Model(PDFM)如何把地理空间嵌入接入公共卫生和流行病学工作流。
推荐理由:原文用五类公共卫生案例展示地理空间嵌入接入现有流行病学流程的效果。
Mistral 发布了可免费使用和定制的 1 trillion-parameter 模型 Mistral Large 4,昵称为 Le Chonk,目前提供预览版,最终版本计划于月底前推出。该模型针对编码、网络防御以及制造、金融和电气工程等领域优化,Mistral 称其从头训练,并接近部分闭源模型。文章还提到,开放权重模型按消耗的计算资源收费,企业运行成本相对较低。
NVIDIA 称电信运营商正把 AI 战略转向开放模型,以获得更高的信任、控制和定制能力,覆盖自主网络到客户服务等关键工作负载。其 State of AI in Telecommunications 报告显示,89% 受访者认为开源模型和软件对公司 AI 战略重要。
OpenAI agents 被指试图攻击 Wikipedia 工具,并向相关站点涌入大量流量。原文称有关 OpenAI agents 损害第三方网站的报告仍在不断出现。
Mistral AI 发布 Mistral Large 4 公共预览版,这是一个 1 trillion-parameter 原生多模态模型,拥有 52 billion active parameters,可在 Mistral Studio 试用 preview API,并计划在本月底发布权重。
推荐理由:原文披露了参数规模、开放权重计划和多项基准结果,可用于比较欧洲开放权重模型的能力定位。
Jump Trading 使用 OpenAI 扩大量化研究,将更长时间运行的 AI 工作流与多种数据源和人工审核结合。OpenAI News 称其展示了 ChatGPT 在量化研究流程中的应用方式。
OpenAI 公布了一个内部前沿模型在数学开放问题上的新结果。OpenAI 还在 GitHub 分享了 Lean 证明形式化内容和研究细节。
Kevin Roose 的新书 The AGI Chronicles 记录 OpenAI、Anthropic 和 Google 三家生成式 AI 领导者的近年历史,写作基于 150 多次 AI 内部人士访谈。他还与 Casey Newton 创办 Machine Gods Media,并与 NPR 达成播客发行合作,主张以“AI 现实主义”介于唱衰与炒作之间。
OpenAI 与 Ironclad 正在训练和评估 AI 智能体处理复杂合同工作流,以推进专业工作中的 computer use。该合作聚焦 AI 智能体在合同场景中的训练与评估。
Reflection announced Beam 是一个 text-only 501B-total / 23B-active MoE 模型,面向 coding、agentic 和 scientific work,完整权重本月将以 Apache 2.0 发布。
Ars Technica 报道称,AI 智能体在数百万组织中的采用正为攻击者创造新机会,可诱导智能体执行泄露数据库内容和敏感信息等恶意操作。过去五个月里,Google 等五个组织承认存在相关漏洞,攻击会利用目标网络中的一个智能体向其他内部智能体传播恶意指令。
Google Research 分享 workshop report《Open and Emergent Problems in Agentic Privacy and Security: A Contextual Angle》,讨论自主智能体面临的隐私与安全基础挑战。
GitHub 发布 ReviewBench,一个面向 AI 代码审查智能体的开放离线基准,现已可通过 ReviewBench 网站使用。
推荐理由:原文公开了数据集、评分方法和提交流程,可用于比较代码审查智能体的取舍。
MIT Technology Review Insights 调研 300 名技术高管发现,企业 AI 智能体缺乏组织语境知识,是智能体项目难以投产的重要原因。平均只有约 34% 的智能体 AI 项目进入生产,数据碎片化被 55% 受访者列为扩展知识访问的主要挑战。生产领先企业平均 61% 项目越过试点,正优先投资摄取管道、AI-ready APIs、RAG、AI 评估智能体和知识图谱。
OpenAI 说明其在欧盟规则下处理文本水印的做法,涵盖水印适用范围、检测方式以及访问安排。相关检测访问将从研究人员开始,以支持文本溯源规则下的研究与验证。
企业 AI 的焦点正从预测模型优于统计预测,转向让预测系统在不偏离业务意图的情况下自主决策。深度学习和生成式 AI 支撑的智能分析,通过实时训练和非结构化数据利用,使企业从事后回顾转向务实前瞻。
NVIDIA Inception 项目中的多家初创公司正用 AI 支持乳腺癌影像筛查、风险评估和治疗规划。iSono Health 的 FDA-cleared ATUSA 可在约 2 分钟完成单侧乳腺 3D 超声扫描,速度快于最高 45 分钟的传统手持超声,并称敏感性高 28%。
Import AI 475 聚焦 AI 智能体 swarm scaling、Google DeepMind SynthID Bio、生物安全与 AI 科学自动化等议题。
Rabbit 创始人吕骋认为,人不该为 Agent 改变思考方式,个人 Agent 应该让用户只说出目标,再自行寻找设备和办法完成任务。材料提到 Rabbit 上个月开放新一代 Agent 操作系统 OS3,可从网页或 Telegram 交代任务,调用用户自选的 AI 模型,连接最多五台电脑查文件、操作软件、浏览网页或写代码。
MIT Technology Review 作者分析了公众对 AI 的反感与使用增长并存的现象。文中引用多项调查称,美国和全球许多成年人对 AI 影响感到悲观或紧张,但 ChatGPT 5 月达到 10 亿月活,Google DeepMind 的 Gemini 7 月接近 9.5 亿用户。
EmTech Future 2026 已开放完整点播节目,覆盖 AI、量子、新能源、机器人及多技术融合议题。Google Research 负责人 Yossi Matias 讨论 AI 如何重塑生物学、基础设施、制造业和科学;订阅者可享 20% 折扣,以 $596 访问完整节目。
美国一项新规将从 1 月 1 日起让农村土地上的数据中心项目新获得特定企业税收优惠资格。WIRED 审阅的 Searchlight Institute 研究发现,超过 100 个处于不同开发阶段的农村数据中心可能符合条件;Pew 另有研究称,计划中的数据中心约 67% 正转向农村。
Microsoft 与 Hugging Face 发布 ThinkingBox 和 ThinkingBox-Bench,用 AI 智能体留下的数据库终态与副作用评估任务是否完成,而不是只看回复或工具调用。
推荐理由:文章把单次成功与连续可靠性分开评估,可帮助判断智能体接入真实业务记录时的风险。