跳到正文
今天10月8日周四10 条
  1. MIT Technology Review · AI61

    AI 机器人突破短期内难以改变日常生活

    MIT Technology Review 分析认为,AI 机器人虽在实验室任务和动作泛化方面取得进展,但短期内难以可靠承担家庭或工厂中的通用工作。文章以 Google DeepMind 的 Gemini Robotics 和 Physical Intelligence 的 π0.7 为例,说明模型仍受训练数据、复杂现实环境和成功率限制;目前不少演示由人远程控制或经过精心编排。

  2. Simon Willison37

    EmbeddingGemma 2 采用 Apache 2.0 许可证

    EmbeddingGemma 2 采用 Apache 2.0 许可证,作者认为嵌入模型不适合只提供闭源、专有、托管版本。嵌入应用常需计算并长期保存成千上万甚至数百万个嵌入向量,若供应商停供模型,用户可能要为重新计算存量向量付费。OpenAI 曾在 2024 年 4 月提出承担用户重新嵌入内容的费用,但作者认为这不能指望所有提供商都会这样做。

  3. The Decoder70

    Google 发布 EmbeddingGemma 2 多模态嵌入模型

    Google 发布开源模型 EmbeddingGemma 2,可将文本、图像、视频、音频和代码转换为数值向量,用于相似内容查找和比较。该模型有 740 million 参数,Google 称其在多模态嵌入基准上超过规模最高达两倍的竞品,并在 Massive Text Embedding Benchmark (Code) 上得分 78.68,高于前代的 68.76。

  4. TechCrunch · AI68

    Google 推出面向所有人的 SynthID 网站,用于识别 AI 生成媒体

    Google 推出新的 SynthID 网站,任何人都可验证图片、视频或音频是否由 AI 生成。该工具此前在 Google I/O last year 向部分记者、媒体从业者和研究人员开放测试,现在支持多种图片、视频和音频格式;Nano Banana、Veo、Lyria、Gemini、Flow、ProducerAI 和 Vids 生成的媒体都会使用 SynthID 水印。

  5. TechCrunch · AI67

    Google Labs 推出 AI 游戏创作平台 Playground

    Google Labs 推出 AI 游戏创作平台 Playground,允许用户用简单文本提示词创建基于浏览器的游戏,无需编码经验。用户可选择 trivia、racing 等类型,设定 2D 或 3D、单人或多人玩法,并上传视觉素材由 AI 转为匹配整体美术风格的游戏资产;游戏可在手机和电脑上游玩、私密保存、链接分享或发布到 Explore gallery。

  6. Google Research68

    Google Research 研究 AI 辅助是否会提升或削弱专利律师专业判断

    Google Research 介绍了一项关于 AI 辅助对专利律师专业能力影响的三个月现场实验,研究对象为 11 家知识产权律所的 133 名律师。实验随机开放当时未发布、现已属于 Gemini Notebook 的 Google Labs AI 专利写作助手,结果显示 AI 在 10 天和 90 天的起草任务中分别将评分提高 0.34 SD 和 0.38 SD。

    推荐理由:这项现场实验区分了 AI 辅助产出与无辅助判断,提供了观察专业技能迁移的具体设计。

10月7日周三
  1. Google DeepMind75

    Google DeepMind 发布 EmbeddingGemma 2 开放轻量多模态嵌入模型

    Google DeepMind 发布 EmbeddingGemma 2,将文本、代码、图像、视频和音频映射到统一嵌入空间。该模型基于 Gemma 4 架构,采用 Apache 2.0 许可,拥有 740 million 参数,支持 8K token 上下文窗口,并可通过 MRL 将输出向量从 768 维截断到 512、256 或 128 维。

    推荐理由:原文给出参数规模、上下文窗口和端侧内存数据,可用于评估多模态嵌入在本地检索场景中的适配性。

10月6日周二
10月5日周一
  1. MIT Technology Review · AI19

    EmTech Future 2026:当 AI 遇见万物

    EmTech Future 2026 已开放完整点播节目,覆盖 AI、量子、新能源、机器人及多技术融合议题。Google Research 负责人 Yossi Matias 讨论 AI 如何重塑生物学、基础设施、制造业和科学;订阅者可享 20% 折扣,以 $596 访问完整节目。

10月4日周日
10月3日周六
10月2日周五
  1. MIT Technology Review · AI61

    Thore Graepel 认为 LLM 并不具备真正推理能力

    Thore Graepel 认为,当今 LLM 主要依赖 next-token prediction 和 CoT 延长生成过程,并不具备 AlphaGo 式的独立推理机制。他以 AlphaGo 的政策网络与搜索机制解释第 37 手,指出真正推理需要显式、持久、可检查的认知状态,以及知识与操作知识方式的分离。他主张未来 AI 应维护可审计的证据、推理和信念修订序列,用于科学、医学、工程等高风险领域。

  2. Latent Space41

    Pi 1.0、Pi Durable 与 AI Engineer NYC 动态

    Pi 1.0 和 Pi Durable 登上 HN 首页,Pi 1.0 增加 Codemode、虚拟模型扩展支持、Deferred tool loading、Anthropic 模型 Cache warming 等功能。Pi Durable 将 Pi 移植到 TypeScript,并外部化有状态组件,支持崩溃恢复、并发会话、自动上下文压缩、多人状态同步和 Hot-Swapping。

10月1日周四
  1. Google DeepMind80

    Google DeepMind 发布 Gemini 4 Argon 前沿模型

    Google DeepMind 宣布 Gemini 4 Argon,这一前沿模型将先通过 Fairwind Program 向一组受信任的网络防御者推出,并逐步扩大访问。

    推荐理由:原文给出发布节奏、价格和多项基准结果,可用于了解 Google 对高能力模型分阶段开放的安排。

9月30日周三
9月28日周一
9月25日周五
9月24日周四