跳到正文
今天10月8日周四4 条
  1. Simon Willison40

    Claude Opus 5.5 生成 Scrimshaw Jukebox 游戏音乐实验

    Simon Willison 测试 Claude Opus 5.5 作曲,让它设计文本音乐格式并构建可播放的 artifact,生成类似《The Secret of Monkey Island》风格的游戏音乐。结果明显偏向 Monkey Island 主题,但作者认为效果出乎意料地好,并提出需与新旧模型对比验证这是否是文本模型近期出现的新能力。

  2. Simon Willison37

    EmbeddingGemma 2 采用 Apache 2.0 许可证

    EmbeddingGemma 2 采用 Apache 2.0 许可证,作者认为嵌入模型不适合只提供闭源、专有、托管版本。嵌入应用常需计算并长期保存成千上万甚至数百万个嵌入向量,若供应商停供模型,用户可能要为重新计算存量向量付费。OpenAI 曾在 2024 年 4 月提出承担用户重新嵌入内容的费用,但作者认为这不能指望所有提供商都会这样做。

10月7日周三
  1. Simon Willison28

    软件博客写作中的反模式

    Michael Lynch 总结了软件博客写作的常见反模式,包括冗长开头、误判读者已有知识、假设读者读过前文、过度正式,以及用链接替代术语解释。他建议文章即使读者不点链接也应能读懂,并强调用自己的声音写作;在许多开发者把写作交给 AI 后,有个性的表达更稀缺。

10月6日周二
10月5日周一
  1. 36氪58

    Rabbit 创始人吕骋谈个人 Agent:人不该为 Agent 改变思考方式

    Rabbit 创始人吕骋认为,人不该为 Agent 改变思考方式,个人 Agent 应该让用户只说出目标,再自行寻找设备和办法完成任务。材料提到 Rabbit 上个月开放新一代 Agent 操作系统 OS3,可从网页或 Telegram 交代任务,调用用户自选的 AI 模型,连接最多五台电脑查文件、操作软件、浏览网页或写代码。

10月2日周五
  1. MIT Technology Review · AI61

    Thore Graepel 认为 LLM 并不具备真正推理能力

    Thore Graepel 认为,当今 LLM 主要依赖 next-token prediction 和 CoT 延长生成过程,并不具备 AlphaGo 式的独立推理机制。他以 AlphaGo 的政策网络与搜索机制解释第 37 手,指出真正推理需要显式、持久、可检查的认知状态,以及知识与操作知识方式的分离。他主张未来 AI 应维护可审计的证据、推理和信念修订序列,用于科学、医学、工程等高风险领域。

10月1日周四
9月18日周五