跳到正文
今天10月8日周四3 条
  1. Simon Willison37

    EmbeddingGemma 2 采用 Apache 2.0 许可证

    EmbeddingGemma 2 采用 Apache 2.0 许可证,作者认为嵌入模型不适合只提供闭源、专有、托管版本。嵌入应用常需计算并长期保存成千上万甚至数百万个嵌入向量,若供应商停供模型,用户可能要为重新计算存量向量付费。OpenAI 曾在 2024 年 4 月提出承担用户重新嵌入内容的费用,但作者认为这不能指望所有提供商都会这样做。

  2. 36氪38

    游戏公司最想要的社区,小红书把它做成了“一座岛”

    小红书通过游戏动漫嘉年华 RED LAND,把围绕IP的线上社区延伸为线下“岛屿”,让玩家在生活化策展、公共活动和同好社交中共同参与。今年RED LAND场地从8万平方米扩展至15万平方米,游戏及动漫IP从50个增至超过160个,活动时长由3天延长至5天,并新增二次元花车巡游。平台还通过Coser换装棚、用户花车方阵和社区NPC等机制提供支持与正反馈,强化用户与IP的长期连接。

10月7日周三
  1. 量子位86

    OpenAI 公开 722 篇未发布内部模型生成的数学手稿

    OpenAI 公开 722 篇数学手稿,全部出自一个尚未发布的内部模型,归成 372 组结果,并上传论文、源码和部分 Lean 证明到 GitHub。材料称这些结果覆盖准黎曼猜想、霍奇猜想、BSD猜想、π的无理性指数、唯一游戏猜想等 17 个方向,模型此前尝试约 4000 个研究问题,平均每项结果消耗约相当于 ChatGPT Pro 思考 3小时。

    推荐理由:原文梳理了手稿覆盖范围、核验状态和数学界反应,可帮助理解AI产出数学成果后的同行消化压力。

10月6日周二
  1. Wired · AI77

    Mistral 发布 1 trillion-parameter 模型 Mistral Large 4,称 Le Chonk 是中国之外最强的开源权重模型

    Mistral 发布了可免费使用和定制的 1 trillion-parameter 模型 Mistral Large 4,昵称为 Le Chonk,目前提供预览版,最终版本计划于月底前推出。该模型针对编码、网络防御以及制造、金融和电气工程等领域优化,Mistral 称其从头训练,并接近部分闭源模型。文章还提到,开放权重模型按消耗的计算资源收费,企业运行成本相对较低。

    同一新闻,精选展示《Mistral AI 发布 Mistral Large 4 公共预览版》

10月2日周五
  1. Hugging Face Blog60

    Asta 开源科学报告生成模型 AstaBrief 8B

    Asta 开源了 AstaBrief 8B,这是一个将研究问题和检索到的文献摘录转成带引用报告的开放权重模型。它已作为 Asta Generate a report 功能中的 Fast mode 提供,并与 Claude 驱动的 Thinking mode 并列;Asta 还开源训练数据,并发布可用自有 PDFs 生成报告的示例 workflow。

    推荐理由:文章披露了训练数据筛选、DPO 构造和速度对比,适合参考科学报告生成模型的工程取舍。

  2. Latent Space41

    Pi 1.0、Pi Durable 与 AI Engineer NYC 动态

    Pi 1.0 和 Pi Durable 登上 HN 首页,Pi 1.0 增加 Codemode、虚拟模型扩展支持、Deferred tool loading、Anthropic 模型 Cache warming 等功能。Pi Durable 将 Pi 移植到 TypeScript,并外部化有状态组件,支持崩溃恢复、并发会话、自动上下文压缩、多人状态同步和 Hot-Swapping。

9月28日周一
9月19日周六
9月1日周二
2月12日周四