Anthropic 发布 Claude Haiku 5.5,定价对标 GPT-6 Luna
Anthropic 发布 Claude Haiku 5.5,这是约一年后的 Haiku 层级更新,定价对标 OpenAI 的 GPT-6 Luna,并已上线 Claude Platform 和 Claude Code。
推荐理由:原文汇总了发布信息、第三方评测和价格细节,可用于比较 Haiku 5.5 与低成本模型的取舍。
Anthropic 发布 Claude Haiku 5.5,这是约一年后的 Haiku 层级更新,定价对标 OpenAI 的 GPT-6 Luna,并已上线 Claude Platform 和 Claude Code。
推荐理由:原文汇总了发布信息、第三方评测和价格细节,可用于比较 Haiku 5.5 与低成本模型的取舍。
Mistral 发布 Mistral Large 4 预览版 Le chonk,这是一个 1 trillion parameter、49 billion active parameter 模型,可通过 Mistral API 使用。
Google 发布开源模型 EmbeddingGemma 2,可将文本、图像、视频、音频和代码转换为数值向量,用于相似内容查找和比较。该模型有 740 million 参数,Google 称其在多模态嵌入基准上超过规模最高达两倍的竞品,并在 Massive Text Embedding Benchmark (Code) 上得分 78.68,高于前代的 68.76。
Musubi 周二宣布发布用于实时内容审核的轻量级决策模型 PolicyLM-1.7B,并以 open weights 形式开放。该模型可读取用普通英语写成的内容政策,并在 under 50 milliseconds 内应用到消息上;它被设计为在成本和速度上接近多数社交平台使用的 AI 分类器,同时利用现代 LLM 的灵活性处理复杂政策。
Anthropic 发布 Haiku 5.5,将100万Token以内短上下文输入价格降至每百万Token 0.1美元,输出0.5美元,缓存读取0.01美元。
OpenAI宣布GPT-6开始向ChatGPT免费和Go用户推送,用GPT-6 Luna逐步替换此前的GPT-5.6 Luna,Plus、Pro、Business和Enterprise用户则从10月7日起陆续使用GPT-6 Sol。
推荐理由:原文同时梳理了免费开放安排、界面变化和安全报告,便于比较GPT-6与GPT-5.6的差异。
Anthropic 发布 Claude Haiku 5.5,文章称其在小模型跑分上超过 DeepSeek V4.1Flash、GLM-5.3-Flash,并逐项赢过 GPT-6 Luna。
推荐理由:原文梳理了 Haiku 5.5 的价格、跑分和迁移改动,可用于评估小模型替换成本。
Anthropic 发布新的快速低成本模型 Claude Haiku 5.5,Simon Willison 实测称其在 100,000 tokens 内价格为 $0.10/$0.50,与 GPT-6 Luna 相同。
推荐理由:作者实测了价格、tokenizer 和推理档位,便于比较 Claude Haiku 5.5 与 GPT-6 Luna 的成本差异。
OpenAI 正在向所有 ChatGPT 用户推出 GPT-6,并加入 Intelligent UI,让回答从纯文本转为包含图形、按钮、图表和表单的交互式界面。
Anthropic 发布 Claude Haiku 5.5,称其是公司迄今最快、最便宜的小模型,并同时下调 Sonnet 5.5 价格。Haiku 5.5 面向摘要、数据库查询、分类和实时客服等高量、成本敏感任务,100,000 tokens 以内提示词价格最高下降 90%,但新版 tokenizer 可能让实际节省小于单价降幅。
推荐理由:文章集中列出价格、基准和可用平台,可用于比较 Haiku 5.5 与同级模型的成本边界。
Mistral 称 Le Chonk 能与顶级闭源模型竞争,同时保持 open-weight。原文未提供参数规模、benchmark 分数、价格或可用性细节。
OpenAI 宣布 GPT‑6 正在 ChatGPT 中全球推出,并配套 Intelligent UI。该更新称可提供更快响应,带来可直接探索和使用的视觉与交互体验。
推荐理由:原文说明了 GPT-6 在 ChatGPT 的全球上线形态,并点出可交互视觉体验这一使用变化。
Google DeepMind 发布 EmbeddingGemma 2,将文本、代码、图像、视频和音频映射到统一嵌入空间。该模型基于 Gemma 4 架构,采用 Apache 2.0 许可,拥有 740 million 参数,支持 8K token 上下文窗口,并可通过 MRL 将输出向量从 768 维截断到 512、256 或 128 维。
推荐理由:原文给出参数规模、上下文窗口和端侧内存数据,可用于评估多模态嵌入在本地检索场景中的适配性。
Mistral 发布了可免费使用和定制的 1 trillion-parameter 模型 Mistral Large 4,昵称为 Le Chonk,目前提供预览版,最终版本计划于月底前推出。该模型针对编码、网络防御以及制造、金融和电气工程等领域优化,Mistral 称其从头训练,并接近部分闭源模型。文章还提到,开放权重模型按消耗的计算资源收费,企业运行成本相对较低。
Mistral AI 发布 Mistral Large 4 公共预览版,这是一个 1 trillion-parameter 原生多模态模型,拥有 52 billion active parameters,可在 Mistral Studio 试用 preview API,并计划在本月底发布权重。
推荐理由:原文披露了参数规模、开放权重计划和多项基准结果,可用于比较欧洲开放权重模型的能力定位。
Reflection announced Beam 是一个 text-only 501B-total / 23B-active MoE 模型,面向 coding、agentic 和 scientific work,完整权重本月将以 Apache 2.0 发布。
Asta 开源了 AstaBrief 8B,这是一个将研究问题和检索到的文献摘录转成带引用报告的开放权重模型。它已作为 Asta Generate a report 功能中的 Fast mode 提供,并与 Claude 驱动的 Thinking mode 并列;Asta 还开源训练数据,并发布可用自有 PDFs 生成报告的示例 workflow。
推荐理由:文章披露了训练数据筛选、DPO 构造和速度对比,适合参考科学报告生成模型的工程取舍。
Google DeepMind 推出 Gemini 4 Argon,用于编码、企业知识工作和网络防御,当前仅通过 Fairwind Program 向政府用户和受信任的网络防御者开放。
推荐理由:原文汇总了 Argon 的开放范围、价格和多组评测结果,便于比较 Google DeepMind 与同级前沿模型。
Google DeepMind 宣布 Gemini 4 Argon,这一前沿模型将先通过 Fairwind Program 向一组受信任的网络防御者推出,并逐步扩大访问。
推荐理由:原文给出发布节奏、价格和多项基准结果,可用于了解 Google 对高能力模型分阶段开放的安排。
H Company 发布 Holo4 系列智能体模型,包括 Holo4-27B dense、Holo4-35B-A3B Mixture of Experts,并更新 Holotron4 Nano。
推荐理由:原文披露了跨 GUI、代码、MCP 和 API 的训练与评测细节,可用于比较通用计算机使用智能体的成本与能力。
Google DeepMind 发布 Gemini 3.8 Flash TTS 和 Gemini 3.8 Flash-Lite TTS 两个文本转语音模型,用于生成更具表现力的音频。
推荐理由:原文列出语音定制、复刻、安全标识和开放渠道,便于判断新 TTS 模型的应用边界。
Google DeepMind 推出 Gemini 3.8 Live 和 Gemini 3.8 Live Extended Thinking,用于近实时推理、语音智能体和更自然的 AI 对话。
推荐理由:原文同时给出语音模型能力、评测结果和开放入口,便于判断其在语音智能体中的适用场景。
Microsoft Research 推出开源研究模型 GigaPath-Flash 和 GigaTIME-Flash,用更高效的病理基础模型支持大规模癌症病理研究。