硅谷101访谈拆解AI数据行业的出题、卖题与判卷生意
硅谷101访谈Scale AI后训练与评测研究负责人何允中、伯克利博士后孙一铀,讨论AI数据行业从人工标注转向rubric、RL环境和智能体数据。对话提到AfterQuery估值从今年4月A轮的3亿美元升至9月新一轮融资后的32亿美元,Bespoke Labs种子轮与A轮融资合计4000万美元。
硅谷101访谈Scale AI后训练与评测研究负责人何允中、伯克利博士后孙一铀,讨论AI数据行业从人工标注转向rubric、RL环境和智能体数据。对话提到AfterQuery估值从今年4月A轮的3亿美元升至9月新一轮融资后的32亿美元,Bespoke Labs种子轮与A轮融资合计4000万美元。
Utopai X 在 Artificial Analysis 最新文生视频榜单中获得 1150分,排名第二,与第一名阿里的 Wan 3.0 相差 7分。文章介绍称,Utopai X 背后是 Utopai Studios,并与其制片平台 PAI 一起用于从剧本拆分、镜头生成到剪辑的影视制作流程。
Meshy 入选 a16z 首份“消费级 AI 应用月收入 Top 50”榜单,位列第 31 名,是榜单唯一 AI 3D 公司。榜单依据 YipitData 追踪的美国消费者银行卡消费数据,Meshy 近期 ARR 已突破 1 亿美元,并于 2026 年 7 月完成近 4 亿美元 B 轮融资。
GitHub 发布 ReviewBench,一个面向 AI 代码审查智能体的开放离线基准,现已可通过 ReviewBench 网站使用。
推荐理由:原文公开了数据集、评分方法和提交流程,可用于比较代码审查智能体的取舍。
Microsoft 与 Hugging Face 发布 ThinkingBox 和 ThinkingBox-Bench,用 AI 智能体留下的数据库终态与副作用评估任务是否完成,而不是只看回复或工具调用。
推荐理由:文章把单次成功与连续可靠性分开评估,可帮助判断智能体接入真实业务记录时的风险。
Import AI 469 讨论 DiG-bench、RSI Simulator 和 Inherent 的 AI 科学家模型 Faraday 等 AI 研究进展。