GitHub 推出 ModernBERT 分类器以扩展 Secret Protection
GitHub 介绍了与 Microsoft Applied Sciences 构建的微调 ModernBERT 分类器,用于把 push protection 扩展到非结构化密钥。
推荐理由:原文结合九个季度数据与新分类器细节,说明 GitHub 如何把密钥防护前移到代码推送链路。
GitHub 介绍了与 Microsoft Applied Sciences 构建的微调 ModernBERT 分类器,用于把 push protection 扩展到非结构化密钥。
推荐理由:原文结合九个季度数据与新分类器细节,说明 GitHub 如何把密钥防护前移到代码推送链路。
OpenAI 公布了一个内部前沿模型在数学开放问题上的新结果。OpenAI 还在 GitHub 分享了 Lean 证明形式化内容和研究细节。
GitHub 发布 ReviewBench,一个面向 AI 代码审查智能体的开放离线基准,现已可通过 ReviewBench 网站使用。
推荐理由:原文公开了数据集、评分方法和提交流程,可用于比较代码审查智能体的取舍。
GitHub Blog 提出,开发者应强化三项 AI 时代技能:指挥 AI agents、审查 AI 首次输出、把节省的实现时间用于更大问题。文章建议用第二个 AI model 批判第一个模型的方案,并提到 GitHub Copilot 的 Rubber Duck agent 会用第二个模型审查计划、代码和测试。
GitHub Blog 介绍了 GitHub Copilot app 中用 canvases 构建自定义工作流的方法。用户可在智能体会话中输入 /create-canvas,并用自然语言说明工作流、界面操作和智能体可执行动作,生成共享界面;canvas 可作为扩展保存、复用或与团队共享,也可从 Awesome Copilot 安装现成 canvas extensions 后再定制。
GitHub Blog 介绍 GitHub Copilot app 的 canvas,认为许多 AI 任务不应只依赖 chat 作为交互界面。canvas 是运行在 GitHub Copilot app 内的小型全栈应用,可与 GitHub Copilot agent 双向通信,也能调用第三方 API 或在本机执行代码。
推荐理由:文章用 GitHub Copilot canvases 示例说明,任务型自定义 UI 可减少把 Agent 当工具本身的 token 消耗。
GitHub Security Lab 介绍了 Fuzzing Taskflow,这是一个面向 C/C++ 项目的自主 fuzzing 流水线,基于 GitHub Security Lab Taskflow Agent 构建。
推荐理由:文章拆解了 LLM agent 接管 fuzzing 覆盖改进和崩溃分诊的流程,对安全自动化工作流有参考价值。
GitHub Blog 介绍了 GitHub Copilot app 为超大 pull request 重建视图的工程方案。团队用一个包含 2,200 个文件、超过 100 万行变更、400 多条行内评论的开源 pull request 压测,通过代码行虚拟化、评论动态高度测量、滚动锚定、增量数据管线和自动化测量循环,让大 diff 与多线程评论保持可滚动和可阅读。
推荐理由:原文拆解了大规模 diff 与评论渲染的工程取舍,可迁移到其他长列表和动态内容界面。
Google Research 推出 MilleMiglia,一个用 C++ 编写的中程物流实例生成器,用于创建真实、隐私保护的中程配送问题 benchmark。中程物流连接区域或洲际配送中心,涉及多车辆接力、时间窗口和转运同步,长期缺少公开高质量数据。其源代码和文档已在 GitHub 提供。
GitHub Podcast 讨论多项 AI 开发热点:AI 生成代码仍需审查,RAG 没有消亡,Skills 也没有取代 MCP。文章认为开发者的关键能力是判断风险、解释 AI 使用方式,并把 agents、Skills、MCP 与 RAG 作为可组合的工作流组件。
Berkeley AI Research 提出一种基于互信息直接评估和优化成像系统的框架,只用含噪测量和噪声模型衡量测量区分物体的能力。其 NeurIPS 2025 论文显示,该信息指标可在彩色摄影、射电天文学、无透镜成像和显微成像中预测系统表现,优化设计可匹配 SOTA 端到端方法,同时需要更少内存和计算且无需任务特定解码器。