AI 驱动黑客工具被指帮助单人攻击者入侵多家韩国银行
Crowdstrike 报告称,一名疑似中文使用者的攻击者在 2026 年 9 月下旬至 10 月初攻击多家韩国金融机构,并窃取大量数据。Khan 称,仅 Shinhan Bank 就有超过 25,000 条包含姓名、联系方式、收入和信用额度的记录被盗,韩国金融监管机构召开紧急会议,总统 Lee Jae Myung 要求彻查。
Crowdstrike 报告称,一名疑似中文使用者的攻击者在 2026 年 9 月下旬至 10 月初攻击多家韩国金融机构,并窃取大量数据。Khan 称,仅 Shinhan Bank 就有超过 25,000 条包含姓名、联系方式、收入和信用额度的记录被盗,韩国金融监管机构召开紧急会议,总统 Lee Jae Myung 要求彻查。
OpenAI 发布了 372 个由内部前沿模型生成的数学结果,托管在 GitHub 而非学术期刊,并称每个结果旨在解决开放问题或取得实质进展。这些结果包含主要计算机算法改进和与 Riemann hypothesis 相关的进展,许多证明带有 Lean 形式化,平均每项消耗约三小时的 ChatGPT Pro Thinking compute。
推荐理由:原文呈现了 AI 生成数学证明从产出到审查的流程变化,以及数学界对理解价值的分歧。
OpenAI 发布了一批由未发布前沿模型生成的数学手稿,共 722 篇,覆盖 372 个相关结果族,据称包含“数百个”开放问题的解法。发布内容包括部分模型推理摘要、所用 compute 估计和尝试问题数量统计,OpenAI 称“平均结果”相当于 3 小时 ChatGPT Pro thinking。
同一新闻,精选展示《OpenAI 在 GitHub 发布 372 个 AI 生成数学证明》
Microsoft 公布搭载 Nvidia RTX Spark 的 Surface Laptop Ultra 和 Surface RTX Spark Dev Box 规格与价格,并配套改版 Windows 11。
Meta 宣布其 Muse assistant 现已推出独立 iPad 应用,距离 9 月 8 日上线 iPhone 仅一个月。Sensor Tower 估计,Muse 自登陆 iOS 和 Android 以来安装量已超过 6.6 million;该应用可连接账户,帮助用户处理邮件、会议、账单,并完成预订、买菜、设定目标和购物等任务。
Microsoft 的 Surface RTX Spark Dev Box 现已开放预购,售价约 $6,000,计划在 11 月发货。
GitHub 介绍了与 Microsoft Applied Sciences 构建的微调 ModernBERT 分类器,用于把 push protection 扩展到非结构化密钥。
推荐理由:原文结合九个季度数据与新分类器细节,说明 GitHub 如何把密钥防护前移到代码推送链路。
OpenAI 公开 722 篇数学手稿,全部出自一个尚未发布的内部模型,归成 372 组结果,并上传论文、源码和部分 Lean 证明到 GitHub。材料称这些结果覆盖准黎曼猜想、霍奇猜想、BSD猜想、π的无理性指数、唯一游戏猜想等 17 个方向,模型此前尝试约 4000 个研究问题,平均每项结果消耗约相当于 ChatGPT Pro 思考 3小时。
推荐理由:原文梳理了手稿覆盖范围、核验状态和数学界反应,可帮助理解AI产出数学成果后的同行消化压力。
OpenAI 公布了一个内部前沿模型在数学开放问题上的新结果。OpenAI 还在 GitHub 分享了 Lean 证明形式化内容和研究细节。
GitHub 发布 ReviewBench,一个面向 AI 代码审查智能体的开放离线基准,现已可通过 ReviewBench 网站使用。
推荐理由:原文公开了数据集、评分方法和提交流程,可用于比较代码审查智能体的取舍。
GitHub Blog 提出,开发者应强化三项 AI 时代技能:指挥 AI agents、审查 AI 首次输出、把节省的实现时间用于更大问题。文章建议用第二个 AI model 批判第一个模型的方案,并提到 GitHub Copilot 的 Rubber Duck agent 会用第二个模型审查计划、代码和测试。
GitHub Blog 介绍了 GitHub Copilot app 中用 canvases 构建自定义工作流的方法。用户可在智能体会话中输入 /create-canvas,并用自然语言说明工作流、界面操作和智能体可执行动作,生成共享界面;canvas 可作为扩展保存、复用或与团队共享,也可从 Awesome Copilot 安装现成 canvas extensions 后再定制。
GitHub Blog 介绍 GitHub Copilot app 的 canvas,认为许多 AI 任务不应只依赖 chat 作为交互界面。canvas 是运行在 GitHub Copilot app 内的小型全栈应用,可与 GitHub Copilot agent 双向通信,也能调用第三方 API 或在本机执行代码。
推荐理由:文章用 GitHub Copilot canvases 示例说明,任务型自定义 UI 可减少把 Agent 当工具本身的 token 消耗。
GitHub Security Lab 介绍了 Fuzzing Taskflow,这是一个面向 C/C++ 项目的自主 fuzzing 流水线,基于 GitHub Security Lab Taskflow Agent 构建。
推荐理由:文章拆解了 LLM agent 接管 fuzzing 覆盖改进和崩溃分诊的流程,对安全自动化工作流有参考价值。
GitHub Blog 介绍了 GitHub Copilot app 为超大 pull request 重建视图的工程方案。团队用一个包含 2,200 个文件、超过 100 万行变更、400 多条行内评论的开源 pull request 压测,通过代码行虚拟化、评论动态高度测量、滚动锚定、增量数据管线和自动化测量循环,让大 diff 与多线程评论保持可滚动和可阅读。
推荐理由:原文拆解了大规模 diff 与评论渲染的工程取舍,可迁移到其他长列表和动态内容界面。
Google Research 推出 MilleMiglia,一个用 C++ 编写的中程物流实例生成器,用于创建真实、隐私保护的中程配送问题 benchmark。中程物流连接区域或洲际配送中心,涉及多车辆接力、时间窗口和转运同步,长期缺少公开高质量数据。其源代码和文档已在 GitHub 提供。
GitHub Podcast 讨论多项 AI 开发热点:AI 生成代码仍需审查,RAG 没有消亡,Skills 也没有取代 MCP。文章认为开发者的关键能力是判断风险、解释 AI 使用方式,并把 agents、Skills、MCP 与 RAG 作为可组合的工作流组件。
Berkeley AI Research 提出一种基于互信息直接评估和优化成像系统的框架,只用含噪测量和噪声模型衡量测量区分物体的能力。其 NeurIPS 2025 论文显示,该信息指标可在彩色摄影、射电天文学、无透镜成像和显微成像中预测系统表现,优化设计可匹配 SOTA 端到端方法,同时需要更少内存和计算且无需任务特定解码器。