跳到正文
今天10月8日周四7 条
  1. The Decoder70

    Google 发布 EmbeddingGemma 2 多模态嵌入模型

    Google 发布开源模型 EmbeddingGemma 2,可将文本、图像、视频、音频和代码转换为数值向量,用于相似内容查找和比较。该模型有 740 million 参数,Google 称其在多模态嵌入基准上超过规模最高达两倍的竞品,并在 Massive Text Embedding Benchmark (Code) 上得分 78.68,高于前代的 68.76。

  2. TechCrunch · AI68

    Google 推出面向所有人的 SynthID 网站,用于识别 AI 生成媒体

    Google 推出新的 SynthID 网站,任何人都可验证图片、视频或音频是否由 AI 生成。该工具此前在 Google I/O last year 向部分记者、媒体从业者和研究人员开放测试,现在支持多种图片、视频和音频格式;Nano Banana、Veo、Lyria、Gemini、Flow、ProducerAI 和 Vids 生成的媒体都会使用 SynthID 水印。

  3. 钛媒体57

    90后负责人接管国产大模型关键岗位

    Tech星球梳理称,刘大一恒、陈宇森、罗福莉、周畅、姚顺雨等90后正在接手国产大模型关键岗位,分别覆盖Qwen、千问办公、MiMo、字节多模态和腾讯大语言模型及AI Infra。文章列举了他们在开源模型、多模态生成、AI Agent、基础模型和办公智能体商业化中的履历与近期成绩。作者认为,职位交接已经发生,但这些团队仍要面对能力上限、成本约束、商业化落地、组织整合和持续追赶等考验。

  4. TechCrunch · AI85

    OpenAI 随 GPT-6 推出 ChatGPT 新界面 Intelligent UI

    OpenAI 将随 GPT-6 推出 ChatGPT 新界面 Intelligent UI,在对话中加入更多可交互视觉元素。该界面可生成可点击按钮、定制计算器、交互式图表、可编辑图形等内容,用于食谱、旅行规划、学习抽象概念等场景。Intelligent UI 将面向 Pro、Plus、Business 和 Enterprise 用户全球推出,免费和低价 Go 层级用户将在 Thursday 获得。

    同一新闻,精选展示《OpenAI 在 ChatGPT 全球推出 GPT-6 和 Intelligent UI》

10月7日周三
  1. Google DeepMind75

    Google DeepMind 发布 EmbeddingGemma 2 开放轻量多模态嵌入模型

    Google DeepMind 发布 EmbeddingGemma 2,将文本、代码、图像、视频和音频映射到统一嵌入空间。该模型基于 Gemma 4 架构,采用 Apache 2.0 许可,拥有 740 million 参数,支持 8K token 上下文窗口,并可通过 MRL 将输出向量从 768 维截断到 512、256 或 128 维。

    推荐理由:原文给出参数规模、上下文窗口和端侧内存数据,可用于评估多模态嵌入在本地检索场景中的适配性。

10月6日周二
  1. Mistral AI84

    Mistral AI 发布 Mistral Large 4 公共预览版

    Mistral AI 发布 Mistral Large 4 公共预览版,这是一个 1 trillion-parameter 原生多模态模型,拥有 52 billion active parameters,可在 Mistral Studio 试用 preview API,并计划在本月底发布权重。

    推荐理由:原文披露了参数规模、开放权重计划和多项基准结果,可用于比较欧洲开放权重模型的能力定位。

10月1日周四
  1. Google DeepMind80

    Google DeepMind 发布 Gemini 4 Argon 前沿模型

    Google DeepMind 宣布 Gemini 4 Argon,这一前沿模型将先通过 Fairwind Program 向一组受信任的网络防御者推出,并逐步扩大访问。

    推荐理由:原文给出发布节奏、价格和多项基准结果,可用于了解 Google 对高能力模型分阶段开放的安排。

9月29日周二
  1. Microsoft Research23

    Microsoft Research Asia – Singapore 一周年:推进 AI 研究、合作与人才培养

    Microsoft Research Asia – Singapore 开设一年来,已扩大团队、深化本地合作,并围绕前沿 AI 的现实应用推进研究。其实验室聚焦下一代 AI 模型与智能体系统、面向行业的 AI、AI-native 研究实践、生态与人才发展,已在医疗、金融、教育和技术等领域开展合作。Microsoft 称该实验室连接其前沿 AI 研究与新加坡高校、政府和产业生态。

9月25日周五
9月18日周五
9月16日周三
7月1日周三
  1. Berkeley AI Research21

    2026 BAIR 博士毕业生展示

    BAIR 庆祝 2026 届 Ph.D. 毕业生,他们的研究覆盖机器人与具身智能、LLM 与推理、计算机视觉、生成建模、AI 安全、人机交互、AI for science and healthcare 等领域。毕业生将前往高校任教或从事博士后研究、加入产业研究实验室,或创办自己的初创公司。

1月10日周六
  1. Berkeley AI Research38

    基于信息驱动的成像系统设计

    Berkeley AI Research 提出一种基于互信息直接评估和优化成像系统的框架,只用含噪测量和噪声模型衡量测量区分物体的能力。其 NeurIPS 2025 论文显示,该信息指标可在彩色摄影、射电天文学、无透镜成像和显微成像中预测系统表现,优化设计可匹配 SOTA 端到端方法,同时需要更少内存和计算且无需任务特定解码器。