AI 日报 · 2026 年 10 月 8 日 · 星期四
AI FOCUS
本期精选汇编
本期按已审核的精选资料汇编,保留来源链接;AI 综合导读暂未生成。
模型发布/更新
OpenAI 内部模型发布 722 篇数学手稿,称解决 500 个开放问题中的 90 个
OpenAI 在一个公开 GitHub 仓库中发布了内部前沿模型产出的 722 篇数学手稿,分为 372 个相关结果族,来自约 4000 个研究问题的评估,平均每个结果消耗约 3 小时 ChatGPT Pro 思考算力,模型本身未发布。
Claude Haiku 5.5 上线 Amazon Bedrock 与 Claude Platform on AWS
AWS 宣布 Claude Haiku 5.5 在 Amazon Bedrock 和 Claude Platform on AWS 上可用。
Liquid AI 开源 d1-3B 与 d1-omni-600M 端侧决策模型
Liquid AI 发布 d1 决策模型家族的两款开源权重模型 d1-3B 和实验性的 d1-omni-600M,前者在 Decision Index 0.2.1 上以 48.57 分成为 10B 以下最佳决策模型,超过 Decider 35B-A3B 的 47.11。
产品发布/更新
NVIDIA 与 Microsoft 发布 RTX Spark 与 Windows 智能体基础设施
在旧金山 Windows AI and Surface 活动上,NVIDIA 与 Microsoft 宣布为 Windows PC 上的 AI 智能体共同设计软硬件,并公布 RTX Spark 笔记本与紧凑台式机。
微软研究院开源 Agent Lightning v1.0:3500 行代码的轻量智能体 RL 框架
微软研究院开源 Agent Lightning v1.0,一个约 3500 行代码的轻量智能体强化学习框架,提出 Harnessed Agentic RL 范式,让部署时使用的 agent harness 直接参与 RL 训练,无需在训练框架内重新实现 agent。
GLM 5.3 上线 Amazon Bedrock
智谱(Z.ai)的 GLM 5.3 已在 Amazon Bedrock 上线,这是一个 753B 参数的混合专家模型,面向编码和长周期智能体任务。该模型支持跨区域推理、隐式与显式提示词缓存以及 Flex、Priority、Standard 三档服务层级,可通过 OpenAI 兼容 API 或 Bedrock Invoke、Converse API 调用。
GitHub 推出基于 ModernBERT 的密钥检测模型,push 前 2 毫秒内拦截
GitHub 发布与 Microsoft Applied Sciences 联合训练的 ModernBERT 分类器,用代码上下文判断候选密钥,可在 2 毫秒内评估一批候选值,据称能把可拦截的密钥数量提升一倍以上。
论文研究
Nemotron 微调后在 IOI 2026 与 IMO 2026 均达金牌水平
英伟达团队基于 Nemotron 3,通过 SFT、RL 与生成-验证-精炼推理流程,在 IOI 2026 和 IMO 2026 双双达到金牌水平。IOI 2026 中 Nemotron-3-Ultra-CC 得 535.4/600,高于 361.12 的金牌线;IMO 2026 系统得 30/42,高于 29 的官方金牌线,其中六题有四题满分。