AI 日报 · 2026 年 10 月 8 日 · 星期四
MYHOT
OpenAI 全球上线 GPT-6,ChatGPT 引入 Intelligent UI
OpenAI 宣布 GPT-6 正在 ChatGPT 中面向全球上线,并同步引入 Intelligent UI。官方称新版本响应更快,提供可视化内容与可直接探索和使用的交互体验。
模型发布/更新
Liquid AI 发布 d1-3B 与 d1-omni-600M 端侧决策模型
Liquid AI 开源 d1 决策模型家族的两个模型 d1-3B 和 d1-omni-600M(实验性),二者不生成 token,而是在单次前向传播中给出答案。
产品发布/更新
Claude Haiku 5.5 上线 AWS Bedrock 与 Claude Platform
AWS 宣布 Claude Haiku 5.5 在 Amazon Bedrock 和 Claude Platform on AWS 上可用。
- Anthropic 发布 Claude Haiku 5.5,价格最高下调 90%The Decoder
NVIDIA 与 Microsoft 发布 RTX Spark 及面向智能体的 Windows 更新
在旧金山 Microsoft 活动上,NVIDIA 与 Microsoft 宣布为 Windows PC 上的 AI 智能体共同设计软硬件,并推出 RTX Spark。
微软研究院开源 Agent Lightning v1.0:约 3500 行的轻量智能体 RL 框架
微软研究院开源 Agent Lightning v1.0,一个约 3500 行代码的轻量智能体强化学习框架,围绕 Harnessed Agentic RL 范式重建,让部署时使用的同一套 agent harness 直接参与训练,无需在训练框架内重新实现智能体。
GitHub 推出基于 ModernBERT 的通用密钥检测模型
GitHub 发布基于 ModernBERT 微调的通用密钥检测分类器,用周围代码上下文识别无固定格式的密钥,可在 2 毫秒内评估一批候选密钥,据称能把可拦截的密钥数量提升一倍以上。
行业动态
OpenAI 发布内部模型产出的 722 篇数学论文,称解决 500 个公开难题中的 90 个
OpenAI 在一个公开 GitHub 仓库中发布了内部前沿模型产出的数学成果,称这批 722 篇手稿分为 372 个相关结果族,来自约 4000 个研究问题的评估,平均每个结果消耗约三小时 ChatGPT Pro 的思考算力,模型本身尚未发布。
Common Sense Media 将 ChatGPT 青少年版评为不可接受风险,家长警报在自杀对话中未触发
Common Sense Media 青年 AI 安全研究所用 4000 多条测试提示评估 ChatGPT 青少年版,将其评为对未成年人不可接受风险,并呼吁在独立测试确认安全前禁止青少年使用。
论文研究
Google Research 三个月实验:AI 辅助提升专利撰写产出,但初级律师无辅助判断力未同步提升
Google Research 在 NBER 发布三个月实地实验,将 133 名专利律师随机分为两组,一组提前使用当时未发布的 Google Labs AI 专利撰写工具(现属 Gemini Notebook)。
Nemotron 微调后在 IOI 2026 与 IMO 2026 双双达到金牌水平
英伟达团队基于 Nemotron 3 通过 SFT、RL 和生成-验证-精炼推理流程,在 IOI 2026 和 IMO 2026 双双达到金牌水平。IOI 2026 中 Nemotron-3-Ultra-CC 得 535.4/600,高于 361.12 的金牌线;IMO 2026 系统得 30/42,高于 29 的官方金牌线。