AI 日报 · 2026 年 10 月 9 日 · 星期五
小易热点
OpenAI 向 ChatGPT 免费用户推送 GPT-6
OpenAI 宣布 GPT-6 开始向 ChatGPT 免费和 Go 用户推送,用 GPT-6 Luna 替换此前的 GPT-5.6 Luna,Plus、Pro 等付费用户则使用 GPT-6 Sol。同日 Anthropic 发布 Claude Haiku 5.5,官方跑分逐项超过 GPT-6 Luna。
模型发布/更新
OpenAI 向 ChatGPT 免费用户推送 GPT-6,聊天框可生成交互界面
OpenAI 宣布 GPT-6 开始向 ChatGPT 免费和 Go 用户推送,用 GPT-6 Luna 替换此前的 GPT-5.6 Luna,Plus、Pro 等付费用户则使用 GPT-6 Sol。
Anthropic 发布 Claude Haiku 5.5,跑分对标 GPT-6 Luna 且价格下调
Anthropic 发布 Claude Haiku 5.5,官方跑分逐项超过 GPT-6 Luna,并超越 DeepSeek V4.1 Flash 和 GLM-5.3-Flash。
Reflection 发布 Beam、Mistral 推出 Large 4,西方开放模型重新提速
美国创业公司 Reflection 发布首款开放权重模型 Beam,一天后 Mistral 推出迄今最大的 Mistral Large 4,两家均以 GLM、Kimi、DeepSeek、Qwen 为主要比较对象。
产品发布/更新
微软与英伟达发布 RTX Spark 与 Surface Laptop Ultra,把「不限量智能」装进 PC
微软在 Windows 与 Surface 特别活动上联合英伟达发布计算平台 RTX Spark 和旗舰笔记本 Surface Laptop Ultra,主打本地运行 AI Agent。
行业动态
Meta AI 助手 Muse 被曝零日漏洞,本地进程可劫持听写流量
安全研究员 Patrick Wardle 披露 Meta 新发布的 Muse macOS 桌面客户端存在尚未修复的零日漏洞,本地非特权进程可覆盖未公开配置项 endo_voyager_dictation_endpoint,将听写流量重定向至攻击者服务器并窃取音频与账户令牌。
论文研究
Nemotron 微调后在 IOI 2026 与 IMO 2026 双双达到金牌水平
英伟达团队从 Nemotron 3 出发,用 SFT、RL 和反馈驱动的推理流程,让模型在 IOI 2026 和 IMO 2026 双双达到金牌水平。IOI 2026 中 Nemotron-3-Ultra-CC 得 535.4/600,超过 361.12 的金牌线和人类最高分 498.27;IMO 2026 系统得 30/42,超过 29 的官方金牌线,六题中四题满分。
技巧与观点
OpenAI 研究员 Noam Brown:1 万个 Agent 解出千禧年难题,多智能体贡献不到 10%
OpenAI 研究员、o1 早期奠基者之一 Noam Brown 在与 Dwarkesh Patel 的对话中表示,用 1 万个智能体、88 小时、1300 亿 token 解决一道千禧年大奖难题,功劳主要来自强大的通用模型,他不会把其中 10% 归给多智能体。