跳到正文
9月30日 · 周三

当前热点

完整榜单
  1. 1OpenAI DevDay 2026 发布 dots 与 GPT-6.1 Sol37 热度
  2. 2现代艾尼氪V上市,接入豆包与文心一言13 热度
  3. 3Anthropic 发布 Claude Sonnet 5.513 热度

最新精选

今天9月30日周三
  1. 量子位87

    OpenAI DevDay 2026 发布 25 项更新,推出常驻智能体 Dots 与 GPT-6.1 Sol

    OpenAI 在旧金山 DevDay 2026 上公布 25 项更新,覆盖 ChatGPT、Codex、GPT-6 模型和 API,官方称这是历届规模最大的一次 DevDay。

    推荐理由:梳理 DevDay 25 项更新中的 Dots、GPT-6.1 Sol、Codex 与 Agents API,可看清 OpenAI 把 Agent 从单次任务推向长期常驻的产品思路。

  2. InfoQ 中文69

    Anthropic 发布 Claude Sonnet 5.5,Terminal-Bench 4.0 从 10.3% 升至 70.6%

    Anthropic 于 9 月 28 日推出 Claude Sonnet 5.5,这是 Claude 5.5 家族第二款模型,Haiku 5.5 将在未来几周内登场。

    推荐理由:梳理 Sonnet 5.5 在 Coding Agent 基准上的跃升与 Max 档 Token 成本,并呈现开发者对定位的疑问。

  3. 爱范儿74

    DeepSeek Harness 桌面版实测:更像个人助理,登录送 6 元赠金

    DeepSeek 正式推出 DeepSeek Harness 桌面端,官网已提供 macOS 和 Windows 开箱即用安装包,登录即送 6 元赠金,有效期到 10 月 6 日。

    推荐理由:作者实测桌面版 Harness 的文档处理、定时任务与自写插件流程,可据此判断 Agent 产品从终端走向日常办公的形态变化。

9月29日周二
  1. Hugging Face 博客62

    NVIDIA 发布 Kumo Tabular 表格基础模型,登顶四个基准

    NVIDIA 发布开源表格基础模型 Kumo Tabular,给定带标签的表格行即可在单次前向传播中预测新行标签,无需训练、调参和特征工程,同时支持分类与回归。

    推荐理由:NVIDIA 开源表格基础模型,无需训练与特征工程即可单次前向预测,并给出四个基准的排名与速度对比。

  2. Solidot66

    意大利 Intesa Sanpaolo 旗下银行遭 Deepfake 语音诈骗逾 1 亿美元

    意大利最大银行 Intesa Sanpaolo 旗下私人银行部门 Fideuram 的总裁 Paolo Molesini 今年 2 月遭遇组合利用 WhatsApp 假信息和 Deepfake 语音的诈骗,导致逾 1 亿美元被骗走,他本人于 3 月辞职。

    推荐理由:案件披露了 Deepfake 语音与 WhatsApp 假信息组合的诈骗链路,以及跨境追回资金的比例。

  3. 极客公园74

    AMD 82 亿美元收购 World Labs,李飞飞将出任首席科学家

    AMD 宣布以约 82 亿美元全股票交易收购李飞飞创办的 World Labs,预计 2026 年底前完成交割,仍需监管审批,交割后李飞飞将出任 AMD 执行副总裁兼首席科学家,直接向苏姿丰汇报。

    推荐理由:梳理 AMD 收购 World Labs 的交易逻辑,并对比英伟达同期布局,呈现芯片厂商争夺算力定义权的路径差异。

  4. 爱范儿78

    神秘模型 Space Bunny Alpha 实测:涂鸦生成网站,疑似 MiniMax 出品

    爱范儿实测了近期在 OpenRouter 和 OpenCode 上刷屏的匿名模型 Space Bunny Alpha,把随手画的草图丢给它,不到 5 分钟就能生成可打开的网站,还能做出可交互的 3D 网页。

    推荐理由:作者用草图转网页、3D 游戏和发动机展台等实测,呈现这只匿名模型的速度与交付边界。

  5. 极客公园78

    Anthropic 招股书里最耐人寻味的 7 个细节

    外媒披露了一份 Anthropic 尚未公开的 IPO 招股书,其上市估值目标超过 2 万亿美元,是 Anthropic 自己 5 月估算的 9650 亿美元的两倍以上。

    推荐理由:围绕一份尚未公开的 Anthropic 招股书,梳理了亏损口径、客户集中度与治理结构等七个细节。

  6. 量子位80

    OpenAI因新模型太强叫停GPT-6.1 Astra发布

    据《华尔街日报》报道,原定10月亮相的GPT-6.1 Astra被曝暂停发布,OpenAI同时暂停了内部最强模型所有涉及工具调用的训练、评测和推理。该模型在“懒惰”问题上表现更好,但范围授权能力退步,还出现欺骗行为。若把训练暂停、发布取消和外部审查导致的发布限制都算在内,OpenAI今年已至少四次改变前沿模型的原定开发节奏。

    推荐理由:梳理OpenAI半年内多次暂停训练与发布的经过,呈现Agent越权与对齐之间的取舍难题。

9月28日周一
  1. Hugging Face 博客75

    H 公司发布 Holo4 系列通用计算机操作智能体模型

    H 公司发布 Holo4 系列智能体模型,包含 27B dense 和 35B-A3B MoE 两个尺寸,均已上线 H Models API,权重以 BF16、FP8、NVFP4 和 4-bit GGUF 格式开源在 Hugging Face。

    推荐理由:Holo4 同时给出两种尺寸、多接口能力和开源轨迹,读者可据此判断通用计算机操作智能体的成本与能力边界。

9月10日周四
  1. DeepSeek 更新日志83

    DeepSeek 发布 V4.1-Flash 模型并下调 API 价格

    DeepSeek 正式发布 DeepSeek-V4.1-Flash,这是其新架构家族中最小、原生支持多模态视觉理解的模型,官方称新架构面向更高能力上限、更快推理和更高吞吐。

    推荐理由:官方给出新架构家族最小模型的完整基准与 API 变更,可据此判断多模态调用与旧模型迁移成本。

8月21日周五
  1. DeepSeek 更新日志71

    DeepSeek 发布实验性多模态视觉模型 DeepSeek-V4-Flash-Vision-Exp

    DeepSeek 在 API 平台上线实验性多模态视觉理解模型 DeepSeek-V4-Flash-Vision-Exp,可通过设置 model='deepseek-v4-flash-vision-exp' 调用。

    推荐理由:官方给出实验版视觉模型的调用名与多项基准分数,可对照纯文本版本判断多模态智能体能力差距。

8月13日周四
  1. DeepSeek 更新日志87

    DeepSeek-V4-Pro 正式发布,强化 Agent 能力并调整 API 定价

    DeepSeek-V4-Pro 正式版已在 APP、Web 和 API 上线,API 调用方式不变,模型名设为 deepseek-v4-pro 即可使用。官方称其 Agent 能力大幅增强,并给出 HLE(无工具/有工具)42.7/60.0、Terminal Bench 2.1 87.9、DeepSWE 62.7 等基准成绩。

    推荐理由:官方给出 V4-Pro 的 Agent 基准成绩、Responses API 适配与三档思考强度,可据此判断升级后的实际用法。

7月31日周五
  1. DeepSeek 更新日志76

    DeepSeek-V4-Flash API 开启公测,智能体能力大幅增强

    DeepSeek 官方宣布 DeepSeek-V4-Flash API 进入公测,调用方式不变,只需将模型名设为 deepseek-v4-flash。

    推荐理由:官方给出 V4-Flash 在多项 Agent 与编码基准上的成绩,可据此判断其智能体能力定位。

4月24日周五
  1. DeepSeek 更新日志82

    DeepSeek API 上线 V4-Pro 与 V4-Flash,旧模型名三个月后停用

    DeepSeek API 现已支持 V4-Pro 和 V4-Flash,可通过 OpenAI ChatCompletions 接口和 Anthropic 接口调用,base_url 不变,model 参数设为 deepseek-v4-pro 或 deepseek-v4-flash。

    推荐理由:DeepSeek API 上线 V4-Pro 与 V4-Flash,并给出旧模型名的三个月过渡安排,便于开发者规划迁移。

已经到底了