DeepSeek 开源昇腾基础组件,与昇腾共建 AI 芯片软件生态
9月30日,DeepSeek 正式开源面向昇腾算力平台的基础设施组件,涵盖 TileLang 高级语言编译工具、高性能计算库与分布式通信库,与此前面向 GPU 平台开源的组件一一对应。
9月30日,DeepSeek 正式开源面向昇腾算力平台的基础设施组件,涵盖 TileLang 高级语言编译工具、高性能计算库与分布式通信库,与此前面向 GPU 平台开源的组件一一对应。
京东、小米、阿里、美团等科技巨头正集体切入物理AI赛道。京东启动"物理AI加速计划"并冲刺六项"全球第一",小米计划未来三年投入至少600亿元用于大模型、具身智能和AI应用,蚂蚁灵波已开源多款具身大模型,美团则发布总参数1.6万亿的LongCat-2.0并推进无人机配送航网。
Naive AI 发布开源模型 Naive-N0.5-Flash,以开源基座为起点,重构注意力架构为每 5 层 SWA 搭配 1 层 DSA 的混合结构,全程保持 1M 上下文,分三阶段累计训练 3.25T tokens。
推荐理由:文章给出 Naive-N0.5-Flash 的架构改造、训练阶段与评测成绩,可据此判断中训练与后训练路线的落地方式。
苹果推送 iOS 27.0.1,修复 iPhone 18 Pro 面容 ID 验证时卡死重启的问题。AMD 宣布以约 82 亿美元股票收购李飞飞创办的 World Labs,李飞飞将出任 AMD 执行副总裁兼首席科学家。Anthropic 发布 Claude Sonnet 5.5,称输出速度比 Sonnet 5 快逾 30%,Terminal-Bench 4.0 得分 70.6%。
AMD 宣布以约 82 亿美元全股票交易收购李飞飞联合创办的 World Labs,李飞飞将出任 AMD 执行副总裁兼首席科学家,向苏姿丰汇报。Manus 发布 2.0 版本,升级自研 Cascade Agent 框架,任务 Token 消耗减少 23.2%、完成时间缩短 28.2%、运行成本降低 32%,并推出个人 AI 助手 Cue,目前处于凭邀请码免费使用的抢先体验阶段。
DeepSeek 通过官方公众号宣布开源面向华为昇腾算力平台的基础设施组件,涵盖 TileLang 高级语言编译工具、计算库和分布式通信库,与面向英伟达平台的开源组件一一对应。
OpenAI 在 DevDay 2026 公布 20 多项更新,推出由 GPT-6 Astra 驱动的常驻智能体 dots,以及强化智能体编程与计算机使用能力的 GPT-6.1 Sol。
OpenAI 在开发者大会发布 25 项更新,推出由 GPT-6 Astra 驱动的个人 AI 智能体 dots,自带云端运行环境、可连接数千款应用并持续自主完成任务,Pro 及企业套餐用户可用。
中国人民银行9月29日宣布调整四项货币政策工具:下调抵押补充贷款(PSL)利率0.25个百分点至1.5%,将“六张网”建设纳入PSL支持领域,科技创新和技术改造再贷款额度增加2000亿元至1.4万亿元、支持比例从60%提至100%,支农支小再贷款额度增加5000亿元至4.85万亿元。
DeepSeek 正式推出 DeepSeek Harness 桌面端,官网已提供 macOS 和 Windows 开箱即用安装包,登录即送 6 元赠金,有效期到 10 月 6 日。
推荐理由:作者实测桌面版 Harness 的文档处理、定时任务与自写插件流程,可据此判断 Agent 产品从终端走向日常办公的形态变化。
DeepSeek Harness 推出官方桌面版,提供 GUI 界面,内置智能体团队、语音输入、终端、Agent 循环、Subagent 和网页搜索 6 个官方插件,并设标准、PTC、极简、创造四种工作模式。
网易云音乐鸿蒙版正式上线,支持歌单、收藏与播放历史跨手机、折叠屏和平板互通,并补上本地音乐导入与深色模式。任正非重申「华为不造车」,将继续帮助东风造好车。腾讯 QClaw 将于 12 月 24 日停运,用户可迁移至 WorkBuddy。
DeepSeek 正式发布 DeepSeek-V4.1-Flash,这是其新架构家族中最小、原生支持多模态视觉理解的模型,官方称新架构面向更高能力上限、更快推理和更高吞吐。
推荐理由:官方给出新架构家族最小模型的完整基准与 API 变更,可据此判断多模态调用与旧模型迁移成本。
DeepSeek 在 API 平台上线实验性多模态视觉理解模型 DeepSeek-V4-Flash-Vision-Exp,可通过设置 model='deepseek-v4-flash-vision-exp' 调用。
推荐理由:官方给出实验版视觉模型的调用名与多项基准分数,可对照纯文本版本判断多模态智能体能力差距。
DeepSeek-V4-Pro 正式版已在 APP、Web 和 API 上线,API 调用方式不变,模型名设为 deepseek-v4-pro 即可使用。官方称其 Agent 能力大幅增强,并给出 HLE(无工具/有工具)42.7/60.0、Terminal Bench 2.1 87.9、DeepSWE 62.7 等基准成绩。
推荐理由:官方给出 V4-Pro 的 Agent 基准成绩、Responses API 适配与三档思考强度,可据此判断升级后的实际用法。
DeepSeek 官方宣布 DeepSeek-V4-Flash API 进入公测,调用方式不变,只需将模型名设为 deepseek-v4-flash。
推荐理由:官方给出 V4-Flash 在多项 Agent 与编码基准上的成绩,可据此判断其智能体能力定位。
DeepSeek API 现已支持 V4-Pro 和 V4-Flash,可通过 OpenAI ChatCompletions 接口和 Anthropic 接口调用,base_url 不变,model 参数设为 deepseek-v4-pro 或 deepseek-v4-flash。
推荐理由:DeepSeek API 上线 V4-Pro 与 V4-Flash,并给出旧模型名的三个月过渡安排,便于开发者规划迁移。