阿里 Qwen-Audio-3.1-TTS 登顶 Artificial Analysis 语音榜
9 月 28 日,阿里巴巴的语音大模型 Qwen-Audio-3.1-TTS 在 Artificial Analysis 的语音排行榜 Controlled Voice Arena 上以 1177 的 Elo 评分位列全球第一。
9 月 28 日,阿里巴巴的语音大模型 Qwen-Audio-3.1-TTS 在 Artificial Analysis 的语音排行榜 Controlled Voice Arena 上以 1177 的 Elo 评分位列全球第一。
可灵发布Kling 4.0大版本更新,主打真实、可控、专业,将于10月正式上线,同时推出Kling 4.0 Flash并于9月28日开放小范围体验。Kling 4.0支持10-bit HDR与4K或1080P输出、单次原生生成最长30秒、最多15项参考素材(10张图片、5段视频、7个主体及3个视频主体)以及9种语言和多种口音方言的口型匹配。
推荐理由:可灵4.0的实测展示了10-bit HDR、多关键帧与多语言口型等具体能力,读者可据此判断国产视频模型在专业流程中的位置。
OpenAI 在 9 月 30 日凌晨开发者活动日推出 GPT-6.1 Sol 模型,性能接近 Astra,费用仅为 Astra 的五分之一,官方称其为同等性能下性价比最高的模型。
DeepSeek 通过官方公众号宣布开源面向华为昇腾算力平台的基础设施组件,涵盖 TileLang 高级语言编译工具、计算库和分布式通信库,与面向英伟达平台的开源组件一一对应。
Anthropic 于 9 月 28 日推出 Claude Sonnet 5.5,这是 Claude 5.5 家族第二款模型,Haiku 5.5 将在未来几周内登场。
推荐理由:梳理 Sonnet 5.5 在 Coding Agent 基准上的跃升与 Max 档 Token 成本,并呈现开发者对定位的疑问。
NVIDIA 发布开源表格基础模型 Kumo Tabular,给定带标签的表格行即可在单次前向传播中预测新行标签,无需训练、调参和特征工程,同时支持分类与回归。
推荐理由:NVIDIA 开源表格基础模型,无需训练与特征工程即可单次前向预测,并给出四个基准的排名与速度对比。
爱范儿实测了近期在 OpenRouter 和 OpenCode 上刷屏的匿名模型 Space Bunny Alpha,把随手画的草图丢给它,不到 5 分钟就能生成可打开的网站,还能做出可交互的 3D 网页。
推荐理由:作者用草图转网页、3D 游戏和发动机展台等实测,呈现这只匿名模型的速度与交付边界。
至知创新研究院IQuest Research发布IQuest-Q1模型,采用decoder-only Transformer主干与稀疏MoE架构,总参数约320B、激活参数约15B。
Anthropic 发布 Claude Sonnet 5.5,输出速度较 Sonnet 5 提升超 30%,单项任务成本最高降低 30%,每百万 token 输入、输出价格仍为 2 美元和 10 美元,Terminal-Bench 4.0 得分 70.6%。
H 公司发布 Holo4 系列智能体模型,包含 27B dense 和 35B-A3B MoE 两个尺寸,均已上线 H Models API,权重以 BF16、FP8、NVFP4 和 4-bit GGUF 格式开源在 Hugging Face。
推荐理由:Holo4 同时给出两种尺寸、多接口能力和开源轨迹,读者可据此判断通用计算机操作智能体的成本与能力边界。
Liquid AI 发布实验性草稿模型 LFM2.5-VL-DSpark,为视觉语言模型 LFM2.5-VL-3B 加入投机解码路径,端侧解码最高提速 3.13x、H100 上最高 2.66x,端到端最高提升 2.62x 和 2.27x。
OpenAI 发布 GPT-6 系列新成员 GPT-6 Sol 和 GPT-6 Luna,两款模型 API 价格相比 GPT-5.6 促销价降低 50%,在 AutomationBench 测试中 Sol 于 xhigh 强度下表现优于 Claude Opus 5,成本仅为后者每任务成本的 9%。
DeepSeek 正式发布 DeepSeek-V4.1-Flash,这是其新架构家族中最小、原生支持多模态视觉理解的模型,官方称新架构面向更高能力上限、更快推理和更高吞吐。
推荐理由:官方给出新架构家族最小模型的完整基准与 API 变更,可据此判断多模态调用与旧模型迁移成本。
DeepSeek 在 API 平台上线实验性多模态视觉理解模型 DeepSeek-V4-Flash-Vision-Exp,可通过设置 model='deepseek-v4-flash-vision-exp' 调用。
推荐理由:官方给出实验版视觉模型的调用名与多项基准分数,可对照纯文本版本判断多模态智能体能力差距。
DeepSeek-V4-Pro 正式版已在 APP、Web 和 API 上线,API 调用方式不变,模型名设为 deepseek-v4-pro 即可使用。官方称其 Agent 能力大幅增强,并给出 HLE(无工具/有工具)42.7/60.0、Terminal Bench 2.1 87.9、DeepSWE 62.7 等基准成绩。
推荐理由:官方给出 V4-Pro 的 Agent 基准成绩、Responses API 适配与三档思考强度,可据此判断升级后的实际用法。
DeepSeek 官方宣布 DeepSeek-V4-Flash API 进入公测,调用方式不变,只需将模型名设为 deepseek-v4-flash。
推荐理由:官方给出 V4-Flash 在多项 Agent 与编码基准上的成绩,可据此判断其智能体能力定位。
DeepSeek API 现已支持 V4-Pro 和 V4-Flash,可通过 OpenAI ChatCompletions 接口和 Anthropic 接口调用,base_url 不变,model 参数设为 deepseek-v4-pro 或 deepseek-v4-flash。
推荐理由:DeepSeek API 上线 V4-Pro 与 V4-Flash,并给出旧模型名的三个月过渡安排,便于开发者规划迁移。