H 公司发布 Holo4 系列通用计算机操作智能体模型
H 公司发布 Holo4 系列智能体模型,包含 27B dense 和 35B-A3B MoE 两个尺寸,均已上线 H Models API,权重以 BF16、FP8、NVFP4 和 4-bit GGUF 格式开源在 Hugging Face。
推荐理由:Holo4 同时给出两种尺寸、多接口能力和开源轨迹,读者可据此判断通用计算机操作智能体的成本与能力边界。
让模型自主规划、调用工具、完成多步任务的技术方向——从 Claude Code、Manus 到各家 Agent 框架与评测基准的全部动态。
H 公司发布 Holo4 系列智能体模型,包含 27B dense 和 35B-A3B MoE 两个尺寸,均已上线 H Models API,权重以 BF16、FP8、NVFP4 和 4-bit GGUF 格式开源在 Hugging Face。
推荐理由:Holo4 同时给出两种尺寸、多接口能力和开源轨迹,读者可据此判断通用计算机操作智能体的成本与能力边界。
Meta 于 9 月 8 日发布个人 AI Agent Muse,上线 13 天累计下载超 250 万次并登顶美国 App Store 免费榜;9 月 21 日 Amazon 以违反使用条款为由弹窗拦截 Muse 访问其商店。
推荐理由:梳理 Amazon 封禁 Meta Muse 与 Shopify 接入的对照,呈现 AI Agent 与平台在流量分配上的结构性冲突。
DeepSeek 在 API 平台上线实验性多模态视觉理解模型 DeepSeek-V4-Flash-Vision-Exp,可通过设置 model='deepseek-v4-flash-vision-exp' 调用。
推荐理由:官方给出实验版视觉模型的调用名与多项基准分数,可对照纯文本版本判断多模态智能体能力差距。
DeepSeek-V4-Pro 正式版已在 APP、Web 和 API 上线,API 调用方式不变,模型名设为 deepseek-v4-pro 即可使用。官方称其 Agent 能力大幅增强,并给出 HLE(无工具/有工具)42.7/60.0、Terminal Bench 2.1 87.9、DeepSWE 62.7 等基准成绩。
推荐理由:官方给出 V4-Pro 的 Agent 基准成绩、Responses API 适配与三档思考强度,可据此判断升级后的实际用法。
DeepSeek 官方宣布 DeepSeek-V4-Flash API 进入公测,调用方式不变,只需将模型名设为 deepseek-v4-flash。
推荐理由:官方给出 V4-Flash 在多项 Agent 与编码基准上的成绩,可据此判断其智能体能力定位。