跳到正文

Agent 智能体

让模型自主规划、调用工具、完成多步任务的技术方向——从 Claude Code、Manus 到各家 Agent 框架与评测基准的全部动态。

最新精选

第 41–43 条 · 共 43 条
7月7日周二
  1. Hugging Face 博客62

    LeRobot v0.6.0 发布:世界模型策略、奖励模型 API 与六个仿真基准

    Hugging Face 发布 LeRobot v0.6.0,围绕机器人学习闭环引入世界模型策略(VLA-JEPA、FastWAM、LingBot-VA)、新一批 VLA(GR00T N1.7、MolmoAct2、EO-1、EVO1、Multitask DiT)以及统一奖励模型 API(Robometer、TOPReward)。

    推荐理由:原文完整列出世界模型策略、奖励模型 API 与六个仿真基准,读者可据此判断机器人学习闭环的可用工具链。

9月22日周一
  1. DeepSeek 更新日志62

    DeepSeek-V3.1-Terminus 发布,deepseek-chat 与 deepseek-reasoner 同步升级

    DeepSeek 将 deepseek-chat 和 deepseek-reasoner 升级至 DeepSeek-V3.1-Terminus,前者对应非思考模式,后者对应思考模式。此次更新在保持原有能力的同时修复了用户反馈的问题,包括减少中英文混用和偶发异常字符,并进一步优化 Code Agent 与 Search Agent 的表现。

    推荐理由:官方更新日志说明了 deepseek-chat 与 deepseek-reasoner 的对应模式,以及语言一致性和 Agent 能力的具体修复方向。

8月21日周四