跳到正文
原文
量子位· henry·· 6 小时前精选AI 评分71

何恺明团队发布多模态 Harness 框架 VISTA

何恺明团队发布多模态Harness框架

AI 导读

何恺明团队在论文《VISTA: A Visual Harness for Reasoning in an Interactive World》中提出视觉原生 Harness 框架 VISTA,让现有多模态模型直接观察环境、保存原始画面,并在推理时随时回看、放大和检查细节,无需从头训练。

推荐理由

何恺明团队提出视觉原生 Harness,读者可了解不重训模型、靠回看原始画面提升多模态推理的思路。

来源:量子位 · qbitai.com