量子位· henry·· 5 小时前精选AI 评分66
何恺明团队发布多模态视觉Harness框架VISTA论文
何恺明团队发布多模态Harness框架
AI 导读
何恺明团队在论文《VISTA: A Visual Harness for Reasoning in an Interactive World》中提出视觉原生Harness框架VISTA,让现有多模态模型直接观察环境、保存原始画面并在推理时回看放大细节,无需从头训练。
推荐理由
文中给出VISTA在多个基准上的成功率提升数据,可评估视觉记忆框架对现有多模态模型的实际增益。
来源:量子位 · qbitai.com