新智元· 新智元·· 20 小时前精选AI 评分56
麻省理工 HugAgent 论文入选 EMNLP 2026 Main Oral:靠访谈让 AI 模拟真人能走多远
EMNLP'26 Oral | 麻省理工:靠访谈让AI模拟真人,这条路能走多远?
AI 导读
麻省理工等机构提出 HugAgent,让大模型基于真实参与者访谈预测其在全民医疗、公共监控、住房增密等新情境下的回答,覆盖 54 名参与者、1,742 个评测项,测试 GPT、Claude、Gemini、DeepSeek、Llama、Qwen 等模型,论文入选 EMNLP 2026 Main Oral。
推荐理由
通过对比两类任务的准确率与访谈长度实验,说明复述已知观点和外推新情境是两回事,可迁移至数字分身的评估思路。
来源:新智元 · mp.weixin.qq.com