哈佛、MIT 联合 OpenAI 与 DeepMind 推出 MatrAIx:83 亿 AI 智能体模拟全球人类行为
一个由哈佛大学与麻省理工学院牵头、OpenAI 和谷歌 DeepMind 等机构参与的研究团队本月发布了 MatrAIx 系统。该系统能够生成多达 83 亿个 AI 智能体,用于模拟全球人类的日常行为。
MatrAIx 采用 1290 个维度对具有不同背景和生活方式的人群进行建模。这些"AI 人"可以像真人一样填写问卷、与客服对话、浏览网页以及操作应用程序。据研究团队公布,这些智能体的整体行为一致性达到 91.5%。
场景不同,一致性表现浮动
研究团队通过 400 次对照测试验证了这一指标,测试覆盖 10 个行为属性和全部四类环境。结果显示,366 次测试中智能体表现出正确特质或成功抑制了无关特质,准确率为 91.5%。
不过,这一一致性会随应用场景发生变化:在问卷和聊天场景中,准确率上升至 92% 至 96%;而在操作应用程序的测试中,则下降至 83%。
数据与代码已开源,实际替代价值仍待验证
目前,经过确定性和质量筛选的百万"人格核心集"已上架 Hugging Face 平台,供研究者使用。同时,相关 8B 人格模型的代码也在 GitHub 上开源。
研究团队认为,这套超大规模仿真系统有望成为社会科学研究和产品测试的全新实验平台。但"AI 人"在多大程度上能够替代真实人类样本,仍需更多交叉验证。