技术进展

MatrAIx系统模拟83亿个AI人

Heooo 08月18日17时33分 24 阅读

「哈佛大学与麻省理工学院联合OpenAI、谷歌DeepMind等机构推出MatrAIx系统,可生成83亿个AI智能体模拟全球人类行为。该系统以1290个维度建模,行为一致性达91.5%,相关人格核心集已开源,被视为社科与产品研究的新试验场。」

哈佛大学与麻省理工学院牵头,联合OpenAI、谷歌DeepMind等顶尖机构,近日推出了一款名为MatrAIx的系统。该系统能够生成多达83亿个AI智能体,用于模拟全球人类行为,这一规模在同类研究中尚属首次。

MatrAIx系统通过1290个维度对各类背景与生活方式的人群进行精细建模,生成的“AI人”可以像真实用户一样填写问卷、与客服对话、浏览网页以及操作App。研究团队表示,这些智能体并非简单的规则程序,而是具备行为一致性的复杂模型,能够在不同场景下表现出符合其设定人格的反应。

在验证环节,团队开展了400次对照测试,覆盖10个行为属性和全部四类环境。结果显示,共有366次智能体表现出正确特质或正确抑制了无关特质,整体行为一致性达到91.5%。不过,一致性会随环境变化而波动:在问卷与聊天场景中,一致性升至92%至96%;而在操控App的测试中,一致性下降到83%。这表明场景复杂度对智能体行为模拟精度有显著影响。

目前,经过确定性与质量过滤的百万级“人格核心集”已上架Hugging Face供研究使用,相关8B人格模型代码也在GitHub上开源。这一开源举措为全球科研人员提供了可复现、可扩展的研究基础。

MatrAIx系统被视为社会科学研究与产品测试的全新试验场。传统上,大规模用户行为研究依赖真实受试者,成本高且周期长,而AI智能体可以快速生成海量行为数据,帮助研究者探索不同人群的反应模式。然而,团队也提醒,“AI人”能在多大程度上替代真实人类样本,仍需更多交叉验证。行为一致性虽然已达到较高水平,但并不能保证在所有场景下完全等同于真实人类。

此项技术进展为AI仿真应用开辟了新方向,未来有望在心理测试、用户体验评估、市场研究等领域发挥重要作用,但其局限性也需要持续关注与改进。

# AI智能体 # 行为仿真 # 开源模型

来源:Heooo AI工具导航