哈佛麻省理工联合团队发布MatrAIx系统 可生成83亿个AI智能体模拟全球人类行为

该系统能够生成83亿个AI智能体,用于模拟全球人类行为,测试结果一致性高达91.5%。

由哈佛大学和麻省理工学院牵头,OpenAI和谷歌DeepMind等机构参与的联合团队,于本月正式推出MatrAIx系统。该系统能够生成83亿个AI智能体,用于模拟全球人类行为,为社会科学研究、市场调研和产品测试等领域提供了一种全新的规模化模拟工具。

MatrAIx系统的核心创新在于其采用1,290个维度对不同背景和生活方式的人群进行建模。这意味着每个AI智能体并非简单的数据复制,而是基于多维度特征生成的具有个体差异性的虚拟人格。这些智能体能够像真人一样完成填写问卷、与客服聊天、浏览网页、操作App等各类行为任务,从而在受控环境中复现真实用户的行为模式。

团队通过一项包含400次测试的对照研究对系统进行了验证,测试覆盖10个行为属性和全部四个环境。结果显示,智能体在400次测试中的366次表现出了正确的特质,或在不相关时正确地抑制了该特质,即在91.5%的情况下表现正确。这一数据会随环境变化而波动:在问卷和聊天场景中,一致性升至92%到96%之间,而在操控App测试中的准确度则降至83%。

这一研究成果对于企业服务领域具有潜在的应用价值。在传统用户研究中,招募大量真实用户进行行为测试往往成本高昂且周期漫长,而MatrAIx系统提供的规模化模拟能力,有望帮助企业更高效地完成产品可用性测试、用户画像分析以及市场策略预演。尤其是对于SaaS企业而言,理解不同行业、不同规模客户的使用习惯至关重要,AI智能体模拟可以补充传统调研方法,提供更快速、更全面的行为数据洞察。

值得注意的是,MatrAIx项目并非简单的学术实验。其背后参与方包括OpenAI和谷歌DeepMind,这两家机构在AI基础模型和智能体研究方面拥有深厚积累。这一合作格局表明,该项目可能涉及前沿大模型技术的应用,例如利用语言模型驱动智能体的对话和决策能力,而不仅仅是基于规则的行为模拟。

目前,经确定性、质量过滤的百万人格核心集(coreset)已在Hugging Face公开发布,供全球研究机构使用。同时,项目的完整代码也已开源,地址为https://github.com/MatrAIx-ai/MatrAIx-Persona-8B。这一开放策略有助于学术界和工业界在统一基准上进一步验证和扩展该系统的能力。

从行业影响来看,MatrAIx的出现标志着AI模拟技术从单一场景走向全局性社会模拟。过去,AI智能体多用于游戏NPC或特定客服场景,而此次发布的系统试图覆盖人类行为的广泛维度,包括态度、偏好、决策逻辑等。这为社会科学定量研究提供了一种新的实验范式,也为企业进行跨文化、跨区域的市场策略模拟创造了条件。

当然,该技术仍处于早期阶段。83%到96%的准确率虽然可观,但在关键决策场景中仍需谨慎对待模拟结果。此外,如何确保模拟数据不引入偏见、如何保护真实人群的隐私模型,也是后续研究需要持续关注的问题。可以预见,随着开源生态的完善和更多验证性研究的开展,AI社会模拟技术有望在用户研究、产品设计、政策评估等领域逐步落地,成为企业数字化决策链条中的一个重要环节。

该文观点仅代表作者本人,企服科学平台仅提供信息存储空间服务。

(0)
欧盟AI法案强制水印条款生效 主流大模型厂商采用统计水印技术
上一篇 1小时前
Cursor发布代码托管平台Origin,GitHub单点风险引发行业关注
下一篇 1小时前

相关推荐

发表回复

登录后才能评论
分享本页
返回顶部