当83亿个AI“分身”开始像真人一样填问卷、逛网页、聊客服,社会研究的底层逻辑正在被改写——这次,哈佛和麻省理工把全人类放进了数字实验室。
83亿虚拟化身:一场社科研究的维度跃迁
MatrAIx系统由哈佛大学、麻省理工学院牵头,联合OpenAI、谷歌DeepMind等机构共同打造。它的野心很直白:用83亿个AI智能体“代理”地球上每个人。研究团队用近60万条真实数据叠加40万条AI合成数据,生成了一套覆盖1290种人格标签的数字人类镜像系统——年龄、职业、心理、行为、性格,几乎任何能想象得到的人类标签都被纳入其中。
这套系统的价值不止于“造人”。它同时搭建了问卷、AI聊天、网页、App四类交互测试场景,整合了1000多项任务,覆盖电商、金融、医疗等25个领域。换句话说,研究者不再需要费尽心思招募真实用户去填表、试用产品,而是可以把83亿个“数字公民”扔进模拟环境,观察他们对任何产品、政策或界面的反应——传统调研的成本、速度、样本量三大痛点,被一次性地技术性解决。
91.5%的一致性,是里程碑也是分水岭
团队通过400次对照测试验证了模型表现。在10个行为属性与四个环境的交叉测试中,智能体有366次呈现了正确特质,整体一致性达91.5%。进一步拆解数据会发现一个有意思的落差:问卷与聊天场景的一致性冲到92%到96%,而App操控测试只有83%。
这组数字透露出一个信号:语言模拟正在逼近真人的“社交面具”,但行为模拟仍有明显短板。AI人已经学会了用合适的语言应对问卷和客服,却未必擅长真实世界中繁琐的界面操作。对产品团队而言,这意味着MatrAIx足以承担概念验证和优先级筛选的重任,但仍然需要真人测试来兜底——特别是动手环节。
数字镜像背后,是一面照向人类自己的镜子
MatrAIx团队已将经过筛选的百万人格核心集在Hugging Face公开发布,这为全球研究者和开发者提供了通用基础设施。但我们也该保持一份清醒:当算法操纵着83亿个“人格棋子”,数据偏见可能被规模放大,而现实世界的复杂性也会在模拟中被过度简化。AI人在模拟中越接近真人,就越要求我们用伦理的尺子去约束它的应用边界。
归根结底,MatrAIx不该成为“真实用户的廉价替代品”,而应当是“理解人类的加速器”。工具可以做加法,但做判断的终归是人。技术越发达,越需要我们对真实的人本身保持敬意与好奇。
— END —
萌头条编辑部原创发布 · 转载请注明出处
