Harvard(哈佛大学)与MIT(麻省理工学院)研究人员利用83亿AI虚拟人格…

会飞的荧 @feitu
Harvard(哈佛大学)与MIT(麻省理工学院)研究人员利用83亿AI虚拟人格模拟整个地球 这个规模非常大。 在一项宛如科幻小说情节的研发成果中,由哈佛大学和麻省理工学院研究人员领衔的大型合作团队发布了 MatrAIx(矩阵AI)——一套人口规模级AI模拟基础设施,旨在模拟地球上几乎每个人的行为。 MatrAIx 以 Persona 8B 为核心,这是一个包含 83 亿个独特数字画像的数据集。每个人像均通过 1,290 个分类维度进行定义,涵盖从人口统计背景、心理特征到消费习惯、技术素养、行为特质以及生活方式偏好等方方面面。 该系统并非静态数据库。研究人员借助前沿大语言模型(包括……)将这些角色激活为智能体。这些智能体可被部署至四种不同的数字环境:问卷调查、AI聊天界面、实时网页浏览,以及原生桌面与移动应用。 Persona 8B(角色档案8B)基于复杂的依赖图(dependency graph)构建,可保留各属性之间真实的关联关系。部分记录为合成生成,其余则从传记、评论、调查及经同意的自我报告中精心提取,并以真实人类数据为基准。 为便于实际研究使用,该团队已发布一个包含约一百万个 personas 的高质量 coreset。 一旦启动,智能体(agents)便会与真实的数字产品和系统进行交互。研究人员已在1,010项任务中完成了超过18,000次评估试验,涵盖电商、软件、金融、医疗保健以及另外20多个领域。系统会记录细粒度的行为信号——例如,智能体在价格上涨后会犹豫多久、何时放弃出现故障的结账流程、在关闭应用前能容忍多大的延迟,以及在AI助手失败后是否还会继续操作。 验证结果优异 在一项涵盖全部四种环境、针对十项行为属性遵循度的400次试验对照研究中,智能体成功表达或正确抑制其指定特征的比例达到91.5%。人类评审也对人工基准角色的质量给出了高度评价(平均4.135分,满分5分)。 这些结果表明,MatrAIx 能够以前所未有的规模,生成在人口统计学与心理特征上均保持一致的模拟用户。 Implications for Research and Business 传统市场研究和用户测试速度慢、成本高,且样本多样性有限。MatrAIx 提供了一种补充方案:仅需一台服务器,一夜之间即可模拟数十亿不同类型人群对新产品功能、定价调整、界面重构或 AI 系统的反应。 产品团队可在成本高昂的正式发布前对想法进行压力测试。研究人机交互(human-AI interaction)的研究人员可以探索罕见的行为边缘案例。政策制定者和社会科学家或许能够模拟新技术在高度多样化人群中的下游影响。 该项目为开源项目。代码已在 GitHub 上发布,项目网站已上线 one-million-persona coreset(百万角色核心集)以供更广泛的研究使用。 随着底层语言模型的持续优化和人格模型的不断精进,这些数字人群的保真度预计将进一步提升。 截至目前,该系统是迄今为止最雄心勃勃的尝试之一,旨在创建一个可用、覆盖人口规模的人类数字镜像——一种模拟基础设施,让我们能够在全球范围内进行"如果……会怎样"的推演,再将其部署到现实世界。 GitHub: github.com/Dujltqzv/Some-…
话题来源 @BrianRoemmele · 32W阅读 · ❤️1155 · x.com/…↗ · 已改写,非原文转载
22 浏览 0 评论 0 反应
登录 后参与评论
还没有评论,来抢沙发。
查看完整榜单
查看完整榜单
查看完整榜单