IT之家 8 月 18 日消息,由哈佛大学和麻省理工学院牵头,OpenAI 和谷歌 DeepMind 等机构参与的团队在本月推出了 MatrAIx 系统。 该系统能够生成 83 亿个 AI 智能体,用于模拟全球人类行为。 该项目利用 1,290 个维度对不同背景和生活方式的人群进行建模。这些 AI 智能体能够像真人一样填写问卷、和客服聊天、浏览网页、操作 App 等,测试结果一致性高达 91.5%。 团队通过一项包含 400 次测试的对照研究进行了验证,测试涵盖 10 个行为属性和全部四个环境。智能体在 400 次测试中的 366 次表现出了正确的特质,或在不相关时正确地抑制了该特质,即 91.5% 的情况下表现正确。 这一数据会随环境变化:在问卷和聊天场景中,一致性升至 92% 到 96% 之间,而在操控 App 测试中的准确度降至 83%。 目前,经确定性、质量过滤的百万人格核心集(coreset)已在 Hugging Face 公开发布,供研究使用。 IT之家附开源链接: https://github.com/MatrAIx-ai/MatrAIx-Persona-8B