当83亿个AI开始”生活”:我们离模拟全人类还有多远?

当83亿个AI开始”生活”:我们离模拟全人类还有多远?

最近科技圈被一条消息刷屏了:哈佛、MIT联手OpenAI和Google DeepMind,搞了个叫MatrAIx的大项目,造出了83亿个AI智能体——差不多把全人类”复制”了一份,扔进数字世界里让他们自己”过日子”。

听起来像《黑客帝国》照进现实?别急,今天咱们不聊科幻,就聊聊这个系统到底干了什么,以及——它到底有多”真”。

这不是一堆聊天机器人,而是一个”数字人类社会”

很多人第一次听到”83亿个AI”时,第一反应是:”这不就是83亿个ChatGPT在瞎聊吗?”

完全不是。

MatrAIx的核心是一个叫 Persona-8B 的数据库,里面存着83亿份极其详细的”人物档案”。每一份档案都由 1290个维度 来定义——从你的出生地、母语、教育背景,到你的性格倾向、消费习惯、政治立场,甚至你爱看什么类型的短视频,全被编码进去了。

关键还不止是信息多,而是 逻辑自洽。研究团队用一个叫”有向无环图”(DAG)的数学结构,把各个属性之间的因果关系理清楚了。举个例子:系统不会生成一个”母语是中文、没出过国、但英语接近母语水平”的虚拟人——除非他的属性里确实写明了”在国际学校长大”或”父母有一方是英语母语者”。这就从根上杜绝了那种”人格分裂”式的AI,让每个虚拟人都”立得住”。

把这些”数字人”放进四个场景,他们会做什么?

有了这么逼真的”数字居民”,科学家们给他们搭建了四个模拟环境,让他们像真人一样活动:

  • 问卷调查:拿一个新的商业概念或政策方案去问他们,看不同人群的反应差异。
  • AI聊天:让他们和AI助手对话,记录情绪变化和满意度。
  • 网页浏览:像普通网民一样搜索、比价、看评价,最终做出购买决策。
  • 应用程序:直接操作手机或电脑上的软件界面,完成复杂任务(比如填表、下单、设置参数)。

目前系统里已经部署了 超过1000项评估任务,覆盖商业、金融、医疗等 25个领域,累计进行了 18000多次大规模模拟。换句话说,这83亿个虚拟人每天都在”上班”——给新产品做测试、给新政策做推演、给AI应用做压力试验。

那问题来了:他们真的能代表我们吗?

这是所有人最关心的问题。

团队做了 400次严格的对照实验,结果显示:这些AI智能体符合其预设人设的一致率达到了 91.5%。也就是说,如果你给一个”年轻、高收入、住在城市”的虚拟人看一款轻奢产品,他的反应大概率会和现实中的同类人群高度吻合。

驱动这些”数字人”的,是目前最顶尖的大模型——包括Claude Opus 4.8和GPT-5.5。论”表演”能力,他们确实不差。

但是——这个”但是”很重要——学术界目前普遍认为,MatrAIx最大的贡献在于 搭建了一个超大规模的基础设施,但它”模拟出的结果是否真的能等同于真人反馈”,这一点 尚未得到严格的实证验证

说白了:系统很强大,基础设施很震撼,但它生成的结论更适合用来 生成假设做压力测试,而不是直接替代真实用户调研,更不是用来做高风险决策的依据。

所以,我们离”模拟全人类”还有多远?

作为一个工具,MatrAIx已经做到了前所未有的规模。在产品设计、政策预演、市场分析这些领域,它能帮企业和研究机构省下大量时间和成本。

但要说”完全复制人类社会”……还早得很。

人类社会有太多东西是无法被1290个维度编码的:突发的情绪冲动、非理性的从众行为、偶然的灵感闪现、难以言说的审美偏好——这些”噪音”恰恰是真实世界最有魅力的部分。

MatrAIx给我们提供了一面镜子,让我们能以极低的成本去”试探”各种可能性。但镜子再清晰,终究不是窗子——它映照的是我们已经定义好的东西,而窗外那个真实而不可预测的世界,依然需要我们用真实的脚去丈量。

换句话说:数字人可以帮我们问”如果……会怎样?”,但最终的决定权,还是在真实的你我手里。

这大概就是技术该有的位置——做我们最得力的助手,而不是取代我们做选择的主人。