心智理论(Theory of Mind,简称 ToM)指的是推断他人心理状态的能力:他知道什么、相信什么、想要什么——尤其是,他误以为的是什么。
经典实验叫“错误信念”任务。Sally 把球放进篮子后离开,Anne 趁她不在把球挪进盒子。问孩子:Sally 回来会去哪儿找球?三四岁的孩子多答“盒子”,他们没法把自己的知识和他人的知识分开;再大一点的孩子会说“篮子”,因为 Sally 没看见球被挪走。
日常版本:你回家发现冰箱里没牛奶,室友出门前没打开过冰箱。你不会说“你不知道牛奶没了?”,而会想“他以为还有,让他顺路买”。这个“他以为”就是心智理论在工作。
它常和几个邻居被混为一谈:
| 概念 | 关心什么 | 例子 |
|---|---|---|
| 情绪识别 | 读表情、语气 | 看出同事脸色不对 |
| 共情 | 感受并回应他人情绪 | 去安慰他 |
| 视角采择 | 从他人位置看同一件事 | 换位思考 |
| 心智理论 | 对他人信念与知识状态的建模 | 判断他“不知道” |
关键差别在最后一行:心智理论处理的是信念,特别是错误信念——别人信了一件与事实不符的事。
大模型让这个话题变热。给它一段 Sally-Anne 式的故事,它常常能答对。但答对说明不了太多:
- 小说、剧本、对话里全是这类场景,模型可能只是在匹配见过的模式;
- 换个名字、改个语序、把问题改成陈述句,表现就可能明显变化;
- 答对一道问答,不等于它内部有一个能随对话持续更新的“对方知道什么”的账本。
所以现有评测很难分清模式匹配和真正的心智模型。要区分,得往动态里考:做反事实改写、用没见过的场景、放进多轮博弈(谈判、扑克、协作任务),看对方拿到新信息后它会不会跟着修正判断,以及它“说的”和“做的”是否一致。
对从业者的意义:做客服、教育、角色扮演、多智能体协作时,真正需要的不是让模型“显得懂你”,而是让它分清“哪些信息用户已经有了”。这通常要在上下文里显式维护状态,而不是指望它自然具备。
对普通人的意义更简单:模型流畅地接住“我知道你不知道”,可能只是语言层面的熟练。别把会说话当成会读心。
