你对自己了解多少?我们大多数人会说:相当了解。但数据却说不然。我们比较了7,013名约会应用用户对自己人格特质的评分,与同一人群的结构化心理测试结果。只有13.8%的人在所有三个特质上都准确到误差在一分以内。对于其他人来说,镜子中的人和测试结果中的人是两个不同的人。
我从SoulMatcher数据库中提取这些数据,原以为差距会比较温和。但我发现的差距更大、更奇怪,而且在一种情况下与流行心理学教给我的预期完全相反。
我们比较了什么
每位SoulMatcher用户在入职 onboarding 时都会对三个特质进行自我评分:共情、自恋和边缘倾向,每个特质的量表为0到10分。这只需几秒钟,完全凭直觉。
之后,许多相同用户会参加结构化的PSY-ID评估:一份更长的问卷,测量相同的三个特质,并为应用的兼容性匹配提供支持。量表相同,人相同,却是两种截然不同的工具。
这为我们提供了7,013名同时拥有两种测量记录的人。将快速自我评分与测试结果并列,就能以比大多数已发表研究更大的样本,描绘出人类自我认知的画像。
在此之前,先说一个诚实的免责声明。测试并非关于一个人的“真相”,而是第二次、更结构化的测量。我们真正测量的是直觉与方法之间的差距。正如你将看到的,这个差距很大。
标题数字
| 特质 | 自我评分(平均) | 测试结果(平均) | 差距 |
|---|---|---|---|
| 共情 | 7.13 | 6.92 | +0.20 |
| 自恋 | 4.32 | 3.89 | +0.43 |
| 边缘倾向 | 4.35 | 3.59 | +0.76 |
三个模式尤为突出。
首先,人们在每个特质上的自我评分都高于测试结果。不仅限于讨好的特质,所有三个都是如此。
其次,直觉与测试之间的相关性很弱:共情为0.31,自恋为0.28,边缘倾向为0.36。如果你根据自我评分猜测某人的测试分数,你几乎无法胜过抛硬币。
第三,偏差并非随机噪声。它们遵循人口统计线,这正是有趣之处。
男性认为自己比测试显示的更自恋
流行观点认为自恋者从不自知。我们的数据显示的是相反的问题,且集中在某一群体。
| 群体 | 自我评分自恋 | 测试结果 | 差距 |
|---|---|---|---|
| 女性(n=3,708) | 4.17 | 4.05 | +0.12 |
| 男性(n=3,290) | 4.49 | 3.72 | +0.77 |
女性对自己自恋的直觉与测试测量结果接近。男性则高估了超过四分之三分:他们称自己比结构化评估发现的更自我中心。
在整个样本中,32.2%的人高估了自己的自恋至少两分。只有20.8%的人低估了相同的幅度。 oblivious 自恋者的刻板印象存在,但在本数据集中,更响亮的故事是人们(主要是男性)给自己贴上测试未确认的标签。
我最喜欢的一个细节:男性也比女性更低估自己的共情。综合来看,男性模式读起来像是系统性的更严厉自我形象,而非更友善的形象。
我们年龄越大,自我形象就越戏剧化
边缘倾向显示出三个特质中最大的差距,且差距随每个十年年龄增长而扩大。
| 年龄组 | 差距(自我评分减测试) |
|---|---|
| 18-24(n=1,056) | +0.42 |
| 25-34(n=2,380) | +0.50 |
| 35-44(n=2,271) | +0.90 |
| 45+(n=1,306) | +1.25 |
在18至24岁时,人们高估自己的边缘分数不到半分。45岁后,高估翻了三倍。总体而言,39%的用户将自己的边缘倾向评分至少高出测试结果两分。
我只能对原因提出一个假设。到45岁时,大多数人经历过离婚、留下痕迹的分手,或多年困难的关系。这些经历成为我们讲述自己故事的一部分:“我很难相处,我很激烈,我有包袱。”测试询问的是当前行为而非传记,因此不同意。我们的全球离婚统计显示这些标记性经历多么常见;这些数据补充的是,它们似乎在自我认知中回响很久之后。
共情:人们真正了解自己的一件事
好消息来了。在共情上,57.9%的人的评分与测试结果误差在一分以内。平均差距为五分之一分,45岁以上的人甚至略微低估自己,差值为0.09。
共情也是我们获得最多反馈的特质。从童年起,人们就会告诉我们何时倾听得好,何时没有。没有人会把你拉到一边说你的边缘倾向在晚餐时似乎升高了。我们准确的特质是世界评论过的那些。
这种解读符合人格研究者更广泛的发现:Simine Vazire关于自我认知的研究表明,人们对自己内部特质的判断相当好,而存在于行为中的特质往往对观察者更清晰(Vazire, 2010)。经典的Dunning-Kruger研究则表明,在反馈稀缺的领域,人们自信地误判自己(Kruger & Dunning, 1999)。
如果你在约会,这意味着什么
一些实际结论直接来自数据。
你的自我描述是粗略草稿,而非事实表。如果只有13.8%的人能准确说出自己所有三个特质,那么我们在约会资料上写的“关于我”答案就继承了这种错误。这就是过度优化约会资料适得其反的原因之一:你最终推销的是一个并不完全存在的人。
结构化胜过直觉。测试也可能错,但它系统性错误的程度小于三秒钟的自我评分。这正是SoulMatcher基于评估档案而非自我描述进行匹配的全部原因,也是PSY-DNA报告存在的原因,供想要更长版本的人使用。
问问了解你的人。既然他人观察到的特质是我们最容易误判的,那么朋友的诚实回答是你无法独自生成的数据。我们的你了解我多少问题让这种对话更容易开始,而且听起来没那么尴尬。
不要字面阅读自己的戏剧。如果你已过40岁并确信自己“太多”而无法维持关系,请注意你所在的人口群体高估了这一自我判断超过一分。感到困难是真实的;测量的特质通常更小。有过去的人仍以可靠的频率出现在我们的成功故事中。
更多来自SoulMatcher研究
方法论
样本:7,013名SoulMatcher用户,他们完成了自我评分(三个特质,0到10分,在onboarding时收集)和结构化PSY-ID评估(在相同量表上测量相同特质)。数据于2026年8月24日汇总。
本文中的所有数字均为群体级聚合。撰写时未访问任何个人记录,且未报告任何小于1,000人的群体。性别比较涵盖6,998名指定性别的用户;年龄比较涵盖7,013名用户,分成四个年龄段。平均值为算术平均值;边缘倾向的中位差距为+1.0,自恋和共情为0.0,这意味着平均差距并非由边缘倾向的极端小尾巴驱动,而对于另外两个特质,大约一半用户高于测试分数,一半低于。
相关性为自我评分与测试结果之间的Pearson r:边缘倾向0.36,自恋0.28,共情0.31。
解释说明:两种测量都不是地面真相。比较量化了快速自我感知与结构化工具之间的分歧程度,而不是一个人“真正”是谁。
本文仅供参考。自恋和边缘等特质名称指在连续量表上测量的人格倾向,而非临床状况。此处内容不是诊断,也不能替代咨询心理学家、心理治疗师或其他合格专家。
本文仅供参考,不能替代心理学家、心理治疗师或其他合格专业人士的咨询。



