你有没有想过,AI 也有"情商"?
最近,一个叫 EQ-Bench 的测试火了起来,它用一套复杂的情感和社交智能评估体系,给各大 AI 模型打分。用 120 个"虚拟用户角色"进行 16 轮深度对话,考察 AI 能否真正"读人"——理解需求、建立信任、适时共鸣。结果很有意思:排名前两位的模型分数几乎相同,但特点完全不同。
四大模型简析
第 1 名:Claude Fable 5(1350 分)
🏆 情商天花板
真实性满分(10.0),建立信任和同理心都是顶级水平。和它聊天就像和真实的人交流,能准确理解你的需求。它的绝对优势在于"人味儿"——不会显得生硬或套路,反而像个真正关心你的朋友。
唯一的小缺点是有时候不够"硬气",面对需要严肃挑战的情况可能过于温和。但这对大多数场景来说,反而是优点。
第 2 名:Kimi K3(1349 分)
🥈 仅差一分的追击者
有趣的是,虽然分数只差 1 分,但特点完全不同。分析能力(8.5)超过 Claude Fable 5(8.2),洞察力满分(10.0)。这意味着 Kimi K3 特别适合需要深度思考和系统分析的场景。
建立信任能力也是满分,但"人味儿"比 Claude 少一点。如果你需要既有温度又有脑子的 AI,Kimi K3 是不二之选。
第 7 名:GPT 5.6-sol(1263 分)
🥉 排名下滑明显
最大问题是"挑战能力"严重不足(4.6/10),显得有点"软"。真实性(6.7)和同理心(7.9)相比前两名也有明显差距。虽然情绪管理(8.2)表现不错,但总体而言,它是个"好好先生",缺乏个性和深度。
第 12 名:GLM 5.2(1229 分)
📍 及格线选手
各项能力都在中等水平,没有明显短板,但也没有突出优势。就像一个很有礼貌但没什么个性的同事——你不会讨厌它,但也不会特别想和它深入交流。适合对情商要求不高的场景。
🎯 场景应用指南(推荐最适合的模型)
这才是重点。高情商的 AI 不是万能的,不同场景对情商的需求完全不同。我会从整个榜单里给你推荐最合适的模型。
心理咨询 & 情感陪伴
用户需要被理解、被看见、被真诚对待。这是情商最关键的舞台。需要 AI 能准确感知情绪、知道什么时候该温暖、什么时候该挑战,还要显得真实自然。
- 🏆 最佳选择:Claude Fable 5(1350)- 真实性和同理心满分
- 次选:Kimi K3(1349)- 既有温度又有深度
- 备选:Claude Opus 4.7(1321)- 性价比较好的备选方案
内容创作 & 文案撰写
需要抓住情感节点、理解不同受众心理、避免生硬套路。高情商的 AI 能写出更有温度、更容易引发共鸣的内容,而不是冷冰冰的模板文案。
- 🏆 最佳选择:Claude Fable 5(1350)- 文字自然有温度
- 次选:Kimi K3(1349)- 深度和温度兼具
- 备选:GPT 5.5(1326)- 逻辑清晰且有共鸣力
日常闲聊 & 陪伴
很多用户其实不是来问问题,而是想找个人聊天。需要 AI 显得自然、有温度、有个性,能接住话题,像个真实的人在交流。这是 Claude Fable 5 的绝对领地。
- 🏆 最佳选择:Claude Fable 5(1350)- 无可替代的"人味儿"
- 次选:Kimi K3(1349)- 对话深度更好
- 备选:Claude Opus 4.7(1321)- 稳定的陪伴体验
专业咨询 & 决策支持
商业咨询、法律建议、技术问题等。用户需要专业分析 + 理解实际困境。这个场景下分析能力和理解力同样重要。
- 🏆 最佳选择:Kimi K3(1349)- 分析能力和洞察力都是满分
- 次选:Claude Fable 5(1350)- ELO 更高但分析力稍弱
- 备选:GPT 5.5(1326)- 情绪管理能力最强
客观分析 & 内容审核
需要保持中立、客观,过度的理解和同情反而会影响判断力。这个场景下,情商高反而可能是"坏事"。
- 🏆 最佳选择:GPT 5.6-sol(1263)- 足够冷静,判断力强
- 次选:GPT 5.4(1283)- 稍微更均衡
- 备选:GLM 5.2(1229)- 中立性更好
教育 & 知识传授
需要理解学生的困惑点、知道什么时候该鼓励、什么时候该严格。既要有温度,也要有深度。
- 🏆 最佳选择:Kimi K3(1349)- 洞察力满分,能深度讲解
- 次选:Claude Fable 5(1350)- 理解学生需求能力最强
- 备选:GPT 5.5(1326)- 鼓励和管理能力均衡
📈 完整排行榜

💡 建议
1. 做情感陪伴产品?Claude Fable 5 是无可争议的第一选择。
2. 需要分析能力 + 温度的全能选手?Kimi K3 是最好的平衡点。
3. 预算有限但需要高质量?Claude Opus 4.7 和 GPT 5.5 的性价比不错。
4. 需要保持客观中立?GPT 系列的冷静特性反而是优势。
5. GLM 5.2 目前还在及格线上,适合对情商要求不高的场景。