【学术科研】“知境”社会心智大模型亮相国产AI超集群曙光8000发布会

7月10日,中国科学院计算技术研究所智能算法安全全国重点实验室(以下简称“实验室”)研究成果“知境”社会心智大模型,在全国产AI超集群曙光8000(登峰)发布会上亮相,首次展示了实验室在大模型社会心智能力评测、高效内化训练和智能体应用三方面的阶段性成果。实验室自主研发的“知境”多模态模型Zing‑27B在5项国际评测基准上的综合均值超越GPT‑5.5;文本模型Zing‑32B性能与DeepSeek‑V4‑Pro水平相当;Zing-8B/14B则以较小参数量在高阶推理基准Hi-ToM上超越参数量为其50倍的模型, 展现出良好的参数效率。

中国科学院计算技术研究所副所长、智能算法安全全国重点实验室主任程学旗研究员在致辞中表示,大模型已在语言表达、知识压缩和生成式推理等方面展现出强大能力,物理世界模型和具身智能也正在推动智能系统从“能说会道”走向“能够行动”。但当人工智能进入真实社会环境,与人持续互动并参与决策时,仅仅“会说”和“会做”还不够,还需要理解人的情感、意图、价值观、社会交往规则和群体行为规律。社会心智正是人工智能理解个体心理状态、社会关系、互动规范和群体行为,并据此作出符合情境判断与决策的能力。它是人工智能安全可信发展的重要基础,也是中国人工智能领域值得持续探索的原创方向。

智能算法安全全国重点实验室副主任郭瑞杰正高级工程师在题为《“知境”:从“工具智能”迈向“社会智能”》的报告中指出,随着大模型进入开放环境并逐步成为行动主体,能否理解隐性规范、动态意图和群体心智,正成为人机共生的关键瓶颈。“知境”社会心智大模型以评测基准建设为起点,以心智推理能力内化训练为核心,以智能体真实行为与决策应用为牵引,探索人工智能从工具智能迈向社会智能的技术路径。围绕这一路线,团队分别从能力评测、模型训练和智能体应用三个层面介绍了“知境”的研究进展。

张语轩研究员介绍了团队如何将人的社会认知过程转化为可计算、可评测的能力维度,并据此构建SoMBench社会心智评测基准。该基准围绕心智表征、社会互动和规范内化三大一级维度,覆盖17个二级维度、71项评测任务,包含3481个经专家验证的实例。与侧重单一能力或静态问答的传统评测相比,SoMBench更强调交互性、诊断性和全景覆盖,力求识别模型在应对开放复杂社会情境中的真实能力边界,对顶级旗舰模型构成重要挑战,为后续模型训练和能力改进提供依据。

朱胜宇副研究员介绍了将社会心智推理能力内化到模型参数中的训练路线。针对高质量训练数据缺失、细粒度社会推理过程不足,以及能力强化与既有知识保持之间的平衡等挑战,团队通过分层数据构建和能力诊断识别训练重点,并结合过程导向训练与分阶段强化,将评测发现的心智能力短板反馈到模型迭代中,以增强模型对复杂社会情境中人物内心状态、互动关系和隐性规范的理解能力。

姚迪副研究员介绍了团队在社会心智智能体系统中的应用探索,围绕开放场景中的多元角色模拟、社会关系建模和持续学习进化开展原型验证,并在短视频用户行为预测、传播效果判断等场景中探索应用价值,推动社会心智能力走向真实任务。

在交流讨论环节中,与会嘉宾围绕“知境”模型开放、评测集和榜单建设、产业场景共建及后续合作等问题提出建议。本次活动集中展示了实验室在社会心智大模型方向的阶段性探索,初步形成从能力评测、模型训练到智能体应用验证的技术链条。下一阶段,实验室将联合产业伙伴和场景用户单位,推动人工智能从工具智能迈向社会智能,为人工智能安全可信发展提供支撑。