我的博士研究从内部认知组织、模块级幻觉机理和长程元认知调控三个层面分析大模型智能体。
大模型智能体 | 幻觉 | 机理可解释性 | 搜索
孙忠祥 (Zhongxiang Sun)
我是中国人民大学高瓴人工智能学院博士生,导师是许俊教授。我的研究围绕可信大语言模型与智能体展开, 目前主要关注幻觉机理、推理与规划、信息检索、可解释性和法律智能。我借鉴认知神经科学的研究方法, 通过任务设计、行为分析、表征分析、机制干预和过程监控,理解大模型智能体如何工作,又会在什么情况下出错。
我预计于 2027 年 6 月毕业,目前正在寻找研究岗位。欢迎与我讨论可信大模型与智能体、 大模型与信息检索的结合、机理可解释性,以及认知神经科学对人工智能研究的启发。
研究概览
相关项目涉及检索增强生成、大型推理模型、个性化大模型、过程奖励和深度搜索智能体。
ReDeEP 入选 ICLR Spotlight;生成式检索工作获 SIGIR-AP 最佳论文奖;另有论文入选 Paper Digest 的 SIGIR 与 CIKM 最具影响力论文榜单。
网站整理了 NeuroCogMap 等项目的介绍、论文和代码,并单列完整发表记录,方便集中查阅。
研究
我把大模型智能体视为一种新的人工智能系统。它能理解上下文,围绕目标展开推理,调用工具和记忆, 与人或其他智能体协作,并在变化的环境中行动。我的工作关心这些能力在模型内部如何组织、故障如何产生, 以及怎样在执行过程中及时发现并纠正问题。具体方法包括认知任务范式、行为边界测试、表征分析、因果干预和过程级监控。
代表论文
这里选取与当前研究主线关系最紧密的工作。其他论文收录在完整列表中。
NeuroCogMap Reveals Cognitive Organization of Large Language Models
arXiv 2026 | 项目负责人 | 内部认知组织
连接稀疏特征、功能分区、认知能力、能力层级与病理定位的多层认知图谱。
ReDeEP: Detecting Hallucination in Retrieval-Augmented Generation via Mechanistic Interpretability
ICLR 2025 Spotlight | 第一作者 | 智能体模块机理
从机制层面解释 RAG 幻觉:外部证据利用不足与参数知识依赖失衡。
Mechanistic Detection and Mitigation of Hallucination in Large Reasoning Models
ICLR 2026 | 第一作者 | 智能体模块机理
从时间神经动力学分析大推理模型中的推理幻觉。
When Personalization Misleads: Understanding and Mitigating Hallucinations in Personalized LLMs
ACL 2026 Findings | 第一作者 | 智能体模块机理
从表征层面解释个性化记忆如何使事实行为发生偏移。
ReARTeR: Retrieval-Augmented Reasoning with Trustworthy Process Rewarding
SIGIR 2025 | 第一作者 | 元认知调控
面向可信多步检索增强推理的过程奖励框架。
Deep Search with Hierarchical Meta-Cognitive Monitoring Inspired by Cognitive Neuroscience
SIGIR 2026 | 第一作者 | 元认知调控
校准推理不确定性与证据不确定性,并按需触发经验驱动纠错的深度搜索框架。
教育经历
- 2022.08 至今 中国人民大学高瓴人工智能学院,博士研究生。
- 2018.08–2022.06 北京交通大学计算机科学与技术专业,本科,专业排名第 1(前 0.4%)。
奖励与荣誉
- 2024 年国家奖学金,并入选全国 100 名研究生国家奖学金获奖学生代表。报道
- 2024 年中国科协青年人才托举工程博士生专项计划。
- 中国人民大学创新人才项目。
- SIGIR-AP 2024 最佳论文奖。
- 首届全国大学生人工智能与智慧治理创新创业竞赛一等奖。
教学经历
- 中国人民大学《大数据分析导论》课程助教,2022 年秋季、2023 年秋季。
- 中国人民大学《Python》课程助教,2023 年春季。
学术与研究经历
- 南洋理工大学,访问学生,2025.09–2026.03,合作导师:刘杨教授。
- 快手,研究实习生,2022.02–2025.06,合作导师:臧小雪、郑凯、宋阳。
- CAIL 2022,组委会成员。
- WWW 2024、2025,审稿人。
- SIGIR 2024、2025,程序委员会委员。
- TOIS,审稿人。
- TASLP,审稿人。
- CIKM 2023、2024,程序委员会委员。
- NeurIPS 2025,审稿人。
- ICLR 2026,审稿人。