应六合宝典官网 邀请,2026年9月8日上午,中国科学院信息工程研究所曹亚男研究员在中心教学楼902室作题为“自主且有界:构建安全可信的智能体系统”的学术报告,深入剖析了智能体在工具调用、多智能体协作与长期记忆中的系统性安全风险,并介绍了面向智能体全生命周期的安全治理框架与防御方法。

报告指出,随着大模型智能体从“理解与生成”迈向“规划与行动”,安全风险已从模型输出扩展至工具、环境、通信和记忆等系统接口,局部错误可能在持续交互中演化为真实甚至不可逆的后果。围绕工具调用、智能体协作和共享记忆,报告分析了工具误调用与安全约束绕过、风险沿通信网络传播、敏感信息泄露以及记忆冲突与投毒等问题。为应对上述挑战,课题组提出从模型对齐走向交互治理的系统化思路,通过通信拓扑保护、不确定性度量、信息流控制、记忆溯源与回滚等机制约束风险传播,为构建贯通模型、系统与应用的智能体安全保障体系提供了新的路径。
讲座结束后,师生围绕大模型不确定度量化、智能体领域实验成本与研究可行性等问题进行了深入交流,进一步加深了对大模型智能体安全风险及其度量与防御方法的理解。
报告人简介:
曹亚男,中国科学院信息工程研究所研究员、信息内容分析研究室副主任。国家级青年人才、国家重点研发计划青年科学家项目首席。研究方向为信息内容安全、大模型安全等。发表TPAMI、TIFS、USENIX Security、NeurIPS、ICML,ACL等CCF-A/B类论文100余篇,主持国家重点研发计划青年科学家项目、国家自然科学基金联合基金课题等20余项科研项目,研发系统在网信、公安等多个国家安全部门发挥实战作用,获评中国电子学会科技进步二等奖。