自2022年大语言模型(Large Language Model, LLM)取得突破以来,人工智能(ArtificialIntelligence,AI)正从“生成式工具”逐渐演进为“自主行动主体”。以大语言模型作为推理与决策核心的智能体(Agent),能够感知环境、规划路径、调用工具、保持记忆,在有限人类监督下自主完成多步骤的复杂任务。2025年以来,智能体的数量和能力呈持续增长态势,应用场景和发展规模不断扩大,为千行百业的发展提供巨大的赋能价值。然而,与高速发展的智能体技术相伴的是日益凸显的安全挑战。近期国内外频发的智能体安全事件,以及政策界和学术界相继发布的安全风险提示均表明,技术演进与安全治理之间存在显著的时间差。