点击蓝字 关注我们
2026年,全球智能体技术加速成熟,产业应用爆发增长。智能体凭借自主感知、规划决策与工具调用能力,推动人工智能从“能说话”向“能办事”的关键跨越。
但能力跃升的同时,风险也在升级:从输出偏差走向行动失控,从单点故障走向网络传导,从静态缺陷走向动态变异。
人工智能治理,正从以内容合规、事前审查为重心的“模型治理”,加速转向以行为约束、全周期治理为重心的“智能体治理”。
中国信息通信研究院与中国政法大学联合发布《智能体治理研究报告(2026年)》,系统梳理智能体时代的新形势、新风险与新治理框架。
关键判断:从模型到行为体
传统人工智能治理以模型和服务提供者为对象,备案、审核、内容标识等制度围绕“谁在提供什么内容”展开。
但智能体的输出不再是内容,而是行动。
它可能调用API、操作数据库、发送邮件、执行代码,甚至直接作用于物理世界。治理对象随之从“模型”转变为“行为体”,治理单元从单一系统扩展为模型、工具链、记忆、执行环境等要素在内的行动整体。
报告提出:治理锚点应从“审批一个服务”,转向“标识每一个运行中的智能体”。
以身份注册与数字凭证确立“它是谁”,以权限声明与动态授权界定“它能做什么”,以数据流向管理厘清“它接触过什么”。
风险图谱:链式行动后果
报告构建了智能体风险图谱,风险逐级传导升级:
一是传统模型风险迁移。
幻觉风险从“输出错误”升级为“行动错误”;数据隐私风险在知情同意、暴露面扩大、长时记忆积累三个维度同步加剧。
二是自主行为风险。
权限过大、滥用越权、工具组件广泛复用、风险叠加传导等问题突出。报告显示,70%的组织授予智能体超出同等人类员工的权限,80%的组织已报告智能体执行了超出预期范围的行为。
三是交互协作风险。
级联失效、跨域数据流转失控、责任追溯真空、身份标识不统一、虚假共识等问题集中出现。多智能体“虚假共识”与“恶意共谋”已从理论推演走向现实。
四是经济社会风险。
劳动力市场结构性冲击、垄断与不正当竞争风险加剧,风险还可能外溢至金融稳定等系统性层面。
五是人类可控风险。
人类自主性可能受到侵蚀,前沿失控风险浮出水面。能否始终保持对智能体的有效控制,成为治理必须守住的底线。
三层治理框架:基础·运行·生态
报告提出“基础层—运行层—生态层”的智能体治理框架。
基础层:解决“它是谁、它能做什么”。包括身份管理、权限管理、数据管理。身份标识、最小权限、动态授权、记忆治理,是智能体安全运行的基础设施。
运行层:解决“做了什么、如何可审计”。包括审查评估、动态监测、透明披露、干预处置。治理重心从内容审查转向行为管控,从结果管控转向过程管控。
生态层:解决“如何交互、谁来担责”。包括责任配置、可信互联、竞争有序。以“控制力”锚定责任:谁设定目标、谁配置权限、谁分发能力、谁从中获益,谁承担相应义务。
一句话概括:基础层确立可信起点,运行层管控行动过程,生态层塑造生态秩序。
全球趋势:四条路径初现
美国:以前沿能力扩散防控为动因,模型审查与标准化双轮驱动。欧盟:以基本权利保护为底色,推动既有规则体系向新场景延伸。新加坡:以全球可信AI枢纽建设为战略目标,多维度推进精准治理。中国:回应“人工智能+”应用需求,探索大模型制度叠加式治理。
全球智能体治理格局初现轮廓,但风险分类、幻觉判定、失控界定等仍缺乏统一共识,国际交流合作紧迫性上升。
未来展望:四维协同发力
报告提出,面向未来需从四个维度构建智能体治理体系:
一是理念引领,把稳治理方向,筑牢安全可控底线;二是制度完善,夯实治理根基,明确权责边界框架;三是技术创新,强化治理能力,提升安全防护水平;四是生态构建,优化治理格局,推动多元协同共治。





结语
以上仅为《智能体治理研究报告(2026年)》精华摘录。完整报告涵盖智能体技术架构、风险图谱、全球治理动向、三层治理框架与未来展望,内容更加系统详实。
关注本公众号,后台回复【智能体治理】,即可获取《智能体治理研究报告(2026年)》完整报告链接。
关注我们
深圳市龙岗区数据产业协会是在区民政局、区政务服务和数据管理局及区数据集团的指导与监管下,由数据要素、人工智能、具身机器人、金融科技等核心领域的企事业单位、高校、科研机构及社会组织共同组成的非营利性行业协作组织。
"4T星球"是在深圳市龙岗区数据产业协会指导下成立的科技精英平台,立足龙岗、辐射湾区、面向全国。我们依托协会的产业资源与公信力,专注于数据科技、金融科技、智能科技与具身科技四大前沿领域的交叉创新。

研报速递
发表评论
发表评论: