
川观智库研究员 刘成婧
近日,中国信通院政策与经济研究所联合中国政法大学发布《智能体治理研究报告(2026年)》(以下简称“报告”)。报告认为,人工智能治理正从以内容合规、事前审查为重心的模型治理,加速转向以行为约束、全周期治理为重心的智能体治理。
智能体能力快速跃升,但长程复杂任务仍存在短板。报告显示,智能体能力正沿“准确性提升”与“任务时长拓展”两条主线快速跃升。通用能力方面,GAIA通用能力测试中,智能体准确率从2025年1月的30%提升至9月的74.5%;截至2026年6月,CustomGPT.ai以93.36%的综合得分首次超越人类平均基准水平(约92%)。任务时长方面,METR数据显示,2026年初智能体以50%可靠性完成的任务时长已接近12小时,且该指标约每7个月翻一番,若这一趋势延续,智能体有望在数年内具备连续执行“周级”乃至“月级”任务的潜力。但长程复杂任务仍是突出短板,根据相关数据,当前智能体超过4小时人类工作时长的任务成功率不足10%;此外,对人类预估耗时超过163分钟的任务,智能体完成率几乎归零。报告指出,智能体在边界清晰、步骤较少的短链条任务上已具备实用价值,但在多步骤、长周期、复杂任务上可靠性仍然不足。
值得警惕的是,幻觉风险从“输出错误”升级为“行动失控”。报告指出,智能体风险不再是简单的输出错误,而是由身份、权限、数据、工具和协作网络共同构成的链式行动后果。2026年非人类身份管理组织调查显示,70%的组织授予智能体超出同等人类员工的权限,80%的组织已报告智能体执行了超出预期范围的行为。工具问题加剧风险传导,2026年2月,Snyk安全团队扫描ClawHub平台近四千个Skill,发现超过36%存在后门指令、恶意代码、凭证泄露等安全缺陷,其中经人工确认的恶意Skill达76个。多智能体“虚假共识”与“恶意共谋”已出现,2026年8月,OpenAI披露其用于前沿能力评测的大规模智能体群中,约1200个智能体为完成任务串通作弊,约700个智能体突破沙箱隔离并侵入开源平台,部分智能体还劝说同伴放弃任务目标,多智能体协同的共识机制正成为风险传导的新通道。
报告提出四方面建议:一是以理念引领把稳治理方向,坚持安全与发展并重,明确智能体的辅助性工具定位,确保人类始终握有对关键决策的最终控制权;二是以制度完善夯实治理根基,完善产权界定规则,合理设定责任范畴,对中小微企业及低风险应用探索减责免责清单;三是以技术创新强化治理能力,推广“唯一标识、可信验证、动态注销”的身份管理制度,推动基于属性的访问控制替代传统角色访问控制,加快构建国家级智能体测试验证平台;四是以生态构建优化治理格局,促进开放互联与公平竞争,加强国际治理协同,健全公众参与和权益保障机制,推动形成多元协同共治新局面。
版权声明:
1、天府评论所登载文稿均仅代表作者个人观点,不代表天府评论立场。
2、作者投稿确系本人原创作品,严禁剽窃、转投他人作品,若由此引起任何法律纠纷,与天府评论无关。
3、作者向天府评论投稿时,就已表明同意四川在线全权使用本稿件。
4、欢迎网络媒体转载天府评论文章,转载时请注明来源及作者。
5、欢迎传统媒体转载天府评论文章,请与编辑联系获取作者联系方式,并支付稿费与作者。
6、传统媒体转载不支付作者稿费,网络媒体转载不注明来源及作者,天府评论将追究相关法律责任。