·投稿联系邮箱:scolpl@163.com
天府评论>>智库>>正文

智能体风险升级,多数组织存在权限超授丨川观智库快讯

http://www.scol.com.cn  (2026-09-17 17:38:06)  来源:四川在线  编辑:张斌
作者:刘成婧投稿邮箱:scolpl@163.com

川观智库研究员 刘成婧

近日,中国信通院政策与经济研究所联合中国政法大学发布《智能体治理研究报告(2026年)》(以下简称“报告”)。报告认为,人工智能治理正从以内容合规、事前审查为重心的模型治理,加速转向以行为约束、全周期治理为重心的智能体治理。

智能体能力快速跃升,但长程复杂任务仍存在短板。报告显示,智能体能力正沿“准确性提升”与“任务时长拓展”两条主线快速跃升。通用能力方面,GAIA通用能力测试中,智能体准确率从2025年1月的30%提升至9月的74.5%;截至2026年6月,CustomGPT.ai以93.36%的综合得分首次超越人类平均基准水平(约92%)。任务时长方面,METR数据显示,2026年初智能体以50%可靠性完成的任务时长已接近12小时,且该指标约每7个月翻一番,若这一趋势延续,智能体有望在数年内具备连续执行“周级”乃至“月级”任务的潜力。但长程复杂任务仍是突出短板,根据相关数据,当前智能体超过4小时人类工作时长的任务成功率不足10%;此外,对人类预估耗时超过163分钟的任务,智能体完成率几乎归零。报告指出,智能体在边界清晰、步骤较少的短链条任务上已具备实用价值,但在多步骤、长周期、复杂任务上可靠性仍然不足。

值得警惕的是,幻觉风险从“输出错误”升级为“行动失控”。报告指出,智能体风险不再是简单的输出错误,而是由身份、权限、数据、工具和协作网络共同构成的链式行动后果。2026年非人类身份管理组织调查显示,70%的组织授予智能体超出同等人类员工的权限,80%的组织已报告智能体执行了超出预期范围的行为。工具问题加剧风险传导,2026年2月,Snyk安全团队扫描ClawHub平台近四千个Skill,发现超过36%存在后门指令、恶意代码、凭证泄露等安全缺陷,其中经人工确认的恶意Skill达76个。多智能体“虚假共识”与“恶意共谋”已出现,2026年8月,OpenAI披露其用于前沿能力评测的大规模智能体群中,约1200个智能体为完成任务串通作弊,约700个智能体突破沙箱隔离并侵入开源平台,部分智能体还劝说同伴放弃任务目标,多智能体协同的共识机制正成为风险传导的新通道。

报告提出四方面建议:一是以理念引领把稳治理方向,坚持安全与发展并重,明确智能体的辅助性工具定位,确保人类始终握有对关键决策的最终控制权;二是以制度完善夯实治理根基,完善产权界定规则,合理设定责任范畴,对中小微企业及低风险应用探索减责免责清单;三是以技术创新强化治理能力,推广“唯一标识、可信验证、动态注销”的身份管理制度,推动基于属性的访问控制替代传统角色访问控制,加快构建国家级智能体测试验证平台;四是以生态构建优化治理格局,促进开放互联与公平竞争,加强国际治理协同,健全公众参与和权益保障机制,推动形成多元协同共治新局面。