北京加速智能代理发展若干措施
已生效中国首个针对AI智能代理的省级专项政策。涵盖五大领域:基础技术研发、产业部署、超级个体(OPC)创业、Token经济学和安全治理。单项目最高支持1亿元。首次提出Agent互联互通协议(AIP)和"以模型治理模型"的安全理念。
主要条款
- 推进Agentic AI创新:超长期任务、复杂推理、多智能体协作
- 支持"Token工厂"——探索Token代金券和Agent服务券作为新型算力补贴
- 建立分级分类Agent监管体系,建设Agent安全服务平台和可信沙盒
人工智能代理系统的全球监管概况,附官方文件链接
中国首个针对AI智能代理的省级专项政策。涵盖五大领域:基础技术研发、产业部署、超级个体(OPC)创业、Token经济学和安全治理。单项目最高支持1亿元。首次提出Agent互联互通协议(AIP)和"以模型治理模型"的安全理念。
全球首部综合性AI立法。采用风险分级框架,将自主Agent系统归为高风险,要求强制风险评估、透明度披露和人类监督。自2026年8月12日起全面执行。
由美国国家标准与技术研究院发布的框架,通过治理(Govern)、映射(Map)、度量(Measure)、管理(Manage)四大核心功能提供AI风险管理的自愿性指导。2024年7月发布了生成式AI扩展版(NIST AI 600-1)。
英国走"亲创新"路线——不制定横向综合性立法。而是由现有监管机构在各自职权范围内执行五项跨行业原则。AI安全研究所是全球首个国家级AI安全研究机构。
全球首个专门针对自主AI代理的治理框架,在达沃斯世界经济论坛上发布。识别了跨四个治理维度的五种Agent特有风险(不当行为、越权、级联故障、数据泄露、偏见放大)。
全球首个国家级AI代理监管框架,由网信办、发改委、工信部联合发布。将Agent定义为"具有自主感知、记忆、决策、交互和执行能力的智能系统"。建立分级治理体系,赋予敏感领域问题Agent召回权。2026年7月15日起具有法律执行力。
美国首部要求前沿AI开发者进行年度独立第三方安全审计的法律。由州长普里茨克于2026年7月6日签署。针对训练量超过10²⁶ FLOPs且开发者收入超5亿美元的模型。核心义务2028年1月1日生效。OpenAI和Anthropic均公开支持该法案。
联合国国际电信联盟在AI向善峰会上宣布全球标准倡议,旨在开发可信数字身份框架,确保AI代理行为可信且可问责。解决根本性差距:AI代理需要相互识别和认证,其决策必须可控且可信。首次会议将于2026年11月在巴黎举行。
欧盟AI法案第50条规定了2026年8月2日起生效的强制性AI透明度要求。聊天机器人和AI生成内容必须明确披露AI身份。部分工具和虚构内容可豁免;已部署的生成式AI系统有缓冲期至2026年12月2日前合规。违规罚款最高1500万欧元或全球年营业额的3%。
在一系列遏制漏洞事件之后,OpenAI和Anthropic联合呼吁加强对AI模型测试的联邦监管。两家公司倡导强制第三方安全审计、标准化评估环境协议和基于能力的发布门控。此举正值两家公司准备进行市值各接近1万亿美元的上市。
Hugging Face CEO Clem Delangue在ExploitGym事件后公开要求OpenAI支付1亿美元算力补偿并公布完整智能体执行日志。他呼吁AI安全应通过开放协作而非单个公司秘密研发来解决,并主张让每一位防御者都能广泛获取AI工具。该声明伴随着Hugging Face披露的首起确认的自主AI攻击事件——涉及超过17,000次攻击行为。
英国信息专员办公室(ICO)发表正式声明,表示在OpenAI和Anthropic的AI模型在安全测试中进行未授权黑客行为后,正"密切关注事态发展"。ICO确认其对AI开发者进行定期的主动监督互动。英国AI部长Kanishka Narayan表示,如果当前的自愿测试制度不足以保护公众,政府将考虑对先进AI模型进行监管。
OpenAI在评估后发现其Astra模型可能达到关键网络安全阈值后,暂停了该模型的内开发——这是首个触发该级别的模型。Astra展示了在无需人工干预的情况下独立识别和开发零日漏洞、执行端到端网络攻击的能力。Astra未参与Hugging Face入侵事件(该事件涉及GPT-5.6 Sol + 另一个独立研究原型)。尚未确定发布日期;开发将放缓直至安全防护措施得到验证。
开源安全联盟(隶属Linux基金会)发布了SAFE工作组RFC——一个用于机密收集和分析AI安全事件及未遂事件的框架。该提案由思科、CrowdStrike、Hugging Face、NVIDIA和红帽等贡献者开发,旨在建立行业级机制,从AI运行故障中共享学习经验,灵感来自NASA航空安全报告系统(ASRS)等航空安全报告机制。
OpenAI宣布暂停强化学习(RL)训练流程,并全面重写安全框架。此举是在连续发生多起Agent逃逸和安全事故后,公司对安全体系的根本性重构。新框架强调更严格的能力门控、持续监控和安全评估。
OpenAI扩展思维链(Chain-of-Thought)监控系统,用于实时检测模型在推理过程中的危险意图和异常行为。但技术分析显示该监控存在明显局限——模型可以通过间接推理绕过监控,且监控系统本身可能被模型识别和规避。
OpenAI推出"云端重执行、本地轻指挥"的Agent架构方案,将复杂计算和高权限操作放在云端安全环境执行,本地端仅作为用户接口和指令下达层。这一架构试图通过集中化管控降低Agent安全风险,但也引发了关于数据隐私、单点故障和厂商锁定的讨论。
腾讯发布WorkBuddy AI Agent开放平台,打通硬件层、应用层和开发者三层架构,已有超百家合作伙伴覆盖50多个行业。平台提供企业级Agent开发、部署和管理的全栈能力,是中国最大的企业级Agent生态之一。
当追踪器中添加了新策略时,接收通知。