《云上Agent基准度量模型》正式发布,腾讯云推动云上Agent安全、稳定、可信
7月29日,在2026可信云大会暨首届Token云服务大会上,《云上Agent基准度量模型》正式发布。腾讯旗下WorkBuddy、CloudQ、AndonQ、MigraQ等产品首批通过了基准认证。
_20260730171215_635.png)
《度量模型》由中国信息通信研究院牵头起草,云计算开源产业联盟发布为技术文件,中国通信标准化协会提出并归口。腾讯云以丰富的Agent产品经验参与模型编制,构建统一的云上Agent度量评估框架。
建立统一度量框架,引入“双重授权”,为Agent设置可控边界
《云上Agent基准度量模型》标准从功能性、安全性、可靠性、用户体验、性能效率和成本效益六个维度,对云上Agent运行表现进行度量,覆盖单智能体和多智能体任务成功率、意图识别准确率、提示词注入防御率、工具滥用率、隐私数据输出率、记忆串扰率、行为可追溯率等指标。在度量范围方面,延伸至Agent决策、工具调用、任务执行和异常处置等运行链路,推动Agent从“能完成任务”进一步走向“可稳定运行、可持续评估”。
在上述六维度度量框架中,如何为自动化操作设定可控边界,是《度量模型》重点回答的问题之一。《度量模型》中针对智能体工具调用提出建议,对于影响范围较广的自动化操作,要求在关键环节增加人工二次确认,明确智能体需要遵守被调用工具的平台规则、安全策略和数据使用政策,禁止未授权的操作及截屏录屏等敏感行为,并通过“人类批准依赖度分层”等指标,对不同任务类型所需的人工确认比例进行度量。
这一设计并非简单限制Agent自主执行,而是按照业务影响范围设置不同的人机协作边界:核心级操作强调关键环节确认、重要级操作可根据风险保留必要的人为介入、一般级操作则可在可控范围内提高自动化程度。而提高自动化程度的同时,也需要遵守政策、规则与策略,避免影响第三方工具的权益,更好地为用户提供智能体服务。《度量模型》同时通过任务中止正确率、任务中止恰当率、升级求助恰当率、行为可追溯率和行为可控率等指标,评价Agent是否能够在应当停止、求助或请求确认时作出合理决策。
由此,《度量模型》中的人工监督从原则性要求进一步转化为可分级、可度量的运行机制,有助于降低Agent因误判或越权操作带来的风险,也为金融、政务、云运维等对操作安全要求较高的场景提供更明确的建设参考。
沉淀多场景Agent安全实践,腾讯云以产品能力推动标准共建
2026年上半年,AI Agent的产品形态与应用边界快速变化。腾讯从轻量云部署OpenClaw起步,持续迭代产品矩阵:面向个人场景推出QClaw、WorkBuddy;面向云运维垂直场景上线CloudQ、AndonQ、MigraQ;面向企业客户提供ADP与ClawPro,逐步形成覆盖个人开发者、垂直行业、企业级客户的完整Agent产品体系。在产品成长的同时,Agent开发、使用、管理、运维过程中的安全性也是腾讯的核心关注。
7月8日,中国信通院发布首批互联网智能体治理系列评估结果,腾讯云WorkBuddy、QClaw、ClawPro、轻量云OpenClaw、云桌面云手机Claw五款产品通过能力评估,腾讯统一身份OneID通过可信互联握手(ATH)能力评估。围绕Agent运行安全,腾讯先后推出AI Agent安全中心、Agent安全网关等产品,从运行时防护、技能分发、身份管控到企业级管控,为Agent产品提供安全保障。
以WorkBuddy为例,系统架构层面支持多种权限模式,配备安全中心和安全沙箱,可结合操作意图识别拦截高危操作;针对第三方Skill等运行风险,构建覆盖“入口拦、运行检、兜底断”的多层防护体系,第三方Skill须通过安全检测后方可启用;数据安全方面采用全链路TLS加密和最小权限原则,并接入腾讯统一身份OneID实现身份与权限管控。
基于这些实践,腾讯云参与《度量模型》编制,为云上Agent稳定、安全运行的度量指标、评估方法和技术要求等提供了丰富建议和实践指引。
1.本网刊载内容,凡注明来源为“飞象网”和“飞象原创”皆属飞象网版权所有,未经允许禁止转载、摘编及镜像,违者必究。对于经过授权可以转载,请必须保持转载文章、图像、音视频的完整性,并完整标注作者信息和飞象网来源。
2.凡注明“来源:XXXX”的作品,均转载自其它媒体,在于传播更多行业信息,并不代表本网赞同其观点和对其真实性负责。
3.如因作品内容、版权和其它问题,请在相关作品刊发之日起30日内与本网联系,我们将第一时间予以处理。
本站联系电话为86-010-87765777,邮件后缀为cctime.com,冒充本站员工以任何其他联系方式,进行的“内容核实”、“商务联系”等行为,均不能代表本站。本站拥有对此声明的最终解释权。
股民心态与光通信无关,刷大盘不如多洞察
今年以来,股市与光通信行业产生了紧密联系,也成了很多人茶余饭后的谈资,就连网络上的段子都开始调侃SPA店里的按摩师都要买入光模块。一时之间,曾经很多人都不知为何物的东西,成为你懂我..[详细]
从香江防线到草原新城:UQC如何重塑全球安全与创新版图
在2026世界人工智能大会期间举办的未来计算•未来算力论坛上,深圳理工大学教务长、国际欧亚科学院院士赵伟,用一句话就交代了当今量子计算究竟发展到了什么程度,并且还让原本极具学术..[详细]
2030年用户数将达9.5亿!IPv6开启高质量发展新征程
近日,中央网络安全和信息化委员会印发《深化互联网协议第六版(IPv6)技术创新和融合应用实施方案(2026—2030年)》(以下简称《实施方案》),明确到2027年,IPv6端到端贯通水平全面提升..[详细]
AI下一站:从“虚拟世界”走向“物理世界”
过去几年,人工智能行业竞争主要集中在大模型上,比拼的是参数、数据训练和推理能力,甚至每隔几个月,模型榜单的座次就会发生变化。而在2026 世界人工智能大会的论坛现场,最明显的感受是,..[详细]
各种AI端云模型大爆发,路由的重要性开始凸显
路由是很多人所熟悉的词汇,最先想到的莫过于家中的路由器,它在网络层面,将数据拆分为一个个小小的“数据包”,以最经济的传输路径,把数据传给下一个节点。如今,“路由”一词又越来越多..[详细]
从文科生到理科生:AI如何走出屏幕,解码世界模型底层架构
为什么一个能写出满分作文的AI,却无法准确预测一个滚落马路的皮球,后面有可能跟着一个慌慌张张来捡球的小孩?7月18日,在2026世界人工智能大会专题研讨会现场,这个问题,以及背后更深刻的..[详细]













