7类评估器加灰度发布,华为云把Agent治理推进运行时

2026年08月26日 由 ATYUN编辑部 发表 405 0
两组版本模块经过流量分配装置接入网关,并由七个评估单元和审计机构共同约束
原创示意图:版本流量、评估、日志与运行时防护共同组成Agent生产控制面,画面并非华为云实际设备。

企业Agent最危险的时刻,往往不是它回答错一道测试题,而是新版本带着错误权限、失控工具调用或断裂会话直接接管全部流量。华为云AgentArts在8月更新中没有再把重点放在模型排行榜,而是一次性补上智能体卫士、灰度策略、网关会话、第三方日志、七类评估器和运行时会话存储。它传递出的信号很清楚:Agent平台正在从“能编排”转向“能上线、能观察、能撤回”。

上线不再一次切换:主要版本与次要版本可按比例分流,先让小范围新会话验证,再决定是否扩大流量。
评估进入执行链:新增七类模型判定评估器,覆盖角色违规、Skill完整度、相关性、威胁、声明对齐、设计质量与Rubric。
治理对象不只自家Agent:第三方托管智能体可把日志上报到AgentArts,与平台内应用统一观测和运维。

智能体卫士盯住全量轨迹,安全开始面对“过程”

传统应用安全更习惯检查入口、身份和最终输出,但Agent会在一次任务中连续检索知识、调用MCP工具、运行代码并修改外部系统。只看答案,无法解释事故发生在哪一步。AgentArts此次让单智能体、工作流和多智能体都能在部署时开启“智能体卫士”,实时检测执行链路与操作轨迹,监控全量行为并识别异常。

这更接近生产系统需要的控制面:安全团队看到的是谁在什么上下文中调用了哪个工具、产生了怎样的状态变化,而不是事后翻一段聊天记录。配合此前已有的Trace、Metric和工具调用指标,FDE团队可以把模型错误、工具失败、权限越界与基础设施故障拆开定位。不过官方尚未公开异常规则覆盖率、误报率和处置时延,卫士目前更像可用的观测入口,而非已经证明能自动阻断所有风险。

灰度策略解决的不是发布速度,而是失败半径

新的运行时访问方式允许同时指定主要版本和次要版本,并把流量比例配置为合计100%。次要版本可以从极小流量开始,新建会话按权重进入不同版本;当次要版本比例归零,全部请求回到主要版本。它把Agent升级从“覆盖Latest”改成了可控制的验证过程。

这项能力与网关会话保持密切相关。开启后,同一个mcp-session-id会持续指向原后端Target,避免多轮对话中途漂移到另一套状态;会话存储又可保存上下文、中间结果和用户偏好。对需要长链任务的企业而言,版本隔离、会话粘性和状态持久化必须一起设计,否则所谓灰度可能只是把同一位用户随机送进两个不兼容世界。

七类评估器把Skill从“装上了”推进到“是否守规矩”

七个预置模型判定评估器不只评价回答好不好,还检查Agent有没有偏离角色、Skill声明与实际行为是否一致、Skill是否完整和相关、设计是否存在威胁,以及能否按自定义Rubric完成任务。这种评估更贴近企业验收:同一个Agent可能语言流畅,却调用了不该使用的工具,或在压力对话中逐步突破业务边界。

第三方托管智能体日志接入进一步扩大了评估范围。企业不必为了统一看板而把所有Agent重写到同一框架,只需创建接入实体并配置日志地址与鉴权信息,就能把多源运行数据汇总。真正落地时仍应建立人工复核样本,因为模型裁判可能继承偏差,自动评分也不能替代业务责任人对高风险动作的审批。

编辑判断:生产工具箱成形,但还缺公开的生产成绩单

这批更新的价值不在单个按钮,而在发布、路由、状态、观测、评估和安全开始围绕同一运行时闭环。对FDE团队,它给出了一套可复用交付顺序:先定义失败样本与审批边界,再建立版本流量和会话隔离,随后接入全链路日志,用评估结果决定扩量或回退。Agent项目也因此有机会从“演示通过”升级为可签字验收的工程。

边界同样明确:本轮七项能力均处于公测,官方没有公布规模上限、服务等级、价格、误报漏报、回滚耗时或具名客户的生产数据。企业不应把功能存在等同于治理完成。下一步最值得观察的,是灰度期间如何绑定业务指标与安全阈值、智能体卫士能否触发自动降级,以及模型评估与人工审批如何共同决定发布门槛。只有这些数字出现,AgentArts才真正从工具集合走向可验证的生产平台。

文章来源:AI Agent
欢迎关注ATYUN官方公众号
商务合作及内容投稿请联系邮箱:bd@atyun.com
评论 登录
热门职位
Maluuba
20000~40000/月
Cisco
25000~30000/月 深圳市
PilotAILabs
30000~60000/年 深圳市
写评论取消
回复取消