
企业Agent最危险的时刻,往往不是它回答错一道测试题,而是新版本带着错误权限、失控工具调用或断裂会话直接接管全部流量。华为云AgentArts在8月更新中没有再把重点放在模型排行榜,而是一次性补上智能体卫士、灰度策略、网关会话、第三方日志、七类评估器和运行时会话存储。它传递出的信号很清楚:Agent平台正在从“能编排”转向“能上线、能观察、能撤回”。
传统应用安全更习惯检查入口、身份和最终输出,但Agent会在一次任务中连续检索知识、调用MCP工具、运行代码并修改外部系统。只看答案,无法解释事故发生在哪一步。AgentArts此次让单智能体、工作流和多智能体都能在部署时开启“智能体卫士”,实时检测执行链路与操作轨迹,监控全量行为并识别异常。
这更接近生产系统需要的控制面:安全团队看到的是谁在什么上下文中调用了哪个工具、产生了怎样的状态变化,而不是事后翻一段聊天记录。配合此前已有的Trace、Metric和工具调用指标,FDE团队可以把模型错误、工具失败、权限越界与基础设施故障拆开定位。不过官方尚未公开异常规则覆盖率、误报率和处置时延,卫士目前更像可用的观测入口,而非已经证明能自动阻断所有风险。
新的运行时访问方式允许同时指定主要版本和次要版本,并把流量比例配置为合计100%。次要版本可以从极小流量开始,新建会话按权重进入不同版本;当次要版本比例归零,全部请求回到主要版本。它把Agent升级从“覆盖Latest”改成了可控制的验证过程。
这项能力与网关会话保持密切相关。开启后,同一个mcp-session-id会持续指向原后端Target,避免多轮对话中途漂移到另一套状态;会话存储又可保存上下文、中间结果和用户偏好。对需要长链任务的企业而言,版本隔离、会话粘性和状态持久化必须一起设计,否则所谓灰度可能只是把同一位用户随机送进两个不兼容世界。
七个预置模型判定评估器不只评价回答好不好,还检查Agent有没有偏离角色、Skill声明与实际行为是否一致、Skill是否完整和相关、设计是否存在威胁,以及能否按自定义Rubric完成任务。这种评估更贴近企业验收:同一个Agent可能语言流畅,却调用了不该使用的工具,或在压力对话中逐步突破业务边界。
第三方托管智能体日志接入进一步扩大了评估范围。企业不必为了统一看板而把所有Agent重写到同一框架,只需创建接入实体并配置日志地址与鉴权信息,就能把多源运行数据汇总。真正落地时仍应建立人工复核样本,因为模型裁判可能继承偏差,自动评分也不能替代业务责任人对高风险动作的审批。
这批更新的价值不在单个按钮,而在发布、路由、状态、观测、评估和安全开始围绕同一运行时闭环。对FDE团队,它给出了一套可复用交付顺序:先定义失败样本与审批边界,再建立版本流量和会话隔离,随后接入全链路日志,用评估结果决定扩量或回退。Agent项目也因此有机会从“演示通过”升级为可签字验收的工程。
边界同样明确:本轮七项能力均处于公测,官方没有公布规模上限、服务等级、价格、误报漏报、回滚耗时或具名客户的生产数据。企业不应把功能存在等同于治理完成。下一步最值得观察的,是灰度期间如何绑定业务指标与安全阈值、智能体卫士能否触发自动降级,以及模型评估与人工审批如何共同决定发布门槛。只有这些数字出现,AgentArts才真正从工具集合走向可验证的生产平台。
