← 交付方法总览
质量体系可泛化原则

红队与安全 Eval(Red-Team & Safety Eval)

质量

领域智能体接了真实数据源、真实权限、真实工具。功能对了不等于安全对了:它可能越权取数、把内部字段泄给用户、被用户话术注入而改变行为、或在没验证过的情况下声称「数据不可用」。安全与权限边界是可测项,不是上线后再看的运气。 本文把安全约束编成红队与安全 eval 用例:越权、数据泄露、提示注入、诚实性、负例/对抗话术,配即时失败条件,并把 AGENTS 红线直接编成 eval。

这套方法怎么落到你的项目

这是我们交付 AI 业务系统的公开方法论骨架。真正落地时,从 生产就绪审查与路线图 入手,或先用 上线前自检 定位薄弱环节。