← 交付方法总览
质量体系可泛化原则

确定性验证器 vs LLM 判官

质量

领域智能体的验收有两种引擎:确定性验证器(代码,逐字/重算可判)与 LLM 判官(语义评分)。用错引擎会失败——把数值算数交给 LLM 会算错,把语义相关性写成逐字断言会脆断。本文件给出明确的分工判据、两者取严合并的规则、以及"把 must-not-say 编成确定性短语目录"和"数值不交 LLM 算"两条硬规则。

这套方法怎么落到你的项目

这是我们交付 AI 业务系统的公开方法论骨架。真正落地时,从 生产就绪审查与路线图 入手,或先用 上线前自检 定位薄弱环节。