← 交付方法总览
打分卡可泛化原则
成熟度打分卡 Maturity Scorecard(五级 × 四闭环)
横切
按四个闭环乘五个等级评估团队当前能力,用来决定下一步补哪一块。它的输出不是一个总分,而是一句具体的话:当前最短的是哪一环、跨到下一档要做成什么。
什么时候需要它
- 要制定能力建设计划,避免四线并进摊薄资源
- 需要解释为什么增加人手不解决当前的质量问题
核心内容
它决定什么
公开的是判断与判据。客户口径、私有阈值和内部示例不在其中。
四环分别评,不合成总分
真相、交付、质量、学习各自给一个等级。合成总分会掩盖结构性短板,而短板恰恰是唯一值得投入的地方。
评分要有证据
每一档的判定应当指向具体事实:有没有 Probe 留痕、有没有可判定的 Exit Gate、有没有护栏、有没有成功的移交。自评感觉不算。
找最短的那一环
交付能力的上限由最弱闭环决定。真相闭环停在 L1 时,质量闭环做到 L4 测的仍然是错的口径。
一次只跨一档
从 L2 到 L3 的关键动作是把人工评审变成可判定判据,从 L3 到 L4 是把判据变成不可绕过的护栏。跨档动作具体且有限,不需要全面改造。
定期重评
人员流动、项目更替之后能力会回落。等级不是一次达成永久保持的。
加人不解决等级问题
L1 到 L2 缺的是固定做法,L2 到 L3 缺的是可判定判据,L3 到 L4 缺的是不可绕过的护栏。这三样都不是人手不足造成的,因此也不能靠加人补上。
怎么判断它真的到位
- 四环各有等级,每个等级都能举出支撑证据
- 改进计划只针对最弱的一到两环
- 能说出跨到下一档具体要做成的那件事
常见误区
- 把等级当考核指标,自评普遍虚高
- 四环同时推进,资源摊薄,哪一环都没跨过分水岭
- 评完就归档,没有转化成具体待办
这套方法怎么落到你的项目
这是我们交付生产级 AI Agent 的公开、脱敏方法骨架。真正落地时,从 AI Agent 生产就绪审查与路线图 入手,或先用 生产上线前深检 定位薄弱环节。
