交付物评估准则

作者:鹿Sir通用技能v1

为交付物评估提供统一的评分方法论,定义完整性、正确性、质量、安全、性能五大评估维度,含问题严重度分级(critical/major/minor)、通过/不通过判定阈值与结构化评审结论输出格式。当用户需要评估交付物质量、制定验收标准、给成果打分、做质量评审结论时触发。触发词:评估准则、验收标准、质量评分、交付评审。

下载量
389
点赞
95
价格
免费

技能文档

---
name: masanao-ohba-evaluation-criteria
title: 交付物评估准则
category: 通用技能
description: 为交付物评估提供统一的评分方法论,定义完整性、正确性、质量、安全、性能五大评估维度,含问题严重度分级(critical/major/minor)、通过/不通过判定阈值与结构化评审结论输出格式。当用户需要评估交付物质量、制定验收标准、给成果打分、做质量评审结论时触发。触发词:评估准则、验收标准、质量评分、交付评审。
---

# 交付物评估准则

一套与技术栈无关的交付物评估方法,定义「交付物应该怎么评」。

## 核心用途

为以下场景建立一致、客观的准则:

- 评估交付物质量
- 对照需求打分
- 做出通过/不通过判定
- 给出可执行的改进反馈

## 技能工作流

### 步骤1:确定评估范围

与用户对齐评估对象、需求文档与验收标准,确认五个维度各自的适用性(如纯文档交付可裁剪性能维度)。

### 步骤2:逐维度评估

按下文五维度清单逐项核对,为每个维度记录 0-100 分、PASS/FAIL 状态与问题列表。

### 步骤3:问题分级

把发现的问题按 critical / major / minor 分级,注明位置与影响。

### 步骤4:套用判定规则

按「通过/不通过判定」一节的阈值计算整体结论,critical 问题直接否决。

### 步骤5:输出评审结论

按统一输出格式生成结构化报告,并附可执行的反馈条目。

## 评估维度

### 完整性(completeness)

```yaml
dimension: completeness
question: "要求的内容是否都齐了?"

criteria:
  functionality:
    - "规格中的功能全部实现"
    - "用户故事全部覆盖"
    - "验收标准全部满足"

  coverage:
    - "边界情况全部处理"
    - "错误路径全部覆盖"
    - "所有集成点已联通"

  documentation:
    - "要求的文档齐备"
    - "API 文档完整"
    - "必要处有注释"

scoring:
  pass: "必备项 100% 齐备"
  fail: "任一必备项缺失"
```

### 正确性(correctness)

```yaml
dimension: correctness
question: "它能不能正确工作?"

criteria:
  functional:
    - "业务逻辑准确"
    - "计算正确"
    - "数据变换有效"

  behavioral:
    - "产出符合预期"
    - "错误处理得当"
    - "边界情况处理正确"

  integration:
    - "外部系统已联通"
    - "数据流转正确"
    - "API 响应正确"

scoring:
  pass: "测试全部通过,无逻辑错误"
  fail: "任一测试失败或存在逻辑错误"
```

### 质量(quality)

```yaml
dimension: quality
question: "它做得好不好?"

criteria:
  code_standards:
    - "遵循项目约定"
    - "无静态检查错误"
    - "格式一致"

  architecture:
    - "遵循设计模式"
    - "关注点正确分离"
    - "依赖管理得当"

  maintainability:
    - "代码可读"
    - "复杂度可控"
    - "无代码坏味道"

scoring:
  pass: "无 critical 问题,major 问题极少"
  fail: "存在 critical 问题"
```

### 安全(security)

```yaml
dimension: security
question: "它安全吗?"

criteria:
  vulnerabilities:
    - "无 SQL 注入"
    - "无 XSS 漏洞"
    - "无 CSRF 漏洞"

  authentication:
    - "鉴权检查完备"
    - "密码处理安全"
    - "会话管理正确"

  data_protection:
    - "敏感数据已加密"
    - "个人敏感信息处理合规"
    - "具备审计日志"

scoring:
  pass: "未发现安全漏洞"
  fail: "存在任一安全漏洞"
```

### 性能(performance)

```yaml
dimension: performance
question: "它的表现达标吗?"

criteria:
  response_time:
    - "API 响应 < 200ms(95 分位)"
    - "页面加载 < 3 秒"

  resource_usage:
    - "内存占用合理"
    - "CPU 使用高效"
    - "无内存泄漏"

  scalability:
    - "能承载预期负载"
    - "无 N+1 查询"
    - "必要处已做缓存"

scoring:
  pass: "达到性能阈值"
  fail: "低于性能阈值"
```

## 评分体系

### 严重度分级

```yaml
severity_levels:
  critical:
    definition: "验收前必须修复"
    examples:
      - "安全漏洞"
      - "数据损坏风险"
      - "核心功能不可用"
    impact: "直接判定 FAIL"

  major:
    definition: "验收前应当修复"
    examples:
      - "逻辑错误"
      - "缺失测试"
      - "性能问题"
    impact: "累计触发阈值判定"

  minor:
    definition: "可以稍后处理"
    examples:
      - "风格改进"
      - "文档缺口"
      - "小型优化"
    impact: "记录在案,不阻塞"
```

### 通过/不通过判定

```yaml
pass_criteria:
  all_of:
    - "无任何 critical 问题"
    - "关键维度全部通过(完整性、正确性、安全)"
  threshold:
    - "major 问题 <= 3"
    - "总分 >= 80%"

fail_criteria:
  any_of:
    - "存在任一 critical 问题"
    - "任一关键维度不通过"
    - "major 问题 > 5"
    - "总分 < 60%"
```

## 输出格式

```yaml
evaluation:
  overall_verdict: PASS|FAIL
  overall_score: <0-100>

  dimensions:
    completeness:
      score: <0-100>
      status: PASS|FAIL
      issues: [...]

    correctness:
      score: <0-100>
      status: PASS|FAIL
      issues: [...]

    quality:
      score: <0-100>
      status: PASS|FAIL
      issues: [...]

    security:
      score: <0-100>
      status: PASS|FAIL
      issues: [...]

    performance:
      score: <0-100>
      status: PASS|FAIL
      issues: [...]

  issue_summary:
    critical: <数量>
    major: <数量>
    minor: <数量>

  feedback:
    - "<可执行的反馈条目>"
```

## 适用范围

本准则作为评估方法论,供交付物评审、质量审查类技能或角色引用:

```yaml
primary_users:
  - "交付物评估者:作为核心评估方法论"
  - "质量审查者:作为质量评估依据"
```

使用说明

# 交付物评估准则

用统一的五维度方法论评估交付物:完整性、正确性、质量、安全、性能,配合严重度分级与通过阈值,输出结构化评审结论。

## 使用

```text
用评估准则审查这次迭代的交付物,对照需求文档逐维度打分并给出验收结论。
```

输出为结构化结论:各维度得分与 PASS/FAIL、问题分级统计(critical/major/minor)、可执行反馈清单,以及整体 PASS/FAIL 判定。

## 工作原理

1. 逐维度核对标准清单(功能覆盖、错误路径、代码规范、安全漏洞、性能阈值等)
2. 按 critical/major/minor 分级记录问题,critical 直接否决
3. 套用判定规则:关键维度全过、major ≤ 3 且总分 ≥ 80% 判 PASS;存在 critical、major > 5 或总分 < 60% 判 FAIL

如何安装此技能?

访问技能市场,点击「安装」按钮,按提示将技能包放入 AI 编程助手的 skills 目录即可。

浏览技能市场

支持平台:Qoder · QoderWork · Claude · Codex 等 AI 编程助手