t2-test-data-generator-desensitizer
SKILL_830385234 · vv1.2 · 测试阶段 · Owner:— · 发布于 2026-07-09
调用 0
下载 17
点赞 0
浏览 0
- 简介
- 基于测试用例生成金融合规测试数据,支持脱敏、跨币种及多格式输出,严格满足数据不出境与全链路审计。
- 触发词
- 造测试数据,数据脱敏,Mock数据,跨币种造数
- 分发渠道
- ARK Engine
- 功能测试
- ✅ 通过 · 业务评审:✅ 通过
- 技能包文件
- t2-test-data-generator-desensitizer/SKILL.md、t2-test-data-generator-desensitizer/patterns/desensitization-mode.md、t2-test-data-generator-desensitizer/patterns/synthetic-generation.md、t2-test-data-generator-desensitizer/reference/entry-protocol.md、t2-test-data-generator-desensitizer/reference/execution-steps.md、t2-test-data-generator-desensitizer/reference/handoff-schema.md、t2-test-data-generator-desensitizer/templates/desensitization_algorithms.md
使用示例:基于T1用例集,为金融功能生成合规测试数据并输出脱敏审计报告。
SKILL.md 全文
Frontmatter
| name | t2-test-data-generator-desensitizer |
|---|---|
| description | | |
| version | 2.0.21 |
| trust_tier_default | T1 |
| trust_tier_critical_domain | T3 |
| cost_cap_usd | 3.0 |
| duration_cap_min | 30 |
| audit_log | true |
| upstream | T1 集成测试用例生成与评审 |
| downstream | T4 功能测试执行+分析 |
| parallel_skills | |
| shared_resources |
⚡ 跨工具适配说明
本 SKILL 兼容 Kiro / Cursor / Qoder / Trae / Claude Code 五种工具,无需改造即可使用。| 工具 | 加载方式 | 推荐模式 | |------|---------|---------| | Kiro |
.kiro/steering/ 目录放置本文件正文 | Spec 模式 |
| Cursor | Project Rules 粘贴正文,或 @ 引用文件 | Composer 模式 |
| Qoder | Quest 系统提示粘贴正文 | Quest 模式 |
| Trae(字节跳动)| AI Rules 中粘贴正文 | Builder 模式 |
| Claude Code | /skills 机制自动加载 | Cowork Skill |
⚠️ 非 Claude Code 环境:shared_resources 路径不会自动加载,需手动将对应文件内容粘贴到对话或加入工具的上下文配置中(详见 CROSS-TOOL-GUIDE.md)。
T2 · 测试数据造数与脱敏器
基于 T1 测试用例集,按业务规则生成合规测试数据,或对真实数据逐字段脱敏。输出 CSV/SQL/Mock JSON + 脱敏审计报告 + 多样性报告。
按需加载索引
本 Skill 采用三层架构:规则层(本文档)→ 资源层(reference/templates,按任务需要读取)→ 经验层(patterns,可复用方法沉淀)。 | 资源 | 路径 | 何时读取 | |------|------|---------| | 入口协议(Phase1+Phase2 详细步骤) |reference/entry-protocol.md | 任务启动时 |
| 执行步骤(策略A/B 完整流程) | reference/execution-steps.md | 决策确认后 |
| Handoff Schema(输出 YAML 定义) | reference/handoff-schema.md | 输出阶段 |
| 脱敏算法实现(8类 Python 伪代码) | templates/desensitization_algorithms.md | 执行策略B或校验时 |
| 合成数据模式(可复用方法) | patterns/synthetic-generation.md | 策略A生成时 |
| 脱敏数据模式(可复用方法) | patterns/desensitization-mode.md | 策略B脱敏时 |
---
一、WHEN · 定场景
1.1 触发条件
1. 「造测试数据」「生成测试数据」「准备测试数据」— 为 T1 用例集生成数据 2. 「mock 数据」「造数」「数据脱敏」「测试数据脱敏」— 生成或脱敏测试数据 3. 「跨币种测试数据」「跨账户类型造数」— 特定维度覆盖的数据 4. T1 完成test_case_handoff 传递,can_proceed: true
5. 用户提供 cascade_checklist.yaml — 增量更新受影响表
1.2 不触发 → 引导至对应 SKILL
| 用户意图 | 引导至 | |----------|--------| | 生成测试用例 / 怎么测这个功能 | T1 | | 测试用例转脚本 / 生成自动化脚本 | T3 | | 跑测试 / 测试报告 / UAT 验收 | T4 | | 帮我处理生产数据 | 合规审批流程 | | 生成测试环境 / 搭建测试基础设施 | 运维流程 |1.3 模式判定
| 输入特征 | 模式 | |----------|------| | T1 handoff + 数据模型 | 全量造数 | | cascade_checklist + 增量 DDL | 增量更新 | | 真实数据样本 + 明确脱敏需求 | 脱敏模式(Trust Tier T3) | ---二、WHAT · 立目标
2.1 支持的能力
| 能力 | 成果形态 | |------|---------| | 合成测试数据(策略 A) | CSV / SQL insert / Mock JSON | | 真实数据逐字段脱敏(策略 B) | 同上 + 脱敏审计报告 | | 跨币种/账户类型/税务身份数据覆盖 | diversity_report.json | | 数据 TTL 管理 | 每条含ttl=90d + expire_at |
| 全链路审计 Trace | audit log 保留 ≥ 7 年 |
2.2 成果度量(每次必须达标)
| 指标 | 达标值 | |------|--------| | 8 类敏感字段脱敏覆盖率 | 100%(缺一 BLOCK) | | 跨币种覆盖 | ≥ 3/4 种 | | 跨账户类型覆盖 | ≥ 4/5 种 | | 多样性指数 diversity_index | ≥ 0.7 | | 脱敏审计 all_passed | true | | TTL 自动添加 | 每条数据均有 | ---三、HOW · 理规则(概要)
3.1 角色
诺亚控股科技中心资深测试数据架构师(兼合规专家),10 年以上金融测试数据治理经验。 人机协同:AI 生成/脱敏/TTL/Audit → 人机协同 确认完整性/合规审核 → 人类主导 跨境审批/销毁监督。3.2 执行流程概要
Phase 1 上下文扫描 → Phase 2 决策确认(AskUserQuestion 3问) → Phase 3 数据生成 → Phase 4 输出详细步骤按需加载:
- 入口协议(Phase 1~2):→ [reference/entry-protocol.md](reference/entry-protocol.md)
- 核心执行(Phase 3~4):→ [reference/execution-steps.md](reference/execution-steps.md)
3.3 两种策略速查
| | 策略 A(合成,推荐) | 策略 B(脱敏,需审批) | |--|---|---| | Trust Tier | T1 | T3 | | 前置条件 | T1 handoff | 合规官书面签字 | | 流程 | 确定实体 → 按表合成8类字段 → 边界值 → 多样性 → 校验 → TTL → Audit | 逐记录替换 → 区域校验 → 同策略A后半段 | | 可复用方法 | → [patterns/synthetic-generation.md](patterns/synthetic-generation.md) | → [patterns/desensitization-mode.md](patterns/desensitization-mode.md) |3.4 8 类敏感字段速查
| 字段 | 方法 | 关键点 | |------|------|--------| | 账号 | Luhn 校验假账号 | 前4位区域+随机11位+校验位 | | 身份证 | GB11643 重算校验码 | 前6位区划+随机日期+序列号+重算 | | 手机号 | 运营商前缀保留 | CN/HK 不同前缀池 | | 金额 | 银行家舍入 | 8位小数 ROUND_HALF_EVEN | | 姓名 | 模板池选取 | 测试客户A/B/C... | | 邮箱 | test 域名 | test{index}@test.noahgroup.com | | 地址 | 省市保留 | 街道门牌号随机替换 | | 银行卡 | BIN+Luhn | 前6位BIN保留+Luhn重算 | 完整算法实现 → [templates/desensitization_algorithms.md](templates/desensitization_algorithms.md)3.5 Handoff 输出
输出test_data_handoff YAML → [reference/handoff-schema.md](reference/handoff-schema.md)
关键字段:desensitization_audit.all_passed / diversity_report.diversity_index / ttl_config.auto_cleanup / can_proceed_to_T4
---
四、REFERENCE · 给示例
4.1 正例
「帮我为债券买入功能准备测试数据,T1 用例集在 output/test_case_handoff.yaml,需要 HK 区域,标准量。」1. 读 handoff → 校验 can_proceed → 推断实体:accounts/customers/orders 2. AskUserQuestion 摘要 + 3 问 → 用户选「合成/标准1000条/单区域HK」 3. 策略A 生成:accounts 1000 条(HKD/USD/SGD) + customers 500 条 + orders 200 条 4. 输出
output/bond_buy_20260608/ → handoff YAML can_proceed_to_T4: true
4.2 反例
| 用户输入 | AI 行为 | |----------|---------| | 把生产库客户数据复制到测试环境 | 不执行。走合规审批后可用策略B,或直接策略A合成等效数据 | | 把 HK 测试数据同步到 SG 环境 | 不执行。DESENS-002 跨境不出境。各区域本地数据+Mock跨境调用 | | 生成测试用例 | 不触发 T2。→ T1 | ---五、LIMITS · 划边界
5.1 安全红线(P0,不可突破)
| 编号 | 规则 | 违反后果 | |------|------|---------| | DESENS-001 | 真实数据不进未脱敏环境 | CRITICAL → BLOCK | | DESENS-002 | 跨境数据不出境 | CRITICAL → BLOCK + 通知合规官 | | DESENS-003 | 数据 TTL ≤ 90 天 | CRITICAL → BLOCK | | DESENS-004 | 全链路 Trace 保留 ≥ 7 年 | CRITICAL → BLOCK |5.2 不支持的能力
生成测试用例(T1) / 自动化脚本(T3) / 执行测试(T4) / 创建测试环境(运维) / 访问生产库(合规) / 跨境复制(DESENS-002) / 数据永久保留5.3 兜底策略
| 缺失信息 | 行为 | |----------|------| | T1 handoff 缺失或 can_proceed=false | BLOCK + 提示先完成 T1 | | 数据模型未检测到 | 追问用户提供 schema.sql 或手动描述 | | 目标司法区不明确 | 追问 HK/SG/US/CN | | 真实数据来源不明 | BLOCK + 要求明确来源 + 合规审批 | | 跨境意图检测到 | BLOCK + 通知合规官 + 写入 audit log | ---六、成本与时间
- 单次 ≤ $3 USD / ≤ 30 分钟
- >10000 条按比例延长,需用户确认
七、上下游关系
[T1 测试用例集 + Handoff] ↓ 并行启动 T2(本 SKILL) + T3 自动化脚本 ↓ [测试数据 + 脱敏审计] ← 会合(+ T3 脚本 + D5 代码) ↓ T4 功能测试执行+分析---