auto-test-skill — independently scanned and version-tracked by SaferSkills.
SaferSkills independently audited auto-test-skill (Agent Skill) and scored it 100/100 (green). The audit ran 55 deterministic rules across Security, Supply Chain, Maintenance, Transparency, and Community; it found 0 high-severity and 0 lower-severity findings. The full rule-by-rule trace and per-finding evidence are below. Free, methodology-open.
Findings & checks · 0 flagged
Every scanned point with the score it earned and what moved between them.
First recorded scan — no prior version to compare against.
The primary manifest — the file an agent reads to learn what this artifact does.
bensz-collect-bugs 规范记录到 ~/.bensz-skills/bugs/,不要直接修改用户本地已安装的 skill 源码;若有 workaround,先记 bug,再继续完成任务。gh 上传新增 bug 到 huangwb8/bensz-bugs;不要 pull / clone 整个仓库。本 skill 的交付不是“口头建议”,而是一组可追溯的文件:
(目录位置以 config.yaml:directories 为准;默认 .bensz-api/skills/auto-test-skill/output/plans/ + .bensz-api/skills/auto-test-skill/output/tests/)
.bensz-api/skills/auto-test-skill/output/plans/vYYYYMMDDHHMM.md:A 轮问题分析与改进计划(每轮 1 份).bensz-api/skills/auto-test-skill/output/tests/vYYYYMMDDHHMM/:A 轮测试会话目录(包含 TEST_PLAN.md + TEST_REPORT.md).bensz-api/skills/auto-test-skill/output/plans/B轮-vYYYYMMDDHHMM.md:B 轮质量原则检查报告(维度以 config.yaml:b_round_check.dimensions 为准).bensz-api/skills/auto-test-skill/output/tests/B轮-vYYYYMMDDHHMM/:B 轮验证会话目录(包含 TEST_PLAN.md + TEST_REPORT.md)vYYYYMMDDHHMM(分钟级时间戳).bensz-api/skills/auto-test-skill/output/plans/(以 config.yaml:directories.plans 为准).bensz-api/skills/auto-test-skill/output/tests/(以 config.yaml:directories.tests 为准)B轮-用户输入
↓
[A轮 × N]:分析 → 计划 → 优化 → 轻量测试
↓
B轮:质量原则检查 → 针对性优化 → 轻量验证
↓
完成(文档齐全 + 问题闭环)#### A.1 初始化会话(生成测试 ID + 目录)
目标:创建本轮的 .bensz-api/skills/auto-test-skill/output/plans/ 与 .bensz-api/skills/auto-test-skill/output/tests/ 骨架。
推荐使用确定性脚本(避免 AI 每次手动拼目录/文件名):
# 方式1:在目标 skill 根目录内执行(--skill-root .)
python3 /path/to/auto-test-skill/scripts/create_test_session.py --skill-root . --kind a --id vYYYYMMDDHHMM --create-plan
# 方式2:在任意位置执行(--skill-root 指向目标 skill 根目录)
python3 auto-test-skill/scripts/create_test_session.py --skill-root /path/to/target-skill --kind a --id vYYYYMMDDHHMM --create-plan说明:
templates/(如存在);否则回退到 auto-test-skill 自带的 templates/,确保对任意 skill 都可用。--id 可省略(脚本自动生成 vYYYYMMDDHHMM);如显式指定,必须为 vYYYYMMDDHHMM 格式。最低要求:
.bensz-api/skills/auto-test-skill/output/plans/ 与 .bensz-api/skills/auto-test-skill/output/tests/ 存在.bensz-api/skills/auto-test-skill/output/tests/vYYYYMMDDHHMM/TEST_PLAN.md 与 .bensz-api/skills/auto-test-skill/output/tests/vYYYYMMDDHHMM/TEST_REPORT.md 存在可选增强(推荐):
--create-plan 自动生成 .bensz-api/skills/auto-test-skill/output/plans/vYYYYMMDDHHMM.md 的骨架(默认不覆盖)#### A.2 批判性分析与计划生成(写入 .bensz-api/skills/auto-test-skill/output/plans/)
目标:使用批判性思维发现系统性问题,写成可执行计划,按 P0/P1/P2 排序。
输出:.bensz-api/skills/auto-test-skill/output/plans/vYYYYMMDDHHMM.md
⚠️ 批判性思维是核心要求(不是可选项):
references/CRITICAL_THINKING_GUIDE.md)质量要求(强制):
核心要求:
.bensz-api/skills/auto-test-skill/output/plans/ 和 .bensz-api/skills/auto-test-skill/output/tests/ 文件,避免"确认偏差"与"路径依赖"SKILL.md、config.yaml(核心工作文件)scripts/、references/、templates/、assets/(如不存在可在计划中说明).bensz-api/skills/auto-test-skill/output/tests/、.bensz-api/skills/auto-test-skill/output/plans/、CHANGELOG.md、README.md(测试产物、变更记录和用户文档,不属于 skill 的工作代码),以及 config.yaml 中 a_round_check.independent_review.exclude_patterns 命中的文件rg/find)对工作文件做全量扫描,确保不遗漏references/CONSTRUCTIVE_SUGGESTION_GUIDELINES.md)批判性思维框架(必读):
references/CRITICAL_THINKING_GUIDE.md ⚠️ 核心文档,必须使用references/A_ROUND_PLAN_TEMPLATE.md ⚠️ 已简化,突出批判性思维要求references/ISSUE_DISCOVERY_TECHNIQUES.md 问题挖掘技巧(辅助工具)references/CONSTRUCTIVE_SUGGESTION_GUIDELINES.md 建设性建议标准references/ANTI_PATTERNS_LIBRARY.md 反例库(快速识别常见问题)#### A.3 执行优化与轻量测试(写入 .bensz-api/skills/auto-test-skill/output/tests/)
目标:按计划逐项修复,并用轻量测试验证。
输出:.bensz-api/skills/auto-test-skill/output/tests/vYYYYMMDDHHMM/TEST_REPORT.md
轻量测试原则:
.bensz-api/skills/auto-test-skill/output/tests/vYYYYMMDDHHMM/_artifacts/,不污染主目录可选增强(推荐,确定性自检):
python3 auto-test-skill/scripts/verify_test_session.py --require-plan .bensz-api/skills/auto-test-skill/output/tests/vYYYYMMDDHHMM#### A.4 是否进入下一轮
⚠️ 强制检查(必须满足才能进入下一轮):
references/ISSUE_DISCOVERY_TECHNIQUES.md 中的技巧)进入下一轮 A 轮的条件(在满足强制检查的前提下):
.bensz-api/skills/auto-test-skill/output/tests/ 会话的 TEST_REPORT.md 中给出验证证据注意:每轮 A 轮都是独立评估,不因“问题已解决”而提前终止;如用户指定 N 轮,则按 N 轮执行。
重要:A 轮结束后(无论多少轮),必须进入 B 轮质量检查,不得跳过。
⚠️ 强制执行:B 轮质量检查是自动测试流程的强制性环节,除非用户明确要求跳过,否则不得省略。
#### B.1 产出质量检查报告(写入 .bensz-api/skills/auto-test-skill/output/plans/)
目标:对 A 轮后的最新状态做系统性质量检查。
输出:.bensz-api/skills/auto-test-skill/output/plans/B轮-vYYYYMMDDHHMM.md
检查维度(以 config.yaml 的 b_round_check.dimensions 为准):
references/模板:templates/B_ROUND_CHECK_TEMPLATE.md
#### B.2 B 轮优化与验证(写入 .bensz-api/skills/auto-test-skill/output/tests/)
⚠️ 强制修复要求:
CHANGELOG.md验证报告必须包含:
可选增强(推荐,确定性自检):
python3 auto-test-skill/scripts/verify_test_session.py --require-plan .bensz-api/skills/auto-test-skill/output/tests/B轮-vYYYYMMDDHHMM完成条件:
目标:对 B 轮发现的所有问题(P0-P2)进行系统性修复并验证。
推荐创建独立会话目录:
python3 /path/to/auto-test-skill/scripts/create_test_session.py --skill-root . --kind b --id vYYYYMMDDHHMM --a-test-id vYYYYMMDDHHMM --create-plan输出:.bensz-api/skills/auto-test-skill/output/tests/B轮-vYYYYMMDDHHMM/TEST_REPORT.md
config.yaml 的 b_round_check.mandatory).bensz-api/skills/auto-test-skill/output/plans/ 与 .bensz-api/skills/auto-test-skill/output/tests/ 结构完整且可追溯CHANGELOG.md 已更新config.yamltemplates/templates/OPTIMIZATION_PLAN_TEMPLATE.mdtemplates/B_ROUND_CHECK_TEMPLATE.mdtemplates/BUG_REPORT_TEMPLATE.mdtemplates/FINAL_SUMMARY_TEMPLATE.mdtemplates/TEST_PLAN_TEMPLATE.mdtemplates/TEST_REPORT_TEMPLATE.mdreferences/references/CRITICAL_THINKING_GUIDE.md ⚠️ 核心文档,必须使用references/A_ROUND_PLAN_TEMPLATE.md ⚠️ 已简化,突出批判性思维references/TESTING_BEST_PRACTICES.mdreferences/CONSTRUCTIVE_SUGGESTION_GUIDELINES.mdreferences/ISSUE_DISCOVERY_TECHNIQUES.mdreferences/ANTI_PATTERNS_LIBRARY.mdscripts/create_test_session.pyscripts/verify_test_session.py~30 seconds. Free. No account. Every finding cites a rule and a line of evidence.