⌨️ 123-flow — three number keys to run your AI-coding workflow: 1=do, 2=review, 3=ship. A Claude Code skill/plugin. 三个数字键接管 AI 工作流
SaferSkills independently audited 123-flow (Agent Skill) and scored it 100/100 (green). The audit ran 55 deterministic rules across Security, Supply Chain, Maintenance, Transparency, and Community; it found 0 high-severity and 0 lower-severity findings. The full rule-by-rule trace and per-finding evidence are below. Free, methodology-open.
Findings & checks · 0 flagged
Every scanned point with the score it earned and what moved between them.
First recorded scan — no prior version to compare against.
The primary manifest — the file an agent reads to learn what this artifact does.
三个数字键, 接管你和 AI 的整个工作流。1= 干到底 ·2= 往死里审 ·3= 收尾上线
裸数字 1 / 2 / 3 (或 /1 /2 /3, 或消息以单独一行的数字结尾) = 三段工作流节奏。 全局最高优先级: 任何 skill / agent / 流程, 收到数字键立即让路。
你跟 AI 协作, 每天重复做三件事: 让它往前干 / 让它回头审 / 让它收尾上线。 每次都要重新组织一句话("嗯你继续"/"帮我检查下有没有问题"/"可以上线了吗")—— 手累, 而且 AI 经常敷衍。
把这三件事各绑一个数字键: 你只打一个字符, AI 就进入对应的完整工作流(不是敷衍地继续, 是带着一整套铁律继续)。这就是给 AI 装一个方向盘。
| 键 | 含义 | 一句话 |
|---|---|---|
| `1` | 干 / Do | 全速执行 + 第一性思考 + 费曼回答 + 自动复盘 + 浏览器实测 + 部署上线 |
| `2` | 审 / Review | 0→100 + 100→0 双向复盘 + 逆向反驳 + 三组检查清单挑一 |
| `3` | 完工 / Ship | 第一性+费曼 → 复盘 → 真机找 BUG → 部署验证 exit 0 (3 内含 2) |
1 跟 2/3 互斥 (往前冲 ≠ 回头审, 不能同时)。3 内含 2 (上线前必先复盘)。
对号入座 —— 这些情况各对应一个键:
| 你遇到 | 打 | 结果 |
|---|---|---|
| 认可了 AI 的方案, 懒得打一长串确认 | 1 | 带全套铁律执行到底 |
| AI 说"做完了", 你将信将疑 | 2 | 逼它自审, 揪出没测的边界 |
| 担心 AI 凭记忆瞎写 / API 用错 | 2 | "查证过"那条逼它去搜证实 |
| 功能开发完准备上线 | 3 | 强制真机实测 + 部署验证 |
| 深夜赶工懒得组织语言 | 1/2/3 | 三键搞定整个开发节奏 |
凡是你想说"继续 / 你确定吗 / 上线了吗", 都压成一个数字键。
数字键是指令, 不是数据:
1 / 2 / 3/1 /2 /3数字键 = SIGINT 中断信号: 任何 skill / agent 跑到一半, 收到数字键立即停手, 把方向盘交回本 skill。不允许任何流程"吞掉"数字键说"我先做完再让位"。
1 = 干 (全速执行)触发: 1 / OK / 执行 / 同意 / 继续 / 好的 / 开干 / go
打 1 等于说: "上一条建议我同意, 别废话, 干到底。" 但"干到底"不是蒙头乱敲 —— 打 1 会同时启动一套执行铁律, 每个任务 (不论大小) 100% 照走:
2)停问例外 —— 这几种必须先确认, 不准闷头干:
rm -rf / drop table / 真转账 / 删生产数据)示例 你: "登录接口 token 过期判断写错了,<应改<=, 改吗?" AI: "建议改auth.ts:42, 顺带补一个边界测试。" 你:1AI: (直接改 + 补测试 + 复盘 + 浏览器验证 + 部署, 不再问"确定吗")
2 = 复盘 (最高标准审查) ⭐ 灵魂这是整套系统的灵魂。 会写代码的 AI 满地都是, 但能"回头审自己、把虚假的完成戳穿"的 AI 很少。 AI 默认讨好你, 倾向说"搞定了"。2 就是逼 AI 当自己的对手, 往死里挑毛病。走法 = 双向推演 + 逆向反驳 + 三组检查清单挑一:
主动站到对立面, 列出"这方案会怎么死":
#### 🅰️ 新功能 / 改旧功能 (13 问)
| # | 问 | 大白话 |
|---|---|---|
| 1 | 有效 | 真解决问题, 还是只碰到边? |
| 2 | 直观 | 用户一眼会用, 还是要猜? |
| 3 | 直接 | 最短路径, 还是绕远? |
| 4 | 自欺欺人 | 表面完成、其实没成? |
| 5 | 诚实 | 有没有藏雷 / 糊弄? |
| 6 | 高效 | 省时省力, 还是笨重? |
| 7 | 为做而做 | 这步真需要, 还是凑数? |
| 8 | 互相污染 | 改了 A 有没有弄坏 B? |
| 9 | 多余 | 有没有能删的冗余? |
| 10 | 最极致省 token | 输出 / 上下文有没有啰嗦? |
| 11 | 最省资源 | 算力 / 内存 / 请求有没有浪费? |
| 12 | 可常态化 | 可持续, 还是一次性 hack? |
| 13 | 稳定 | 边界 / 异常会不会炸? |
#### 🅱️ 代码 (21 问 = 🅰️ 13 问 + 代码专属 8 问)
代码相关任务, 在 🅰️ 全部 13 问之上, 再加:
| # | 问 | 大白话 |
|---|---|---|
| 14 | 简单精简美观 | 代码干净, 还是又长又乱? |
| 15 | 没有屎山 | 在堆技术债吗? |
| 16 | 多语言一致 | 产品多语言时, 各语言文案 (如简体 / 繁体 / 英文) 同步无遗漏? |
| 17 | 没有矛盾冲突 | 跟现有逻辑 / 约定打架没? |
| 18 | 不重复 | 该复用的有没有抄一遍? |
| 19 | 省存储空间 | 数据结构 / 缓存有没有浪费? |
| 20 | 查证过 | 关键 API / 库行为 / 最佳实践是搜过证实的, 不是凭记忆猜的? |
| 21 | 治本 | 修根因, 还是贴膏药? |
#### 🅒 算法 / 数学公式 (18 问)
算法和公式不像普通功能, 错一个边界可能几年后才爆。这组去掉"省 token", 加最关键一条:
| # | 问 | 大白话 |
|---|---|---|
| ⭐ | 稳定运行 100 年 | 极端输入、长期运行、边界值, 公式都不崩? |
算法组同样覆盖: 精简美观 / 无屎山 / 有效 / 直观 / 直接 / 不自欺 / 诚实 / 高效 / 不互相污染 / 无矛盾冲突 / 不多余 / 不重复 / 省存储 / 可常态化 / 稳定 / 查证过 / 治本。
量化完 + 行动项列完 + 双向都跑过 | 或连续 2 轮挑不出新问题。
3 = 收尾 (上线前的最后一道闸)触发: 3 / 收尾 / 验证一遍 / 完工 / 跑一遍验证
4 步, 缺一不可:
调用 2 的精简版: ≤200 字结论 + 一份风险清单。别省这步。
Uncaught / Failed to fetch / 5000 才算数放行档位: 🟢 GO 直接上线 | 🟡 SOFT-HOLD 修掉非致命项再上线 | 🔴 BLOCK 命中红线 → 回 2 重跑。
Q: 为什么 `3` 包含 `2`? 上线前不复盘 = 裸奔。收尾流程强制塞一道复盘, 所以打 3 自动含了 2。
Q: 为什么 `1` 跟 `2`/`3` 互斥? 1 是"往前冲", 2/3 是"回头审"。同一刻只能一个方向, 否则就是边冲边刹车。
Q: 自动触发会不会很烦? 只在高风险场景自动接复盘 (涉钱 / 法律 / 健康 / 不可逆)。日常你不打数字, 它不抢戏。
Q: 跟 first-principles / 费曼 / 复盘类 skill 冲突吗? 不冲突, 是调度关系。3 会去调用它们; 它们负责"怎么想 / 怎么审", 本 skill 负责"什么时候触发哪一段"。
这套 1/2/3 是作者的工作流约定。Fork 它, 改本文件:
核心思想一句话: 用最短的输入, 切换最常用的工作流阶段。
~30 seconds. Free. No account. Every finding cites a rule and a line of evidence.