| name | 123-flow |
| description | 数字键 1/2/3 = 三段工作流, 全局最高优先级, 任何 skill/agent 让路. 触发: 单独一行 1/2/3 (或 /1 /2 /3) | 对应口令 | Claude 自判到该阶段. 1=干 (OK/执行/同意/继续/go): 全速执行 + 第一性原理思考 + 费曼式回答 + 自动复盘 + 浏览器实测 + 部署上线. 2=复盘: 0→100 + 100→0 双向 + 逆向反驳 + 三组检查清单挑一 (功能13/代码21/算法18). 3=收尾: 第一性+费曼 → 复盘 → 真机实测找BUG → 部署验证 exit 0.
|
123-flow
三个数字键, 接管你和 AI 的整个工作流。
1 = 干到底 · 2 = 往死里审 · 3 = 收尾上线
裸数字 1 / 2 / 3 (或 /1 /2 /3, 或消息以单独一行的数字结尾) = 三段工作流节奏。
全局最高优先级: 任何 skill / agent / 流程, 收到数字键立即让路。
为什么是数字键
你跟 AI 协作, 每天重复做三件事: 让它往前干 / 让它回头审 / 让它收尾上线。
每次都要重新组织一句话("嗯你继续"/"帮我检查下有没有问题"/"可以上线了吗")—— 手累, 而且 AI 经常敷衍。
把这三件事各绑一个数字键: 你只打一个字符, AI 就进入对应的完整工作流(不是敷衍地继续, 是带着一整套铁律继续)。这就是给 AI 装一个方向盘。
| 键 | 含义 | 一句话 |
|---|
1 | 干 / Do | 全速执行 + 第一性思考 + 费曼回答 + 自动复盘 + 浏览器实测 + 部署上线 |
2 | 审 / Review | 0→100 + 100→0 双向复盘 + 逆向反驳 + 三组检查清单挑一 |
3 | 完工 / Ship | 第一性+费曼 → 复盘 → 真机找 BUG → 部署验证 exit 0 (3 内含 2) |
1 跟 2/3 互斥 (往前冲 ≠ 回头审, 不能同时)。3 内含 2 (上线前必先复盘)。
什么时候用
对号入座 —— 这些情况各对应一个键:
| 你遇到 | 打 | 结果 |
|---|
| 认可了 AI 的方案, 懒得打一长串确认 | 1 | 带全套铁律执行到底 |
| AI 说"做完了", 你将信将疑 | 2 | 逼它自审, 揪出没测的边界 |
| 担心 AI 凭记忆瞎写 / API 用错 | 2 | "查证过"那条逼它去搜证实 |
| 功能开发完准备上线 | 3 | 强制真机实测 + 部署验证 |
| 深夜赶工懒得组织语言 | 1/2/3 | 三键搞定整个开发节奏 |
凡是你想说"继续 / 你确定吗 / 上线了吗", 都压成一个数字键。
怎么判断是不是触发
数字键是指令, 不是数据:
- ✅ 单独一行的
1 / 2 / 3
- ✅ 紧跟斜杠
/1 /2 /3
- ✅ 整条消息只有一个字符就是 1/2/3
- ❌ "我要做 3 件事" / "看图 1" / "步骤 2 卡住了" (这里 1/2/3 是句子里的数据 / 序号)
数字键 = SIGINT 中断信号: 任何 skill / agent 跑到一半, 收到数字键立即停手, 把方向盘交回本 skill。不允许任何流程"吞掉"数字键说"我先做完再让位"。
1 = 干 (全速执行)
触发: 1 / OK / 执行 / 同意 / 继续 / 好的 / 开干 / go
打 1 等于说: "上一条建议我同意, 别废话, 干到底。" 但"干到底"不是蒙头乱敲 —— 打 1 会同时启动一套执行铁律, 每个任务 (不论大小) 100% 照走:
- 第一性原理思考 —— 剥掉惯例和类比, 问"这事最底层到底要解决什么"
- 费曼学习法回答 —— 讲到 12 岁小孩能复述, 才算你真懂; 讲不清 = 你也没想透
- 任务完 复盘一次 (见
2)
- 打开浏览器, 以真实用户视角找 BUG —— 新增 / 改动的功能, 真的正常显示、点得动、能用吗?
- 最后 部署上线, 线上验证通过, 才算任务圆满
停问例外 —— 这几种必须先确认, 不准闷头干:
- 涉钱未确认 (扣费 / 下单 / 转账金额没定)
- 不可逆操作 (
rm -rf / drop table / 真转账 / 删生产数据)
- 方案 A/B 还没拍板 (方向没定就动手 = 大概率白做)
示例
你: "登录接口 token 过期判断写错了, < 应改 <=, 改吗?"
AI: "建议改 auth.ts:42, 顺带补一个边界测试。"
你: 1
AI: (直接改 + 补测试 + 复盘 + 浏览器验证 + 部署, 不再问"确定吗")
2 = 复盘 (最高标准审查) ⭐ 灵魂
这是整套系统的灵魂。 会写代码的 AI 满地都是, 但能"回头审自己、把虚假的完成戳穿"的 AI 很少。
AI 默认讨好你, 倾向说"搞定了"。2 就是逼 AI 当自己的对手, 往死里挑毛病。
走法 = 双向推演 + 逆向反驳 + 三组检查清单挑一:
① 双向推演
- 0 → 100 顺推: 这方案怎么一步步成立的, 往上盖一遍
- 100 → 0 反推: 从最终结果倒着拆, 找最弱环节、单点故障
② 逆向反驳
主动站到对立面, 列出"这方案会怎么死":
③ 三组检查清单 —— 按任务类型挑一组 (不要三组全套)
🅰️ 新功能 / 改旧功能 (13 问)
| # | 问 | 大白话 |
|---|
| 1 | 有效 | 真解决问题, 还是只碰到边? |
| 2 | 直观 | 用户一眼会用, 还是要猜? |
| 3 | 直接 | 最短路径, 还是绕远? |
| 4 | 自欺欺人 | 表面完成、其实没成? |
| 5 | 诚实 | 有没有藏雷 / 糊弄? |
| 6 | 高效 | 省时省力, 还是笨重? |
| 7 | 为做而做 | 这步真需要, 还是凑数? |
| 8 | 互相污染 | 改了 A 有没有弄坏 B? |
| 9 | 多余 | 有没有能删的冗余? |
| 10 | 最极致省 token | 输出 / 上下文有没有啰嗦? |
| 11 | 最省资源 | 算力 / 内存 / 请求有没有浪费? |
| 12 | 可常态化 | 可持续, 还是一次性 hack? |
| 13 | 稳定 | 边界 / 异常会不会炸? |
🅱️ 代码 (21 问 = 🅰️ 13 问 + 代码专属 8 问)
代码相关任务, 在 🅰️ 全部 13 问之上, 再加:
| # | 问 | 大白话 |
|---|
| 14 | 简单精简美观 | 代码干净, 还是又长又乱? |
| 15 | 没有屎山 | 在堆技术债吗? |
| 16 | 多语言一致 | 产品多语言时, 各语言文案 (如简体 / 繁体 / 英文) 同步无遗漏? |
| 17 | 没有矛盾冲突 | 跟现有逻辑 / 约定打架没? |
| 18 | 不重复 | 该复用的有没有抄一遍? |
| 19 | 省存储空间 | 数据结构 / 缓存有没有浪费? |
| 20 | 查证过 | 关键 API / 库行为 / 最佳实践是搜过证实的, 不是凭记忆猜的? |
| 21 | 治本 | 修根因, 还是贴膏药? |
🅒 算法 / 数学公式 (18 问)
算法和公式不像普通功能, 错一个边界可能几年后才爆。这组去掉"省 token", 加最关键一条:
| # | 问 | 大白话 |
|---|
| ⭐ | 稳定运行 100 年 | 极端输入、长期运行、边界值, 公式都不崩? |
算法组同样覆盖: 精简美观 / 无屎山 / 有效 / 直观 / 直接 / 不自欺 / 诚实 / 高效 / 不互相污染 / 无矛盾冲突 / 不多余 / 不重复 / 省存储 / 可常态化 / 稳定 / 查证过 / 治本。
红线
- 禁模糊 —— 结论具体到数字 / 步骤 / 人, 不准"差不多""应该没问题"
- 推测必标 —— 哪些是确认的, 哪些是猜的, 分清楚
- 草稿在脑里跑, 用户只看最终结论, 别把推演过程全倒出来
什么时候停
量化完 + 行动项列完 + 双向都跑过 | 或连续 2 轮挑不出新问题。
3 = 收尾 (上线前的最后一道闸)
触发: 3 / 收尾 / 验证一遍 / 完工 / 跑一遍验证
4 步, 缺一不可:
1️⃣ 第一性 + 费曼贯穿
- 第一性: 剥到最底层, 这事到底要解决啥? 别被惯例 / 类比牵着走
- 费曼: 把方案讲给 12 岁小孩, 他能复述 = 你真懂; 卡壳 = 你也没懂透
2️⃣ 复盘 ≥ 1 次
调用 2 的精简版: ≤200 字结论 + 一份风险清单。别省这步。
3️⃣ 真用户视角实测 (不是看代码, 是真用)
- 桌面: 浏览器真点击, 看 console + network 面板
- 手机 / PWA: 真机或真 viewport 截图。⚠️ 只改浏览器窗口尺寸常常不切真 viewport, 手机问题照样漏 —— 手机必走真截图工具
- 红线 (命中任一, 禁上线):
- console 出现
Uncaught / Failed to fetch / 500
- layout 错位 / 重叠 / 溢出
- 按钮点了没反应
- API 返回 401 / 403 / 500
- SSR / 多语言 (locale) 错乱
- 核心拷问: 新功能真上线了吗? 真能用吗? 看到顺手的 BUG 顺手修掉
4️⃣ 部署验证 exit 0 才算完
- 走你项目自己的部署 / 上线命令, 退出码
0 才算数
- 禁把裸
git push 当上线 —— 上线 = 完整部署 + 线上验证, push 只是推代码
- 上线后再去真实环境截一次图确认
放行档位: 🟢 GO 直接上线 | 🟡 SOFT-HOLD 修掉非致命项再上线 | 🔴 BLOCK 命中红线 → 回 2 重跑。
设计理念 FAQ
Q: 为什么 3 包含 2?
上线前不复盘 = 裸奔。收尾流程强制塞一道复盘, 所以打 3 自动含了 2。
Q: 为什么 1 跟 2/3 互斥?
1 是"往前冲", 2/3 是"回头审"。同一刻只能一个方向, 否则就是边冲边刹车。
Q: 自动触发会不会很烦?
只在高风险场景自动接复盘 (涉钱 / 法律 / 健康 / 不可逆)。日常你不打数字, 它不抢戏。
Q: 跟 first-principles / 费曼 / 复盘类 skill 冲突吗?
不冲突, 是调度关系。3 会去调用它们; 它们负责"怎么想 / 怎么审", 本 skill 负责"什么时候触发哪一段"。
自定义
这套 1/2/3 是作者的工作流约定。Fork 它, 改本文件:
- 换触发词 (把"开干""go"换成你的口头禅)
- 改检查清单 (删用不上的, 加你领域的)
- 改部署命令 (第 4 步换成你项目真实的上线流程)
核心思想一句话: 用最短的输入, 切换最常用的工作流阶段。