工程工具知识花园
AI 写代码越快,人越要负责判断
AI 写代码越快,开发人员越不能当甩手掌柜。规格驱动开发(SDD)不是用文档取代 Vibe Coding,而是给 Vibe Coding 加一份稳定、可评审、可验证的上下文。spec/design/tasks 的初稿、拆分、格式整理、持续回写都可以交给 AI——开发人员不需要成为文档录入员,需要成为判断的人。
AI 干活,人判断
AI 适合干的:扫描源码整理现状、起草 spec/design、拆 tasks、建追踪关系、实施代码补测试、回写结果。这些解决的是信息整理和执行速度。
开发人员真正要参与的七件事:
- 指认事实来源:哪个入口、模块、接口文档或测试代表当前行为;原型只能说明页面目标,不能证明业务规则。
- 揪出 AI 偷偷补的假设:接口字段、状态值、权限、兜底逻辑有没有依据;没依据的进待确认项,不自己编答案。
- 确认方案适合现有系统:分层、依赖、兼容、性能、安全、回滚有没有漏;复杂度是否与风险匹配。
- 决定哪些风险先关闭:会改变数据结构、接口契约、核心流程的,必须先确认;其余可以隔离推进。
- 检查任务拆分可执行:依赖顺序对不对、每项能否独立验证、不把"全面测试"这种大词当任务。
- 判断证据够不够:构建、单测、Mock 各自证明了什么;不能把低等级证据自动升级成高等级结论。
- 对最终状态负责:实现与规格是否一致、设计是否还反映代码、是"已实现"还是"已验证"、剩余风险带到哪。
同一个人可以兼多个角色,但每一类结论都要知道依据来自哪里。
Token 不保证更少
直接说结论:SDD 不保证第一轮 Token 更少。写规格、评审规格本身就是新增消耗。
传统总 Token = 初始 Prompt + 实现对话 + 重复解释 + 纠错返工
SDD 总 Token = 规格与评审 + 实现对话 + 规格回写 + 少量纠错
只有"减少的重复解释和返工"大于"新增的规格成本",SDD 才真正省 Token。跨会话、多人协作、接口状态权限约束多的任务更可能省;几分钟能改完的小改动、一次性原型,大概率更费。
效率看整条链,不看写代码的速度
只看开工第一小时,SDD 往往更慢——传统方式已经开写代码了,SDD 还在整理待确认项。
效率应该按完整链路衡量:
需求进入 → 规则确认 → 实现 → 测试与联调 → 验收 → 返工 → 最终验证
代码生成更快,但联调、验收、返工更慢,不算提效。SDD 的收益来自更早发现问题和减少返工,不是来自文档格式本身。
三档选择,不搞一刀切
- 直接 Vibe:小文案、局部样式、一次性探索、可丢弃原型,能立即验证、失败成本很低。
- 轻量记录:单页面局部功能、边界明确的单点 Bug,有少量旧行为要保护。
- 完整 SDD:跨模块改动、接口契约变化、权限状态持久化、支付审批外部写入等高风险流程、多人或多次会话。
任务影响扩大时,从低档往高档升。Plan 模式解决"这一次任务准备怎么做",SDD 解决"团队依据什么做、哪些规则已确认、做到什么才算验证完成"——前者是单次执行方案,后者是长期依据。
小结
AI 越能写,人越要守住判断:事实来源、隐藏假设、方案取舍、风险排序、证据等级。文档可以 AI 写,判断不行。SDD 省不省 Token、提不提效,不看写代码的速度,看整条交付链少走了多少弯路。