Vibe → Spec / AI 编程范式迁移
01 / 22
封面

请使用桌面浏览器查看

本演示基于大屏布局,桌面体验最佳

AI CODING · 2026
从 VIBE 到 SPEC 的迁移
22 张幻灯片 · 4 个章节

从 Vibe Coding
Spec Coding

AI 编程正经历一次静默的范式迁移:
凭感觉交付的代码, 到规格驱动的工程化体系。

22
SLIDES
4
CHAPTERS
7
TOOLS
8
PRINCIPLES
SPACE 开始
按 T 打开目录
02 · 目录

四个章节,一条迁移路径

从「凭感觉交付」到「先规格后实现」,按章节递进。点击任一卡片直接跳转。

01
为什么是现在
AI 编码的四个阶段 · 2022 → 2026
02
Prompt Coding
人类主导的片段补全
03
Vibe Coding
Karpathy 的原始定义与三大特征
04
Agentic Coding
Agent 自主编码 · 关键时间点
05
Spec Coding / SDD
先规格后实现 · 代表项目
06
四阶段对比
同一指标下看变化
07
为什么迁移
Vibe 四大痛点 · Agentic 三大局限
08
Software 3.0
Karpathy 的范式框架
09
Spec Coding 落地
五阶段工作流 · 八条原则 · 工具与决策树
03 · 第一篇章

AI 编程的重心迁移

三年前我们把 Copilot 当补全用;一年前我们让 Agent 自己跑命令;今年一件事正在发生:

稀缺的不再是"能不能写"
而是"写什么"
SWE-bench Verified 已突破 80%,Agent 能力不再稀缺。
瓶颈正在向「清晰、可验证、可被 Agent 执行」的规格迁移。
"代码是最后一英里产物,规格才是人机共同契约。"
— 主流行业共识 · 2025–2026
04 · 时间线

四个阶段 · 2022 → 2026

不是替代,而是重心迁移 —— 工具能力持续增强,瓶颈不断重定义。

2022 → 2024
Prompt Coding
人类主导,片段补全。Copilot、Tabnine、CodeWhisperer。
2025 H1
Vibe Coding
自然语言驱动整个项目,靠感觉迭代,忘记代码本身。
2025 H2
Agentic Coding
Agent 多文件自主操作,SWE-bench 跨过 80%。
2025 H2 → now
Spec Coding / SDD
先规格后实现,可验证、可审查。
05 · 阶段 01

Prompt Coding  ·  片段补全

用提示词引导 LLM 生成代码片段,人类主导一切 —— AI 编码第一次被大规模日常化。

核心动作
  • 开发者手写骨架,AI 仅补全函数体、行内注释、样板代码
  • 上下文窗口受限,几乎无跨文件、跨模块意识
  • 在样板代码密集场景下提升明显;陌生代码库基本无效
  • 生产力结果:提效但未质变
代表工具
GitHub Copilot Tabnine CodeWhisperer 早期 Cursor
function calculateInvoiceTotal(items, coupon) {
  // AI 补全 ↓
  // 按下 Tab 给出 5 行建议,人类判断、接受、修改
}
06 · 阶段 02

Vibe Coding  ·  凭感觉交付

2025 年 2 月,Karpathy 一条推文改变了行业语汇,并入选 Collins 2025 年度词汇。

— ANDREJ KARPATHY · X · 2025·02·02 —
"There's a new kind of coding I call 'vibe coding', where you fully give in to the vibes, embrace exponentials, and forget that the code even exists."
"I just see stuff, say stuff, run stuff, and copy-paste stuff, and it mostly works."
"the code gradually goes beyond my comprehension, but the project still runs."
核心动作
自然语言驱动整个项目
心法特征
不读代码、不审 diff、靠"跑起来"判断对错
扩散事件
Collins 2025 年度词汇
07 · 阶段 03

Agentic Coding  ·  Agent 自主编码

AI Agent 自主调用工具、跨文件操作、执行测试、自我规划 —— 人类只设定目标与边界。

多文件
在数十个文件间编辑、重构、迁移,跨模块协调。
工具调用
运行命令、查日志、写测试、读数据库、提交 PR。
记忆
会话级上下文 + 项目级检索,可记忆之前的决策。
可追溯
决策散落在工具调用链中,但已可被回放与审查。
"Coding Agent 从 demo 变成 production tool,历时不到 12 个月。"
08 · 关键时间点

Agent 时代 · 十二个月的剧变

Claude Code 公测 → GA → 插件生态 → SWE-bench 突破 80%,一年走完了过去十年的路。

2025·02
Claude Code 公测
终端原生 CLI · beta research preview · Anthropic
2025·06
Claude Code GA
配合 Claude 4 · VS Code / JetBrains 插件 · 子代理委派 · MCP 集成
2025·06
Cursor Agent Mode / Windsurf Wave
多 Agent · Cascade 自主流 · 商业化加速
2025·全年
开源生态爆发
Cline / Roo Code / Kilo Code / Aider 大量涌现
2026·01
SWE-bench Verified 突破 80%
Claude 系领先 · Agent 能力不再稀缺
09 · 阶段 04

Spec Coding / SDD  ·  先规格后实现

规格成为 第一性公民
代码只是 最后一英里
规格先于代码、规格驱动代码、规格可被验证。
代码是可丢弃的中间产物,规格是人机共同契约。
2025·07
AWS Kiro
Specs + Hooks + Vibe
2025·09
GitHub Spec Kit
五阶段方法 · 开源
2025·09
Tessl
$125M · 持续验证
开源
BMAD-METHOD
多角色敏捷链
v0.17
OpenSpec
极轻量 CLI
10 · 工作流

SDD 五阶段工作流

GitHub Spec Kit 标准化的工作流 —— 从宪法(原则约束)到实现(代码落地)的完整链路。

01
Constitution
项目级原则与约束
constitution.md
02
Specify
定义要构建什么(What)
requirements.md
03
Clarify
澄清模糊需求
clarify.md
04
Plan
制定实现计划(How)
plan.md
05
Tasks · Implement
拆分任务并执行
tasks.md → code
EARS 标注法 · Kiro
"While <precondition>, when <trigger>, the <system> shall <response>." 让规格具备形式化潜力。
报告成效 · 某团队
引入 Spec Kit 后:AI 生成代码可用率 37% → 82%;代码评审时间下降 64%。
11 · 八条原则

从 Spec Kit · Tessl · Martin Fowler 综合提炼 · 八条核心原则

P·01
规格先行 Spec-first
在写任何代码之前,先产出可被审查的规格。
P·02
宪法约束 Constitution
用 constitution.md 锁定全局原则,减少随意性。
P·03
澄清先于实现 Clarify
进入 Plan 阶段前,主动提出模糊点的问题。
P·04
可验证可执行 Verifiable
规格必须包含验收标准与测试用例。
P·05
规格即真相 Source of Truth
代码是规格的「最后一英里」产物。
P·06
小步增量 Versioned
spec 应是 change-set 形式,跟随 PR/Issue。
P·07
双层记忆 Context + Spec
AGENTS.md 管持续上下文,Spec Kit 管任务上下文。
P·08
审计与可追溯 Audit
保留 spec → plan → tasks → implement 完整链路。
12 · 对比

四个阶段 · 同一指标下看变化

不是线性取代,而是重心迁移 —— 每一次转移都重新定义了能力边界。

阶段 核心重点 代表工具 典型问题
Prompt Coding 用提示词引导 LLM 生成代码片段;人类主导。 Copilot · Tabnine · CodeWhisperer 片段化,无项目级意识
Vibe Coding 自然语言驱动整个项目,靠感觉迭代,忘记代码本身。 Cursor Composer · Replit Agent · Bolt · v0 质量不可控 · 技术债累积 · 上下文丢失
Agentic Coding Agent 多文件、自主调工具、自跑测试;可记忆与可回放。 Claude Code · Cursor · Windsurf · Aider · Cline 长任务漂移 · 上下文腐烂 · 规划弱
Spec Coding / SDD 先规格后实现,可验证、可执行;规格即人机共同契约。 Spec Kit · Kiro · Tessl · BMAD · OpenSpec 写规格有成本 · 需纪律 · 小项目或过度
工具能力持续增强,但瓶颈正从 "能不能写" 转向 "写什么"。这正是 Spec Coding 时代的入口。
13 · 第二篇章

Vibe Coding · 四大痛点

凌晨 2 点查 Bug 时,18 位 CTO 给出了一致判断 —— 那不是心流,是生产噩梦。

01
性能崩塌
正常路径上看起来对,但边界条件、并发、冷启动场景下全面失效。缺乏对真实负载的感知。
02
安全漏洞
注入、SSRF、密钥硬编码、CORS 配置等常见攻击面未覆盖。开发者不读代码,就没人发现漏洞。
03
混沌代码
缺乏一致的架构、命名、模块边界。AI 每次补全的局部最优会让全局结构腐烂。
04
信任债
团队对 AI 代码失去信任,却无法重写它 —— 因为写它的人也没真正理解它。
根本原因:开发者 不再理解 自己生产的东西。Agent 时代部分缓解,Spec 时代彻底解决。
14 · 三大局限

Agentic Coding · 三大局限

Agent 并非无懈可击。三个问题同指一处 —— 把目标写在规格里,而不是散落在工作记忆中。

01
规划弱
Agent 擅长做局部最优,不擅长对系统先验。缺整体架构约束,决策总是"做了再说"。
arXiv 2503.09572 · Plan-and-Act
02
长任务漂移
数百次工具调用后,行为偏离初始目标。任务越长、上下文越满,Agent 越容易"忘记它原本要做什么"。
arXiv 2510.23822 · ReCAP
03
上下文腐烂
上下文窗口填满后模型表现明确退化。Context Engineering 成为 Agent 时代的核心议题。
Anthropic · Effective context engineering
目标、约束、验收标准写在规格里,而不是散落在 Agent 的工作记忆中。
15 · 心法对比

Vibe Coding  vs  Spec Coding  ·  两种编程哲学

VIBE CODING
"I see stuff, say stuff, run stuff,
copy-paste stuff."
  • 目标即过程,描述即结果
  • 通过运行判断对错
  • 代码超出理解也能发布
  • 心流即生产力,但也即失控
  • 信任建立于演示,而非代码
SPEC CODING / SDD
"I write a spec, then the system writes the code."
  • 目标写下来,过程可被委派
  • 通过验收标准判断对错
  • 代码超出理解也能交付
  • 心流让位给规格,先慢后快
  • 信任建立于规格,而非演示
不是"写代码 vs 不写代码",是"代码是不是你思考的产物"。Spec Coding 让思考从代码里解放出来。
16 · Software 3.0

Karpathy 的范式框架

代码是程序的三种范式 —— 从手写到神经网络,再到用英语"编程"LLM。

1.0
人类手写代码
Python · C++ · Java
程序员是作者,CPU 是读者。
2.0
神经网络
权重即代码
数据集 + 损失函数,计算机写权重。
3.0
LLM 即平台
用英语编程
代码成为可被丢弃的中间产物。
A KEY KARPATHY INSIGHT
"Partial autonomy is the safety default.
The autonomy slider is the key UX pattern of Software 3.0."
你拉满 Agent 的自主权,越需要一份清晰的规格作为"护栏"。规格不是约束 Agent 的工具,是释放 Agent 自主性的工具
17 · 工具矩阵

七大主流工具 · Spec 友好度一览

真正决定你工作流的不是哪一个,而是它是否支持你的规格写法。

工具 定位 Spec 友好 私有化 参考定价
Claude Code Anthropic 终端 CLI + 插件,推理最强,Spec Kit 原生集成 ★★★★★ ★★★ 按用量 $100–300
Cursor Anysphere 的 AI-native IDE,Composer + Agent 双形态 ★★★★ ★★ $20 / $40 / $200
AWS Kiro VS Code 基座的内置 SDD IDE · Specs + Hooks + Vibe ★★★★★ ★★ $19 / $39
GitHub Copilot 生态最广的 IDE 助手,2025 加入 Coding Agent ★★★★ ★★★ $10 / $19 / $39
Aider 终端 AI 配对编程,git 原生,SWE-bench 标杆 ★★★★ ★★★★★ 开源,自带 API
Cline VS Code 开源扩展 · Plan/Act 双模式 · MCP Marketplace ★★★★ ★★★★★ 开源,自带 API
Tessl 以 spec-gap 为切口的平台 · 持续验证 ★★★★★ ★★★ 企业定制
MCP · 不起眼的英雄:Model Context Protocol(2024·11 起)已被 OpenAI / Microsoft / Google / 主要 IDE 厂商支持。 它把外部 spec 源喂给 LLM,把执行结果反馈回 Agent。
18 · 决策树

工具选择 · 从场景到工具

四个问题,从项目规模、合规要求、规格严格度、工作流偏好,逐步缩窄到具体工具。

Q1 · 项目规模
个人小项目  →  Cursor Hobby / Cline + Claude Sonnet
中大型 / 团队  →  继续 Q2
Q2 · 是否需要严格生产级规格
 →  Cursor Pro / Windsurf / Claude Code Plan Mode
 →  继续 Q3
Q3 · 工作流偏好
严格分阶段  →  Spec Kit + Claude Code / Cursor
IDE 一站式  →  AWS Kiro
多角色敏捷  →  BMAD-METHOD
极轻量 CLI  →  OpenSpec + Claude Code
Q4 · 企业合规
SOC2 / 审计  →  Cursor Business / Claude Code Enterprise
私有化  →  Aider / Cline + 自托管
速记心法
你还在做原型、只是证明可行性,不必上规格

你代码需要被别人审、被 Agent 续先写规格

出现凌晨 2 点查 Bug的体验,规格今天是最后一天
"Spec Coding 不是'用不用某个工具',是'是否把规格放进 PR 流程'。"
19 · 落地

团队迁移 · 90 天路线

从 vibe 团队迁移到 spec 团队的 90 天路线 —— 不要追求完美规格,从一个真实痛点出发。

STEP 01 · WEEK 1–2
写好宪法
全员共创 constitution.md,聚焦 5–8 条不可妥协项:库选择、API 风格、安全基线、错误处理风格。同时建立 AGENTS.md / CLAUDE.md,明确 Agent 边界。
STEP 02 · WEEK 3–6
挑一个模块跑通
选一个边界清晰、复杂度适中的模块,按 Specify → Clarify → Plan → Tasks → Implement 走一遍,形成 spec → PR 的真实样例,并在团队复盘。
STEP 03 · WEEK 7–12
让规格成为 PR 的一部分
把 spec/ 加入 PR 模板;缺规格视为不完整。把规格评审和代码评审合并为一次评审。建立 spec 改动追溯:变更口径 → spec → 代码 → 验证。
不要从 "今天起每行代码都要先写规格" 开始;从一个真实痛点出发,让规格解决它,然后扩散。
20 · 上下文与 Spec

Context Engineering  ·  双层记忆

让 Agent 长时间可靠工作,需要把"持续上下文"和"任务上下文"分层管理。

持续上下文 · Project-wide
AGENTS.md / CLAUDE.md / GEMINI.md:跨生态标准,20,000+ 项目采用。
锁定项目级身份:项目是什么、技术栈、命名约定、不可妥协的边界面。
提示:ETH Zurich 2025/2026 研究指出 —— 仅在"非可推断细节"处使用,过载反而损害效率。
任务上下文 · Task-specific
Spec / Plan / Tasks:每次任务的边界、目标、验收标准。
通过 MCP 协议从 Confluence / Notion / GitHub Issues 喂入;执行结果(CI、日志)反馈回 Agent。
建议:每个 PR 都附带 spec diff,建立可追溯链路。
Anthropic 四策略: Write(外部 scratchpad) · Select(检索相关) · Compress(摘要压缩) · Isolate(子代理隔离)。
21 · 总结

记住这五条就够了

如果只能带走 22 张幻灯片里的 5 句话 ——

01 AI 编程的重心,正从 "能不能写" 转向 "写什么"
02 Vibe Coding 的四大痛点不解决,再强的 Agent 也只能堆出新的技术债。
03 规格是 Agentry 自主性的护栏,不是对 Agent 的约束。
04 工具先于方法,但方法决定工具的命运 —— 选 Spec Kit 还是 Kiro,取决于团队纪律。
05 当规格进入 PR 流程,Spec Coding 才真正落地
— Q & A · 22 / 22 —
Thank you.
code is the last-mile approach.
"维持软件,即演化规格。"
github.com/github/spec-kit · kirodotdev.dev · tessl.com · BMAD-METHOD
22
SLIDES
4
CHAPTERS
7
TOOLS
8
PRINCIPLES
目录 · Index
点击任意卡片跳转
— 按 ESC 关闭 · 点击跳转 —