本演示基于大屏布局,桌面体验最佳
AI 编程正经历一次静默的范式迁移:
从凭感觉交付的代码,
到规格驱动的工程化体系。
从「凭感觉交付」到「先规格后实现」,按章节递进。点击任一卡片直接跳转。
三年前我们把 Copilot 当补全用;一年前我们让 Agent 自己跑命令;今年一件事正在发生:
不是替代,而是重心迁移 —— 工具能力持续增强,瓶颈不断重定义。
用提示词引导 LLM 生成代码片段,人类主导一切 —— AI 编码第一次被大规模日常化。
2025 年 2 月,Karpathy 一条推文改变了行业语汇,并入选 Collins 2025 年度词汇。
AI Agent 自主调用工具、跨文件操作、执行测试、自我规划 —— 人类只设定目标与边界。
Claude Code 公测 → GA → 插件生态 → SWE-bench 突破 80%,一年走完了过去十年的路。
GitHub Spec Kit 标准化的工作流 —— 从宪法(原则约束)到实现(代码落地)的完整链路。
不是线性取代,而是重心迁移 —— 每一次转移都重新定义了能力边界。
| 阶段 | 核心重点 | 代表工具 | 典型问题 |
|---|---|---|---|
| Prompt Coding | 用提示词引导 LLM 生成代码片段;人类主导。 | Copilot · Tabnine · CodeWhisperer | 片段化,无项目级意识 |
| Vibe Coding | 自然语言驱动整个项目,靠感觉迭代,忘记代码本身。 | Cursor Composer · Replit Agent · Bolt · v0 | 质量不可控 · 技术债累积 · 上下文丢失 |
| Agentic Coding | Agent 多文件、自主调工具、自跑测试;可记忆与可回放。 | Claude Code · Cursor · Windsurf · Aider · Cline | 长任务漂移 · 上下文腐烂 · 规划弱 |
| Spec Coding / SDD | 先规格后实现,可验证、可执行;规格即人机共同契约。 | Spec Kit · Kiro · Tessl · BMAD · OpenSpec | 写规格有成本 · 需纪律 · 小项目或过度 |
凌晨 2 点查 Bug 时,18 位 CTO 给出了一致判断 —— 那不是心流,是生产噩梦。
Agent 并非无懈可击。三个问题同指一处 —— 把目标写在规格里,而不是散落在工作记忆中。
代码是程序的三种范式 —— 从手写到神经网络,再到用英语"编程"LLM。
真正决定你工作流的不是哪一个,而是它是否支持你的规格写法。
| 工具 | 定位 | Spec 友好 | 私有化 | 参考定价 |
|---|---|---|---|---|
| Claude Code | Anthropic 终端 CLI + 插件,推理最强,Spec Kit 原生集成 | ★★★★★ | ★★★ | 按用量 $100–300 |
| Cursor | Anysphere 的 AI-native IDE,Composer + Agent 双形态 | ★★★★ | ★★ | $20 / $40 / $200 |
| AWS Kiro | VS Code 基座的内置 SDD IDE · Specs + Hooks + Vibe | ★★★★★ | ★★ | $19 / $39 |
| GitHub Copilot | 生态最广的 IDE 助手,2025 加入 Coding Agent | ★★★★ | ★★★ | $10 / $19 / $39 |
| Aider | 终端 AI 配对编程,git 原生,SWE-bench 标杆 | ★★★★ | ★★★★★ | 开源,自带 API |
| Cline | VS Code 开源扩展 · Plan/Act 双模式 · MCP Marketplace | ★★★★ | ★★★★★ | 开源,自带 API |
| Tessl | 以 spec-gap 为切口的平台 · 持续验证 | ★★★★★ | ★★★ | 企业定制 |
四个问题,从项目规模、合规要求、规格严格度、工作流偏好,逐步缩窄到具体工具。
从 vibe 团队迁移到 spec 团队的 90 天路线 —— 不要追求完美规格,从一个真实痛点出发。
让 Agent 长时间可靠工作,需要把"持续上下文"和"任务上下文"分层管理。
如果只能带走 22 张幻灯片里的 5 句话 ——