[关闭]
@TedZhou 2026-07-20T15:15:15.000000Z 字数 9329 阅读 10

Vibe Coding:从一条推文到AI编程新范式

AI 技术


Vibe Coding:从一条推文到AI编程新范式

2025年2月2日,OpenAI创始成员、前特斯拉AI总监Andrej Karpathy在X上发布了一条约145词的推文。他写道:"有一种我称之为'vibe coding'的新型编程方式,你完全顺应直觉,拥抱指数级增长,甚至忘记代码的存在。"他描述了自己使用Cursor Composer配合Claude Sonnet、通过SuperWhisper语音输入进行开发的场景:几乎不碰键盘,面对AI生成的代码修改"全部接受",从不阅读差异对比,遇到错误就把报错信息原封不动贴回去。Karpathy后来称这条推文为"a shower of thoughts throwaway tweet"——一条随手发出的碎片想法。

这条推文在数周内迅速获得数百万次浏览。没人能预料到,这个带有自嘲和实验性质的表述,会在短短九个月内被柯林斯词典评为2025年度词汇,并催生出一个全新的软件开发范式。而概念提出者Karpathy本人,也在2026年5月加入Anthropic——Claude模型的开发阵营,为这个故事增添了新的注脚。

一、什么是Vibe Coding?

1.1 从Karpathy的推文说起

Karpathy的原始推文包含几个容易被忽略却至关重要的细节。他明确表示这种方式"对抛弃式周末项目来说还不错"——将其定位为低风险、实验性的个人项目,而非生产级软件开发。他描述的工作流程极端到"diff不看、报错盲贴、bug修不掉就随机改到消失",带有明显的戏谑色彩。

然而,在后续的传播中,这些限定条件被大量过滤。"不会写代码也能做应用"的叙事占据了主流。术语的含义迅速泛化——从一种特定的"不看代码"的极端工作流,变成了泛指各种AI辅助编程的热词。

1.2 核心定义与特征

综合学术定义,Vibe Coding是一种由生成式AI驱动的软件开发范式,开发者通过自然语言描述需求与意图,由大语言模型自动生成、修改、调试代码。其核心特征包括:

1.3 一个被泛化的概念

随着术语的走红,其含义迅速泛化。实践者Simon Willison做出了一个犀利的区分:"如果你审查了LLM写的代码、做了全面测试、能向别人解释工作原理——那就不是Vibe Coding,那就是软件开发。"他进一步指出,将Vibe Coding视为"所有AI辅助编程"的泛称,既稀释了术语本身的意义,也给人造成了"负责任的AI辅助编程不过如此"的错误印象。

这一区分至关重要:将Vibe Coding视为"所有AI辅助编程"的泛称,与将其理解为一种特定的、带有实验性质的工作流,会导向完全不同的判断。Stack Overflow 2025开发者调查的数据也印证了这种分化:仅12%的开发者承认自己进行过Vibe Coding(即不审查AI生成代码就接受),而约72%的开发者明确拒绝这种做法。

二、历史演进:从萌芽到爆发

2.1 技术铺垫(2021-2024)

Vibe Coding并非凭空出现,而是AI辅助编程技术演进的产物。2021年GitHub Copilot的发布开启了"AI自动补全"时代;2022年ChatGPT的出现带来了"对话式编码";2024年Cursor等AI原生IDE的爆发以及Claude 3.5 Sonnet等模型的突破,使AI具备了"读取整个代码库、直接修改多个文件、运行终端命令"的能力。这些技术积累为Vibe Coding的诞生铺平了道路。

2.2 概念诞生与爆发(2025)

2025年2月2日,Karpathy的推文正式提出"vibe coding"一词。此后传播速度惊人:

从一条推文到年度词汇,仅用了九个月。Collins总经理Alex Beecroft表示:"'vibe coding'被选为柯林斯年度词汇,完美地捕捉了语言如何与技术一同演变。它标志着软件开发领域的一次重大转变——AI正在让编程变得更加普及。"

2.3 从Vibe到Agentic:概念的演进(2026)

进入2026年,Karpathy本人在Sequoia AI Ascent 2026大会上提出了一个更高级的阶段——"智能体工程"(Agentic Engineering)。他用两个比喻清晰地划分了二者的界限:Vibe Coding是"抬高地板"(raising the floor),让所有人都能写软件;而Agentic Engineering是"抬高天花板"(raising the ceiling)——在维持专业质量标准的同时,实现高速开发甚至超越原有水平。

Karpathy在大会上进一步阐释:Agentic Engineering是在Vibe Coding基础上发展起来的更为严肃的学科。在Agentic Engineering中,开发者99%的时间不再直接写代码,而是编排AI智能体完成工作并充当监督者。LLM是"锯齿状的、统计性的、被召唤出来的实体,需要一种全新的品味和判断力来驾驭"。他坦言,提出Vibe Coding一年后,自己"从未感到如此落后于时代"。

三、2026年的现状:繁荣、分化与争议

3.1 工具生态的成熟

截至2026年,Vibe Coding的工具生态已形成多层次格局:

其中,Claude Code在Stack Overflow 2025开发者调查中已获得10%的开发者使用(Cursor为18%),但闭源且仅支持Claude模型,月费100到200美元。Claude Code的创造者Boris Cherny在2026年多次公开表示"编程已经被解决"(coding is solved),并透露Anthropic内部80%-90%的代码已由Claude Code自身编写,公司工程师人均生产力提升约70%。

国内大厂在2026年二季度已全线入场。百度将自然语言生成应用的体验推到了生产级交付层面,腾讯推出了主打灵感和共创氛围的独立产品,字节跳动则将AI编程工具做成了一个脱离传统开发环境的独立端。蚂蚁灵光上线六天下载量突破200万,首月用户创建的"闪应用"突破1200万个——上线两周时这一数字已达330万,增长势头迅猛。绝大多数创造者完全不懂代码。歌手胡彦斌也用AI编程为粉丝开发了互动社区App"彦火"。

3.2 采用率与生产力

采用率数据令人瞩目。Stack Overflow 2025年开发者调查显示,84%的受访者正在使用或计划使用AI工具参与开发流程,51%的专业开发者已经每天在使用。然而,对AI的信任度却呈现下降趋势:积极情绪从2023-2024年的70%以上降至2025年的60%,46%的开发者表示不信任AI工具的输出准确性,仅33%表示信任,只有3%表示"高度信任"。66%的开发者对"几乎正确但差一点"的AI解决方案感到沮丧。

生产力数据并非一边倒的乐观。虽然AI辅助开发者报告任务完成速度提升35-55%,但一项针对经验丰富开源开发者的随机对照试验发现,使用AI工具反而多花了19%的时间完成任务。这种"效率悖论"的根源在于:AI加速了代码生成,却增加了审查、调试和修复幻觉的成本。

3.3 "全民造应用"与真实门槛

Vibe Coding最具传播力的叙事是"不会写代码的人也能做出应用"。然而,现实远比口号复杂。

钛媒体的一篇深度报道记录了一个典型样本:深圳电子配件贸易商用Cursor做了一个工具,解决客户Excel提成计算的痛点。第一个版本因退款口径未对齐而算错账,客户在群里说了一句"数字对不上"。他当晚修改逻辑,第二天重新跑通。三个月后,十几个按月付费的客户留了下来,99元一个月。没有融资,没有刷屏,但它提供了一个更接近中国真实商业场景的Vibe Coding样本。

同一篇报道指出,2026年上半年Product Hunt上那些以Cursor、Claude或Vibe Coding作为卖点的项目,发布当天往往能收获不错的点赞,但几个月后仍能持续更新和商业化推进的并不多。报道总结道:"Vibe Coding加速了发布,没有自动带来持续运营。""做出来"和"做出一个产品"之间,有一段很多人还没意识到的距离。

3.4 安全危机:38万个暴露资产

Vibe Coding最严峻的挑战来自安全领域。2026年5月,以色列资安公司Red Access发布《Shadow Builders》报告,在主流Vibe Coding平台上发现逾38万个可公开存取的网络资产。其中约5,000个疑似由企业建置,超过2,000个包含企业营运或个人敏感数据——包括临床试验数据、银行记录、患者对话——在未设定任何存取控制的情况下直接暴露于公开网络;部分甚至预设允许任何知道网址的人取得管理员权限。这些应用程序遍布六大洲,横跨各产业。Axios、WIRED和VentureBeat分别独立验证了部分暴露案例。

报告指出,影子AI(Shadow AI)的风险样貌已发生根本变化——从员工把不当内容贴进ChatGPT,演变为员工在未告知安全或IT部门的情况下,使用AI开发平台建置完整应用程序、串接正式系统,并将成品发布到公开互联网。行销人员建立连接真实业绩数据的活动追踪工具、财务团队将发票数据拉进董事会仪表板——这类行为每天都在发生。传统的资产发现工具设计用于发现服务器、容器和云实例,对"产品经理在Lovable上花一个周末搭建的、连接着Supabase生产数据库的营销配置器"完全视而不见。

四、工程化转型:Harness与Loop

面对Vibe Coding暴露出的代码质量、安全漏洞和可维护性问题,社区开始探索将工程纪律引入AI编程。企业AI编程实践面临的困境可概括为"三个失控":财务失控(员工用AI盲目重试,Token费用爆表,无效成本极高)、质量失控(AI疯狂产出代码,留下满地Bug,架构师Review崩溃,合并后反而成了"黑盒")、管理失控(团队成员AI编程工具各异,历史代码无法协同维护,项目无法量化)。这三个失控,正是工程化转型要解决的核心问题。

4.1 Harness Engineering:给AI套上"缰绳"

Harness Engineering在2025年概念确立、2026年大规模落地,迅速成为AI工程化的核心方法论。其核心理念可以用一个公式概括:Agent = Model + Harness。Harness就是套在大语言模型外面的一整套运行环境——工具调用接口、上下文管理、权限控制、错误处理、安全护栏、状态持久化、反馈机制。它把一个只会预测下一个token的模型,变成一个能在真实工程环境里干活的Agent。

Harness Engineering的演进路径清晰可辨:从Prompt Engineering(2022-2024,优化单次推理质量)到Context Engineering(2025,为每次决策构建动态上下文)再到Harness Engineering(2025年确立、2026年大规模实践,构建完整的反馈控制系统)。

2025年2月,Anthropic发布技术博客《Effective harnesses for long-running agents》,明确提出Managed Agents(管理型Agent架构)和File-backed State(基于文件持久化状态)的标准范式,用机械化的文件读写代替脆弱的上下文记忆。2025年上半年,OpenAI发布技术博客《Harness engineering: leveraging Codex in an agent-first world》,揭秘了3名工程师如何不写一行代码,完全靠构建Harness(包括渐进式披露的目录架构)约束Agent输出100万行生产级代码。到2026年,学术界的共识已经形成:Prompt已退化为底层的"汇编语言",而Harness才是大模型时代的"高级编程语言与操作系统"。

Harness的实践效果显著。一个典型案例可以说明问题:同一个知识库项目,在未引入Harness脚手架时,用Trae IDE多次运行相同提示词"介绍这个项目,启动它",每次执行的上下文、Token花销、执行步骤和输出结果完全不同——Token消耗像买彩票一样不可预测。引入Harness后,同样的任务跨工具能保证思考过程一致、执行步骤稳定、输出结果大体一致。在Qoder平台的对比测试中,未加Harness的项目完成四个功能开发(文档导入、文档索引、问答功能、历史记录)消耗24 credits、0.16元、5分钟、4次对话(含3次Bug修复);加Harness后仅消耗12 credits、约40%算力成本、2分钟、1次对话即完成全部功能验证。Stripe的Minions项目更是将这一理念推向了工业级:通过pre-push hook、本地linting和分层CI验证构建混合架构,Minions每周产出1,300+个PR,每个PR都经过超过300万条测试的验证。

Harness Engineering的核心价值在于:它不重构原项目代码,只在原项目上添加一层脚手架,让AI在编程时更好理解项目、降低幻觉。良好的Harness工程化项目,还能拉齐不同能力和工具的差距——同样的任务,无论用Trae还是Qoder,无论搭配哪个大模型,都能保证稳定的输出质量。目前,除Harness外,还诞生了Ralph Wiggum Loop、Agentic Engineering等前沿的AI软件架构思路,但它们仍有待实际项目验证。

4.2 Loop:让AI从"问一次"变"自己转"

如果说Harness是"地基",那么Loop就是运行其上的"流水线"。2026年中期,OpenClaw创始人Peter Steinberger发了一条推文:"你不应该再给编程Agent写提示词了,你应该设计循环来提示你的Agent。"这条推文引发广泛讨论。

同一时期,Claude Code的创造者Boris Cherny在Sequoia AI Ascent 2026上也表达了几乎相同的观点:loops是未来,他的工作已经从写代码变成了设计和管理loop。Cherny透露,他已经八个月没有手写一行代码,有些日子他同时管理数万个AI智能体。两个人独立得出同一个结论——这并非巧合,而是一场正在发生的范式转移。

Loop的核心思想是让AI智能体自主运行"生成-执行-观察-修正"的闭环。每次循环,AI读取实时的代码库状态和运行环境状态,而非依赖聊天记忆。人类的角色从"每一步操作"变为"检查点验收"——定义目标、设定约束、提供反馈,但不参与每一步的执行。

从Harness到Loop,中间隔了不到两个月。

4.3 SDD:让规范成为AI的"唯一事实来源"

在Harness的基础上,社区进一步提出了SDD(Spec-Driven Development,规范驱动开发)。其核心思想是:将需求文档(Spec)作为AI开发的"唯一事实来源"。与传统开发不同,SDD中的Spec不只是"文档",而是可被AI解析、可驱动代码生成、可作为验收标准的结构化规范。

一份完整的SDD通常包含三个核心文档:proposal.md(需求提案)、spec.md(技术规格,包含组件设计、接口契约、数据结构)、tasks.md(任务拆分,每个task对应可执行的代码变更单元)。这些文档以结构化Markdown编写,AI可直接解析。

得物技术团队的实践揭示了一个关键洞察:Harness思维的本质是"给AI一个已有的实现作为参照,让它照着复刻一份,而不是凭空创造"。这一思路大幅降低了AI幻觉的概率,因为AI不再需要从零构建,而是在明确的约束和参照下工作。

Harness、Loop和SDD三者构成了递进关系:Harness提供运行环境,Loop提供工作流模式,SDD提供规范层面的方法论。三者共同将AI编程从"随性"推向"工程"。

五、未来展望:从Vibe到Agentic

5.1 Agentic Engineering的崛起

Karpathy在2026年Sequoia AI Ascent 2026大会上正式提出的Agentic Engineering,正被视为Vibe Coding的"规范化升级版本"。如果说Vibe Coding是"抬高地板",让所有人都能写软件,那么Agentic Engineering就是"抬高天花板"——在维持专业质量标准的同时,实现高速开发甚至超越原有水平。

两者的本质区别在于:

维度 Vibe Coding Agentic Engineering
起点 一条Prompt 一份正式的技术规格(Specification)
终点 一个能跑的Demo 一个经过测试、验证、可上线的生产级系统
开发方式 人类与AI的单点对话 多个AI智能体的工程化协作
人类角色 需求提出者 架构师与质量把关者

Agentic Engineering通过引入"智能体协作"机制,将单一对话模型升级为多角色系统——每个智能体承担特定职责,如需求解析、代码生成、测试验证、优化建议等。其本质是从"人类与AI的单点交互"转向"AI系统内部的工程化协作"。Karpathy强调,在Agentic Engineering中,人类仍然对质量负责——不能引入安全漏洞、不能有混乱的架构、不能有脆弱的系统。最好的工程师不再是写每一行代码的人,而是能够指挥Agent而不让质量崩塌的人。

5.2 人才市场:AI架构师的价值重估

Vibe Coding和Agentic Engineering的演进,正在重塑技术人才市场的价值分配。

脉脉2026年1-4月数据显示,AI科学家/负责人平均月薪已达132,796元,断层式领先算法研究员的74,441元。AI岗位平均月薪60,738元,较新经济行业平均水平高出约26%。AI岗位数量同比增长约12倍,人才供需比仅为0.97,远低于新经济行业整体的1.79——AI领域人才供不应求的结构性紧缺清晰可见。

具体到AI软件架构方向,薪资分层极为明显。Agentic AI架构师资深级别月薪可达10万-16万元(字节/阿里/华为),大模型算法工程师资深级别月薪6.7万-10万+,而入门级仅2.4万-3.5万元。科锐国际2026年报告指出,AI行业优秀人才跳槽薪资涨幅普遍维持在20%-30%,关键岗位最高可达50%。大厂年包方面,阿里P7(专家/经理)为87-112万元,P8(高级专家)达162-228万元;字节3-1(高级专家)为137-195万元,3-2(资深专家)达238-285万元。

这一趋势与行业判断高度一致:AI前沿技术圈正稀缺懂软件架构的研发人员。擅长软件架构的研发在AI时代价值更大——AI算法强并不等价于代码软件架构能力。OpenAI、DeepSeek、Anthropic等前沿实验室都在招募Harness软件工程人才,而非纯粹的算法研究员。正如当前网页文章所言:"强大的模型依然会失败,真正决定AI生产力的,是人类为它搭建的'软件工程支架'。"

值得注意的是,脉脉创始人林凡判断:35岁以上职场人正在迎来价值重估。在Agent时代,繁琐工作可由AI代劳,而35+人群沉淀的行业经验能与AI深度协同,恰恰是驾驭AI、搭建工作流最关键的资产。与此同时,初级岗位持续收紧——2026年1-2月,1年以内经验的岗位仅占1.23%,市场对职场新人的需求明显收缩。这与行业判断形成呼应:"初中级工程师职业生涯会非常难"——Vibe Coding让工程师被逼着要进阶到高级甚至架构师的编程水平。那些快速成长的AI软件架构工程师,能拿到过去数倍的报酬,是企业争抢的人才。

5.3 谷歌总监的警告

并非所有人都对Vibe Coding的前景持乐观态度。前谷歌云AI总监、Chrome工程负责人Addy Osmani在2026年初断言:"Vibe Coding已撞南墙,而AI辅助编程即将崛起。"他警告,只会写Prompt的程序员将在2026年被淘汰。Osmani的观点是:AI编程工具是强大的力量倍增器,但它们不能取代工程基本功。在2026年,人类工程师仍然是这场戏的导演。

这一判断与Karpathy的"抬高天花板"论形成了一种微妙的对照:Vibe Coding确实降低了入门门槛,但真正的专业价值正在从"写代码"向"驾驭AI"转移。能够定义架构、设定约束、指挥多个AI智能体协同工作的人,正在成为新的稀缺资源。Osmani后来离开Google,撰写了新书《Beyond Vibe Coding》,书名本身就是对这个时代最精炼的注脚。

5.4 一个正在加速收敛的未来

从2025年2月Karpathy那条约145词的推文,到2026年中Harness和Loop的密集涌现,Vibe Coding的演进速度令人目眩。每一代概念的寿命都在缩短——从Prompt Engineering到Context Engineering用了约三年,从Context Engineering到Harness Engineering用了一年,从Harness到Loop不到两个月。

这个演进路径清晰地表明:AI编程正在从"随性"走向"工程"。Vibe Coding完成了它的历史使命——它让世界意识到"用自然语言写软件"是可能的,并催生了庞大的工具生态和用户基础。但它的局限性同样真实:代码质量不可控、安全漏洞频发、缺乏工程规范。Harness、Loop和SDD的出现,正是为了在这些"坑"上架桥。而Agentic Engineering的提出,则为AI编程指明了下一个方向——不是让AI替代人类开发者,而是让人类成为"AI团队的指挥官"。

正如Karpathy在AI Ascent 2026上所言:"智能变得廉价,但理解始终稀缺。"(Intelligence gets cheap, but understanding stays scarce.)在Vibe Coding开启的这个新时代,真正的竞争力不在于是否会写代码,而在于是否理解自己究竟在建造什么。

添加新批注
在作者公开此批注前,只有你和作者可见。
回复批注