第二天问题:当你的 Vibe-Coded 应用遇到真实用户时

第二天问题:当你的 Vibe-Coded 应用遇到真实用户时

2026年6月10日

Vibe-coded 应用的第一天是你做过最完美的 demo。prompt 生效了,界面很干净,数据库里有数据,你还发了一条带屏幕录像的推文。我们经历过很多次这样的日子,我们不是来剥夺这种快乐的。

我们在这里讨论的是第二天,因为没有人的发布贴会提到这一点。第二天是当真实用户登录,做了某些你没想到的测试,你的应用在“生成”与“工程化”之间的差距显现之时。

第二天实际上是什么样子

它很少以崩溃开始。它始于一些诡异的现象:一个接受乱码的表单,一个对某个特定用户失效的页面,一个以没人能复现的方式出错的数字。你将错误粘贴到聊天框中。AI 自信地修复了它。结果这个修复弄坏了其他东西。

欢迎来到 prompt 版的“打地鼠”游戏。因为 AI 修复的是症状而非根源,每一次补丁都堆叠在之前的基础上,代码库悄然变成了构建者所说的“弗兰肯斯坦代码”:一个由冲突风格、重复函数和混乱逻辑组成的补丁集,数据库查询直接写在界面代码里。随着项目规模超过 AI 的上下文窗口,模型开始忘记自己之前的决定,并提出与之矛盾的代码。你不再是在维护一个应用,而是在与它谈判。

还有一个更残酷的变体:静默部署失败。你的托管构建因一个小错误而失败,但在线 URL 仍显示旧版本,而你——因为没看到变化——告诉 AI 它的修复“没起作用”。于是它针对一个已经解决的问题,生成了一个完全不同且更复杂的方案。几轮之后,你得到了一个臃肿的 v5 版本代码,而其实 v1 就很好。

你看不见的部分

调试的跑步机至少是可见的。但安全问题不可见,这也是为什么我们在处理业务构建时对此态度严厉的原因。

这里的研究结果确实令人不安。LLM 生成的代码约 90% 能成功编译,但其中大约 45% 包含 OWASP Top 10 漏洞——如可绕过的登录检查、注入缺陷。AI 工具优化的是“demo 能运行”,这导致了可预见的捷径:在浏览器中实现访问控制(任何用户都可以通过编辑页面绕过),将数据库权限完全开放以确保构建时不报错,以及将 API 密钥硬编码在文件中(因为构建者不知道什么是环境变量)。随后这些文件被推送到公共 GitHub 仓库,凭据抓取工具会按时发现它们。

这就是为什么这特指一个“第二天问题”:一个可被利用的应用运行起来是完美的。对于“客户 A 技术上可以读取客户 B 的记录”这种情况,没有错误消息。如果你运气好,你会从用户那里得知;如果你运气不好,后果会糟糕得多。而标准的建议(“多测试!”)在现实面前碰壁:非技术构建者测试的是“快乐路径”(happy path),而故障潜伏在边缘情况中——并发 Bug,或者 AI 从未生成的、但 demo 并不需要的忘记密码重置流程。

没人列项的维护债务

将这些机制在数月间叠加,你就会得到我们所认为的技术债务中的“发薪日贷款”:现在立即获得软件,以后支付复利。AI 采取的每一个捷径都是未来的修复项。每一次修复都意味着更多的额度消耗和更多的代码臃肿。平台更新发布并破坏了你没触碰的功能——在 prompt-to-app 平台上的长期构建者报告说,他们必须向客户收取每月维护费,仅仅是为了处理来自平台自身的回归问题。

这就是这件事核心的讽刺之处:vibe coding 承诺使软件开发民主化,而对于生产应用来说,它在很大程度上使技术债务民主化了。非技术构建者最终持有他们使用 AI 试图避免的东西——一个需要开发人员判断力的代码库——只不过现在它是其业务的承重墙,而他们却看不懂它。

诚实的抉择

那么你实际上该怎么做?在经历了大量构建和几次教训后,我们认为这归结为一个分叉点,有两条诚实的路径,而那个不诚实的中庸方案是唯一的错误答案。

路径一:学习维护代码。 如果你足够热爱并愿意深入研究,vibe coding 将成为一个正向的加速器而非陷阱。阅读 agent 编写的内容。在交付一个依赖于 RLS 的应用之前,先搞清楚 RLS 是什么。从仅限 prompt 的工具升级到 CursorReplit,在那里代码就是界面,你可以培养真正的判断力。这条路确实很棒——但这只是一条路,需要数月的行走,而一边向客户交付未阅读的代码一边假装自己在走这条路,才是真正的陷阱。

路径二:将危险部分放在非生成的基础之上。 诚实地面对你的应用是一个业务工具——客户门户、追踪器、内部 CRM——并意识到其中 80% 正是 AI 最不擅长生成的“管线”工作:身份验证、权限、密码重置、数据访问。将这类应用构建在像 Softr 这样的无代码平台之上,那里的管线是经过测试的可视化配置基础设施,而 AI Co-Builder 依然能给你带来第一天的开发速度。当你需要自定义风格时,它的 vibe-coding 模块将生成的代码限制在单个组件中,这样 AI 就可以在不影响房顶支撑的情况下装饰房子。这条路径上的第二天是“编辑”而非“考古挖掘”——这也是为什么它在我们的 客户门户排名 中名列前茅。

继续大胆地用 vibe coding 做有趣的事情——原型、玩具、周末实验正是这些工具的拿手好戏。只需在真实用户出现之前,决定好你站在分叉路的哪一边。因为“第二天”不会礼貌地询问你。

对比工具

准备好开始 vibe coding 了吗?

我们基于真实的构建案例对工具进行排名。在启动下一个项目之前,先看看各款构建工具的定位。

查看排名 →