能演示 vs 能上线:你 AI 做的应用什么时候才算真正准备好面对真实用户
大多数 AI 做的应用在演示时光鲜亮丽,到了第三个真实用户面前就崩了。下面教你判断自己处在哪一边,以及如何不靠开发者就把这道差距填上。
每个用 AI 应用构建器的人,都会迎来这样一个时刻:你做出来的东西开始有模有样了。页面加载出来了,按钮能点了,表单能接收输入了,数据也出现在该出现的地方。你点来点去,感觉自己像个创业者。这是种很好的感觉。但这也正是很多人卡住的地方 —— 因为”我演示时它能用”和”陌生人用它时它能用”之间的差距,比看上去要大得多,而这道差距在 AI 应用构建器的预览窗口里是不会显现的。
这篇文章讲的,是如何有意识地去填上这道差距。你不需要变成一名工程师。你需要知道:该测什么、按什么顺序测,以及什么时候可以不再把一个东西叫作原型。
“能演示”到底是什么意思
一个能演示的 AI 应用,是指它在你测过的那条路径上、用着跟你一直粘进提示词里差不多的数据,做成了你想让它做的那件事。登录能用,仪表盘能加载,你想给联合创始人看的东西出现在了屏幕上。
能演示并非毫无价值。四个月前,你做出来的这个东西,可还是一笔自由职业者的合同加六个星期的工期。但它同时也是一个只被你一个人、独自在那条顺风顺水的路径上测过的版本。真实用户可不会乖乖待在顺风顺水的路径上。
他们会粘进一个末尾带着多余空格的邮箱地址。他们会在 iPad 上横屏用 Safari。他们会用着移动数据进来,让页面半加载着干等三十秒,才去点那个按钮。他们指望”后退”能用,指望刷新不会丢掉他们刚输入的任何东西。
演示之所以具有误导性,不是因为 AI 做出来的是假东西。而是因为操作演示的那个人,知道哪里埋着雷。你本能地去点那些能用的按钮。而真实用户会去点那些你忘了它们还存在的按钮。
最先崩掉的五样东西
在我看过的、那些用 AI 应用构建器从演示走向上线的人当中,最先在真实用户面前崩掉的,往往是同样的五样东西。逐个有意识地把它们过一遍,是走向”能上线”最快的路。
**1. 空状态。**你的仪表盘里有三个项目时看着挺好,因为你做开发时就用了三个项目。一个新用户注册进来,落在一个什么都没有的仪表盘上,看到的是一块灰色的空白矩形。修复办法就一句提示词:“当用户一个项目都没有时,显示一条友好的消息,说明接下来该做什么,再加一个按钮让他创建第一个项目。“无聊,十秒钟的活儿,却决定了用户是觉得”这坏了”还是”这挺贴心”。
**2. 错误状态。**现在就试试:关掉你的 wifi,在应用里点来点去。故意输一个错的密码。提交一个邮箱字段空着的表单。如果你的应用崩溃、卡死,或者甩出一个像 500 Internal Server Error 这样的原始报错,那你就有错误状态的问题。AI 构建器能修,但你得开口问:“当 API 调用失败时会怎样?当用户输入了错误数据时呢?当他们离线时呢?“这是三条各自独立的提示词,它们覆盖了真实用户陷入麻烦的大多数情况。
**3. 移动端视图。**你最早的用户里,大约一半 —— 也许更多,取决于你的应用是什么 —— 会用手机打开它。对于标准布局,AI 构建器把响应式设计处理得不错;可一遇到定制的布局,尤其是任何涉及侧边栏、吸附弹窗或复杂表单的地方,就处理得很糟。用你的手机打开你的应用,用另一只大拇指,照一个真人会用的方式去用。如果有任何东西溢出屏幕、有任何东西小到点不准、或者有任何东西在你想打字时挡住了键盘,那就是要修的地方。通常一条提示词:“让这个页面在手机屏幕上显示正常,尤其是 [出问题的那块] —— 桌面版保持不变。”
**4. “第二个用户”问题。**这是个隐蔽的坑。很多 AI 做的应用都假设只有一个用户。你创建的数据就留在应用里。然后第二个用户注册进来,要么看到了你的数据,要么什么数据都没有、一头雾水。这是个身份验证和数据隔离的问题,值得在上线前让 AI 解释一下它是怎么存储用户数据的。正确的问法:“解释一下用户数据是怎么隔离的。如果有两个人注册,一个能看到另一个的数据吗?“它的回答就是这道测试。
**5. “我改主意了”按钮。**真实用户随时都在撤销操作。他们会删掉刚创建的账户,因为邮箱输错了。订阅两分钟后就退订。他们想编辑昨天做的一个项目,因为标题有个错别字。AI 应用构建器要是放任不管,往往只搭出”创建”这条路,而跳过”编辑或删除”那条 —— 因为演示从头到尾只让它去创建东西。如果你带着这个缺口上线,你最早的三个用户会在一小时内给你发邮件,而那封邮件的开头会是”怎么”两个字。把你的应用走一遍,对每一个界面都问一句:“用户能撤销刚才做的事吗,或者以后能改吗?“凡是答案为”不能”的地方,那就是你上线前必须补上的一个功能。
“能上线”并不意味着什么
对一个 AI 做的应用来说,“能上线”跟一家银行那种”能上线”不是一回事。你不需要 99.99% 的可用性。你不需要做压力测试。你不需要运行手册,也不需要值班排班。你不是 Stripe,你只是一个服务真实用户的小东西。
你真正需要的,是一个不会让你在陌生人面前丢脸的版本。一旦你知道要找什么,这在一两个专注的下午里就能做到。上面那五点占了大头。剩下的,就是让应用变得好懂 —— 每个按钮上的文案都清清楚楚,点下去的行为可以预料,没有哪个页面会在一个点了没反应的后退箭头那里走进死胡同。
从能演示到能上线,最大的那一跃不在代码里。它在于你是否愿意像陌生人那样去用你自己的应用。我给人的窍门是:在咖啡店把你的手机递给一个朋友,请他做你应用的主要那件事,而你一句都不解释。别给提示。看着他的大拇指。他第一个停顿超过三秒的地方,就是你这周最该修的东西。第二、第三个地方,通常是紧随其后的小修小补。
一份简短的上线清单
在你把它推给最初十个真实用户之前,把这份清单走一遍。这里面没有一项需要写代码。每一项要么是一条给你 AI 应用构建器的提示词,要么是一次手动的点点点。
- 我已经从一个无痕浏览窗口、以一个全新用户的身份,端到端地走完了一遍,没有任何抄近路。
- 我已经在我的手机上用过这个应用。
- 我已经试着把表单弄坏 —— 空字段、奇怪的输入、超长的输入。
- 我已经问过 AI 构建器用户数据是怎么隔离的,而它的回答说得通。
- 我有办法在出问题时联系到用户(一个邮箱字段、一个反馈链接,什么都行)。
- 我有办法知道什么时候出了问题 —— AI 构建器通常提供基础的错误日志;把它打开。
- 每个页面的空状态,都告诉了用户接下来该做什么。
- 每一个会创建东西的操作,都有办法撤销、编辑或删除。
如果你走完这份清单,发现少了几项,那些就是明天的提示词。如果你走完发现大部分都缺,那这应用还没准备好 —— 而在你把链接发给任何人之前就知道这一点,是件有用的事。
诚实的中间地带
大多数 AI 做的应用,会在一个中间区里待上一阵子。它们基本能用,有几处毛边,把一小群用户服务得不错,但放到大规模下就会崩。对一家初创公司或一个内部工具来说,在这个区里待上几个月完全没问题。错误在于:把一个只能演示的应用,当成它已经越过了这个区。另一个错误是:把”能上线”当成一个你永远够不着的完美主义标准。
真正要问的是:要是一个朋友用了这个,再回头跟我反馈,我会觉得自在吗?如果会,那对你现在这个阶段来说,你就足够”能上线”了。如果你宁愿在他告诉你感想之前抢着冲过去修点什么,那就把那样东西记下来,先修它。
你不需要为一万个用户做好准备。你需要为下一个十人做好准备。那是一份真实、有限的待修清单,而你的 AI 应用构建器能帮你在一个下午里搞定其中大部分。
如果你已经把一个 AI 做的应用推给了真实用户,那第一个崩掉、又是你没料到的东西是什么?这通常比”我的准备好了吗”更有意思 —— 因为那个意外,才是真正的信号。