原型与产品:怎么判断你的 AI 应用真的做好了

你用 AI 做的应用能跑了,该有的功能都有了。那为什么还总觉得它没准备好?这是一份写给非技术创客的指南,讲清"能用的原型"和"别人真愿意掏钱买的东西"之间的那道鸿沟。

几周前,我认识的一位创客用一个 AI 应用构建器做了一个给心理治疗师用的预约应用。整件事花了她四天。它实现了她需要的功能:治疗师能查看自己的日程,客户能预约,确认信息通过邮件发出。它能用。

她盯着它看了两个星期,却一直没上线。

我问她为什么,她说:“它能用,但是……感觉它还没做好。”

我问她想改什么。她说:“我不知道。这才是问题所在。”

这是用 AI 应用构建器做东西时最难熬的一刻。东西是能用的,但”能用”和”我愿意安心地请真人来用它”之间,隔着一道鸿沟。看懂这道鸿沟——并搞清楚自己究竟站在它的哪一边——就是”把东西发出去”和”永远卡在脑子里那个声音的阶段”之间的区别。

“做好了”到底是什么意思

这里有一个至关重要的区分:原型是你用来检验一个想法的东西,产品是你用来解决一个问题的东西。

那个治疗师预约应用,是个原型。它证明了概念可行。一个治疗师能用它。但有十七个小地方让它显得粗糙:

  • 邮件确认信很简陋。没有 logo,没有自定义品牌,文案是套话。
  • 取消预约不会发通知。客户就那么不来了。
  • 治疗师约满时,没有候补名单。
  • 注册流程不收集治疗师的专长,所以没法按执业类型来筛选。
  • 预约前 24 小时没有提醒邮件。

这些都不会让应用崩掉。但它们都会让一个真正的治疗师心里嘀咕:“这感觉像是有人花一个周末攒出来的东西,而不是我该为之付钱的东西。”

那种感觉是真实的,而且很重要。原型在理论上解决了问题。产品在实践中解决问题——为正在使用它的那个活生生的人。

把原型和产品区分开的三个问题

难就难在这里:你没法知道还缺了什么。你的 AI 构建器也没法知道。所以你需要三个能快速判断自己站在线哪一边的问题。

1. 你自己会用它来解决你自己的问题吗?

这个问题很诚实,因为你得真正和自己的产品朝夕相处。

如果你是那个治疗师预约应用的创客,你会用它来预约你自己的心理治疗吗?不是”你能不能”——而是你会不会真的用它,而不是用一来一回的邮件,或者一份共享的 Google Doc?

如果答案是不会,那你就没做好。你心里清楚得很哪里不对劲——每次打开应用你都能感觉到。如果答案是会,那你就更接近了。

我提到的那位创客,自己把治疗师的注册流程走了一遍。她卡在表单那一步(还没让她预约,就先要了太多信息)。她看到确认邮件,觉得它显得很业余。她开始琢磨她的治疗师会怎么收到这封邮件,以及它会不会被丢进垃圾邮件。

她没有像一个付费客户那样去用自己的产品。等她这么做了,她找出了十处要改的地方。

2. 你有没有把它给三个你以外的人看过?

跟潜在用户聊天,比做产品更难,所以大多数创客都跳过了这一步,因为他们想在发布时给人一个惊喜。这是个错误。

你不需要一个焦点小组。你需要的是三个跟你心目中客户相似的人。对那个治疗师应用来说,那就是三个真正的治疗师。

你要找的是这些:他们在哪里犯迷糊?他们在哪里犹豫?他们会问什么?不是问”你觉得它怎么样?“(人都太客气了)。让他们真的去做那件事——预约一次、发一封确认邮件、取消点什么。

当那位创客把她的治疗师应用给三个治疗师看时,其中两个问:“我能设定我什么时候有空的规则吗?比如,我只在周四接新客户,下午两点之前不接连排两单。“应用有日历,却没有规则。她当初是照着她以为预约该怎么运作来做这个原型的,而不是照着治疗师实际怎么工作来做。

那才是产品级的信息。你光靠一份规格文档,是猜不出来的。

3. 如果把它交给十个真实用户,什么会出岔子?

这是最难的问题,因为它要求你真正去思考你的边缘情况。

对那个治疗师应用来说:

  • 如果一个客户试图同时预约两个同一时间的约,会怎样?(应用不检查。)
  • 如果一个治疗师取消了一个预约,会怎样?客户会被自动通知吗?(不会。)
  • 如果客户的邮箱地址填错了怎么办?有没有办法不用从头再来就改掉它?(没有。)
  • 如果一个治疗师病了一天,需要把日历关一个星期怎么办?(她得手动删掉每一个预约。)

这些不是 bug。应用不会崩。但它们是”小划伤”。有了十个真实用户和真实的边缘情况,你头一个星期就会全撞上。

产品会处理边缘情况。不是全部——有些事可以等。但那些在真实用户头两周里就会发生的情况,那些必须好使。

如何决定:三层测试法

用这个来搞清楚你处在什么位置:

第一层:核心流程——主路径能走通吗?用户能完成你这个应用设计来做的那件主要的事吗?

对那个治疗师预约应用来说:能。有人可以注册、预约、收到确认。它能用。

第二层:来自真实使用的边缘情况——你已经把它给三个真实用户看过了。他们有没有撞上什么你没做的东西?他们在哪里犯过迷糊吗?

对那个治疗师预约应用来说:有。那三个治疗师想要基于规则的可约时间。其中一个犯了迷糊,因为邮件确认看起来太套话了。还有一个想批量删除预约却办不到。

第三层:打磨与专业感——它感觉得出来你在乎吗?还是感觉像是你随手拼凑的?

对那个治疗师预约应用来说:感觉像是拼凑的。邮件确认很简陋。没有自定义品牌。出错时没有任何错误提示,所以一旦出了岔子,用户完全不知道发生了什么。

下面是判断的经验法则:

  • 三层全都过关? 你是个产品了。发出去。
  • 第一、二层过了,第三层没过? 你完成了 80%。花一天打磨。
  • 第一层过了,二、三层都没过? 你是个原型。先别发。
  • 第一层都还不扎实? 你没做好。继续做。

那个治疗师应用,卡在第一层和第二层的交界处。核心流程能走通,但真实的治疗师发现它缺了零件。所以那位创客有一个选择:再花一个星期,用她的 AI 构建器把治疗师真正需要的功能加上;或者就拿现有的发出去,以后再补。

(她加上了。花了三天。现在它是个产品了。)

让这件事变难的,到底是什么

这么多创客卡在这里,原因在于:做东西很好玩,发东西很吓人。

做东西,是一场和你 AI 工具的对话。你有个想法,你描述它,工具就把它做出来。反馈循环只要几分钟。发东西不一样。你一按发布,万一哪里不对,是真人会发现。没有重来的机会。

于是我们就给自己找各种不发的理由。“打磨得还不够。""我应该再加一个功能。""万一字体不对怎么办?“然后六个星期过去了,你还守着一个能用、却感觉没做好的东西,并且说服了自己那是因为字体的缘故。

不是字体的事。

通常是因为你还没花时间和一个真实用户相处,或者你做出了一个在你脑子里讲得通、却不太契合真实的人怎么工作的东西。这是可以解决的。它只要求你承认你不知道自己不知道什么,然后去找一个知道的人聊一聊。

上线准备清单

用这个。它简短又诚实。

  • 我自己用它做过那件真实的任务,而且成功了(不是演示模式那种走过场,是真的做了)。
  • 我把它给三个真会用它的人看过,他们犯迷糊的地方我都改好了。
  • 每一个可能发生的错误,都有一条告诉用户该怎么办的提示(不是”错误”两个字,而是实打实的指引)。
  • 就算这是接下来半年的最终版本,我也能接受(意思是:它已经完整到哪怕我再也不碰它,也是有用的)。
  • 比起在真空里埋头加更多功能,我更期待从真实用户那里学到的东西。

如果五个框你都能打钩,你就做好了。上线。

如果不能,那就别上。但要把原因说具体。“感觉没做好”不是个理由。“真正的治疗师需要可约规则,而我还没做出来”才是个理由。那是可以行动的。那是可以解决的。那就是”卡住”和”走在路上”之间的区别。

那个治疗师应用的创客,昨天把它发出去了。她有了第一个付费客户。产品并不完美,但它是真实的,而且她的客户已经在告诉她下一步该做什么了。这才是你知道自己做好了的时刻:不是当应用变完美的时候,而是当你准备好去搞懂”完美”对正在用它的人究竟意味着什么的时候。