别再猜用户想要什么了:vibe 项目的用户访谈与需求验证实战
AI 让做出来变便宜、做对变贵。一套可照做的用户访谈方法论:五人法则招募、The Mom Test 提问原则、20 个现成问题、30 分钟访谈结构、亲和图聚类与痛点分级矩阵,外加一人团队每月 4 场的轻量 SOP。

AI 让"做出来"变便宜了,"做对"变贵了
先说一个你大概率经历过的场景:周五晚上灵感来了,周六周日两天 vibe 出一个 MVP,周一发到社群求反馈,周三发现——没人用。不是代码写得烂,不是 UI 丑,是这个"问题"本身就不存在,或者没痛到值得换工具的地步。
这是 vibe coder 这个群体最贵的失败模式。AI 解决的是"把想法变成软件"的成本,它解决不了"想法本身值多少钱"。以前做一个 App 要三个月,你会在动手前掂量掂量;现在一个周末就能上线,掂量的环节被跳过了——方向错了,执行力越强,浪费越大。
用户访谈就是最低成本的需求验证。一杯咖啡钱、一通 30 分钟电话,换你三个月不做错方向。它的 ROI 在整个产品流程里是最高的,只是看起来最"不性感",所以没人愿意做。
先把一个误解澄清掉:访谈不是市场调研,不是发问卷,不是找一帮人开座谈会。它是跟真实用户聊他真实做过的事,从他过去的行为里挖出他自己都没意识到的需求。你要的不是观点,是证据。
招募:找谁、去哪找、给什么
五人法则:别一上来就想访谈 50 个人
Jakob Nielsen 当年研究可用性测试时有个著名结论:5 个用户能发现大约 85% 的可用性问题。需求访谈同理——你不是在做统计学意义上的抽样,你是在找模式。5 个人里有 3 个人提到同一个痛点,这就是信号,足够你动手了。
实操标准:访完 5 个人,如果已经听不到新东西,说明这一波够了,去干活;如果 5 个人说的全是新东西,说明你没找对人群,换一批人再来 5 个。不要在一个错误的人群上访谈 20 个人,访谈数量救不了招募质量。
去哪找人:按转化率排序
第一梯队是你已有的用户。应用内弹窗、邮件列表、付费用户群——这些人已经为你的产品付出过时间或金钱,回复率最高。话术别写"帮我填个问卷",写"我想听听你上次用 XX 时遇到的具体麻烦,30 分钟,结束后有 50 元红包"。具体、真诚、不画饼。
第二梯队是相关社群。Twitter、即刻、V2EX、垂直领域的 Discord 和微信群。别直接发招募帖,先潜水一周,看谁在抱怨跟你方向相关的问题,然后私信他。正在抱怨的人是最好的访谈对象——他的痛点是新鲜的、带情绪的,不用你挤牙膏。
第三梯队是冷启动名单。Product Hunt、Reddit、App Store 评论区里给现有方案打低分的人,直接私信约聊。转化率低,但这些人对你验证"现有方案哪里不行"极有价值。
付费招募平台是最后手段。能花钱买到访谈当然省事,但平台上的人是"职业受访者",回答偏职业化,信息密度不如前两梯队。
招募标准要写成行为,不要写成标签
这是新手最容易写错的一行字。错误示范:"25-35 岁,一线城市白领,对效率工具感兴趣"。正确示范:"过去一个月里,手动整理过 3 次以上报销单的人"。行为描述自带筛选——符合行为的人,痛点大概率是真实的;符合标签的人,可能只是"感兴趣"而已。
给什么回报:买时间,不买答案
30 分钟访谈,20-50 元红包或咖啡券是体面的区间。B2B 场景可以给产品终身免费版或新功能优先体验权。记住回报的逻辑:它是买对方的时间,不是买"正确的答案"。
一个细节:回报要在访谈结束后给,不要先给。先给了,对方会觉得欠你人情,回答自动变客气——你花了钱,买到的全是赞美,亏大了。
提纲设计:问过去的行为,不问未来的意愿
Rob Fitzpatrick 在《The Mom Test》里讲透了这件事:好问题问的是过去的具体行为,坏问题问的是对未来的看法。为什么叫 Mom Test?因为你拿着想法去问你妈,她永远说"宝贝你真棒"——熟人和礼貌性赞美一样,都是坏数据的来源。
对比一下。坏问题:"如果有一个自动整理报销的 App,你会用吗?"——谁都会说"会啊",这句话的信息量是零。好问题:"你上次整理报销是什么时候?花了多久?当时具体是怎么做的?"——对方只能讲真实发生过的事,编都编不圆。
核心原则就一条:任务观察大于直接提问,直接提问里问行为大于问观点。能让他演示一遍,就别只让他说;只能让他说,就让他说上次具体发生了什么,别让他预测未来。
20 个可直接套用的问题清单
下面这 20 个问题是我访谈工具类产品时反复用的弹药库,按四组编排。注意:不是一次全问,一次 30 分钟能深挖 6-8 个就够了。顺序也不重要,跟着对方的话走,哪个顺手用哪个。
A 组:背景(建立上下文,5 个)
- 1. 你平时是怎么处理 XX 这件事的?(开放式开场,让对方进入讲故事模式)
- 2. 上一次做这件事是什么时候?(锁定具体事件,拒绝泛泛而谈)
- 3. 当时花了多长时间?(量化,时间是最好的痛点标尺)
- 4. 除了你,还有谁参与这件事或被它影响?(发现隐藏的利益相关者)
- 5. 这件事在你的工作/生活里有多重要?1 到 10 分打几分?(重要性校准)
B 组:行为深挖(核心弹药,6 个)
- 6. 能带我走一遍上次的具体过程吗?从第一步开始说。(时间线还原,魔鬼在细节里)
- 7. 当时你用的什么工具?为什么选它而不是别的?(现有解决方案的真实评价)
- 8. 过程中最烦的一步是哪一步?具体烦在哪?(痛点定位,追问"具体"两次以上)
- 9. 有没有哪次搞砸了?当时发生了什么?(失败故事的信息密度最高)
- 10. 你试过别的办法吗?最后为什么放弃了?(验证他是否真的在乎——在乎的人会折腾)
- 11. 如果这一步能像魔法一样消失,你愿意付多少钱?(价格探测,强度标尺)
C 组:任务观察(信息密度最高,4 个)
- 12. 你现在能现场演示一遍吗?(屏幕共享或当面,看他做一次胜过问十个问题)
- 13. 你刚才为什么点了这里而不是那里?(决策瞬间的真实逻辑)
- 14. 这个地方你犹豫了一下,当时在想什么?(犹豫处就是 friction 所在)
- 15. 如果只能保留一个功能,你留哪个?(逼他排序,排序即优先级)
D 组:收尾与转介绍(别浪费最后 3 分钟,5 个)
- 16. 还有什么我没问到、但你觉得我应该知道的?(最高频的意外收获来源)
- 17. 如果让你给同样被这事困扰的朋友推荐一个解决方案,你会怎么描述?(他的自然语言就是你的 landing page 文案)
- 18. 你身边还有谁经常被这事困扰?方便介绍吗?(滚雪球招募,最好的招募渠道)
- 19. 我一个月后回来跟你同步进展,可以吗?(建立长期联系,把受访者变成顾问团)
- 20. 如果我们做出了解决方案,你愿意第一个试用吗?(承诺测试——嘴上说愿意容易,真到时候看他行动)
第 11 个问题(愿意付多少钱)是整场访谈的试金石。如果对方支支吾吾说"嗯……看情况吧",这个痛点的强度大概率是假的。真痛的人会脱口而出一个数字,甚至反问你"什么时候能上线,我现在就想买"。
访谈执行:30 分钟的标准结构
0-5 分钟:破冰,别直奔主题
开场先聊两句对方的背景:"你是做什么的?平时用我们产品吗?怎么找到我们的?"目的是让对方放松,从"被审问"模式切换到"讲故事"模式。同时把规则讲清楚:会录音、录音只用于内部整理、随时可以叫停、结束后有小红包。规则讲清楚了,对方才敢说真话。
5-20 分钟:行为深挖 + 任务观察,这是核心 15 分钟
这 15 分钟里,80% 的时间应该对方在说话。你的台词库只有三句:"然后呢?""能具体说说吗?""当时你心里在想什么?"忍住给建议的冲动,忍住说"我们正好在做这个功能"的冲动——你一剧透,对方后面说的全是迎合你的话。
如果对方愿意,直接让他演示一遍他现在是怎么做的。人们在描述自己行为时会自动美化("我一般都会先分类整理"),但手不会骗人——你会看到他根本没分类,而是全堆在一个文件夹里。这个 gap 就是机会。
20-27 分钟:痛点确认,把听到的复述回去
"所以你的意思是,每次月底你都要花两小时手动对账,最烦的是发票和系统里的数字对不上,对吗?"然后闭嘴,让对方纠正你。这是整场访谈信息密度最高的部分——对方纠正你的每一句话,都是精准的需求描述。记下来,原话记下来。
27-30 分钟:收尾,转介绍 + 长期联系
问 D 组的 16-20 题。转介绍一定要当场要,不要说"回头你帮我问问",当场就要微信推名片或邮箱。长期联系的许可也要当场确认,一个月后你回来同步进展时,对方会觉得被尊重——你的第一批种子用户就是这么来的。
记录方法:录音 + 24 小时内转录 + 原话卡片
一定要录音。手机、腾讯会议、Zoom 都行,提前告知并征得同意是底线。不要相信自己的笔记——现场记笔记会让你分心,更重要的是,笔记记的是你的理解,不是对方的原话。
访谈后 24 小时内转录。现在 AI 转录又便宜又准,飞书妙记、通义听悟这类工具直接出文字稿,30 分钟的访谈转录成本几乎可以忽略。超过 24 小时不处理,你的记忆会自动按你的偏好加工——你会只记住支持你想法的部分,这叫确认偏误,访谈白做了。
转录之后做"原话卡片":把关键原话逐条摘出来,一卡一句话,带上说话人编号和时间戳。比如:"月底对账要搞两个晚上,发票和系统永远对不上——#3,12:40"。不要只记结论,结论是你的解读,会丢信息;原话才是资产,是下一步聚类的原材料。
亲和图聚类示例:把 5 场访谈的原话卡片摊开,按"说的其实是同一件事"分组,类别从卡片里自然长出来
从访谈到需求:三步走
第一步:亲和图聚类,让类别自己长出来
把所有原话卡片摊开——实体便利贴贴满一面墙,或者 FigJam、Miro 这类在线白板。然后按"说的其实是同一件事"分组。关键:不要预设分类。不要先画好"易用性/性能/功能缺失"三个框再往里塞,那叫验证自己的假设,不叫聚类。
一人团队 5 场访谈大概产出 80-150 张卡片,最后聚成 6-10 个主题。给每个主题起名字时,用用户的原话风格,比如"发票永远对不上",而不是"数据一致性问题"。前者让你每次看到都想起用户的脸,后者让你想起 Jira 工单——你想为哪一个加班,重不重要?
第二步:痛点分级,频率 × 强度矩阵
聚类告诉你"用户在说什么",分级告诉你"先做什么"。画一个 2×2 矩阵:横轴是频率(多少人提到、提到多少次),纵轴是强度(用户的情绪有多激烈、愿意付出多少代价——第 11 个问题的答案就是强度的标尺)。
强度高
│
低频高强度 │ 高频高强度 ← v1 先做这里
(利基机会, │ (核心需求,
记入需求池) │
────────────────┼────────────────
低频低强度 │ 高频低强度
(直接忽略) │ (体验优化,
│ 有空再做)
│
强度低
低频 高频
右上象限(高频高强度)就是你的 v1 功能清单,毫无争议。左上象限(低频高强度)别急着扔——提的人少但个个愿意付钱,这往往是高付费意愿的利基需求,先记到需求池标"待验证",等用户多了再回头看。左下直接忽略,右下排到体验优化 backlog 里。
痛点分级矩阵示例:横轴频率、纵轴强度,右上象限是 v1 必做,左上是待验证的利基机会
第三步:需求池,一张表管住所有想法
聚类和分级的结果要沉淀下来,否则下个月你就忘了为什么没做某个功能。一人团队不需要复杂的 PRD,一张表就够了:
需求池模板(每行一个需求)
─────────────────────────────────────────────
需求: 自动识别发票并填充报销单
来源访谈: #2、#3、#5(3/5 人提到)
频率: 高(3/5)
强度: 高(#3 说"愿意付 50/月",#5 说"月底都要加班搞这个")
象限: 高频高强度
状态: 待开发
备注: #2 补充:只认增值税专票,普票不 care
─────────────────────────────────────────────
需求: 报销单自动生成英文版
来源访谈: #4(1/5 人提到)
频率: 低(1/5)
强度: 高(#4 说"外企审计必备,愿意单独付费")
象限: 低频高强度
状态: 待验证
备注: 可能是外企员工利基需求,等用户量上来再回访 #4
─────────────────────────────────────────────
状态只有五种:待验证 / 验证中 / 待开发 / 已上线 / 已放弃
已放弃也要留着,写清放弃原因——三个月后你会忘了当时为什么放弃,
然后兴冲冲地重新做一遍。
一人团队的轻量节奏:每月 4 场
访谈最大的敌人不是方法不对,是坚持不下来。一人团队不需要专职用研,需要的是一个轻到不可能失败的节奏:
- 第一周:招募。发出 10 封邀约(邮件/私信/社群帖),目标约到 2 人。邀约话术固定模板,每次只改名字和一句话个性化,别每次重写。
- 第二、三周:各做 2 场。固定时间,比如每周三晚上 8 点。写进日历,雷打不动。不要"有空再约"——有空永远不会有。
- 第四周:聚类 + 更新需求池。花 2 小时,把 4 场的原话卡片聚类,更新需求池的状态和象限。这是把访谈变成决策的临门一脚,跳过这一步,访谈就只是聊天。
全程投入约 6-8 小时/月,相当于每周少看两集剧。回报是:你的 roadmap 每一项都能说出"这是 #2、#3、#5 三个人亲口说的",而不是"我觉得用户会喜欢"。
访谈债务:多久不访谈就危险?
我给自己定的红线是:连续 6 周没跟用户聊过天,就是债务违约。症状很好认:你开始用"我觉得用户会喜欢"代替"我听到用户说";需求评审时你的论据变成"我猜""应该是"。一出现这句话,立刻约访谈,不管 roadmap 多满。
另一个量化信号:需求池里"待验证"状态的需求超过 5 个还没人聊过,说明你在闭门造车。访谈债务和技术债务一样,欠得越久利息越高——区别在于技术债务爆雷是系统崩了,访谈债务爆雷是你花三个月做了一个没人要的东西。
常见坑:都是我踩过的
坑一:引导性问题。"你是不是也觉得手动对账很烦?"——别这么问,你已经把答案喂给对方了,对方点头只是出于礼貌。改成:"对账这事你感觉怎么样?"把评价权交还给对方。
坑二:只访谈熟人。朋友、同事、前同事会出于礼貌说好话,The Mom Test 的书名就来自这个——你妈永远觉得你的想法很棒。熟人访谈只能用来练手、练流程,不能用来验证方向。验证必须找陌生人,最好是正在被这个问题折磨的陌生人。
坑三:把礼貌性赞美当验证。"这个想法太酷了!""上线了我一定用!"——Fitzpatrick 说得直接:赞美是毒品,远离它。验证的唯一标准是对方付出真金白银或真实时间:预付费、注册试用、转介绍朋友、答应一个月后回访。嘴上说的都不算,行动才算。
坑四:用访谈代替上线验证。这是最隐蔽的一个。访谈只能证伪,不能证实——它能告诉你"这条路是错的"(没人有这个痛点),但不能告诉你"这条路是对的"(有人说痛,就一定会买单)。访谈是过滤器,不是水晶球。访谈之后还是要做最小可用版本,上线看真实数据。
坑五:"为什么"问太多。连续追问为什么,对方会开始现场编理由给你——人对自己的动机并没有那么了解。行为问题问"是什么/怎么做",动机问题点到为止。真想知道为什么,去看他怎么做(任务观察),别问他怎么想。
坑六:访谈完不复盘。24 小时内不转录、不摘原话卡片,等于没访谈。你的大脑会自动美化记忆,只留下支持你想法的部分。对抗的方法很笨但有效:定个规矩,访谈结束当天必须产出原话卡片,否则不许开下一场。
可直接抄的访谈提纲模板
最后附一份完整提纲模板,复制到备忘录里就能用。方括号里是执行备注,正式访谈时删掉。
30 分钟版
受访者编号:___ 日期:___ 产品/方向:___
- 自我介绍 + 访谈目的("想了解你平时是怎么处理 XX 的")
- 规则说明:会录音仅内部使用、可随时叫停、结束后有小红包
- 破冰:你是做什么的?平时用我们产品吗?
(核心!80% 时间对方说)
- 你平时是怎么处理 XX 的?
- 上一次是什么时候?花了多久?
- 能带我走一遍上次的具体过程吗?从第一步开始。
- 当时用的什么工具?为什么选它?
- 过程中最烦的一步是哪一步?具体烦在哪?[追问"具体"至少两次]
- 有没有哪次搞砸了?当时发生了什么?
- 试过别的办法吗?为什么放弃了?
- 如果这一步能魔法般消失,你愿意付多少钱?
[如果对方愿意:现在能现场演示一遍吗?]
[观察到犹豫时:刚才这里犹豫了一下,当时在想什么?]
- 复述:"所以你的意思是……,对吗?"[闭嘴,等对方纠正]
- 如果只能保留一个功能/解决一个麻烦,你选哪个?
- 还有什么我没问到、但你觉得我应该知道的?
- 你身边还有谁经常被这事困扰?方便介绍吗?[当场要联系方式]
- 我一个月后回来跟你同步进展,可以吗?
- 如果我们做出了解决方案,你愿意第一个试用吗?
□ 转录录音 □ 摘原话卡片(一卡一句+编号+时间戳)
□ 记入需求池 □ 发感谢+红包
结语:访谈是 vibe coder 最便宜的护城河
AI 把"做出来"的成本打到了地板价,这意味着竞争会越来越卷,卷的方向只能是"做对"。而"做对"的信息不在你的脑子里,在用户的嘴里——在那些他上周加班搞报销的深夜里,在他对着错乱的发票骂脏话的瞬间里。
访谈不会给你标准答案,它只会让你少犯错。而对一人团队来说,少犯一次大错,价值超过做对十个小功能。这个月约 4 个人聊聊吧,从第 18 个问题(转介绍)开始,你会发现用户比你想象的更愿意说话——毕竟,能认真听他们抱怨的人,真的不多。
相关文章

你花一个周末加上了邀请链接,一个月后:发出 200 条邀请,回来 3 个注册,2 个还是你自己的小号。推荐计划不是'加个链接'——它是一套经济系统。本文从 R < CAC × L 算账公式讲起:单边/双边奖励决策、现金/折扣/额度/功能解锁四种奖励形态定价,Next.js 可直接跑的邀请归因与防刷代码,羊毛党识别 5 招、三阶段上线节奏,以及 K-factor 增长指标与失败模式复盘。

waitlist 不是许愿池,是转化漏斗。本篇给出完整打法:四种等候名单形态与决策表、一天落地的 Next.js + Supabase 最小实现(注册接口、double opt-in、排队名次、推荐计分)、上线前 30 天每周动作节奏表、反作弊与数据清洗、Launch 当天 5 个转化动作、验证通过的指标判断线,以及排队很长但 launch 当天没人来的 3 个解法。

一人团队流量小,更要懂实验设计。这篇实战指南给 vibe 开发者一套小流量实验框架:三大误区(样本量幻觉、过早看结果、只测 UI 颜色)、一句话假设模板与北极星/护栏指标、样本量估算表与实验周期公式、30 行 Next.js Feature Flag 中间件与三档灰度策略、5 个经典坑的真实翻车案例、PostHog/GrowthBook/自研的成本账,以及一页纸实验复盘模板。