AI时代定性研究角色转变 01|评判AI主持人,越像真人越优吗?
一个行业越成熟、越规范,越容易形成一套关于“正确”的稳固共识。用户研究同样如此。
长期以来,我们对“优秀的访谈主持人”已经有了相对明确的评判:能够在较短时间内建立信任关系,捕捉受访者语气和细微表情的变化,不机械照本宣科,并能灵活把握深挖与追问的时机。
因此,当 AI 开始涉足定性访谈,我们也习惯以真人为参照:它像初级主持人,还是资深主持人?能不能像人一样自然交流、理解情绪、建立信任?
但在近期一次由 Mizzen Insight 支持的实际研究项目中,我们观察到了一些出乎意料的现象:一场原计划30分钟的访谈,实际平均时长达到45分钟,最长一场,受访者和AI主持人聊了整整72分钟。
这也让我们开始重新审视:评价一个 AI 主持人时,“像不像真人”,真的是最关键的指标吗?
项目背景:
敏感话题、高专业壁垒、
高样本量的多重挑战
某大型 AI 健康产品正处于高速扩张阶段。随着用户量急剧增加,团队需要更深入地理解不同健康人群:他们如何使用产品、如何理解 AI 健康服务,又在哪些场景中真正建立信任与依赖。
这项研究涉及多个高敏感健康议题,需要完成百余场一对一深度访谈。但客户侧研究团队仅有约5人,还要赶在产品快速迭代的窗口期内形成结论。
除了时间紧迫,项目还叠加了多重难题:话题隐私性高,受访者难以敞开心扉;通过产品内部招募,无法预判受访者的表达能力和参与意愿;医疗健康领域专业门槛高,也很难要求每位主持人都具备完备的专业素养。
面对跨度较大的健康议题,很难要求每位研究员都具备相应的专业背景和生活阅历。与此同时,他们还需要营造一个低压力、让受访者感到被理解的氛围,引导其讲清身体感受、用药选择、就医经历,甚至非常私密的生活处境和情感困扰,难度极大。
面对这些难题,该团队使用Mizzen Insight开展了这批深度访谈。
在首批 3 个项目中,原计划每场访谈约 30 分钟,实际平均时长达到45 分钟,最长一场达到72 分钟。受访者的平均回答质量评分为4.1—4.3 分(满分 5 分),也高于平台整体项目约3.7分的平均水平。
访谈时间更长,并不必然意味着访谈质量更高。但结合回答质量来看,这些项目现象至少提示我们:在某些研究主题下,AI 主持人可能带来与真人主持不同的访谈效果。
想知道 Mizzen Insight 如何助力你的业务场景?
点击公众号主页的【预约演示】菜单,预约你的专属产品演示,我们将结合你的具体需求,为你介绍适合的应用方式。
AI 主持人优势一:
更少人际压力,
更容易充分表达
我们尝试从心理学角度理解,为什么 AI 主持人在这类项目中表现优异。这里涉及两个经典概念:霍桑效应和主试效应。
霍桑效应
当人们知道自己正在被关注、观察或研究时,可能改变自己的行为和表达方式。
放在用户研究中,受访者可能会更加谨慎、得体,甚至下意识给出更符合外界期待的回答。
主试效应
主持人的期望、态度、语气、表情和追问方式,可能有意无意地影响受访者,使其产生迎合、回避或被引导的回答。
在医疗健康等隐私性很强的访谈中,主持人的性别、年龄和生活阅历等客观因素,都可能进一步放大受访者的顾虑。
AI 主持人或许不能完全消除霍桑效应,但它可能减少真人主持人带来的部分主试效应,以及被评价、被判断的人际压力,带给受访者更多安全感,甚至形成一种在“向树洞倾诉”的体验。
至少在这次实践中,我们看到:AI 主持人的身份并不一定会妨碍受访者表达;在一些高敏感度、高隐私性的研究主题中,反而可能成为访谈顺利开展的有利条件。
AI 主持人优势二:
专业知识储备,
支撑复杂话题持续追问
除了访谈关系的变化,AI 主持人的另一项优势,是专业知识储备。
医疗健康访谈常常要求主持人听懂各种病症、治疗方法和药品名称。这对真人主持人而言,意味着很高的前期学习成本;面对跨度较大的研究主题,也很难在短时间内完成全面准备。
而预训练大模型本身已经具备较广泛的知识储备,再结合可定制的行业知识库和术语表,AI 主持人可以更好地识别复杂病症、专业术语和相关表达,并围绕研究目标继续追问。
*图中内容已脱敏
这也是 Mizzen Insight 持续打磨 AI 主持人的方向:让 AI 围绕研究目标理解语境、识别线索、动态追问,并在复杂的专业话题中保持稳定。
这并不意味着 AI 可以替代专业研究员,也不意味着真人主持人的经验不再重要。它只是提醒我们:如果始终以“像不像真人”作为唯一标准,就可能忽视 AI 自身的特点和优势。
回到研究本身:
我们真正需要
AI 主持人做到什么?
真人主持人能够捕捉微妙的情绪变化,凭借经验做出判断,也能够通过真实的人际互动建立关系——这些依然是定性研究中非常重要的能力。
但 AI 主持人的价值,也不应该只通过“有多像真人”来衡量。
回到研究本身,我们真正关心的始终是:它能否服务于研究目标,能否让受访者充分表达,能否理解回答并抓住值得追问的线索,能否稳定执行研究设计。
从这次实践来看,AI 主持人并不只是对真人主持人的模仿。它也可能凭借自身的身份和能力,在特定研究场景中发挥独特作用。
当主持人可以是 AI,我们需要重新思考的不只是“如何提问”,还有什么样的访谈关系,更有利于真实信息的产生。
下一篇是 02 受访者篇,我们继续讨论:当主持人变成 AI,“好受访者”的标准发生了什么变化?
想知道 Mizzen Insight 如何助力你的业务场景?点击公众号主页的【预约演示】菜单,预约你的专属产品演示,我们将结合你的具体需求,为你介绍适合的应用方式。
--- The End ---