这个问题几乎总是以错误的顺序出现:“我们要进行有调节的测试还是无调节的测试?”。在定义您想要学习的内容之前选择方法。结果是可以预见的,时间和金钱都浪费在错误的解决问题的方法上。
审核测试和非审核测试是进行可用性测试的两种方法,观察真人使用产品以找出产品失败的地方。两者都有效。但它们服务于不同的目的,在正确的背景之外使用它们会浪费精力或得出薄弱的结论。
这是一本实用指南:每种方法是什么,何时使用哪种方法,以及如何应用它而不犯导致研究空虚的错误。没有超出必要的理论。
审核和非审核之间有什么变化
不同之处在于测试期间有辅导员在场。
在主持测试中,研究人员亲自或通过电话实时陪伴参与者。他提出任务、观察,并可能会问“你现在在想什么?”或“你为什么点击那里?”。这是围绕产品使用进行的引导性对话。
在无人主持的测试中,参与者单独使用该产品,没有任何人观看直播。他从工具接收任务,在自己的时间和环境中执行它们,系统记录发生的事情、点击、路径,有时还有屏幕和语音。然后研究人员对其进行分析。
总结核心权衡:适度提供深度和背景,但成本昂贵且缓慢;无节制的提供了规模和速度,但失去了深入研究当下的能力。
步骤 1:定义问题是“为什么”还是“有多少”
在选择任何方法之前,脚本从这里开始。研究问题到底是什么?
如果问题是关于动机、推理、困惑,“为什么人们在这一步放弃?”,“他们从这个屏幕中理解了什么?”,你需要深度。你需要能够立即提出问题,看到犹豫,理解想法。这是适度的测试领域。
如果问题是关于大规模行为,“人们完成哪个版本更快?”,“大多数人在流程中的哪个位置崩溃?”,你需要数量。该模式需要许多参与者才能可靠。这是不受监管的测试领域。
混淆两者的是根本错误。对于体积问题使用“中等”的成本很高,而且样本太小。使用未经审核的“为什么”问题会生成没有您正在寻找的解释的数据。
步骤 2:当适度是正确的选择时
当产品、流程或想法仍然是新的且充满未知时,适度的测试就会发挥作用。
在开始时使用它,当你甚至不知道问题是什么时。实时对话揭示了意想不到的事情:这个人以你从未想象过的方式理解一个概念,他们因为你没有注意到的原因而陷入困境。只有当有人理解并询问时才会出现这种情况。
还可以在复杂或高风险的流程、多步骤流程、重要决策、需要深入理解其推理的特定受众中使用它。例如,在由不同数字熟悉程度的人使用的公共服务中,密切观察某人迷路的地方比任何数字都更有价值。
接受的局限性:因为它既昂贵又耗时,所以温和派的参与者很少。这足以发现问题,少数人已经揭示了大多数主要的可用性障碍,但无法准确测量。
第 3 步:当不受监管是正确的选择时
当您已经有了明确的假设并想要快速而大声地验证它们时,无节制的测试就会发挥作用。
用它来比较替代方案:两个版本的屏幕、两个结账流程。对于许多参与者来说,最有效的模式在统计上比五个人的模式更可靠。
当您需要速度和规模时使用它。由于不需要安排和跟踪每次会议,因此可以在短时间内收集数十人的回应,包括来自不同地点和背景的回应。对于基础广泛的产品来说,这捕获了限制于少数参与者的调节所无法实现的多样性。
接受的限制:你失去了实时的“为什么”。你看到人们在某个时刻陷入困境,但你无法立即询问原因。因此,写得不好的任务会毁掉未经审核的测试,没有人来澄清,指令中的任何歧义都会变成数据中的噪音。
步骤4:在实践中,将两者结合起来
成熟的剧本不会择一而抛弃另一个。按顺序组合。
一种行之有效的方法:从适度的测试开始,以发现问题并在不确定的时期了解原因。然后,在已经形成的假设下,使用未经调节的测试来大规模验证您在少数人身上观察到的情况是否在许多人身上得到了证实。
这是深入学习然后广度确认的循环。温和派提出正确的问题;未经调节的措施充满信心地做出反应。将它们视为互补而非竞争的选择,才能充分发挥每一种选择的优势。
破坏任何可用性测试的错误
无论采用何种方法,一些错误都会导致整个研究失败。
首先是招募错误的人员。与同事或不代表真实用户的人进行测试会产生对真实公众无效的结论。测试它的人需要看起来像使用它的人。
二是对参与者进行引导。适度地,很容易在不知不觉中“提供帮助”、指出方向、建议点击。这会影响结果:你想看看这个人是否可以单独完成这件事,但你最终却为他们做了这件事。规则是观察和询问,而不是教导。
第三,混淆观点与行为。一个人所说的他们会做的并不总是他们会做的。可用性测试基于观察到的行为,您点击的位置、停止的位置,而不是您声明的意见。 “我发现这很容易”,一个花了五分钟、犯了两次错误的人说的比你看到的要少。
方法就是手段;学习就是终点
最后,有节制和无节制都是服务于一件事的工具:根据真实的人们的行为方式做出产品决策,而不是团队想象他们的行为方式。
两者之间的选择是技术性的和实用性的,这取决于问题、时刻、预算和您需要的规模。不可协商的是进行某种测试。仅仅凭构建者的直觉设计的产品带有那些过于接近而看不到普通用户的困惑的人的偏见。
测试是一种谦虚的行为,它将那些认为自己知道用户想要什么的人与那些去检查的人区分开来。选择好方法只是确保这种验证是值得的。
如果您即将投资用户研究,但尚未确定要回答哪个问题,那么在选择方法之前解决这个问题是值得的。我的博客上还有其他关于用户体验、研究和产品设计的文章,这些文章深入探讨了该主题。
另请阅读
- [高保真原型:它是什么以及何时值得付出努力0
- 【以用户为中心的设计-小团队如何选择1
- [应用原型实践:如何在使用代码之前测试想法2
- [界面写作:适合刚开始的人的指标和 KPI3
- [高保真原型:审批和构建前的清单4
- 【高保真原型:快速指南,不浪费时间55