可用性测试:产品可用性评估的实验法

可用性测试(Useability testing)是指,最终用户在有代表性的场景中尝试使用产品完成一个或一系列任务,用研员对此过程进行系统性观察。

在研究活动中,用户一边与产品(可以是纸原型、低保真或高保真原型、已发布产品)互动,一边使用出声思维法。给用户展示相同的产品、并要求完成相同的任务,以尽可能多地确定可用性问题。

如能进行多轮可用性测试,研究结果将更可靠、投资回报率更高。例如,使用15名用户进行一轮测试,不如使用5名用户进行3轮测试,后者能找到更多的可用性问题。如果测试过程中发生产品迭代(如基于反馈对原型或产品进行功能调整),则多轮测试更加必要。

如果有多个不同用户类型,则每种用户类型至少应选3~4名用户参与测试。

根据具体情况,可用性测试存在一些具体的可选方法。

1 实验室研究

进行实验室研究时,你将用户邀请到你的专用实验室进行测试。

如果公司没有正式的实验室,你可以利用会议室、笔记本电脑、录屏软件和视频相机等搭建临时实验室。具体内容请参见之前的相关内容。

实验室的好处是设备高端、网速很快、没有任何干扰,也能为每位用户提供一致的使用环境,让用户专注于评估你的产品。

但实验室不同于用户的真实环境,用户行为未必与真实世界中的行为一致。

2 眼动跟踪

在实验室研究中,眼动跟踪仪是经常使用的特殊设备。

多数眼动仪在实验室中用于台式屏幕,更好的眼动仪适用于移动设备,而今天很多便携的眼动仪可用于实地研究。

眼动仪的原理由摄像头、投影仪和算法三部分组成:投影仪向用户的眼睛部位投射近红外光,摄像头拍摄用户眼睛和观察模式的高清图像,而机器学习、图像处理等算法则用于确定用户的眼睛位置和注视点。

通过研究用户在哪里导找(或不寻找)信息或功能,以及用了多长时间寻找,记录用户注视点和扫视点(即在两个注视点之间快速眼球运动),可以创建热力图(Heat map)。用户的目光停留在某个点上的时间越长,表明该区域越“热”,用红色表示。当越少的用户观看一个区域、或观看的时间越短,表明该区域越“冷”,显示成蓝色(或绿色)。没人看的位置则标识为黑色(或不标识)。

眼动仪的体积已经可以做得很小,室外用途则经常做成眼镜式,甚至嵌入在普通眼镜上,并可适用于各种移动设备。

除了在实验室中用于屏幕眼动跟踪,眼动仪可以用于各种实地研究,例如在商店进行购物研究、在汽车里进行汽车研究等。

除了热力图,眼动跟踪还可以显示为聚焦图(Focus map)、注视路径图(Gaze path plot)等方式。

以上图片均来自国外眼动跟踪网站。

眼动追踪是一种主动评估方法,当用户与产品互动时,你不应要求使用出声思维法,因为用户与你讲话或回忆过去时会改变眼睛注视点,也就干扰了眼动跟踪数据。

如果你酷爱出声思维,可以使用回溯性出声思维法,也就是向用户显示眼动跟踪视频,请他说明当时的想法。据研究,回溯性出声思维法能够有效提升识别可用性问题的能力。但很显然,它将增加研究的时间成本。

3 快速迭代测试评估

不同于一般的可用性测试,快速迭代测试评估(RITE)是一种形成性评估方法。

RITE最早由微软公司提出,用于迅速解决游戏开发中遇到的可用性问题,并评估剩余的功能。

RITE的目的是,迅速确定让用户不能完成任务或产品不能达到既定目标的严重可用性问题。它旨在发现尽可能多、尽可能大的可用性问题,并衡量可用性问题的严重性。

RITE在产品开发周期的早期用原型进行。产品团队必须观察所有RITE研究,跟进发现可用性问题,并在解决方案上达成一致。然后更新原型,进行下一轮研究,观察问题是否已解决。如果团队不能在问题严重性和解决方案上达成一致,就先不忙修改原型,继续进行RITE研究。如此循环多轮,直到不再发现可用性问题。

与5名用户的多轮可用性测试相比,RITE通常招募更多的用户、进行更多轮研究。同时,RITE需要产品团队观察所有的研究、且每轮研究都要通过头脑风暴找出解决方法、还要多轮快速更新原型,所以RITE是一个“烧钱”的资源密集型方法。

因此,可以认为RITE是一个危险的方法,在产品早期就需要投入很多资源。不过,它可以增加团队信心,让大家认为正在创建没有可用性问题的产品。

4 咖啡馆研究

顾名思义,咖啡馆研究就是:当需要迅速决定采取哪些设计方向时,邀请用户在咖啡馆共进午餐,一边进行5~10分钟的调研。

咖啡馆研究属于形成性评估方法。仅需几个小时,就可以从10个以上用户得到反馈。

咖啡馆研究最早由Google提出和采用。虽然用户可以是Googler的朋友或家人,但在技能、人口统计信息和产品熟悉程度等方面需要多样化,以便在尽可能短的时间内收集足够多的数据,识别产品方向和可用性问题等。

所以,你也可以在茶馆、咖啡馆、餐馆甚至商场进行可用性研究。

5 现场评估与测试

不难想见,在用户环境中进行可用性评估,能够提高产品的环境真实性,了解用户在现实世界中如何使用你的产品。

可以在产品生命周期的早期或晚期进行现场评估。它属于实地研究,具体方法可参考上周的内容。

除了现场评估,你也可以进行现场测试。作为一种总结性评估方法,你可以设计两个或多个产品功能或性能,通过用户的现场操作比较哪一个设计的点击率更高、转化率更好等等。

这种方法也叫A/B测试。一部分用户看见版本A,另一部分用户看见版本B,通过日志分析,对功能或性能进行比较。A和B可以是对现有产品的改进,也可以是两个全新的设计。

在A/B测试中,对所有版本都必须进行并行测试,以控制无关变量的影响。

为了进行统计分析,A/B测试需要较大的样本量。好在,如今的A/B测试多数并非现场测试,而是在线远程进行。

6 合意性测试

产品仅仅可用是远远不够的,还必须让用户觉得好用、爱用。

微软提出的合意性测试,是通过观察用户的情绪反应,研究用户对产品是否满意的方法。

基于市场研究和之前的用户研究,微软用研人员确定了118个积极、消极和中性的形容词,例如:非传统的、有吸引力的、不一致的、专业的、激励的、吓人的等等。根据需要,你可以、用户也可以增加其他的形容词,将其添加到列表中,并注意保持积极、消极和中性词的多寡均衡。

与进行合意性测试前,你需要创建一组情绪卡片,每张卡片写上一个形容词。用户与产品交互后,将情绪卡片交给用户,请他任意选择的5~10张卡片来描述对产品的感觉,并让用户告诉你为什么选择这些卡片。

根据经验,进行合意性测试时,每个用户类型选择25名用户进行测试较为合适。之后,你可以使用亲和图等方法进行分析。

如果合意性测试与期待的用户情绪不匹配,你可以对产品进行修改,如增删产品功能、改变消息语气、优化视觉效果等,然后再进行测试。

小结

本节我们介绍了产品可用性评估的实验法,它们统称可用性测试,包括6、7种具体方法:

  1. 实验室研究;
  2. 眼动跟踪;
  3. 快速迭代测试评估;
  4. 咖啡馆研究;
  5. 现场评估与测试;
  6. 合意性测试。
X

类似文章

发表回复

您的邮箱地址不会被公开。 必填项已用 * 标注