返回设计思维
THINKING · №03 · 可用性检查方法
启发式评估Heuristic Evaluation
用原则巡检界面没有用户测试时先找明显问题多个评估者独立检查
先看什么时候调用
启发式评估是让评估者依据一组可用性原则检查界面,并记录问题位置、违反的原则、严重度和建议的专家评审方法。
- 触发条件
- 原型或页面已经存在,需要快速发现明显的可用性问题,但暂时无法组织完整的真实用户测试。
- 改变什么
- 把“我觉得不顺”改写成可定位的问题、违反的启发式、受影响的任务和修复优先级。
- 适用边界
- 启发式评估不是用户测试;一个评估者或一个 agent 扫一遍,不能证明真实用户能完成任务,也不能替代无障碍和性能检查。
- 如何验证
- 让 3–5 个评估者独立检查关键任务,合并重复问题并标注严重度,再用真实任务或行为数据验证高优先级问题。
直接发给 agent
Perform a heuristic evaluation of this interface.
Use the specified heuristic set and inspect these realistic tasks: [list tasks]. For every finding, report:
- the exact screen and interaction state
- the violated heuristic and the observed evidence
- severity from 0 (not a problem) to 4 (usability catastrophe)
- the smallest repair that protects the task
- a concrete test that could confirm or reject the finding
Do not call this user testing. Separate usability risks from accessibility, content, performance, and security findings.
来源与证据
Nielsen 与 Molich 1990 年的研究把启发式评估作为专家检查方法,并观察到单个评估者只能发现部分问题,多个独立评估者合并结果更可靠。
深入理解
先把“感觉不对”变成可讨论的问题
启发式评估适合做第一轮体检:它让评审者按一组原则逐页检查,而不是只说“这个界面不够现代”。记录必须落到具体任务和具体状态,否则建议无法复现。
最小工作法
先列出两三个真实任务,例如“作者发布一篇文章”“访客从首页找到某个分类”。让评估者独立完成检查,再合并重复项。每一项至少写明位置、违反的原则、严重度、受影响的任务和下一步验证。
Agent 能做什么,不能做什么
Agent 可以帮助你把问题按原则归类、检查状态覆盖和生成修复候选。但它看不到真实用户的犹豫、误操作和环境限制。单次自动巡检的输出只能是风险清单,不能叫“可用性测试报告”。
严重度不是装饰
严重度应服务排序:阻断核心任务的错误优先于文案风格不一致;重复出现且影响多个页面的问题优先于孤立的微小偏差。修复后仍要回到任务,用行为证据验证。