昨天談使用者研究與可用性測試,靠的是找真實使用者、看他們實際卡在哪。今天談評估方法的另一支:不找使用者,改由專家對照一組原則走查介面。這種做法快、省、隨時能做——只要一位懂原則的人和一份介面,一個下午就能列出一疊問題。這組原則裡最經典的,就是 Jakob Nielsen 在 1994 年提出、至今仍是業界共識的十大可用性啟發式(10 Usability Heuristics),以及用它來檢查介面的啟發式評估法(heuristic evaluation)。
📖 學
為什麼叫「啟發式」
先講清楚這個容易被誤會的名字。「啟發式(heuristic)」不是精確的規格,而是經驗法則、大原則——它告訴你方向,不告訴你尺寸。Nielsen 自己特別強調,這十條是「broad rules of thumb」,不是「specific usability guidelines」(那種「按鈕圓角要 8px」的規範)。所以它們的用途是當檢查清單的軸線:拿著這十條去對照介面,問「這裡有沒有違反某一條」。原則本身抽象,威力在於覆蓋面廣、放諸各種介面皆準。
十大原則逐條講(附一句實例)
1. 系統狀態可見性(Visibility of system status) 系統要隨時讓使用者知道現在發生什麼事,並在合理時間內給回饋。例:上傳檔案時顯示進度條與百分比,而不是畫面凍住讓人不知道當掉了沒。
2. 系統與真實世界的匹配(Match between system and the real world)
用使用者熟悉的語言、概念、順序,而不是工程師的術語。例:購物車用「垃圾桶」圖示表示刪除,而不是丟一個 ERR_ITEM_0x04 給使用者看。
3. 使用者的控制與自由(User control and freedom) 使用者常會誤觸,要給他明確的「緊急出口」——復原、取消、返回。例:寄信後給 5 秒「收回」按鈕;刪除後出現「復原(Undo)」而不是直接消失。
4. 一致性與標準(Consistency and standards) 同一個東西在不同地方要長得一樣、叫一樣的名字,並遵循平台慣例。例:整個網站的主要按鈕都用同一種顏色與位置,別這頁叫「送出」、那頁叫「確認」、下一頁又叫「完成」。
5. 預防錯誤(Error prevention) 比起事後給好的錯誤訊息,更好的是一開始就讓錯誤不會發生。例:日期選擇器直接禁用不可選的日期;刪除重要資料前跳出確認對話框。
6. 辨識優於回想(Recognition rather than recall) 把選項、動作、資訊擺在看得見的地方,減少使用者要用腦記憶的負擔。例:搜尋框顯示最近搜尋紀錄,而不是要人憑空記得上次打了什麼關鍵字。
7. 彈性與使用效率(Flexibility and efficiency of use)
同時照顧新手與熟手——加速器(快捷鍵、常用捷徑)讓老手更快,又不干擾新手。例:提供鍵盤快捷鍵、可自訂的常用工具列,新手用選單、老手按 Cmd+K。
8. 美學與極簡設計(Aesthetic and minimalist design) 介面不該放不相關或很少用到的資訊——每多一分雜訊,就稀釋掉真正重要內容的能見度。例:結帳頁只留必要欄位,把促銷橫幅、次要連結收起來,別讓人分心。
9. 協助使用者辨識、診斷並從錯誤中復原(Help users recognize, diagnose, and recover from errors) 錯誤訊息要用白話說清楚出了什麼問題,並建設性地給出解法。例:「密碼需至少 8 碼並含一個數字」,而不是「輸入無效」。
10. 說明文件與幫助(Help and documentation) 最好是介面不需要說明就會用;但真的需要時,幫助文件要好找、聚焦在使用者的任務上、列出具體步驟。例:表單欄位旁的「?」提示、搜尋得到的說明中心,而不是一本沒人讀的 PDF 手冊。
啟發式評估法:專家怎麼走查一個介面
**啟發式評估(heuristic evaluation)**是一種「可用性檢視法(usability inspection method)」:找一小群評估者,拿這十條原則逐一檢查介面,判斷它有沒有違反,把違規點列成清單。關鍵的操作要點有幾個:
- 先獨立、後彙整:每位評估者各自獨立走查一遍,不互相討論,把發現的問題各自記下來;全部做完後再開會彙整(常用親和圖 affinity diagramming 把相似問題分群)。先獨立是為了避免互相帶風向,讓每個人的視角都完整保留。
- 為什麼需要多位評估者:Nielsen 的研究指出,單一評估者平均只能找出約 35% 的可用性問題——再厲害的專家也會漏。不同人看到的問題彼此重疊但不完全一樣,人數疊上去覆蓋率才夠。實務建議用 3 到 5 位評估者:低於 3 位漏太多,超過 5 位邊際效益遞減、成本卻線性上升。這是投報率的甜蜜點。
- 走查方式:通常把介面走兩遍——第一遍先熟悉整體流程與範圍,第二遍才逐一元件、逐一畫面對照十條原則細查。若是領域特定的系統(例如醫療、金融後台),先給評估者一份「典型使用情境」腳本,列出使用者會做的實際任務步驟,讓他們照著走。
嚴重度評分:讓問題可以排優先序
找出一堆問題後,不能每個都當同等重要來修。啟發式評估搭配一套 0 到 4 的嚴重度評分(severity rating),幫團隊排修復優先順序:
- 0=不算問題(I don’t agree this is a usability problem)
- 1=表面問題,不急,有空再修
- 2=次要問題,優先度低
- 3=主要問題,重要、應優先修
- 4=災難級問題,上線前必須修掉
嚴重度是三個因素的綜合:發生頻率(多常遇到)、影響程度(遇到時多難克服)、持續性(是一次性還是會反覆卡)。實務上常在評估者獨立找完問題、彙整成一份清單後,請每位評估者各自對這份完整清單評分,再取平均——這樣分數比單人當場評更可靠。
和昨天的使用者測試互補,不是取代
這是最該記住的一點:啟發式評估和可用性測試回答不同問題,互相補位。
- 專家評估擅長找「一般性違規」:對照通用原則抓出來的問題,像是缺少回饋、術語不友善、缺少復原出口、一致性破損——這些不需要真實使用者就能判斷。它快、便宜、任何開發階段(連線框稿都行)都能做,還能幫你圈出使用者測試時該重點觀察的地方。
- 使用者測試擅長找「真實情境障礙」:只有真實使用者帶著真實動機去操作,才會浮現的問題——他們對某個詞的獨特誤解、在你意想不到的地方放棄、心智模型和你設計的流程對不上。這些是專家坐在辦公室裡想不到的。
正確的用法是兩者串起來:先用啟發式評估快速掃掉一批明顯違規、把介面清乾淨,再拿去做使用者測試,把寶貴的真人時間花在挖那些只有真實情境才會現形的深層問題。
優缺點與一個必須破除的迷思
啟發式評估的優點很直接:快、成本低、不需要招募使用者、任何階段都能做、還能同時產出可行動的違規清單。缺點也很實在:
- 容易誤報(false positives):評估者可能把「違反原則」當成「一定是問題」,但有些違規在真實情境下根本不影響使用,甚至是刻意為之的取捨。
- 找不到領域特定的問題:通用原則抓不到「這個報稅流程對台灣使用者來說少了一個關鍵欄位」這種需要領域知識與真實情境的問題。
- 依賴評估者素質:結果好壞取決於評估者對原則和對可用性的理解,不同人差異可能不小。
最該破除的迷思是:「有了十大原則,就不用測使用者了。」 這是徹底的誤解。Nielsen Norman Group 自己講得很白:啟發式評估不能取代使用者研究——要做出好體驗,你終究得拿去給真實使用者測。十大原則幫你排除「明顯做錯的事」,但「使用者到底會不會用、願不願意用、在哪裡卡住」,只有真人能告訴你。把專家評估當成使用者測試的替代品,而不是前置的清掃步驟,是最常見也最傷的用法錯誤。
🧠 記
- 十大啟發式是經驗法則(rules of thumb),不是精確規範;它給方向、當檢查軸線,原則抽象但覆蓋面廣。
- 背十條的骨架:狀態可見、貼近真實世界、給退出自由、一致性、預防錯誤、辨識優於回想、彈性效率、極簡美學、好的錯誤訊息、說明文件。
- 啟發式評估要先各自獨立走查、再彙整;單一評估者平均只找出約 35% 問題,所以要 3–5 位取覆蓋率與成本的甜蜜點。
- 嚴重度評分 0–4(0 非問題 → 4 上線前必修),綜合頻率、影響、持續性,彙整後由多人各自評分取平均較可靠。
- 專家評估找一般性違規(快、任何階段可做),使用者測試找真實情境障礙(只有真人才浮現)——兩者互補、串起來用。
- 破迷思:十大原則不能取代使用者測試;它是前置的「清掃」,不是替代品,且有誤報與抓不到領域問題的先天限制。
✍️ 實踐
挑一個你手邊在用或在做的介面(App 的某一個流程、後台的某一頁都行),拿十大原則當清單,獨立走查兩遍:第一遍熟悉流程,第二遍逐一畫面對照,每發現一個違規就記下「違反第幾條 + 具體位置 + 為什麼是問題」。走完後給每個問題打 0–4 嚴重度,依分數排序——你會發現一份清清楚楚的待修清單自己浮出來了。
如果能找到同事,更值得做的是兩三個人各自獨立走查同一個介面,再湊在一起彙整。你會親眼看到「一個人漏一半」是真的:每個人抓到的問題重疊卻不相同,合起來才完整。最後提醒自己,這份清單是「該優先驗證的假設」,不是「已經確定的事實」——把它帶進下一輪使用者測試,讓真人幫你確認哪些是真問題、哪些只是你的誤報。
🔗 延伸學習
- 10 Usability Heuristics for User Interface Design — Nielsen Norman Group(十大原則官方原文,每條都有詳解)
- How to Conduct a Heuristic Evaluation — Nielsen Norman Group(啟發式評估操作步驟與嚴重度評分)
- Heuristic evaluation — Wikipedia(方法脈絡、優缺點與研究出處)
- Heuristic Evaluation — Interaction Design Foundation(補充教學與實務案例)
💬 問 AI
想快速幫自家介面做一輪啟發式走查,可以把畫面截圖或流程描述貼給 AI,請它扮演可用性專家、逐條對照十大原則檢查。試試這段 prompt:
你是資深可用性(usability)專家。我會貼上一段介面描述(或截圖說明),
請你用 Jakob Nielsen 十大可用性啟發式逐條走查,對每一條:
1. 判斷這個介面有沒有違反,若有,指出具體位置與為什麼是問題;
2. 給一個 0–4 的嚴重度評分(0 非問題、4 上線前必修),並說明理由;
3. 提出一個具體可行的修改建議。
最後,依嚴重度由高到低整理成一份待修清單,
並特別標出「哪些問題建議進一步用真實使用者測試驗證」(因為專家評估可能誤報、
也抓不到領域特定問題)。
我的介面是:
【在這裡貼上你的介面描述或流程】