사용성 테스트는 "사람들이 이걸 좋아하나요?"가 아니라 "사람들이 이걸로 실제 과제를 해낼 수 있나요?"를 묻습니다. 참가자에게 "이 앱에서 비행기표를 예약해 보세요" 같은 구체적인 과제를 주고, 화면을 보며 생각을 소리 내어 말하게 한 뒤(think-aloud), 어디서 멈칫하고 어디서 잘못 누르는지를 그대로 관찰합니다.
참가자 5명이면 사용성 문제의 대부분(약 85%)이 드러난다는 것이 널리 인용되는 경험칙입니다. 완벽한 통계적 확신을 주는 숫자는 아니지만, 큰 문제일수록 적은 인원에서도 반복해서 나타나기 때문에 소규모·반복 테스트가 대규모 1회 테스트보다 효율적입니다.
설문이나 인터뷰가 사람들이 "말하는 것"을 듣는 방법이라면, 사용성 테스트는 사람들이 실제로 "하는 것"을 보는 방법입니다. 말과 행동이 다른 경우가 흔해서, 특히 "이 버튼이 뭔지 알겠어요?"라고 물어보는 대신 실제로 눌러보게 하는 게 중요합니다.
언제 쓰나
프로토타입이 클릭 가능한 상태가 된 뒤, 구조·라벨·흐름에 대한 가정을 실제 행동으로 검증하고 싶을 때. 늦어도 개발 착수 전에 한 번은 돌리는 게 안전합니다.