"앱이 이제 더 쉬워진 것 같아요." 사용성 개선은 이런 식의 주관적인 평가에 그치는 경우가 많습니다 — 실제로 나아졌더라도 측정할 수 없고, 지난 분기나 경쟁사와 비교할 수도 없습니다. 1986년 존 브룩이 만든 시스템 사용성 척도(SUS)는 열 개의 표준 질문을 하나의 점수로 정리해 이 문제를 해결합니다.
질문이 결코 바뀌지 않으므로 SUS 점수는 제품·버전·시간에 걸쳐, 그리고 방대한 발표 벤치마크와 비교할 수 있습니다. SUS의 가장 큰 장점은 이러한 비교 가능성에 있습니다.
Note
SUS는 웹사이트, 모바일 앱, 소프트웨어, 키오스크 등 다양한 디지털 서비스의 사용성을 평가하는 데 널리 활용됩니다.
열 가지 질문
응답자는 1–5 동의/비동의 척도로 열 개의 진술을 평가합니다. 긍정 문항과 부정 문항이 번갈아 제시됩니다: 홀수 번은 긍정("자주 쓸 것 같다"), 짝수 번은 부정("불필요하게 복잡했다").
Tip
점수는 어떻게 만들어지나
원시 1–5 답변은 단순 평균이 아니라 표준 계산 방식을 거쳐 0–100 점수로 환산됩니다.
- 1홀수(긍정) 항목은 응답에서 1을 뺌.
- 2짝수(부정) 항목은 5에서 응답을 뺌.
- 3조정된 열 점수를 모두 합함(각각 이제 0–4).
- 4합계에 2.5를 곱해 0–100점으로 환산.
Watch out
숫자 읽기
SUS 점수는 다른 제품이나 기존 연구와 비교할 때 의미가 있습니다. 뱅고르와 동료들의 널리 쓰이는 해석은 숫자를 등급과 수용성 판단에 매핑합니다.
| 점수 | 해석 |
|---|---|
| ≥ 80.3 | A등급 — 매우 우수 |
| ≈ 68 | 평균 수준 |
| ≥ 70 | 수용 가능 |
| 50 – 70 | 경계 |
| < 50 | 수용 불가 |
백분위 순위가 더욱 명확하게 합니다: 68점은 테스트된 모든 제품의 약 50백분위에 있으니, "68"은 문자 그대로 "평균"을 뜻합니다.
Tip
SKARI Survey Lab의 SUS
SKARI의 Survey Lab은 SUS를 올바르게 채점하고 해석해줍니다 — 역코딩 항목을 처리해 정확하게 계산한 후 벤치마크 척도에 놓습니다.
- 역코딩 항목이 자동 처리된 0–100 SUS 점수
- 표준 벤치마크 대비 등급과 백분위 순위
- 사용성·학습성 하위 척도
- 어떤 진술이 점수를 끌어내렸는지 보는 문항별 결과 분석
Takeaway
자주 묻는 질문
68은 좋은 점수인가요?
정확히 평균입니다. "수용 가능"은 70 위, A등급 경험은 80 위를 목표로 하세요.
몇 명이 필요한가요?
SUS는 적당한 표본에서 안정됩니다 — 수십 명이면 쓸 만한 점수를 주고, 표본이 많을수록 결과의 신뢰성이 높아집니다.
SUS와 맞춤 사용성 설문 중?
시간에 걸쳐 벤치마크 가능한 숫자를 원하면 SUS, 무엇을 고칠지 알아야 하면 사용성 인터뷰나 추가 설문을 함께 진행하세요.
핵심 요약
질문
10
고정, 표준
척도
0–100
퍼센트 아님
평균
68
중간점
A등급
≥ 80.3
매우 우수
SUS는 주관적인 사용성 평가를 하나의 벤치마크된 숫자로 바꿉니다. 올바르게 채점하고, 퍼센트가 아니라 등급과 백분위 순위로 읽으면 — 다른 성과 지표처럼 사용성을 추적할 수 있습니다.
Takeaway
CSAT와 NPS
만족과 충성도 지표
중요도-만족도(IPA)
어디에 UX 수정을 집중할지
카노 모델
어떤 기능이 만족을 이끄는지