ГлавнаяИнструментыПродуктовый дизайнКалькулятор SUS
Калькулятор SUS: оценка юзабилити по System Usability Scale
Вставьте ответы всех респондентов из таблицы или заполните одну анкету. Калькулятор посчитает балл SUS от 0 до 100 для каждого ответа, среднее с доверительным интервалом, переведёт результат в процентиль и буквенную оценку, добавит словесную оценку, разделит удобство и лёгкость освоения и покажет, какие из десяти утверждений тянут балл вниз.
—
Разбор по вопросам
| Вопрос | Утверждение | Среднее 1–5 | Вклад 0–4 |
|---|
Формула. Нечётные вопросы: ответ − 1; чётные: 5 − ответ; SUS = сумма × 2,5. Интервал: среднее ± tn−1 · s / √n. Оценки и процентили — по шкале Сауро и Льюиса, где 68 — 50-й процентиль.
Расчёт идёт в вашем браузере — введённые данные никуда не отправляются.
Как пользоваться
- Проведите стандартную анкетуПокажите все десять утверждений SUS в исходном порядке со шкалой согласия от 1 до 5 — сразу после того, как участник выполнил задачи в продукте.
- Вставьте ответыСкопируйте столбцы с ответами из сервиса опросов или таблицы, по респонденту в строке. Заголовки и столбец с ID распознаются автоматически, а ошибочные строки перечисляются, а не пропадают молча.
- Посмотрите балл, интервал и оценкуСредний балл SUS показан с доверительным интервалом, процентилем относительно сотен исследований, буквенной и словесной оценкой.
- Найдите слабые вопросыТаблица по вопросам показывает средний ответ и вклад каждого утверждения — видно, в чём проблема: сложность, непоследовательность, освоение или уверенность.
Что такое System Usability Scale и как считать балл
System Usability Scale (SUS) — анкета из десяти утверждений, которую Джон Брук создал в Digital Equipment Corporation в 1986 году и опубликовал в 1996-м как «быструю и грубую» шкалу юзабилити. Она стала самым распространённым стандартизированным опросником удобства: бесплатна, не зависит от технологии, заполняется за минуту и работает на небольших выборках.
Участник оценивает каждое утверждение от 1 (совершенно не согласен) до 5 (полностью согласен). Нечётные утверждения позитивные («Система показалась мне простой в использовании»), чётные — негативные («Система показалась мне излишне сложной»), поэтому они считаются в противоположных направлениях:
SUS — не процент. Балл 75 не означает «удобно на 75 %». Чтобы его интерпретировать, нужно сравнение с другими продуктами — для этого и нужны процентили и оценки.
Несколько респондентов
Балл считается для каждого респондента, затем баллы усредняются. Доверительный интервал строится по распределению Стьюдента, потому что выборки в SUS обычно маленькие:
Таллис и Стетсон (2004) показали, что SUS приходит к устойчивым выводам уже на 12–14 участниках — быстрее других сравнённых анкет. Даже на 5 участниках балл информативен, но интервал широк; калькулятор показывает его, чтобы не делать выводов из разницы в пару баллов.
О переводе. Анкета создавалась на английском. Формулировки в калькуляторе — аккуратный перевод, близкий к оригиналу; какой бы перевод вы ни выбрали, используйте один и тот же во всех замерах, иначе сравнение между раундами теряет смысл.
Как интерпретировать балл SUS: процентиль, оценка, словесная шкала
Джефф Сауро и Джеймс Льюис собрали данные SUS из сотен исследований. Средний балл — 68, это 50-й процентиль. Их шкала оценок с поправкой на распределение (curved grading scale), построенная по 241 промышленному исследованию, сопоставляет диапазоны баллов с буквенными оценками и процентилями:
Калькулятор показывает оценку для среднего балла и процентиль, линейно интерполированный внутри этих диапазонов. Балл 72,5 — это C+ и примерно 65-й процентиль: немного выше среднего, а не «хорошо на 72,5 %».
Словесная оценка. Бангор, Кортум и Миллер (2009) добавили к анкете седьмой, дополнительный вопрос — описать продукт одним словом — и посчитали средний SUS для каждого варианта: хуже некуда — 12,5, ужасно — 20,3, плохо — 35,7, терпимо — 50,9, хорошо — 71,4, отлично — 85,5, лучше не бывает — 90,9. Калькулятор выбирает вариант с ближайшим средним. Те же авторы предложили зоны приемлемости: ниже 50 — неприемлемо, 50–70 — пограничная зона, выше 70 — приемлемо.
Удобство и освоение
Льюис и Сауро (2009) обнаружили, что вопросы 4 и 10 — о помощи технического специалиста и о том, сколькому пришлось научиться, — образуют отдельный фактор освоения (learnability). Калькулятор переводит их в шкалу 0–100 (сумма двух вкладов × 12,5), а остальные восемь вопросов — в балл удобства (сумма × 3,125). Если удобство высокое, а освоение низкое, продукту обычно нужен онбординг получше, а не редизайн.
Как правильно проводить SUS
- Спрашивайте после задач, а не после демо. SUS измеряет воспринимаемое удобство опыта — участник должен сам поработать с продуктом.
- Сохраняйте формулировки и порядок. Изменённые утверждения, удалённые вопросы или другая шкала ломают сравнимость с базой. Заменять «систему» на «сайт», «приложение» или название продукта — принятая практика.
- Не убирайте негативные вопросы. Чередование тона — часть метода. Существует полностью позитивная версия (Сауро и Льюис, 2011) с близкими результатами, но не смешивайте версии в одном исследовании.
- Обрабатывайте пропуски явно. Распространённое правило — заменить один пропущенный ответ нейтральной тройкой, а респондентов с большим числом пропусков исключить. Калькулятор перечисляет пропущенные строки, чтобы решение было за вами.
- Сравнивайте, а не просто отчитывайтесь. SUS полезнее всего при сравнении версий, конкурентов или релизов. Если доверительные интервалы сильно пересекаются, разница не доказана — размер выборки поможет оценить калькулятор выборки.
- Смотрите на поведение. Низкое освоение и слабые вопросы 3, 7 и 10 часто указывают на проблему первого запуска. Метрики активации после улучшения онбординга покажут, сработало ли изменение.
SUS измеряет, насколько удобным люди считают продукт; NPS — готовы ли они его рекомендовать. Метрики связаны, но продукт может быть удобным и при этом не настолько ценным, чтобы его советовать.
Источники
- Brooke J. SUS: A "quick and dirty" usability scale. In: Jordan P. W. et al. (eds.) Usability Evaluation in Industry. Taylor & Francis, 1996.
- Sauro J., Lewis J. R. Quantifying the User Experience: Practical Statistics for User Research, 2nd ed. Morgan Kaufmann, 2016 — шкала оценок, средний уровень 68.
- Bangor A., Kortum P., Miller J. Determining What Individual SUS Scores Mean: Adding an Adjective Rating Scale. Journal of Usability Studies, 4(3), 2009.
- Bangor A., Kortum P. T., Miller J. T. An Empirical Evaluation of the System Usability Scale. International Journal of Human–Computer Interaction, 24(6), 2008 — зоны приемлемости.
- Lewis J. R., Sauro J. The Factor Structure of the System Usability Scale. HCD 2009, LNCS 5619 — подшкалы удобства и освоения.
- Tullis T. S., Stetson J. N. A Comparison of Questionnaires for Assessing Website Usability. UPA Conference, 2004 — размер выборки.
Частые вопросы
Как посчитать балл SUS?
Для нечётных вопросов (1, 3, 5, 7, 9) вычтите 1 из ответа, для чётных (2, 4, 6, 8, 10) вычтите ответ из 5. Сложите десять вкладов и умножьте на 2,5. Получится балл от 0 до 100 для одного респондента; для группы баллы усредняют.
Какой балл SUS считается хорошим?
Средний уровень в базе сравнения — 68, это 50-й процентиль. Баллы выше 80,8 получают A по шкале Сауро и Льюиса и входят в лучшие 10 %. Ниже 51,7 — F, худшие 15 %. Выше 70 обычно считается приемлемым.
Балл SUS — это процент?
Нет. SUS лежит от 0 до 100, но 68 — это средний результат, а не «удобно на 68 %». Для интерпретации переведите балл в процентиль или оценку: 68 — 50-й процентиль, 80,3 — примерно 89-й.
Сколько участников нужно для SUS?
SUS даёт полезный результат на небольших выборках: по данным Таллиса и Стетсона, выводы становятся устойчивыми примерно с 12–14 участников. На 5 участниках балл тоже можно посчитать, но интервал будет широким — не сравнивайте версии, различающиеся на несколько баллов.
Можно ли менять формулировки вопросов SUS?
Заменить «систему» на «сайт», «приложение» или название продукта можно — на результаты это заметно не влияет. Переписывать утверждения, убирать вопросы или менять пятибалльную шкалу нельзя: пропадёт сравнимость с опубликованными данными.
Что означают баллы удобства и освоения?
Вопросы 4 и 10 (нужна помощь специалиста, пришлось многому научиться) измеряют освоение, остальные восемь — удобство. Оба переводятся в шкалу 0–100. Низкое освоение при нормальном удобстве говорит о том, что людям трудно начать, — это задача онбординга.
Что делать с пропущенными ответами?
Распространённое правило — заменить один пропущенный ответ нейтральной тройкой, а респондентов с бо́льшим числом пропусков исключить. В калькуляторе отметьте соответствующую опцию; все исключённые строки будут перечислены.
Ещё в разделе «Продуктовый дизайн»
- Проверка контраста цветов
Проходит ли пара цветов текста и фона WCAG AA или AAA?
- Генератор доступной палитры
Как получить доступную палитру, где контраст проверен для каждого оттенка?
- Палитра интерфейса для сайта
Какие цвета интерфейса вывести из фирменного цвета, чтобы весь текст прошёл контраст?
- Генератор типографической шкалы
Какие размеры шрифта дают стройную адаптивную типографическую шкалу?
- Время чтения подсказок и тура
Успеет ли пользователь прочитать подсказку или шаг тура?
- Проверка текста подсказки
Достаточно ли подсказка короткая, понятная и ведёт ли к действию?