Почему нельзя сложить баллы разных тестов в один индекс

Редакция Просвета · 17.08.2026

В этой статье

Вы прошли несколько тестов о своём состоянии и получили несколько разных результатов. Дальше возникает понятное желание: свести всё в одно число — чтобы одним взглядом понять, насколько всё в порядке. Некоторые сервисы такое число и показывают. Разберёмся, почему посчитать его честно почти никогда не получается — и на что смотреть вместо него.

Если коротко

  • Шкалы меряют разное, устроены по-разному и спрашивают о разных периодах — сумме таких баллов не с чем соотнестись.
  • Большой международный набор шкал PROMIS показывает семь областей рядом и общего балла не даёт.
  • Складывать можно, если получившийся показатель проверили отдельно, как самостоятельный инструмент.
  • Полезнее сравнение осей: «настроение в норме, тревожность выражена» говорит больше, чем одна цифра.

Почему одна цифра так притягивает

Желание совершенно нормальное, и спорить с ним незачем. Одно число — привычный способ разобраться в чём угодно: температура, вес, заряд батареи. Оно экономит силы: не нужно держать в голове три показателя и соображать, как они соотносятся.

С результатами тестов так не выходит — и причина не в том, что «человек не сводится к цифрам». Причина техническая, и её можно объяснить за пять минут.

Что именно ломается при сложении

Тесты меряют разные вещи. PHQ-9 — про настроение и то, что с ним связано: сон, аппетит, силы. GAD-7 — про беспокойство. Шкала самооценки Розенберга — про устойчивое отношение к себе. Это три разных вопроса, а не три замера одного и того же. В психометрике — науке об измерении психологических свойств — так и написано: сложить показатели, которые меряют разное, технически можно, и получится вполне устойчивое число, вот только соответствовать оно не будет ничему. Составной показатель осмыслен ровно настолько, насколько его части принадлежат друг другу.

У тестов разные линейки. PHQ-9 даёт от 0 до 27, шкала Кесслера K-10 — от 0 до 40, шкала благополучия ВОЗ — от 0 до 100, причём у неё высокий балл означает «хорошо», а не «плохо». В DASS-21 баллы подшкал ещё и умножаются на два. Складывать такие числа — примерно как складывать километры с килограммами: арифметика сработает, смысл — нет.

У тестов разные окна наблюдения. PHQ-9 спрашивает про последние две недели, K-10 — про последние четыре, DASS-21 — про прошлую неделю, шкала ASRS — про полгода, а шкала самооценки вообще без срока, про «в целом». К какому периоду относится сумма таких баллов — вопрос без ответа.

И главное: у суммы нет нормы. У каждой отдельной шкалы пороги получены в исследованиях: столько-то баллов — такая-то выраженность, проверено на сотнях людей с контрольными интервью специалистов. У самодельной суммы такой проверки нет и взяться ей неоткуда. Число «62 из 118» не с чем сравнить: нет исследования, которое сказало бы, много это или мало.

Как это устроено у профессионалов

PROMIS — большой международный набор шкал для оценки здоровья, и его «профиль для взрослых» показателен: семь областей (настроение, тревожность, физическое функционирование, утомляемость, сон, социальная активность, влияние боли) — и общего балла нет. Не забыли посчитать: его нет принципиально. При этом баллы каждой области переводят в одну общую метрику — чтобы области можно было сравнивать между собой и увидеть, какая просела сильнее. Сравнивать — да, складывать — нет.

Тот же принцип у бланка PHQ-SADS (Кронке и соавторы, 2010): три опросника на одном листе, но три отдельные оси со своими порогами — зачем вообще проходить несколько тестов, мы разобрали отдельно.

Когда складывать всё-таки можно

«Никогда ничего не складывайте» было бы удобным правилом — и неправдой. Складывать можно, если получившийся показатель проверили отдельно, как самостоятельный инструмент.

Так сделали Kroenke и соавторы в 2016 году (Psychosomatic Medicine): PHQ-9 и GAD-7 объединили в один опросник из 16 пунктов с диапазоном 0–48 и назвали PHQ-ADS. На выборке 896 человек авторы отдельно доказали, что суммарный балл здесь имеет право на существование, — и заново установили для него пороги: 10, 20 и 30. Ключевое слово — «заново»: пороги не унаследовали от исходных шкал, а получили с нуля, для новой суммы. Вот это и есть разница между сложением и проверенным составным показателем.

Есть и второй случай — инструменты, где общий балл заложен в конструкцию. DASS-21 состоит из трёх подшкал, и его суммарный балл читается как общий уровень психологического напряжения; в русской версии (Золотарева, 2021) надёжность этого общего показателя — 0,94. А шкала Кесслера K-10 с самого начала создавалась как одно число: она меряет неспецифический дистресс — общее душевное напряжение, без разделения на тревогу и подавленность. Её русская версия валидирована в 2025 году на выборке 1667 человек.

Вывод из этих примеров не «складывать нельзя», а точнее: общий уровень напряжения — вполне законная величина, но меряют её собственной шкалой, а не арифметикой над чужими.

На что смотреть вместо одной цифры

Что заметнее всего сейчас. Полезный ответ даёт не сумма, а сравнение: настроение в норме, а тревожность выражена — это уже понятная картина, с которой можно что-то делать. Общий балл эту разницу как раз стирает.

Как это меняется. Один замер — точка, второй — направление. Повторить те же шкалы через пару недель информативнее, чем искать самое точное число сегодня.

Несколько повышенных осей — обычная картина. Это не «двойная беда»: почему тревога и подавленность часто идут вместе — в отдельной статье.

Как это сделано у нас

В Чекапе вы выбираете тему, проходите несколько подходящих шкал — и на сводной странице видите их рядом: у каждой свой уровень и полоса выраженности. Общего балла там нет и не будет — вместо него картина по осям. И общая рамка для всех этих шкал: каждая из них — скрининг и самонаблюдение, а не диагноз; выраженность признаков они показывают, а диагноз ставит только специалист в живом разговоре.

Каждая шкала в каталоге подписана: что она измеряет, откуда взяты пороги, кто адаптировал русскую версию. Читать результаты вместе — можно и нужно. Складывать — нет.

Собрать картину: Чекап — несколько коротких тестов по одной теме, без общего балла →

Источники

  1. Kroenke K., Wu J., Yu Z. et al. Patient Health Questionnaire Anxiety and Depression Scale (PHQ-ADS): Initial Validation in Three Clinical Trials. Psychosomatic Medicine, 2016, 78(6):716–727. DOI 10.1097/PSY.0000000000000322
  2. PROMIS Adult Profile Scoring Manual. HealthMeasures, Northwestern University. www.healthmeasures.net
  3. Kroenke K., Spitzer R.L., Williams J.B.W., Löwe B. The Patient Health Questionnaire Somatic, Anxiety, and Depressive Symptom Scales: a systematic review. General Hospital Psychiatry, 2010, 32(4):345–359. DOI 10.1016/j.genhosppsych.2010.03.006
  4. Золотарева А.А. Психометрическая оценка русскоязычной версии шкалы депрессии, тревоги и стресса (DASS-21). Психологический журнал, 2021, № 5. ras.jes.su/psy/s020595920017077-0-1
  5. Kessler R.C. et al. Short screening scales to monitor population prevalences and trends in non-specific psychological distress. Psychological Medicine, 2002, 32(6):959–976. DOI 10.1017/S0033291702006074
  6. Кислицын Д.В. и др. Психометрические свойства русскоязычной версии шкалы психологического дистресса Р. Кесслера. Психиатрия, 2025, 23(2). DOI 10.30629/2618-6667-2025-23-2-65-77
  7. Individual Psychometrics (онлайн-учебник по психометрике), гл. 13 «Composite Scores». individual-psychometrics.rbind.io/compositescores
Почему нельзя сложить баллы разных тестов в один индекс