Методологія когнітивного тестування Стандартизована процедура для конкурсного відбору та атестації

Технічна довідка: методологія, валідність, надійність, інтерпретація. Розроблено відповідно до ITC Guidelines. Доступно для завантаження як PDF.

Зв'язатися з нами
ITC Test Use ITC Computer-Based Testing Стандартизована процедура

Ми тестуємо когнітивні здібності кандидатів — логіку, аналітику, абстрактне та вербальне мислення. Тести побудовані за міжнародними психометричними стандартами, адаптовані для українського конкурсного відбору. Нижче — як саме і чому це працює. Документ можна завантажити як PDF.

Когнітивні домени

Що саме ми вимірюємо і навіщо.

Логічне мислення

Силогізми, дедукція, контрапозиція, аналіз аргументів. Чи може кандидат зробити правильний висновок з наданих даних.

Аналітичні здібності

Таблиці, графіки, відсотки, тренди, бюджетний аналіз. Чи вміє кандидат працювати з числами.

Абстрактне мислення

Послідовності, трансформації, латинські квадрати, аналогії. Закономірності без слів — чиста логіка.

Вербальне мислення

Розуміння тексту, оцінка аргументів, виявлення припущень, позиція автора. Чи розуміє кандидат те, що читає.

Типи завдань

Як виглядають завдання для кандидата.

01

Множинний вибір (single choice)

4 варіанти відповіді, один правильний. Кожне питання має унікальний ID та тег складності. Порядок варіантів рандомізується при кожному запуску.

02

Завдання з текстовим стимулом

Вербальний блок: кандидат читає текст (150-300 слів), потім відповідає на питання щодо розуміння, інференції та оцінки аргументів. Модель Watson-Glaser Critical Thinking Appraisal.

03

Числові та табличні завдання

Аналітичний блок: інтерпретація таблиць, графіків, відсоткових розподілів. Кандидат виконує обчислення та обирає правильний висновок.

04

Патерни та послідовності

Абстрактний блок: визначення закономірностей у числових рядах, матрицях, трансформаціях. Модель Raven's Progressive Matrices.

Система оцінювання

Прозора, об'єктивна, автоматизована.

Базове оцінювання

Кожне правильне питання = 1 бал. Відсоток правильних відповідей по кожному домену та загальний композитний бал.

Перцентильний ранг — позиція кандидата відносно інших учасників тієї ж сесії.

Зважене оцінювання

Для спеціалізованих батарей: кожне питання має коефіцієнт складності.

×1.22
легке
×1.55
середнє
×2.16
складне

PDF-звіт кандидата

Автоматично згенерований звіт для кожного кандидата: загальний результат, розбивка по доменах з візуалізацією, часовий аналіз, дані цілісності тестування, методологічна довідка.

Стандартизація процедури

Однакові умови для всіх кандидатів.

Єдиний таймер

Фіксований ліміт часу на кожен тест. Автоматична відправка при завершенні.

Рандомізація

Порядок питань та варіантів відповідей рандомізується. Вибірка з пулу.

Єдиний інтерфейс

Ідентичний UI, інструкції та навігація для кожного кандидата.

Цілісність тестування

Технічні засоби контролю чесності проходження.

Унікальні токени

Кожен кандидат отримує одноразове UUID-посилання. Токен прив'язаний до сесії, повторне використання неможливе.

Детекція фокусу

Фіксація кожного випадку переходу на іншу вкладку або додаток. Кількість відображається у звіті.

Серверне оцінювання

Правильні відповіді ніколи не передаються клієнту. Підрахунок балів виключно на сервері. Неможливо підробити результат.

Аудит-лог

IP-адреса, User-Agent, час початку та завершення, тривалість на кожне питання — повний запис для аналізу.

Захист даних

Що ми робимо з даними кандидатів.

HTTPS-шифрування всіх з'єднань

Конфігурації тестів захищені від прямого доступу (.htaccess)

Авторизований доступ до результатів тільки для адміністратора

Мінімізація персональних даних — тільки ім'я та результати

Можливість видалення даних за запитом організації

Хостинг на території ЄС

Міжнародні стандарти

Розробка та адміністрування відповідно до рекомендацій ITC.

ITC Guidelines on Test Use (2013)

Відповідальне використання тестів, інтерпретація результатів у контексті, врахування обмежень, професійна етика оцінювання.

ITC Guidelines on Computer-Based and Internet-Delivered Testing (2005)

Технологічні вимоги, еквівалентність цифрового та паперового форматів, стандартизація умов, безпека тестового контенту.

Psychometric References

Формати завдань базуються на Watson-Glaser Critical Thinking Appraisal (вербальне мислення), Raven's Standard Progressive Matrices (абстрактне мислення), стандартних числових батареях (аналітичні здібності).

В Україні не існує обов'язкової державної сертифікації психометричних тестів для конкурсного відбору. Наші тести розроблені відповідно до міжнародних рекомендацій. За потреби готові залучити незалежного психолога-рецензента.

Технічна довідка

Для психологів-рецензентів і юристів — деталі, яких немає вище.

Розробка завдань (item development)

Джерела, експертна перевірка, калібрування складності

Ми не вигадуємо формати з нуля. Вербальні завдання побудовані за моделлю Watson-Glaser, абстрактні — за Raven's Progressive Matrices, аналітичні — на стандартних числових батареях. Запозичуємо підхід, а питання пишемо свої, українською, під наш контекст.

Кожне питання проходить рецензію: методист пише, психолог перевіряє — чи дійсно воно вимірює те, що заявлено, і чи немає двозначності. Окремо дивимось, як питання виглядає очима кандидата (face validity).

Складність калібруємо на пілотних проходженнях: легкі (70–90% правильних), середні (40–70%), складні (15–40%). Якщо питання занадто просте (>90%) або занадто складне (<15%) — прибираємо, бо воно не розрізняє кандидатів. Додатково рахуємо point-biserial correlation: нижче 0.20 — питання йде на перегляд.

Зараз у банку 150 завдань у 6 пулах (логіка, аналітика, абстрактне, вербальне + два пули у форматі ВККС). Кожне питання має теги домену, підтеми і складності. Пул зростає після кожної реальної сесії.

Змістова валідність (content validity)

Експертний протокол, матриця покриття доменів

Простіше кажучи: чи справді наші питання покривають те, що ми заявляємо? Якщо в батареї на логіку половина питань — насправді про уважність, результат не можна читати як «рівень логічного мислення».

Рецензент-психолог перевіряє кожне питання на три речі: чи воно реально активує потрібну когнітивну функцію, чи виглядає адекватно з точки зору кандидата, і чи немає культурних упереджень у формулюванні.

Банк збалансований по підтемах — щоб, скажімо, у логічному блоці не було 80% силогізмів і 20% всього іншого:

Логічне: дедукція, індукція, силогізми, контрапозиція, необхідні/достатні умови, аналіз аргументів
Аналітичне: таблиці, графіки, відсотки, тренди, порівняння, обчислення
Абстрактне: числові послідовності, матричні аналогії, трансформації, латинські квадрати
Вербальне: розуміння тексту, інференція, оцінка аргументів, виявлення припущень

Після кожної сесії з 30+ кандидатами робимо post-hoc аналіз: дивимось на розподіл відповідей, час, дискримінативність. Якщо питання всі вгадують або ніхто не встигає — воно йде на перегляд.

Надійність (reliability)

Cronbach's α, SEM, внутрішня узгодженість

Cronbach's α — наскільки питання в одному домені узгоджені між собою. Якщо α низька, значить деякі питання вимірюють щось інше, і загальний бал ненадійний.

α ≥ 0.70 — прийнятна (мінімум для кадрових рішень)
α ≥ 0.80 — висока
α ≥ 0.90 — відмінна (для коротких батарей рідко досяжна)

Публікуємо α по кожному домену після 100+ проходжень. На малих вибірках не публікуємо — нестабільна оцінка гірша за відсутню.

SEM (стандартна помилка) = SD × √(1 − α). Показує, в якому діапазоні знаходиться реальний бал кандидата. Якщо два кандидати відрізняються на 1–2 SEM — вони статистично рівні, і ранжувати їх некоректно.

Test-retest поки не проводили — в конкурсній сесії повторне проходження неможливе. Плануємо окреме дослідження з добровольцями (інтервал ~3 місяці, цільовий r > 0.75).

Автоматично стежимо за inter-item correlation: якщо два питання корелюють надто сильно (r > 0.85), одне з них — кандидат на видалення як дублікат.

Повні дані надійності надаємо замовнику після кожної сесії з 30+ кандидатами.

Інтерпретація результатів

Що означають бали, обмеження, рекомендоване використання

Кандидат отримує відсоток правильних по кожному домену і композитний бал (середнє, у ВККС-батареях — з ваговими коефіцієнтами). Орієнтири:

80–100% — впевнено розв'язує складні завдання
60–80% — базові + частина складних
40–60% — переважно базові, є прогалини
< 40% — суттєво нижче типового

Перцентиль — порівняння з іншими учасниками тієї ж сесії, а не з популяцією взагалі. 75-й перцентиль = випередив 75% колег. Між сесіями порівнювати некоректно — склад різний.

Що важливо розуміти:

  • Когнітивний тест — один з інструментів, не вирок. Schmidt & Hunter (1998): валідність для прогнозу ефективності ≈ 0.51, разом з інтерв'ю ≈ 0.63.
  • Тест не вимірює мотивацію, доброчесність, лідерство чи професійні знання. Тільки когнітивні здібності.
  • Втома, стрес або тест-тривога можуть дати ±5–10 п.п. Близькі результати (в межах SEM) — статистично рівні.
  • Повна культурна нейтральність — мета, не факт. Вербальний блок чутливіший; абстрактний — найменше.

Для чого підходить: скринінг при масовому конкурсі, компонент у multi-method assessment (тест + інтерв'ю + робоча проба), періодична атестація.

Для чого ні: як єдина підстава hire/reject, для клінічної діагностики, для відбору на топ-позиції без assessment-center.

Джерела та посилання

ITC documents, академічні посилання, законодавство України

Міжнародні рекомендації (ITC)

  • International Test Commission. (2013). ITC Guidelines on Test Use (Version 1.2). intestcom.org
  • International Test Commission. (2005). ITC Guidelines on Computer-Based and Internet-Delivered Testing. intestcom.org
  • International Test Commission. (2014). ITC Guidelines on Quality Control in Scoring, Test Analysis, and Reporting of Test Scores.
  • International Test Commission. (2017). ITC Guidelines for Translating and Adapting Tests (2nd ed.).

Психометричні джерела

  • Schmidt, F. L., & Hunter, J. E. (1998). The validity and utility of selection methods in personnel psychology. Psychological Bulletin, 124(2), 262–274.
  • Watson, G., & Glaser, E. M. (2010). Watson-Glaser II Critical Thinking Appraisal — Technical Manual. Pearson.
  • Raven, J. (2000). The Raven's Progressive Matrices: Change and stability over culture and time. Cognitive Psychology, 41(1), 1–48.
  • Cronbach, L. J. (1951). Coefficient alpha and the internal structure of tests. Psychometrika, 16(3), 297–334.
  • American Educational Research Association et al. (2014). Standards for Educational and Psychological Testing.

Законодавство України

  • Закон України "Про державну службу" від 10.12.2015 № 889-VIII, ст. 22 (тестування при вступі на держслужбу).
  • Постанова Кабінету Міністрів України від 25.03.2016 № 246 "Про затвердження Порядку проведення конкурсу на зайняття посад державної служби".
  • Регламент роботи Вищої кваліфікаційної комісії суддів України (ВККС): розділ "Тестування когнітивних здібностей" — формат 40 питань (20 вербальних + 8 логічних + 12 абстрактних), 30 хв., максимум 60 балів, поріг 55%.

Повні бібліографічні посилання та копії ITC Guidelines надаються замовнику на запит. ITC Guidelines у відкритому доступі: intestcom.org/page/16.

Корисні матеріали

Статті з психології та нові тести — раз на тиждень