Технічна довідка: методологія, валідність, надійність, інтерпретація. Розроблено відповідно до ITC Guidelines. Доступно для завантаження як PDF.
Ми тестуємо когнітивні здібності кандидатів — логіку, аналітику, абстрактне та вербальне мислення. Тести побудовані за міжнародними психометричними стандартами, адаптовані для українського конкурсного відбору. Нижче — як саме і чому це працює. Документ можна завантажити як PDF.
Що саме ми вимірюємо і навіщо.
Силогізми, дедукція, контрапозиція, аналіз аргументів. Чи може кандидат зробити правильний висновок з наданих даних.
Таблиці, графіки, відсотки, тренди, бюджетний аналіз. Чи вміє кандидат працювати з числами.
Послідовності, трансформації, латинські квадрати, аналогії. Закономірності без слів — чиста логіка.
Розуміння тексту, оцінка аргументів, виявлення припущень, позиція автора. Чи розуміє кандидат те, що читає.
Як виглядають завдання для кандидата.
4 варіанти відповіді, один правильний. Кожне питання має унікальний ID та тег складності. Порядок варіантів рандомізується при кожному запуску.
Вербальний блок: кандидат читає текст (150-300 слів), потім відповідає на питання щодо розуміння, інференції та оцінки аргументів. Модель Watson-Glaser Critical Thinking Appraisal.
Аналітичний блок: інтерпретація таблиць, графіків, відсоткових розподілів. Кандидат виконує обчислення та обирає правильний висновок.
Абстрактний блок: визначення закономірностей у числових рядах, матрицях, трансформаціях. Модель Raven's Progressive Matrices.
Прозора, об'єктивна, автоматизована.
Кожне правильне питання = 1 бал. Відсоток правильних відповідей по кожному домену та загальний композитний бал.
Перцентильний ранг — позиція кандидата відносно інших учасників тієї ж сесії.
Для спеціалізованих батарей: кожне питання має коефіцієнт складності.
Автоматично згенерований звіт для кожного кандидата: загальний результат, розбивка по доменах з візуалізацією, часовий аналіз, дані цілісності тестування, методологічна довідка.
Однакові умови для всіх кандидатів.
Фіксований ліміт часу на кожен тест. Автоматична відправка при завершенні.
Порядок питань та варіантів відповідей рандомізується. Вибірка з пулу.
Ідентичний UI, інструкції та навігація для кожного кандидата.
Технічні засоби контролю чесності проходження.
Кожен кандидат отримує одноразове UUID-посилання. Токен прив'язаний до сесії, повторне використання неможливе.
Фіксація кожного випадку переходу на іншу вкладку або додаток. Кількість відображається у звіті.
Правильні відповіді ніколи не передаються клієнту. Підрахунок балів виключно на сервері. Неможливо підробити результат.
IP-адреса, User-Agent, час початку та завершення, тривалість на кожне питання — повний запис для аналізу.
Що ми робимо з даними кандидатів.
HTTPS-шифрування всіх з'єднань
Конфігурації тестів захищені від прямого доступу (.htaccess)
Авторизований доступ до результатів тільки для адміністратора
Мінімізація персональних даних — тільки ім'я та результати
Можливість видалення даних за запитом організації
Хостинг на території ЄС
Розробка та адміністрування відповідно до рекомендацій ITC.
Відповідальне використання тестів, інтерпретація результатів у контексті, врахування обмежень, професійна етика оцінювання.
Технологічні вимоги, еквівалентність цифрового та паперового форматів, стандартизація умов, безпека тестового контенту.
Формати завдань базуються на Watson-Glaser Critical Thinking Appraisal (вербальне мислення), Raven's Standard Progressive Matrices (абстрактне мислення), стандартних числових батареях (аналітичні здібності).
В Україні не існує обов'язкової державної сертифікації психометричних тестів для конкурсного відбору. Наші тести розроблені відповідно до міжнародних рекомендацій. За потреби готові залучити незалежного психолога-рецензента.
Для психологів-рецензентів і юристів — деталі, яких немає вище.
Джерела, експертна перевірка, калібрування складності
Ми не вигадуємо формати з нуля. Вербальні завдання побудовані за моделлю Watson-Glaser, абстрактні — за Raven's Progressive Matrices, аналітичні — на стандартних числових батареях. Запозичуємо підхід, а питання пишемо свої, українською, під наш контекст.
Кожне питання проходить рецензію: методист пише, психолог перевіряє — чи дійсно воно вимірює те, що заявлено, і чи немає двозначності. Окремо дивимось, як питання виглядає очима кандидата (face validity).
Складність калібруємо на пілотних проходженнях: легкі (70–90% правильних), середні (40–70%), складні (15–40%). Якщо питання занадто просте (>90%) або занадто складне (<15%) — прибираємо, бо воно не розрізняє кандидатів. Додатково рахуємо point-biserial correlation: нижче 0.20 — питання йде на перегляд.
Зараз у банку 150 завдань у 6 пулах (логіка, аналітика, абстрактне, вербальне + два пули у форматі ВККС). Кожне питання має теги домену, підтеми і складності. Пул зростає після кожної реальної сесії.
Експертний протокол, матриця покриття доменів
Простіше кажучи: чи справді наші питання покривають те, що ми заявляємо? Якщо в батареї на логіку половина питань — насправді про уважність, результат не можна читати як «рівень логічного мислення».
Рецензент-психолог перевіряє кожне питання на три речі: чи воно реально активує потрібну когнітивну функцію, чи виглядає адекватно з точки зору кандидата, і чи немає культурних упереджень у формулюванні.
Банк збалансований по підтемах — щоб, скажімо, у логічному блоці не було 80% силогізмів і 20% всього іншого:
Після кожної сесії з 30+ кандидатами робимо post-hoc аналіз: дивимось на розподіл відповідей, час, дискримінативність. Якщо питання всі вгадують або ніхто не встигає — воно йде на перегляд.
Cronbach's α, SEM, внутрішня узгодженість
Cronbach's α — наскільки питання в одному домені узгоджені між собою. Якщо α низька, значить деякі питання вимірюють щось інше, і загальний бал ненадійний.
Публікуємо α по кожному домену після 100+ проходжень. На малих вибірках не публікуємо — нестабільна оцінка гірша за відсутню.
SEM (стандартна помилка) = SD × √(1 − α). Показує, в якому діапазоні знаходиться реальний бал кандидата. Якщо два кандидати відрізняються на 1–2 SEM — вони статистично рівні, і ранжувати їх некоректно.
Test-retest поки не проводили — в конкурсній сесії повторне проходження неможливе. Плануємо окреме дослідження з добровольцями (інтервал ~3 місяці, цільовий r > 0.75).
Автоматично стежимо за inter-item correlation: якщо два питання корелюють надто сильно (r > 0.85), одне з них — кандидат на видалення як дублікат.
Повні дані надійності надаємо замовнику після кожної сесії з 30+ кандидатами.
Що означають бали, обмеження, рекомендоване використання
Кандидат отримує відсоток правильних по кожному домену і композитний бал (середнє, у ВККС-батареях — з ваговими коефіцієнтами). Орієнтири:
Перцентиль — порівняння з іншими учасниками тієї ж сесії, а не з популяцією взагалі. 75-й перцентиль = випередив 75% колег. Між сесіями порівнювати некоректно — склад різний.
Що важливо розуміти:
Для чого підходить: скринінг при масовому конкурсі, компонент у multi-method assessment (тест + інтерв'ю + робоча проба), періодична атестація.
Для чого ні: як єдина підстава hire/reject, для клінічної діагностики, для відбору на топ-позиції без assessment-center.
ITC documents, академічні посилання, законодавство України
Повні бібліографічні посилання та копії ITC Guidelines надаються замовнику на запит. ITC Guidelines у відкритому доступі: intestcom.org/page/16.
Готові обговорити ваш проєкт?
Налаштуємо батарею тестів під ваші потреби — конкурс, атестація, оцінка команди.
Зв'язатися з намиcontact@piznay.online
Статті з психології та нові тести — раз на тиждень