Методологія
Як рахуються індекси, наскільки їм можна довіряти і що це за вибірка. Принцип проєкту: кожне число має бути видно, звідки воно. Повна версія — у документації набору даних.
1. Як рахується індекс
Замість наукометрії (кількість публікацій, цитувань) індекси формуються зі структурованих оцінок самих науковців і зводяться в дифузійний індекс — за аналогією з Індексом менеджерів із закупівель (PMI) та Індексом споживчих настроїв.
Індекс = [P₁·1 + P₂·0,5 + P₃·0 + P₄·(−0,5) + P₅·(−1)] · 100 + 100 P₁…P₅ — частки відповідей від найпозитивнішої до найнегативнішої. Діапазон 0–200, 100 = нейтральний рівень: позитивних і негативних оцінок порівну.
SE = 100 · sd / √n; 95 % ДІ = значення ± 1,96 · SE sd — стандартне відхилення зважених відповідей (ваги від +1 до −1), n — кількість відповідей на питання (від 188 до 199). Зведений Індекс наукових можливостей (ІНМ) — геометричне середнє трьох індексів забезпеченості (фінансування, обладнання, час); його ДІ рахувався бутстрепом (10 000 повторів по респондентах).
Однакове значення індексу може означати різне: 100 — це і «майже всі обрали нейтральну відповідь», і «думки розділилися навпіл». Тому на сайті поруч з індексом завжди показано розподіл п'яти відповідей.
2. Три типи показників
24 індекси вимірюють три різні речі, і на сайті вони подаються окремо:
| Тип | Що це | Індексів | Які |
|---|---|---|---|
| Стан зараз | оцінка поточного стану на момент опитування | 6 | ІНМ ф, ІНМ о, ІНМ ч, ІНМ, ІЯНР в, ІЯНР ч |
| Оцінка змін | як змінилося, на думку респондентів; це не виміряна динаміка, а їхня оцінка на момент опитування | 16 | ІНЧ 1, ІНЧ 5, ІКННЧ 1, ІКННЧ 5, ІБВЧ 1, ІБВЧ 5, ІНМ ф1, ІНМ ф5, ІНМ о1, ІНМ о5, ІНМ ч1, ІНМ ч5, ІЯНР в1, ІЯНР в5, ІЯНР ч1, ІЯНР ч5 |
| Очікування | чого респонденти очікують у майбутньому | 2 | ІОРН 1, ІОРН 5 |
Оцінка змін — не виміряна динаміка. Респонденти відповідали, як, на їхню думку, змінилися частка часу, забезпеченість чи якість за рік і за п'ять років. Це їхня оцінка на момент опитування; для п'яти років — ще й з пам'яті. Зріз одномоментний, тож справжню динаміку покаже лише порівняння хвиль. З тієї ж причини ретроспективні індекси не входять до перевірки конструктної валідності (розд. 7).
У наборі даних ці індекси належать до вимірів «Динаміка структури часу», «Динаміка забезпеченості» і частково «Якість результатів»; на сайті вони названі «оцінкою змін», щоб не створювати враження часового ряду.
3. Вибірка і невизначеність
N = 200 (25.02.2026 – 13.04.2026, 46 днів; більшість відповідей — у березні). Генеральна сукупність — 136 131 наукових, науково-педагогічних і педагогічних працівників ЗВО і наукових установ (Держстат, 2024); вибірка — 0,15 %. Анкета в Google Forms, три канали поширення одночасно: запрошення на адреси з офіційних сайтів установ, звернення до керівників установ, соціальні мережі й наукові спільноти. Відбір невипадковий (зручний / самовідбір); участь добровільна й анонімна.
Класична «похибка вибірки» тут не застосовна. Невизначеність подано 95 % довірчими інтервалами: вони описують статистичну точність оцінок. Відмінність вибірки від генеральної сукупності оцінено критерієм χ² (розд. 5).
Довірчі інтервали в розрізах за групами
У теплокартах на сторінках блоків ДІ є для кожної клітинки (перемикач «Показати 95 % ДІ»):
- частки (% обраних, згодних, незабезпечених) — інтервал Вілсона. На відміну від звичайного «частка ± 1,96·√(p(1−p)/n)», він не виходить за межі 0–100 % і коректний при малих n та частках біля краю; тому поблизу 0 чи 100 % він несиметричний (напр., 93,4 % → 89,1–96,1). Так само рахуються ДІ чотирьох відсоткових показників на головній;
- індекси за групами — та сама закрита форма, що й для загальних індексів;
- середні частки часу — середнє ± 1,96·sd/√n.
База клітинки — кількість відповідей на питання в групі. Групи бувають від n = 5, тож інтервали широкі: медіанна ширина ДІ для часток — близько 43 пунктів у групах з n < 20 і 23 — у більших. Групи з n < 20 на теплокартах заштриховані. При малих n нормальне наближення для індексів грубе; якщо ж у групі всі відповіді однакові, формула дає нульову ширину — такий ДІ не показуємо («—»).
ДІ груп рахувалися з первинних даних і до версії 1.0 набору на Zenodo не входять, тож із набору їх не відтворити (точкові значення — відтворюються).
4. Профіль вибірки
Хто ці 200 респондентів. Питання про характеристики в анкеті були необов'язковими.
| Характеристика | Склад вибірки |
|---|---|
| Посада | науково-педагогічні працівники — 47,0 %; керівники / заступники керівників підрозділів — 21,5 %; наукові працівники (без викладання) — 19,0 %; аспіранти — 4,5 % |
| Науковий ступінь | мають ступінь — 87,5 % (кандидати наук / PhD — 63,5 %; доктори наук — 24,0 %); без ступеня — 12,5 % |
| Вчене звання | найчисельніші — доценти (37,0 %) та особи без звання (34,0 %) |
| Науковий стаж | переважно понад 10 років; групи 11–20 і 21–30 років разом — 56,5 % |
| Галузь знань | найпредставленіші — суспільні (27,6 %) та природничо-математичні (24,1 %) науки (самооцінка) |
| Науковий напрям | прикладні дослідження — 58,9 %; фундаментальні — 51,3 %; науково-технічні розробки — 15,2 % (множинний вибір) |
| Тип установи | ЗВО — 70,4 %; наукові установи — 28,6 %; інше — 1 % |
| Географія | 21 область України; найбільше — Київська (32,1 %) та Одеська (18,4 %) |
Тип установи, ступінь, звання й галузь докладніше зіставлено з генеральною сукупністю нижче; частки там рахуються від тих, хто відповів на відповідне питання, тож можуть дещо відрізнятися.
5. Репрезентативність (χ² проти Держстату)
Вибірку звірено з генеральною сукупністю за чотирма критеріями. За всіма — статистично значуща відмінність (p < 0,05), що очікувано для нестратифікованого пілоту. Зміщення системне: вибірка перекошена в бік більш кваліфікованих і залученіших у науку респондентів. Таке зміщення типове для подібних опитувань. Водночас саме оцінки кваліфікованих і досвідчених науковців найважливіші для розуміння стану системи. Область — лише описово: для χ² замало спостережень у регіонах.
Тип установи
χ² = 19,88, df = 1, p = < 0,001 (N = 197)
| Категорія | ген. % | вибірка % | зміщення, в.п. |
|---|---|---|---|
| ЗВО | 83,0 | 71,1 | −11,9 |
| Наукова установа | 17,0 | 28,9 | +11,9 |
Науковий ступінь
χ² = 27,93, df = 2, p = < 0,001 (N = 200)
| Категорія | ген. % | вибірка % | зміщення, в.п. |
|---|---|---|---|
| Кандидат наук / PhD | 53,4 | 63,5 | +10,1 |
| Доктор наук | 17,4 | 24,0 | +6,6 |
| Без наукового ступеня | 29,2 | 12,5 | −16,7 |
Вчене звання (ЗВО)
χ² = 12,32, df = 2, p = 0,002 (N = 140)
| Категорія | ген. % | вибірка % | зміщення, в.п. |
|---|---|---|---|
| Доцент | 39,3 | 49,3 | +10,0 |
| Без вченого звання | 45,1 | 30,0 | −15,1 |
| Професор | 14,4 | 18,6 | +4,2 |
| Старший дослідник | 1,2 | 2,1 | +0,9 |
Галузь наук (НУ)
χ² = 20,46, df = 3, p = < 0,001 (N = 56)
| Категорія | ген. % | вибірка % | зміщення, в.п. |
|---|---|---|---|
| Природничо-математична | 44,0 | 41,1 | −2,9 |
| Інженерно-технологічна | 17,6 | 5,4 | −12,2 |
| Суспільна | 10,2 | 26,8 | +16,6 |
| Аграрно-ветеринарна | 11,2 | 14,3 | +3,1 |
| Біомедична | 8,6 | 5,4 | −3,2 |
| Гуманітарно-мистецька | 8,5 | 7,1 | −1,4 |
6. Підготовка даних
- Очищення вибірки. Первинна база — 202 анкети; дві виключено (одна — з-за меж цільової географії, одна — від респондента поза цільовою групою). Фінальна вибірка — 200.
- Пропущені відповіді. Питання необов'язкові, тож кожен показник рахується на тих, хто відповів на відповідне питання; n наведено поруч із кожним значенням.
- Частки часу респонденти обирали інтервалом (0–10 %, 11–20 % … 91–100 %); у розрахунках — середини інтервалів (5, 15 … 95 %).
- Категоризація. Два пункти тестової версії анкети, яких респонденти не бачили, виключено (56 → 54 види). Частки ДНД / КННД / БД — від суми цих трьох відповідей; «важко визначити» і «не стикався» до бази не входять.
- Галузі. Нестандартні відповіді (зокрема міждисциплінарні) об'єднано в «Інше (міждисциплінарна)».
7. Надійність і валідність
Зведена оцінка
| Вимір | Метод | Результат | Оцінка |
|---|---|---|---|
| Репрезентативність вибірки | Тести χ² (4 критерії) | усі значущі; зміщення системне (до більш кваліфікованих) | Обмеження |
| Відмінності ЗВО і НУ (відомі групи) | Критерій Манна-Уітні | ДНД p < 0,001; БД p = 0,003; КННД p = 0,161 (н/з) | Підтверджено |
| Узгодженість оцінок часу | Контроль суми часток | середня 96,1 %; медіана 95,0 % | Прийнятно |
| Міжекспертна надійність категоризації | Fleiss κ; P̄ | κ = 0,275 (помірна); P̄ = 0,531 | Помірна |
| Внутрішня узгодженість шкал | Cronbach α; MIC | 7/7 шкал α ≥ 0,70; 4 шкали ≥ 0,80; усі MIC ≥ 0,50 | Добре |
| Конструктна валідність | ρ Спірмена (5 пар) + поправка BH | 5/5 в очікуваному напрямі; 4 значущі за BH (3 за BY) | Підтверджено |
| Якість і узгодженість відповідей | Реверсивний контроль | лише 1,4 % обтяжених БД суперечать моделі | Підтверджено |
За сукупністю вимірів інструмент має прийнятні або добрі психометричні властивості. Головне обмеження — не психометрика, а зміщеність вибірки: результати пілотні й потребують підтвердження на стратифікованій вибірці.
Внутрішня узгодженість шкал (Cronbach α і MIC)
Cronbach α — наскільки узгоджено пункти шкали вимірюють спільний конструкт. MIC — середня кореляція між усіма парами пунктів; на відміну від α, вона не залежить від кількості пунктів, тож саме її коректно порівнювати між шкалами різної довжини.
| Шкала | Пунктів | N | α | MIC |
|---|---|---|---|---|
| 1. Поточна забезпеченість | 3 | 194 | 0,755 | 0,510 |
| 2. Динаміка забезпеченості (рік) | 3 | 191 | 0,748 | 0,501 |
| 3. Динаміка забезпеченості (5 років) | 3 | 185 | 0,786 | 0,553 |
| 4. Якість власних (тепер + рік + 5 років) | 3 | 197 | 0,804 | 0,579 |
| 5. Якість інших (тепер + рік + 5 років) | 3 | 196 | 0,878 | 0,712 |
| 6. Достатність часу (4 питання) | 4 | 192 | 0,881 | 0,649 |
| 7. Очікування ІОРН (рік + 5 років) | 2 | 199 | 0,905 | 0,838 |
N — респонденти з повними відповідями на всі пункти шкали. За критерієм Нанналі α ≥ 0,70 — прийнятно, ≥ 0,80 — добре, ≥ 0,90 — відмінно: усі сім шкал прийнятні або кращі, чотири — добрі; усі MIC ≥ 0,50.
- Найвищий α у шкали очікувань не означає, що вона «найнадійніша»: α механічно зростає з кількістю пунктів. За MIC найтісніше пов'язані пункти про очікування (0,838) і про якість досліджень інших (0,712), найслабше — про забезпеченість ресурсами (0,510). Дуже висока MIC може свідчити й про надлишковість окремих пунктів.
- Шкали якості поєднують поточний рівень з оцінками змін за рік і за 5 років — концептуально різні виміри. Вони корелюють достатньо тісно, щоб їх об'єднувати, але строго одновимірними не є: α перевіряє узгодженість, а не одновимірність.
Узгодженість оцінювачів (Fleiss κ)
Наскільки однаково науковці відносять види діяльності до наукової / корисної ненаукової / безглуздої: κ = 0,275 (середня узгодженість P̄ = 0,531) — «помірна» за шкалою Лендіса–Коха. Помірний консенсус очікуваний: межі між категоріями частково суб'єктивні, і сам ступінь розбіжності — змістовний результат. Узгодженість по кожному виду (Pᵢ) — на сторінці категоризації.
Конструктна валідність (Spearman ρ)
Чи корелюють теоретично пов'язані конструкти в передбаченому моделлю напрямі: більше дійсної наукової діяльності й ресурсів → вища якість і оптимістичніші очікування; більше безглуздої діяльності → нижчі. Використано лише поточні й проспективні показники, виміряні одночасно.
| Пара конструктів | N | ρ | p | p (BH) | p (BY) | Напрям |
|---|---|---|---|---|---|---|
| Частка ДНД ↔ якість власних | 198 | +0,351 | < 0,001 | < 0,001 | < 0,001 | позитивна, збігся |
| ІНМ (бали) ↔ очікування (рік) | 194 | +0,315 | < 0,001 | < 0,001 | < 0,001 | позитивна, збігся |
| Частка БД ↔ очікування (рік) | 197 | −0,196 | 0,006 | 0,009 | 0,022 | негативна, збігся |
| Частка БД ↔ якість власних | 197 | −0,147 | 0,040 | 0,050 | 0,113 | негативна, збігся |
| ІНМ (бали) ↔ якість власних | 194 | +0,127 | 0,078 | 0,078 | 0,179 | позитивна, збігся |
ІНМ (бали) — індивідуальна сума трьох оцінок забезпеченості (3–15), а не зведений індекс. p (BH) і p (BY) — поправки Бенджаміні-Гохберга і суворіша Бенджаміні-Єкутіелі на п'ять порівнянь. Усі п'ять зв'язків спрямовані так, як передбачає модель; за BH значущі чотири, за BY — три. За Коеном дві кореляції помірні, решта слабкі — для різних конструктів це очікувано: надто високі кореляції означали б, що конструкти не розрізняються. Найсильніший зв'язок — частка дійсної наукової діяльності та якість власних досліджень (ρ = +0,351).
Відомі групи: ЗВО і наукові установи (критерій Манна-Уітні)
Структура робочого часу має відрізнятися між закладами вищої освіти і науковими установами, де наукова робота основна. Критерій непараметричний, бо відповіді інтервальні, розподіли асиметричні, а групи різного розміру.
| Категорія | ЗВО: середня / медіана (N) | НУ: середня / медіана (N) | Різниця, в.п. | U | p |
|---|---|---|---|---|---|
| Дійсна наукова (ДНД) | 26,6 / 15,0 (139) | 42,5 / 45,0 (57) | +15,9 | 2 289 | < 0,001 |
| Корисна ненаукова (КННД) | 37,4 / 35,0 (139) | 32,7 / 25,0 (56) | −4,7 | 4 387 | 0,161 (н/з) |
| Безглузда (БД) | 31,8 / 25,0 (139) | 22,0 / 15,0 (56) | −9,8 | 4 918,5 | 0,003 |
У наукових установах частка дійсної наукової діяльності значно вища, а безглуздої — нижча: інструмент розрізняє групи, які мають відрізнятися. Розподіли за типом установи — на сторінці структури часу.
Узгодженість відповідей
Контроль суми часток. Частки ДНД, КННД і БД разом мають давати близько 100 %. Сума середин обраних інтервалів у середньому — 96,1 % (медіана 95,0 %; N = 198): оцінки часу узгоджені з поправкою на інтервальний формат.
Сума трьох часток (середини інтервалів, %) — кількість респондентів; виділено 85–115 %.
Реверсивний контроль. Серед 71 респондентів, у яких безглузда діяльність забирає понад 30 % робочого часу, лише 1 (1,4 %) вважає, що її усунення не покращить якість роботи (55 — «значно покращиться», 15 — «дещо покращиться», 1 — «не зміниться»). Відповіді узгоджені з центральною тезою, що свідчить про осмислене заповнення анкети.
8. Етика і захист даних
Перед заповненням анкети кожен респондент давав обов'язкову згоду на участь у дослідженні та обробку даних. Решта питань — необов'язкові, винагорода не передбачалась, адреси електронної пошти не збирались. Поширення анкети через керівників установ Південного регіону підтримав лист Південного наукового центру НАН України та МОН України. Відкриті перевірочні питання (назва посади та установи) використано лише для верифікації відповідей і видалено.
- Лише агрегати. Мікродані (відповіді окремих респондентів) не публікуються.
- Придушення малих груп. Групи з n < 5 у розрізах не показуються («·»), так само — окремі клітинки, де на питання в групі відповіли менше 5 осіб.
- Розрізи одновимірні — кожна демографічна ознака окремо, без перехресних таблиць, тож окремого респондента не «відновити» перетином ознак. Стійкість до відновлення придушених груп відніманням перевірено.
- Коментарі подано дослівно, без редагування; їх перевірено на прямі ідентифікатори (імена, контакти, вказівки на конкретну особу) — таких немає.
9. Що можна перевірити самостійно
Набір на Zenodo укомплектовано так, щоб опубліковані числа можна було перерахувати без доступу до мікроданих:
| Величина | Чи відтворюється | Звідки (аркуш книги) |
|---|---|---|
| 23 індекси: значення, SE, 95 % ДІ | точно | «Розподіли індексів» + формула вище |
| ІНМ (зведений) — значення | точно | геометричне середнє трьох складових |
| ІНМ — 95 % ДІ | лише наближено | бутстреп по респондентах |
| Cronbach α і MIC — 7 шкал | точно | «Статистики шкал» |
| Fleiss κ | точно | «Категоризація»: 54 види × 3 категорії |
| Spearman ρ, p, p (BH), p (BY) | точно | «Пари конструктів» |
| Критерій Манна-Уітні | точно | «Частки часу» |
| Сума часток, реверсивний контроль | точно | «Надійність» |
| χ² репрезентативності | точно | «Репрезентативність» |
| Значення в розрізах за групами | точно | «Крос-таби» |
| 95 % ДІ в розрізах за групами | ні — їх немає у версії 1.0 | рахувалися з первинних даних для сайту |
Завантажити набір і процитувати →
10. Межі
Пілотна апробація на невипадковій вибірці, зміщеній у бік кваліфікованіших і залученіших у науку респондентів (розд. 5); чи узагальнювати результати з огляду на це зміщення — вирішує користувач даних. Дані самозвітні — це сприйняття, а не об'єктивні виміри. Зріз одномоментний: порівнянь у часі з цих даних зробити не можна. Призначення пілоту — показати, що інтерсуб'єктивні індекси якості науки вимірні на системному рівні.
Відомі обмеження інструменту: двоє респондентів у коментарях повідомили, що окремі кнопки відповідей не спрацьовували (помітної втрати відповідей немає); анкета не дозволяла обрати кілька галузей одночасно; частина респондентів зазначає, що частки часу оцінювала приблизно.