Науковий Барометр

Методологія

Як рахуються індекси, наскільки їм можна довіряти і що це за вибірка. Принцип проєкту: кожне число має бути видно, звідки воно. Повна версія — у документації набору даних.

1. Як рахується індекс

Замість наукометрії (кількість публікацій, цитувань) індекси формуються зі структурованих оцінок самих науковців і зводяться в дифузійний індекс — за аналогією з Індексом менеджерів із закупівель (PMI) та Індексом споживчих настроїв.

Індекс = [P₁·1 + P₂·0,5 + P₃·0 + P₄·(−0,5) + P₅·(−1)] · 100 + 100

P₁…P₅ — частки відповідей від найпозитивнішої до найнегативнішої. Діапазон 0–200, 100 = нейтральний рівень: позитивних і негативних оцінок порівну.

SE = 100 · sd / √n; 95 % ДІ = значення ± 1,96 · SE

sd — стандартне відхилення зважених відповідей (ваги від +1 до −1), n — кількість відповідей на питання (від 188 до 199). Зведений Індекс наукових можливостей (ІНМ) — геометричне середнє трьох індексів забезпеченості (фінансування, обладнання, час); його ДІ рахувався бутстрепом (10 000 повторів по респондентах).

Однакове значення індексу може означати різне: 100 — це і «майже всі обрали нейтральну відповідь», і «думки розділилися навпіл». Тому на сайті поруч з індексом завжди показано розподіл п'яти відповідей.

2. Три типи показників

24 індекси вимірюють три різні речі, і на сайті вони подаються окремо:

ТипЩо цеІндексівЯкі
Стан зараз оцінка поточного стану на момент опитування 6 ІНМ ф, ІНМ о, ІНМ ч, ІНМ, ІЯНР в, ІЯНР ч
Оцінка змін як змінилося, на думку респондентів; це не виміряна динаміка, а їхня оцінка на момент опитування 16 ІНЧ 1, ІНЧ 5, ІКННЧ 1, ІКННЧ 5, ІБВЧ 1, ІБВЧ 5, ІНМ ф1, ІНМ ф5, ІНМ о1, ІНМ о5, ІНМ ч1, ІНМ ч5, ІЯНР в1, ІЯНР в5, ІЯНР ч1, ІЯНР ч5
Очікування чого респонденти очікують у майбутньому 2 ІОРН 1, ІОРН 5

Оцінка змін — не виміряна динаміка. Респонденти відповідали, як, на їхню думку, змінилися частка часу, забезпеченість чи якість за рік і за п'ять років. Це їхня оцінка на момент опитування; для п'яти років — ще й з пам'яті. Зріз одномоментний, тож справжню динаміку покаже лише порівняння хвиль. З тієї ж причини ретроспективні індекси не входять до перевірки конструктної валідності (розд. 7).

У наборі даних ці індекси належать до вимірів «Динаміка структури часу», «Динаміка забезпеченості» і частково «Якість результатів»; на сайті вони названі «оцінкою змін», щоб не створювати враження часового ряду.

3. Вибірка і невизначеність

N = 200 (25.02.2026 – 13.04.2026, 46 днів; більшість відповідей — у березні). Генеральна сукупність — 136 131 наукових, науково-педагогічних і педагогічних працівників ЗВО і наукових установ (Держстат, 2024); вибірка — 0,15 %. Анкета в Google Forms, три канали поширення одночасно: запрошення на адреси з офіційних сайтів установ, звернення до керівників установ, соціальні мережі й наукові спільноти. Відбір невипадковий (зручний / самовідбір); участь добровільна й анонімна.

Класична «похибка вибірки» тут не застосовна. Невизначеність подано 95 % довірчими інтервалами: вони описують статистичну точність оцінок. Відмінність вибірки від генеральної сукупності оцінено критерієм χ² (розд. 5).

Довірчі інтервали в розрізах за групами

У теплокартах на сторінках блоків ДІ є для кожної клітинки (перемикач «Показати 95 % ДІ»):

База клітинки — кількість відповідей на питання в групі. Групи бувають від n = 5, тож інтервали широкі: медіанна ширина ДІ для часток — близько 43 пунктів у групах з n < 20 і 23 — у більших. Групи з n < 20 на теплокартах заштриховані. При малих n нормальне наближення для індексів грубе; якщо ж у групі всі відповіді однакові, формула дає нульову ширину — такий ДІ не показуємо («—»).

ДІ груп рахувалися з первинних даних і до версії 1.0 набору на Zenodo не входять, тож із набору їх не відтворити (точкові значення — відтворюються).

4. Профіль вибірки

Хто ці 200 респондентів. Питання про характеристики в анкеті були необов'язковими.

ХарактеристикаСклад вибірки
Посаданауково-педагогічні працівники — 47,0 %; керівники / заступники керівників підрозділів — 21,5 %; наукові працівники (без викладання) — 19,0 %; аспіранти — 4,5 %
Науковий ступіньмають ступінь — 87,5 % (кандидати наук / PhD — 63,5 %; доктори наук — 24,0 %); без ступеня — 12,5 %
Вчене званнянайчисельніші — доценти (37,0 %) та особи без звання (34,0 %)
Науковий стажпереважно понад 10 років; групи 11–20 і 21–30 років разом — 56,5 %
Галузь знаньнайпредставленіші — суспільні (27,6 %) та природничо-математичні (24,1 %) науки (самооцінка)
Науковий напрямприкладні дослідження — 58,9 %; фундаментальні — 51,3 %; науково-технічні розробки — 15,2 % (множинний вибір)
Тип установиЗВО — 70,4 %; наукові установи — 28,6 %; інше — 1 %
Географія21 область України; найбільше — Київська (32,1 %) та Одеська (18,4 %)

Тип установи, ступінь, звання й галузь докладніше зіставлено з генеральною сукупністю нижче; частки там рахуються від тих, хто відповів на відповідне питання, тож можуть дещо відрізнятися.

5. Репрезентативність (χ² проти Держстату)

Вибірку звірено з генеральною сукупністю за чотирма критеріями. За всіма — статистично значуща відмінність (p < 0,05), що очікувано для нестратифікованого пілоту. Зміщення системне: вибірка перекошена в бік більш кваліфікованих і залученіших у науку респондентів. Таке зміщення типове для подібних опитувань. Водночас саме оцінки кваліфікованих і досвідчених науковців найважливіші для розуміння стану системи. Область — лише описово: для χ² замало спостережень у регіонах.

Тип установи

χ² = 19,88, df = 1, p = < 0,001 (N = 197)

Категоріяген. %вибірка %зміщення, в.п.
ЗВО 83,0 71,1 −11,9
Наукова установа 17,0 28,9 +11,9

Науковий ступінь

χ² = 27,93, df = 2, p = < 0,001 (N = 200)

Категоріяген. %вибірка %зміщення, в.п.
Кандидат наук / PhD 53,4 63,5 +10,1
Доктор наук 17,4 24,0 +6,6
Без наукового ступеня 29,2 12,5 −16,7

Вчене звання (ЗВО)

χ² = 12,32, df = 2, p = 0,002 (N = 140)

Категоріяген. %вибірка %зміщення, в.п.
Доцент 39,3 49,3 +10,0
Без вченого звання 45,1 30,0 −15,1
Професор 14,4 18,6 +4,2
Старший дослідник 1,2 2,1 +0,9

Галузь наук (НУ)

χ² = 20,46, df = 3, p = < 0,001 (N = 56)

Категоріяген. %вибірка %зміщення, в.п.
Природничо-математична 44,0 41,1 −2,9
Інженерно-технологічна 17,6 5,4 −12,2
Суспільна 10,2 26,8 +16,6
Аграрно-ветеринарна 11,2 14,3 +3,1
Біомедична 8,6 5,4 −3,2
Гуманітарно-мистецька 8,5 7,1 −1,4

6. Підготовка даних

7. Надійність і валідність

Зведена оцінка

ВимірМетодРезультатОцінка
Репрезентативність вибірки Тести χ² (4 критерії) усі значущі; зміщення системне (до більш кваліфікованих) Обмеження
Відмінності ЗВО і НУ (відомі групи) Критерій Манна-Уітні ДНД p < 0,001; БД p = 0,003; КННД p = 0,161 (н/з) Підтверджено
Узгодженість оцінок часу Контроль суми часток середня 96,1 %; медіана 95,0 % Прийнятно
Міжекспертна надійність категоризації Fleiss κ; P̄ κ = 0,275 (помірна); P̄ = 0,531 Помірна
Внутрішня узгодженість шкал Cronbach α; MIC 7/7 шкал α ≥ 0,70; 4 шкали ≥ 0,80; усі MIC ≥ 0,50 Добре
Конструктна валідність ρ Спірмена (5 пар) + поправка BH 5/5 в очікуваному напрямі; 4 значущі за BH (3 за BY) Підтверджено
Якість і узгодженість відповідей Реверсивний контроль лише 1,4 % обтяжених БД суперечать моделі Підтверджено

За сукупністю вимірів інструмент має прийнятні або добрі психометричні властивості. Головне обмеження — не психометрика, а зміщеність вибірки: результати пілотні й потребують підтвердження на стратифікованій вибірці.

Внутрішня узгодженість шкал (Cronbach α і MIC)

Cronbach α — наскільки узгоджено пункти шкали вимірюють спільний конструкт. MIC — середня кореляція між усіма парами пунктів; на відміну від α, вона не залежить від кількості пунктів, тож саме її коректно порівнювати між шкалами різної довжини.

ШкалаПунктівNαMIC
1. Поточна забезпеченість 3 194 0,755 0,510
2. Динаміка забезпеченості (рік) 3 191 0,748 0,501
3. Динаміка забезпеченості (5 років) 3 185 0,786 0,553
4. Якість власних (тепер + рік + 5 років) 3 197 0,804 0,579
5. Якість інших (тепер + рік + 5 років) 3 196 0,878 0,712
6. Достатність часу (4 питання) 4 192 0,881 0,649
7. Очікування ІОРН (рік + 5 років) 2 199 0,905 0,838

N — респонденти з повними відповідями на всі пункти шкали. За критерієм Нанналі α ≥ 0,70 — прийнятно, ≥ 0,80 — добре, ≥ 0,90 — відмінно: усі сім шкал прийнятні або кращі, чотири — добрі; усі MIC ≥ 0,50.

Узгодженість оцінювачів (Fleiss κ)

Наскільки однаково науковці відносять види діяльності до наукової / корисної ненаукової / безглуздої: κ = 0,275 (середня узгодженість P̄ = 0,531) — «помірна» за шкалою Лендіса–Коха. Помірний консенсус очікуваний: межі між категоріями частково суб'єктивні, і сам ступінь розбіжності — змістовний результат. Узгодженість по кожному виду (Pᵢ) — на сторінці категоризації.

Конструктна валідність (Spearman ρ)

Чи корелюють теоретично пов'язані конструкти в передбаченому моделлю напрямі: більше дійсної наукової діяльності й ресурсів → вища якість і оптимістичніші очікування; більше безглуздої діяльності → нижчі. Використано лише поточні й проспективні показники, виміряні одночасно.

Пара конструктівNρpp (BH)p (BY)Напрям
Частка ДНД ↔ якість власних 198 +0,351 < 0,001 < 0,001 < 0,001 позитивна, збігся
ІНМ (бали) ↔ очікування (рік) 194 +0,315 < 0,001 < 0,001 < 0,001 позитивна, збігся
Частка БД ↔ очікування (рік) 197 −0,196 0,006 0,009 0,022 негативна, збігся
Частка БД ↔ якість власних 197 −0,147 0,040 0,050 0,113 негативна, збігся
ІНМ (бали) ↔ якість власних 194 +0,127 0,078 0,078 0,179 позитивна, збігся

ІНМ (бали) — індивідуальна сума трьох оцінок забезпеченості (3–15), а не зведений індекс. p (BH) і p (BY) — поправки Бенджаміні-Гохберга і суворіша Бенджаміні-Єкутіелі на п'ять порівнянь. Усі п'ять зв'язків спрямовані так, як передбачає модель; за BH значущі чотири, за BY — три. За Коеном дві кореляції помірні, решта слабкі — для різних конструктів це очікувано: надто високі кореляції означали б, що конструкти не розрізняються. Найсильніший зв'язок — частка дійсної наукової діяльності та якість власних досліджень (ρ = +0,351).

Відомі групи: ЗВО і наукові установи (критерій Манна-Уітні)

Структура робочого часу має відрізнятися між закладами вищої освіти і науковими установами, де наукова робота основна. Критерій непараметричний, бо відповіді інтервальні, розподіли асиметричні, а групи різного розміру.

КатегоріяЗВО: середня / медіана (N)НУ: середня / медіана (N)Різниця, в.п.Up
Дійсна наукова (ДНД) 26,6 / 15,0 (139) 42,5 / 45,0 (57) +15,9 2 289 < 0,001
Корисна ненаукова (КННД) 37,4 / 35,0 (139) 32,7 / 25,0 (56) −4,7 4 387 0,161 (н/з)
Безглузда (БД) 31,8 / 25,0 (139) 22,0 / 15,0 (56) −9,8 4 918,5 0,003

У наукових установах частка дійсної наукової діяльності значно вища, а безглуздої — нижча: інструмент розрізняє групи, які мають відрізнятися. Розподіли за типом установи — на сторінці структури часу.

Узгодженість відповідей

Контроль суми часток. Частки ДНД, КННД і БД разом мають давати близько 100 %. Сума середин обраних інтервалів у середньому — 96,1 % (медіана 95,0 %; N = 198): оцінки часу узгоджені з поправкою на інтервальний формат.

Сума трьох часток (середини інтервалів, %) — кількість респондентів; виділено 85–115 %.

Реверсивний контроль. Серед 71 респондентів, у яких безглузда діяльність забирає понад 30 % робочого часу, лише 1 (1,4 %) вважає, що її усунення не покращить якість роботи (55 — «значно покращиться», 15 — «дещо покращиться», 1 — «не зміниться»). Відповіді узгоджені з центральною тезою, що свідчить про осмислене заповнення анкети.

8. Етика і захист даних

Перед заповненням анкети кожен респондент давав обов'язкову згоду на участь у дослідженні та обробку даних. Решта питань — необов'язкові, винагорода не передбачалась, адреси електронної пошти не збирались. Поширення анкети через керівників установ Південного регіону підтримав лист Південного наукового центру НАН України та МОН України. Відкриті перевірочні питання (назва посади та установи) використано лише для верифікації відповідей і видалено.

9. Що можна перевірити самостійно

Набір на Zenodo укомплектовано так, щоб опубліковані числа можна було перерахувати без доступу до мікроданих:

ВеличинаЧи відтворюєтьсяЗвідки (аркуш книги)
23 індекси: значення, SE, 95 % ДІточно«Розподіли індексів» + формула вище
ІНМ (зведений) — значенняточногеометричне середнє трьох складових
ІНМ — 95 % ДІлише наближенобутстреп по респондентах
Cronbach α і MIC — 7 шкалточно«Статистики шкал»
Fleiss κточно«Категоризація»: 54 види × 3 категорії
Spearman ρ, p, p (BH), p (BY)точно«Пари конструктів»
Критерій Манна-Уітніточно«Частки часу»
Сума часток, реверсивний контрольточно«Надійність»
χ² репрезентативностіточно«Репрезентативність»
Значення в розрізах за групамиточно«Крос-таби»
95 % ДІ в розрізах за групамині — їх немає у версії 1.0рахувалися з первинних даних для сайту

Завантажити набір і процитувати →

10. Межі

Пілотна апробація на невипадковій вибірці, зміщеній у бік кваліфікованіших і залученіших у науку респондентів (розд. 5); чи узагальнювати результати з огляду на це зміщення — вирішує користувач даних. Дані самозвітні — це сприйняття, а не об'єктивні виміри. Зріз одномоментний: порівнянь у часі з цих даних зробити не можна. Призначення пілоту — показати, що інтерсуб'єктивні індекси якості науки вимірні на системному рівні.

Відомі обмеження інструменту: двоє респондентів у коментарях повідомили, що окремі кнопки відповідей не спрацьовували (помітної втрати відповідей немає); анкета не дозволяла обрати кілька галузей одночасно; частина респондентів зазначає, що частки часу оцінювала приблизно.