Школярі після початку використання генеративного штучного інтелекту стали приблизно на 30% швидше виконувати домашні завдання й отримувати за них вищі оцінки. Однак через пів року їхні результати на іспитах без доступу до ШІ, за оцінкою дослідників, знизилися приблизно на 20% від початкового середнього рівня. Найбільші навчальні втрати спостерігали серед учнів, чия поведінка була схожа на передавання значної частини домашньої роботи ШІ.
Таких висновків дійшли David Strömberg зі Стокгольмського університету, Victor Lei та Yanhui Wu з University of Hong Kong у дослідженні The Generative AI Learning Penalty: Evidence from Chinese Secondary Education.
Робота оприлюднена як CEPR Discussion Paper та на SSRN. 4 вересня 2026 року автори також окремо представили основні результати у колонці VoxEU.
Дослідження охопило 26 811 учнів 7–12 класів одного округу в центральному Китаї та 30 місяців навчання — від вересня 2022 року до червня 2025-го.
Його результати не означають, що будь-яке використання ChatGPT, DeepSeek чи іншого ШІ автоматично погіршує навчання. Навпаки, одна з найцікавіших частин роботи показує: вирішальним може бути те, як саме учень користується ШІ.
Що саме досліджували
Автори використали адміністративні дані шкіл за 30 місяців.
Вони аналізували:
- результати щотижневих домашніх робіт;
- час, який учні витрачали на домашні завдання;
- результати щомісячних іспитів без доступу до матеріалів;
- окружні контрольні;
- результати вступного іспиту до старшої школи Zhongkao;
- результати вступного іспиту до університетів Gaokao;
- дані з дев’яти навчальних предметів.
Дослідники також намагалися встановити, коли саме кожний учень почав користуватися генеративним ШІ.
Для цього під час опитування учнів просили перевірити дату реєстрації в сервісах штучного інтелекту, якими вони користувалися.
На початку періоду спостереження — восени 2022 року — генеративним ШІ практично ніхто не користувався.
До червня 2025 року про його використання повідомляли вже близько 80% учнів.
Найпоширенішими сервісами були Doubao та DeepSeek — універсальні генеративні ШІ-системи, а не спеціально створені навчальні тьютори.
Домашнє завдання стали виконувати значно швидше
Після початку використання ШІ продуктивність під час виконання домашньої роботи помітно зросла.
До використання генеративного ШІ середній час виконання завдання становив близько 64 хвилин.
Приблизно через шість місяців після початку використання ШІ він скоротився до 45 хвилин.
Це зменшення приблизно на 30%.
Одночасно результати домашніх робіт, за оцінкою авторів, зросли приблизно на 18% від середнього рівня до початку використання ШІ.
Тобто зовні ситуація виглядала дуже позитивно:
менше часу → краща домашня робота → вища оцінка.
Але результати перевірки реальних знань рухалися в протилежному напрямку.
Результати іспитів через пів року знизилися
Щомісячні іспити проходили без доступу до навчальних матеріалів та ШІ.
Через приблизно шість місяців після початку використання генеративних систем автори оцінюють падіння результатів таких іспитів приблизно на 20% від середнього результату до використання ШІ.
Цю цифру важливо трактувати правильно.
Вона не означає, що кожен школяр почав отримувати на 20 процентних пунктів менше.
Так само вона не означає, що учні «втратили 20% знань».
Йдеться про оцінений статистичний ефект відносно середнього результату групи до початку використання ШІ.
| Показник | Приблизна зміна через 6 місяців |
|---|---|
| Час на домашнє завдання | −30% |
| Результат домашньої роботи | +18% |
| Результат закритих іспитів | −20% |
Виходить парадокс: домашні роботи ставали кращими, але результати перевірки знань — гіршими.
Хороша домашня оцінка перестала означати хороші знання
Це одна з найцікавіших частин дослідження саме для вчителів.
Серед школярів, які не користувалися генеративним ШІ, зберігався звичний зв’язок:
чим кращі результати домашньої роботи, тим кращі результати іспиту.
Серед користувачів ШІ цей зв’язок змінився.
Учні з дуже високими результатами домашніх завдань могли водночас показувати слабші результати на іспитах.
Тобто після появи генеративного ШІ сама оцінка за домашню роботу може стати менш надійним показником того, наскільки учень справді засвоїв матеріал.
Для школи це принципово важливо.
Учитель може бачити:
правильно виконане завдання → високу оцінку → формально хороший результат,
але не бачити, скільки власної розумової роботи виконав учень.
Близько 80% користувачів демонстрували поведінку, схожу на «передавання» роботи ШІ
Автори побачили два різні патерни використання генеративного ШІ.
Через шість місяців близько чотирьох із п’яти учнів, які користувалися ШІ, виконували домашні завдання менш ніж за 50 хвилин.
Це було швидше навіть за найшвидших учнів, які ШІ не використовували.
Одночасно їхні результати домашніх робіт були дуже високими, але результати іспитів — помітно гіршими.
Автори зазначають, що такий патерн узгоджується з передаванням значної частини домашньої роботи генеративному ШІ.
Але тут є важливе застереження.
Дослідники не спостерігали за екраном кожного школяра і не можуть сказати, що 80% дітей буквально копіювали готові відповіді.
Тому некоректно писати:
«80% учнів списували домашні завдання через ШІ».
Правильніше:
поведінка приблизно 80% користувачів ШІ була сумісною з тим, що значна частина роботи могла передаватися генеративній системі.
А що сталося з учнями, які продовжували працювати самостійно
Решта — приблизно кожен п’ятий користувач ШІ — після початку його використання не скоротили час домашньої роботи настільки різко.
Вони продовжували витрачати на завдання приблизно стільки ж часу, скільки учні без ШІ.
Їхні домашні результати також покращувалися, що свідчить про використання генеративних інструментів.
Але результати іспитів у цієї групи були близькими до результатів учнів, які ШІ не використовували.
Саме це не дозволяє звести результати дослідження до тези «ШІ шкодить освіті».
Набагато точніше сказати:
ризик зростає тоді, коли ШІ починає замінювати процес навчання, а не допомагати в ньому.
Чому просто змусити дитину довше сидіти над домашнім завданням недостатньо
Автори окремо застерігають від надто простого висновку.
Не можна сказати:
«Якщо учень сидітиме над домашнім не 30, а 60 хвилин, проблема зникне».
Учні, які використовують ШІ по-різному, можуть відрізнятися мотивацією, навчальними звичками, знаннями та цифровими навичками.
Тому час є лише одним із сигналів.
Найважливіше — яку роль відіграє ШІ в навчальній діяльності.
Наприклад, є велика різниця між запитами:
«Розв’яжи мені це завдання і дай відповідь»
і
«Не давай готової відповіді. Поясни, де помилка в моєму розв’язанні, і постав запитання, яке допоможе мені знайти правильний крок».
В обох випадках дитина користується генеративним ШІ.
Але навчальна діяльність принципово різна.
Негативний ефект накопичувався з часом
Ще одна важлива особливість роботи — тривалий період спостереження.
Під час щомісячних контрольних негативна різниця спочатку була невеликою, а приблизно через шість місяців ставала значно більшою.
Для вступних іспитів ефект формувався ще повільніше — приблизно протягом двох років.
Коли він досягав повного масштабу, автори оцінювали зниження результатів приблизно на:
- 24% від початкового середнього для вступного іспиту до старшої школи Zhongkao;
- 18% — для університетського вступного іспиту Gaokao.
Автори пояснюють різницю тим, що звичайна контрольна переважно перевіряє матеріал останніх тижнів або місяців.
Вступний іспит охоплює знання, накопичені протягом кількох років.
Тому можливий негативний ефект використання ШІ проявляється в ньому поступово.
Це також означає, що короткі експерименти тривалістю кілька тижнів можуть не показувати повної картини.
Які предмети постраждали найбільше
За оцінками дослідників, ефект відрізнявся між групами предметів.
| Предметна галузь | Оцінене зниження результатів |
|---|---|
| Соціальні науки — зокрема історія та політика | близько 27% |
| STEM-предмети | близько 22% |
| Англійська мова | близько 17% |
| Китайська мова | близько 9% |
І знову: це не означає, що «ШІ забирає 27% знань з історії».
Це оцінки зміни результатів іспитів відносно базового середнього у конкретній вибірці та дослідницькому дизайні.
Найбільші втрати виявили не лише серед слабших учнів
Цікавий результат стосується того, кого негативний ефект зачепив сильніше.
Автори виявили більші оцінені навчальні втрати серед:
- молодших учнів у вибірці;
- хлопців;
- учнів, які до початку використання ШІ мали високі навчальні результати.
Останній результат особливо важливий.
Може здаватися, що найкраще захищені від надмірної залежності від ШІ саме сильні школярі.
У цьому дослідженні картина була іншою: негативний ефект виявився особливо помітним саме у тих, хто раніше навчався добре.
Чи доводить дослідження, що ChatGPT погіршує навчання
Ні — принаймні такий загальний висновок був би некоректним.
Є кілька важливих обмежень.
1. Це не рандомізований експеримент
Учнів випадково не розподіляли на дві групи — «користуватися ШІ» та «не користуватися ШІ».
Рішення почати користуватися генеративними сервісами вони приймали самі.
Автори застосували staggered difference-in-differences — квазіекспериментальний статистичний підхід.
Вони порівнювали, як змінювалися результати конкретних учнів після початку використання ШІ, із результатами учнів, які на той момент його ще не використовували.
До початку використання ШІ групи демонстрували дуже схожі результати та тенденції.
Такий дизайн значно сильніший за просте порівняння «користувачів» і «некористувачів», але він усе одно залежить від статистичних припущень і не має всіх переваг рандомізованого експерименту.
2. Дослідження проведене в одному регіоні Китаю
У вибірці — 26 811 школярів, що є дуже великою кількістю.
Однак усі вони навчалися в одному окрузі центрального Китаю.
Результати не можна автоматично переносити на українські школи, американських учнів чи всі освітні системи світу.
Самі автори прямо застерігають від такого перенесення величини ефекту.
3. Учні переважно користувалися універсальними чатботами
Найпоширенішими були Doubao та DeepSeek.
Це важливо, бо універсальний чатбот, який легко видає готову відповідь, — не те саме, що спеціально спроєктований освітній ШІ-тьютор, який навмисно не розв’язує завдання за учня, а веде його запитаннями.
Тому результати не можна переносити на будь-який можливий освітній ШІ.
4. Автори не бачили кожної взаємодії з ШІ
Дослідники знали, коли учень почав користуватися ШІ, бачили час виконання домашніх завдань і результати.
Але вони не мали повного запису всіх запитів школяра до чатбота.
Тому висновок про «outsourcing» — передачу домашньої роботи — зроблений за характерним поведінковим патерном, а не за прямим спостереженням кожної взаємодії.
Що це означає для вчителя
Дослідження ставить перед школою проблему, яка ширша за звичайне «списав / не списав».
Генеративний ШІ може зробити так, що результат роботи більше не відображає процес навчання.
Тому оцінювати засвоєння матеріалу лише за домашніми роботами стає ризикованіше.
Практично це означає, що вчителю доцільно поєднувати домашню роботу з іншими способами перевірки:
- короткими завданнями в класі без ШІ;
- усним поясненням розв’язання;
- запитаннями про логіку виконання роботи;
- поетапними чернетками;
- невеликими тестами за матеріалом домашнього завдання;
- завданнями, де потрібно не лише назвати відповідь, а й пояснити шлях до неї.
Це не обов’язково означає повну заборону генеративного ШІ.
Навпаки, проблема може полягати саме в тому, що учні використовують потужний інструмент найпростішим способом — для отримання готового результату.
Як дозволити ШІ, але не віддавати йому навчання
Для школи корисніше встановити не лише правило «можна / не можна ChatGPT», а визначити дозволені способи його використання.
Наприклад, ШІ можна використовувати, щоб:
- попросити пояснити незрозуміле поняття іншими словами;
- отримати додатковий приклад;
- попросити створити тренувальні запитання;
- перевірити власне рішення;
- знайти слабке місце у власному аргументі;
- отримати підказку без готової відповіді;
- потренувати іноземну мову;
- порівняти кілька способів розв’язання.
Натомість передавання чатботу повного завдання з проханням створити готову відповідь залишає учневі значно менше навчальної роботи.
Про межу між допомогою ШІ та підміною власної роботи ми окремо пояснювали у матеріалі «Штучний інтелект і академічна доброчесність: коли використання ШІ стає порушенням».
Також варто заздалегідь встановити зрозумілі правила використання генеративних систем у конкретному закладі. Як показують українські дані, ШІ вже став звичним інструментом для учнів, але чіткі правила його використання мають далеко не всі школи.
Чого це дослідження не доводить
За його результатами не можна стверджувати, що:
- будь-який ШІ погіршує навчання;
- кожен учень, який користується ChatGPT або DeepSeek, починає вчитися гірше;
- 80% школярів списують;
- результати українських учнів упадуть на ті самі 20%;
- використання ШІ потрібно повністю заборонити;
- оцінки за домашню роботу більше не мають сенсу.
Дослідження показує конкретні результати в конкретній освітній системі та сильний зв’язок між способом використання універсального генеративного ШІ і подальшими результатами навчання.
Його головне попередження можна сформулювати простіше:
ШІ може значно покращити результат виконаного завдання, не покращуючи при цьому знання учня.
І саме цю різницю школам доведеться навчитися бачити.
Головні цифри дослідження
| Показник | Дані |
|---|---|
| Учасників | 26 811 учнів |
| Класи | 7–12 |
| Період спостереження | 30 місяців |
| Предметів | 9 |
| Користувалися ШІ до червня 2025 року | близько 80% |
| Час на домашнє через 6 місяців | 64 → 45 хвилин |
| Зміна часу | близько −30% |
| Результати домашніх робіт | близько +18% |
| Результати щомісячних іспитів | близько −20% |
| Zhongkao у довшій перспективі | близько −24% |
| Gaokao | близько −18% |
| Користувачі з поведінкою, схожою на передачу роботи ШІ | близько 80% користувачів ШІ |
Головний висновок
Результати роботи Strömberg, Lei та Wu не дають підстав оголошувати генеративний ШІ ворогом освіти.
Але вони показують небезпеку моделі, за якої школяр отримує кращий результат із меншими зусиллями, водночас дедалі менше виконуючи ту розумову роботу, заради якої домашнє завдання взагалі задавали.
Для вчителя це означає, що в епоху генеративного ШІ дедалі важливішим стає оцінювання не лише готової відповіді, а й процесу мислення учня.
А для школи головне питання поступово змінюється з:
«Чи дозволяти дітям користуватися ШІ?»
на:
«Як зробити так, щоб ШІ допомагав дитині вчитися, а не вчився замість неї?»
Джерела
- SSRN — David Strömberg, Victor Lei, Yanhui Wu, «The Generative AI Learning Penalty: Evidence from Chinese Secondary Education»
- CEPR — Discussion Paper DP21577 «The Generative AI Learning Penalty: Evidence from Chinese Secondary Education»
- VoxEU / CEPR — «The generative AI learning penalty in secondary school», колонка авторів від 4 вересня 2026 року




