После трёх месяцев колоноскопии с искусственным интеллектом 19 опытных врачей находили на 21 % меньше аденом без него. Сорок лет данных — аудит.
Проверка на отключение
Девятнадцать опытных врачей, три месяца поддержки и шесть пунктов исчезнувшего навыка
С сентября 2021 по март 2022 года четыре польских центра эндоскопии внедрили искусственный интеллект в рутинную колоноскопию. Когда те же 19 специалистов затем работали без него, их показатель выявления аденом упал с 28,4 % до 22,4 %✓ Установленный факт [1] — относительное падение на 21 % в том диагностическом умении, которое определяет специальность✓ Установленный факт [2]. У них не отняли ничего, кроме практики. Настоящий доклад разбирает, когда такой обмен происходит, когда не происходит и что сорок лет контролируемых исследований калькуляторов, письма от руки и спутниковой навигации уже установили об этом различии.
Накопленные данные дают точный ответ, и он старше нынешнего спора. Передача когнитивной задачи машине ослабляет лежащую в основе способность тогда, когда машина берёт на себя шаг извлечения из памяти или порождения, который человек выполнил бы сам, и оставляет эту способность нетронутой — порой даже улучшает её, — когда снимается лишь трение вокруг шага, по-прежнему выполняемого человеком◈ Веские доказательства [12]. Польское исследование колоноскопии даёт самый чистый естественный эксперимент по первому случаю. Девятнадцать эндоскопистов, у каждого из которых за плечами более 2 000 процедур, три месяца работали с поддержкой ИИ в четырёх центрах, участвовавших в программе профилактики рака; их показатель выявления без поддержки затем упал на шесть процентных пунктов✓ Установленный факт [1].
Население, которое ставит этот опыт на себе, охватывает уже большую часть поколения. Третий ежегодный опрос британских студентов бакалавриата, опубликованный в марте 2026 года по 1 054 ответам очной формы обучения, показал: 95 % так или иначе пользуются генеративным ИИ, а 94 % применяют его в оцениваемых работах✓ Установленный факт [20]. Доля тех, кто вставляет созданный ИИ текст прямо в сдаваемую работу, достигла 12 % против 8 % в 2025 году и 3 % в 2024-м✓ Установленный факт [20]. Институциональное предложение за те же два года выросло втрое: с 9 % студентов, располагавших университетскими инструментами в 2024 году, до 38 % в 2026-м✓ Установленный факт [20]. Распространение перестало быть студенческой практикой, которую надзирают; это закупаемая инфраструктура.
Поведенческие данные большого масштаба показывают, что именно изменила эта закупка. Десятилетняя панель из 3,2 млн взаимодействий на адаптивной математической платформе ALEKS сопоставила темы, легко переносимые в запрос к чат-боту, с темами на основе графиков, которые так не переносятся. Время занятий по уязвимым для ИИ темам сокращалось на 2,8 % за квартал среди студентов после выхода ChatGPT, суммарно на 26,9 % за одиннадцать кварталов; у старшеклассников — на 31,3 %, а у пятиклассников заметных изменений не выявлено◈ Веские доказательства [21]. На случайно назначенных заданиях под наблюдением вероятность верного ответа снизилась суммарно на 25 %◈ Веские доказательства [21]. Быстрее выполнено, менее прочно усвоено — измерено на тех же учащихся и в той же программе.
Сводные показатели навыков снижались ещё до всего этого. Обследование компетенций взрослых Организации экономического сотрудничества и развития (ОЭСР), охватившее около 160 000 человек в возрасте от 16 до 65 лет в 31 стране и обнародованное в декабре 2024 года, установило: за предшествующее десятилетие грамотность чтения выросла лишь в двух странах, Финляндии и Дании, а во всех прочих осталась на месте или снизилась✓ Установленный факт [18]. С математической грамотностью дело обстоит лучше — рост зафиксирован в восьми странах✓ Установленный факт [18]. Сильнее всего снижение затронуло наименее образованных, что расширило разрыв внутри каждой страны✓ Установленный факт [19]. Школьные данные указывают туда же: средний результат ОЭСР по математике потерял около 15 баллов между 2018 и 2022 годами, а чтение — примерно 10✓ Установленный факт [34].
Ничто из перечисленного не служит доказательством применительно к искусственному интеллекту, и принять это за доказательство было бы первой напрашивающейся ошибкой. Снижение взрослых компетенций опережает ChatGPT на десятилетие; разворот эффекта Флинна, измеренный примерно на 394 000 взрослых американцев, охватывает 2006–2018 годы, то есть время до больших языковых моделей, и затронул не все области — вербальное и матричное рассуждение, а также ряды букв и чисел снизились, тогда как трёхмерное вращение выросло✓ Установленный факт [22][33]. Эти ряды задают исходную точку, но не причину. Они описывают население, чьи измеренные когнитивные показатели уже дрейфовали, когда появилось устройство разгрузки общего назначения.
Схема наблюдательная, но необычно чистая: те же 19 операторов, те же четыре центра, та же процедура, до и после. Выявление аденом при колоноскопиях без ИИ упало с 28,4 % — 226 процедур из 795 — до 22,4 %, то есть 145 из 648✓ Установленный факт [1]. Процедуры с поддержкой за тот же период дали 25,3 %, 186 из 734✓ Установленный факт [2]. Каждый оператор выполнил более 2 000 колоноскопий до начала исследования, что снимает очевидный искажающий фактор неопытности✓ Установленный факт [1]. Результат опубликован в журнале «Ланцет гастроэнтерология и гепатология» (The Lancet) 12 августа 2025 года✓ Установленный факт [2].
Доклад построен в том порядке, в каком появлялись доказательства. Второй раздел объясняет, почему человек вообще делегирует и почему суждение, управляющее этим делегированием, систематически ненадёжно. Третий посвящён навигации — единственной области, где структурная цена получена прямой визуализацией. Четвёртый возвращает к контролируемым исследованиям калькуляторов и конспектирования, давно ответившим на общий вопрос. Пятый и шестой разбирают литературу о больших языковых моделях и материалы о профессиональной утрате навыка. Седьмой сопоставляет то, что реально сделали пять государств. Восьмой формулирует, что доказательства выдерживают, а что нет.
Почему разум делегирует
Разгрузка — рациональная стратегия, опирающаяся на самооценку, которая часто ошибается
Когнитивная разгрузка не есть болезнь современности. Это обыденное использование физического действия для снижения внутренней когнитивной нагрузки: наклонить голову, чтобы прочесть повёрнутое изображение, записать встречу, поставить будильник✓ Установленный факт [12]. Решение о разгрузке управляется метакогнитивным суждением о собственных возможностях, и это суждение измеримо ошибается в обе стороны◈ Веские доказательства [12]. Значимый вопрос не в том, разгружают ли люди мышление, а в том, что сам акт разгрузки делает с оцениваемой при этом способностью.
Рамку, упорядочившую эту литературу, задали Эван Риско и Сэм Гилберт в журнале «Тенденции в когнитивных науках» в 2016 году, и в ней три подвижные части. Склонность к разгрузке зависит от внутренней когнитивной нагрузки, которую иначе создала бы задача, и от метакогнитивной оценки собственных возможностей; акт разгрузки затем воздействует на эту оценку; наконец, разгрузка прямо влияет на когнитивные способности◈ Веские доказательства [12]. Загвоздка кроется в среднем звене. Тот, кто исправно делегирует задачу, перестаёт получать сведения о собственной компетентности, которые подсказали бы ему, оправдано ли делегирование по-прежнему.
Самая цитируемая из эмпирических опор оказалась и самой повреждённой. В 2011 году Бетси Спэрроу, Дженни Лю и Дэниел Вегнер представили четыре исследования, из которых следовало: ожидая постоянного доступа к сведениям, человек хуже запоминает их сами и лучше запоминает, где их найти✓ Установленный факт [11]. Находка вошла в обиход под названием эффекта Google, или цифровой амнезии. Она же вошла в кризис воспроизводимости: репликации высокой мощности не воспроизвели самый цитируемый компонент, эксперимент с праймингом Струпа, а поздние обобщения указывают, что общий эффект реален, но меньше и куда сильнее зависит от контекста, чем следовало из исходной статьи⚖ Оспаривается [11].
Эта поправка весит больше, чем ей обычно отводят. Сильная версия эффекта Google — будто поисковые системы выхолостили семантическую память — не установлена, и настоящий доклад её не утверждает. Защитимая версия уже и старше: память транзактивна. Люди всегда распределяли знание между другими людьми, а интернет распространил существовавший механизм на нечеловеческого партнёра✓ Установленный факт [11]. Транзактивная система эффективна ровно до тех пор, пока партнёр доступен и точен. Её отказ проявляется не в забывании, а в неспособности заметить, что партнёр ошибся.
Они перестанут упражнять память, ибо станут полагаться на написанное, припоминая вещи уже не изнутри самих себя, а посредством внешних знаков.
— Сократ, в диалоге Платона «Федр», около 370 года до нашей эрыВозражение, что доводу 2 400 лет и он ошибался всякий раз, заслуживает серьёзного отношения, ибо наполовину справедливо. Письмо действительно вынесло память вовне, и Сократ верно угадал механизм, ошибившись в следствии✓ Установленный факт [32]. Грамотные общества не стали менее способными; они стали способны на иное и большее, поскольку письмо не столько изъяло из мышления шаг, сколько добавило ему постоянную опору. Исторический материал, стало быть, не даёт оснований ни для паники, ни для благодушия. Он даёт основание для вопроса о том, какой именно шаг убирает конкретное орудие.
Вопрос поддаётся уточнению. Калькулятор убирает исполнение алгоритма, выбирать который ученик уже научился. Спутниковый навигатор убирает построение пространственного представления, а не только его исполнение. Проверка орфографии убирает извлечение написания уже выбранного слова. Большая языковая модель, у которой просят сочинение, убирает выбор довода, извлечение подтверждений, порядок утверждений и порождение фраз — все шаги, кроме запроса и оценки итога. Это не однородные вмешательства, и нет причин ожидать от них одинакового исхода.
Именно метакогнитивный слой делает различие трудноразличимым изнутри. Опрос исследовательского подразделения Microsoft и Университета Карнеги — Меллона среди 319 работников умственного труда, охвативший 936 реальных случаев применения и представленный на конференции 2025 года по человеческому фактору в вычислительных системах, установил: чем выше доверие к системе ИИ, тем слабее критическая проверка её выдачи, тогда как чем выше уверенность в собственном умении, тем проверка тщательнее✓ Установленный факт [6]. Под поддержкой компетентность и восприятие компетентности расходятся. А заметить ослабевший навык лучше прочих должен именно тот человек, чей ослабевший навык это замечание и производит.
Что показывает навигация
Единственная область, где структурная цена визуализирована, измерена во времени и признана обратимой
Пространственная навигация — единственная когнитивная функция, для которой довод о разгрузке располагает прямыми нейроанатомическими данными по обе стороны баланса. Построение когнитивной карты увеличивает задний гиппокамп✓ Установленный факт [9]; отказ от такого построения сопряжён с более крутым трёхлетним снижением зависимой от гиппокампа пространственной памяти◈ Веские доказательства [8]. Лондонский таксомоторный промысел дал первую половину находки случайно, спутниковая навигация — вторую.
Экзамен лондонских таксистов (The Knowledge) требует заучить около 25 000 улиц и уметь построить маршрут между любыми двумя точками без подсказок. В 2000 году Элеанор Магуайр с коллегами сообщила в трудах Национальной академии наук США, что задний гиппокамп лицензированных лондонских таксистов заметно крупнее, чем у контрольной группы, а объём коррелирует с проведённым за рулём временем — положительно в задней области и отрицательно в передней✓ Установленный факт [9]. Структура следовала за употреблением, у взрослых, в отделе мозга, который долго считали неизменным после развития.
Довод держится на последующих работах. Увеличение не постоянно и не бесплатно. Обзоры литературы о таксистах фиксируют, что преимущество заднего гиппокампа отступает от неупотребления после выхода на пенсию и что пожилые водители, продолжавшие работать, сохраняли преимущество перед бросившими◈ Веские доказательства [10]. Обратная сторона задокументирована столь же тщательно: те же водители уступали контрольной группе в ряде задач на усвоение новых зрительно-пространственных сведений◈ Веские доказательства [10]. Мастерство такого рода арендуют, а не покупают, и арендная плата вносится непрерывным извлечением из памяти.
Очевидный современный вопрос — что происходит, когда извлечение прекращается, — получил ответ у Луизы Дамани и Вероник Бобо в журнале (Scientific Reports) в апреле 2020 года. Исследовательницы оценили накопленный за жизнь опыт спутниковой навигации у 50 постоянных водителей вместе с несколькими гранями пространственной памяти: применением стратегий, когнитивным картированием и кодированием ориентиров. Больший накопленный опыт сопровождался худшей пространственной памятью при самостоятельной навигации, то есть тогда, когда прибор недоступен✓ Установленный факт [8]. Поперечный результат сам по себе неоднозначен, и авторы это понимали.
Тринадцать первоначальных участников прошли повторное обследование спустя три года после первой сессии. Более интенсивное применение прибора в промежутке сопровождалось более крутым снижением зависимой от гиппокампа пространственной памяти◈ Веские доказательства [8]. Объяснение через обратную причинность — будто прибор охотнее берут люди с плохим чувством направления — было проверено и поддержки не получило: активные пользователи не сообщали, что взялись за него из-за скверной ориентации◈ Веские доказательства [8]. Направление стрелки и составляет всю находку. Без него корреляция в поперечном срезе весила бы не больше наблюдения, что пользующиеся словарём пишут менее уверенно.
Эффект не сводится к лабораторной задаче. Стратегия навигации по ориентирам, оценённая более чем у 37 000 участников, ослабевает на протяжении всей человеческой жизни, а равновесие между стратегией по ориентирам и картографической стратегией — это ровно то, что убирает пошаговая голосовая подсказка✓ Установленный факт [10]. Водитель, следующий за произносимыми указаниями, исполняет последовательность; представления он не удерживает. Снаружи автомобиля поведение выглядит одинаково. Внутри одна из двух операций, сформировавших гиппокамп таксистов, больше не выполняется.
Здесь уместны две оговорки. Выборка по спутниковой навигации мала — 50 участников в поперечном срезе, 13 в продольном, — а трёхлетнее наблюдение за тринадцатью людьми есть сигнал, а не приговор⚖ Оспаривается [8]. Кроме того, ни одно исследование не показало, что сниженная пространственная память причиняет этой группе хоть какой-нибудь функциональный ущерб в обыденной жизни, поскольку обыденная жизнь уже включает прибор. Находка состоит в атрофии внутренней способности, а не в том, что человек хуже ориентируется. Это разные утверждения, и второе не доказано.
Навигация вносит в общий довод механизм с измеренной опорой. Орудие, подменяющее построение внутреннего представления, сопряжено с угасанием этого представления и поддерживающей его ткани; угасание следует за объёмом подмены; и оно обращается вспять, когда представление отстраивают заново✓ Установленный факт [9][10]. Утверждение заметно сильнее всего, что способна сегодня подкрепить общая литература о разгрузке, и доступно оно ровно в одной области. Остальная часть доклада посвящена тому, насколько далеко оно обобщается.
Что контролируемые исследования уже решили
Калькуляторы, война пера с клавиатурой и желательные трудности ответили раньше, чем вопрос был задан
Спор об ИИ ведётся так, будто прежних данных об орудиях, берущих на себя часть когнитивной задачи, не существует. Их очень много, они необычайно хорошо контролируемы и сходятся: вред заключён не в орудии, а в том, убирает ли оно шаг, на котором происходит научение◈ Веские доказательства [13][17]. Метаанализ 79 исследований калькуляторов, опубликованный в 1986 году, обнаружил улучшение на всех ступенях, кроме одной, — и эта оговорка есть самый поучительный итог всего свода✓ Установленный факт [13].
Рэй Хембри и Дональд Дессарт свели в 1986 году для «Журнала исследований в области математического образования» 79 исследовательских отчётов о карманных калькуляторах. На всех ступенях, кроме четвёртого класса, применение калькулятора рядом с обычным преподаванием улучшало навыки среднего ученика в письменных вычислениях, как в упражнениях, так и при решении задач✓ Установленный факт [13]. Отношение к предмету и математическая самооценка улучшались на всех ступенях и во всех группах способностей✓ Установленный факт [13]. Более поздние работы о графических калькуляторах пришли к совместимым выводам: эффект оказывался наибольшим там, где прибор встраивали в преподавание ради исследования и понятийной работы, а не выдавали для тренировки и проверки◈ Веские доказательства [14].
Четвёртый класс — та оговорка, что уточняет правило. Длительное применение калькулятора на этой ступени, судя по данным, мешало становлению базовых навыков у средних учеников✓ Установленный факт [13]. В четвёртом классе закрепляются многозначные арифметические процедуры; там извлечение и исполнение сами составляют предмет учения, а не сопутствующие издержки. Дать орудие до того, как процедура автоматизировалась, — и оно займёт место, где сложился бы автоматизм. Дать после — и оно освободит ресурс для следующей ступени. Тот же прибор, обратный знак, а переменной служит возрастная позиция ученика.
Литература о конспектировании показывает противоположный сбой и предостерегает против самого довода настоящего доклада. Широко цитируемый результат 2014 года, будто рукописный конспект превосходит набранный на клавиатуре в понятийных вопросах, поскольку медленный носитель принуждает к порождающей обработке, прямой репликации не выдержал. Кайла Морхед, Джон Данлоски и Кэтрин Роусон не нашли устойчивых различий между рукой, ноутбуком, электронным блокнотом и — что примечательно — группой, вовсе не конспектировавшей⚖ Оспаривается [15]. Обширная прямая репликация в журнале (Psychological Science) пришла к тому же выводу: мини-метаанализы дали малые и незначимые эффекты в пользу руки⚖ Оспаривается [16].
Два нулевых итога и один сильный положительный — не противоречие, а уточнение. Результат о калькуляторах и результат о конспектировании роднит то, что ни одно из орудий не убирало порождающий шаг там, где вреда не возникло. Калькулятор, выданный после автоматизации арифметической процедуры, оставляет выбор процедуры за учеником. Ноутбук для конспекта по-прежнему требует от ученика решить, что стоит записать. Там же, где орудие навредило, в арифметике четвёртого класса, оно заняло ровно ту операцию, ради установки которой программа и существовала.
Литература наук об учении прямо называет недостающую переменную. Рамка желательных трудностей Роберта и Элизабет Бьорк гласит, что условия, снижающие результат по ходу учения — распределение во времени, чередование, самостоятельное порождение, тренировка извлечения, — улучшают долговременное сохранение и перенос◈ Веские доказательства [17]. Акт извлечения сведений по влиянию на позднейшую доступность сильнее акта повторного чтения◈ Веские доказательства [17]. Всякое орудие, подменяющее извлечение, тем самым убирает операцию, строящую прочное знание, что бы оно ни делало с сегодняшним результатом.
Самое полезное число во всей литературе о разгрузке — оговорка в метаанализе сорокалетней давности. Калькуляторы помогали на всех ступенях, кроме той, где автоматизируемая процедура и была предметом учения✓ Установленный факт [13]. Это не факт о калькуляторах, а правило внедрения орудий: поддержка безвредна на операциях, уже усвоенных, и разрушительна на операциях, ещё не усвоенных. Всякая пишущаяся сейчас школьная политика по ИИ есть, сознаёт она это или нет, ставка на то, где именно относительно этой черты стоит каждый ученик.
Рамка желательных трудностей несёт и собственный предел, и честность требует его назвать. Эффекты не универсальны: они слабеют или обращаются вспять, когда рабочая память уже загружена материалом с высокой взаимозависимостью элементов⚖ Оспаривается [17]. Трудность желательна лишь там, где ученику хватает ресурса ей ответить. Эта оговорка режет в обе стороны. Она ослабляет всякое огульное утверждение о пользе трения и усиливает более узкое: ценность орудия целиком зависит от того, какой шаг оно забирает и у кого.
Что показывают языковые модели
Четыре независимые схемы, три года данных и одно направление
Литературе о больших языковых моделях и познании едва исполнилось три года, а в ней уже четыре методически не связанных исследования, указывающих в одну сторону: лабораторная электроэнцефалография, опрос 666 взрослых, опрос 319 работников умственного труда и контролируемый учебный эксперимент по правке сочинений◈ Веские доказательства [3][5][6][7]. Ни одно не решает дела в одиночку. Ценность свода в том, что каждое даёт сбой в свою сторону, а согласуются они всё равно.
Самое разрекламированное оказалось и самым слабым как доказательство, и самым полезным как показ. Группа медиалаборатории Массачусетского технологического института разделила 54 участника из пяти университетов Бостона на три группы — одна писала сочинения с большой языковой моделью, другая с обычной поисковой системой, третья без вспомогательных средств — и всё время записывала мозговую активность решёткой из 32 электродов с частотой 500 герц✓ Установленный факт [3]. Участникам отводилось 20 минут, темы они выбирали из философских заданий стандартизированных вступительных тестов. Группа без средств показала самую сильную и широко распределённую нейронную связность, поисковая группа — среднюю, модельная — самую слабую✓ Установленный факт [3].
Важна в этой работе не мера связности, трудная для истолкования и не прошедшая рецензирования к моменту обнародования⚖ Оспаривается [4]. Важен поведенческий остаток. Писавшие с моделью хуже помнили собственные тексты и слабее ощущали их своими✓ Установленный факт [3]. Авторы назвали этот рисунок когнитивным долгом: поверхностное кодирование в момент порождения, дефицит которого обнаруживается лишь тогда, когда текст надо воспроизвести или защитить. Ровно такую подпись литература о желательных трудностях и предсказывает для орудия, убирающего порождающий шаг◈ Веские доказательства [17].
Опросные данные обширнее и грубее. Смешанное исследование Михаэля Герлиха с 666 участниками, вышедшее в журнале Societies в январе 2025 года, обнаружило значимую отрицательную связь между частым применением инструментов ИИ и показателями критического мышления, статистически опосредованную когнитивной разгрузкой✓ Установленный факт [5]. Молодые участники обнаружили большую зависимость и меньшие показатели; высокий уровень образования связь смягчал✓ Установленный факт [5]. Схема остаётся корреляционной, с самоотбором и самоотчётом, и не позволяет отбросить встречную возможность: инструменты активнее берут люди с изначально более слабым критическим мышлением⚖ Оспаривается [5]. Это гипотеза с 666 точками данных, а не доказательство.
Переменную вычленяет контролируемый учебный эксперимент. Ичжоу Фань с коллегами в «Британском журнале образовательных технологий» за 2025 год сопоставил учащихся, которым помогал ChatGPT, помогали живые эксперты, помогал инструмент анализа письма, и учащихся без всякой помощи. Группа ChatGPT дала наибольший прирост оценок за сочинение. Прирост знаний и перенос знаний у неё значимо от прочих групп не отличались✓ Установленный факт [7]. Механизм авторы назвали метакогнитивной ленью: учащиеся следовали отклику модели, чтобы выполнить задание быстро, вместо той оценки и того самоконтроля, которые порождают переносимое понимание◈ Веские доказательства [7].
Это самый воспроизводимый итог молодой литературы и самый ясный по политическим следствиям. Оценки за сочинение в условии с ChatGPT выросли; прирост и перенос знаний значимо не отличались от условия без помощи✓ Установленный факт [7]. Время работы над уязвимыми для ИИ темами математики у студентов сократилось суммарно на 26,9 %, тогда как вероятность верного ответа на заданиях под наблюдением упала на 25 %◈ Веские доказательства [21]. Всякая система оценивания, измеряющая сданную работу вместо удержанной способности, зафиксирует поэтому улучшение ровно у той части учащихся, которая усваивает меньше◈ Веские доказательства [7][21].
Отдают учащиеся именно ту часть работы, которую программа ценит выше всего. Разбор компанией Anthropic 574 740 учебных диалогов за окно в 18 дней с разметкой по таксономии Блума помещает 39,8 % запросов в высшую категорию — создание, и 30,2 % в анализ, против 10,9 % на применение и 10,0 % на понимание✓ Установленный факт [23]. Делегирование перевёрнуто относительно обычного допущения: рутина остаётся, а работа высшего порядка отдаётся. Выборка сильно смещена к ранним пользователям и к информатике, давшей 38,6 % пользователей против 5,4 % студенчества США⚖ Оспаривается [23].
Учебные заведения отвечают на порождающий ИИ переустройством оценивания, и 65 % британских студентов сообщают, что оценивание уже заметно изменилось✓ Установленный факт [20]. Почти всё это переустройство нацелено на обнаружение или недопущение текста, созданного ИИ. Данные же помещают уязвимость в другое место: орудие улучшает сданную работу и не улучшает удержанное знание✓ Установленный факт [7][21]. Учреждение, успешно удостоверившее авторство и продолжающее оценивать сданный продукт, решит вопрос добросовестности и оставит вопрос научения ровно там, где он был.
Коммерческая траектория задаёт срок для любого политического ответа. Рынок искусственного интеллекта в образовании оценивается примерно в 10,6 млрд долларов в 2026 году против приблизительно 7,5 млрд в 2025-м и, по прогнозу, достигнет около 42,5 млрд к 2030 году◈ Веские доказательства [35]. Институциональное предложение этих инструментов британским студентам выросло с 9 % до 38 % за два года✓ Установленный факт [20]. Закупки обгоняют оценочную литературу на несколько лет — знакомый рисунок в образовательных технологиях, который прежде ни разу не завершался благополучно⚖ Оспаривается [26].
Утрата навыка вне класса
Медицина и авиация поставили этот опыт первыми, с приборами и последствиями
Самое веское свидетельство того, что машинная помощь ослабляет экспертный навык, приходит вовсе не из образования. Оно приходит из двух профессий, непрерывно измеряющих собственную работу: из гастроэнтерологии, где показатели выявления проверяют по каждой процедуре отдельно, и из коммерческой авиации, где утрата ручного пилотирования уже два десятилетия числится названной угрозой безопасности✓ Установленный факт [1][31]. В обеих ухудшение обнаружилось у специалистов, которые уже были экспертами.
Польскую работу стоит изложить заново именно потому, что схема её столь непритязательна. Она была наблюдательной, а не рандомизированной. Девятнадцать эндоскопистов из четырёх центров, с более чем 2 000 предшествующих колоноскопий у каждого, наблюдались во время внедрения поддержанного ИИ выявления в их учреждениях с сентября 2021 по март 2022 года✓ Установленный факт [1]. Выявление аденом при процедурах без поддержки упало с 28,4 % до 22,4 %; процедуры с поддержкой дали 25,3 %✓ Установленный факт [2]. Сопоставление идёт внутри одного оператора и одного центра, что снимает большинство встречных объяснений, обычно поглощающих результат такого размера.
Предложенный механизм скорее внимательный, чем мнемонический. Оператор, работающий рядом с системой, помечающей возможные образования, постепенно смещает зрительный поиск от сплошного просмотра к подтверждению того, что выдала система. Ослабевает не знание о том, как выглядит аденома; ослабевает длительный самостоятельный поиск, находящий ту, на которую никто не указал. Ровно этот структурный сдвиг авиационная литература описывает с 1990-х годов: переход от исполнителя к наблюдателю и связанные с ним особые издержки бдительности◈ Веские доказательства [31].
Наши результаты тревожны, учитывая стремительное распространение ИИ в медицине. Нам срочно нужны дальнейшие исследования.
— Марцин Романьчик, Силезская академия, «Ланцет гастроэнтерология и гепатология», август 2025 годаАвиация даёт самый долгий из доступных естественных экспериментов. Навыки ручного пилотирования без сравнительно частой практики сползают к границам допустимого качества, и выдерживание воздушной скорости ослабевает одним из первых◈ Веские доказательства [31]. Позиция федерального авиационного управления США, выработанная после серии расследований потери управления в полёте, состоит в том, что автоматизация требует больше подготовки, а не меньше, что владение ручным пилотированием остаётся первостепенным для безопасности и что пилотам следует вести самолёт вручную на значительной части коммерческих рейсов при подходящих условиях✓ Установленный факт [31]. Регулятор здесь предписывает профессионалам намеренно отказываться от доступного орудия, чтобы сберечь способность, которую оно подменяет.
| Уязвимость | Тяжесть | Оценка |
|---|---|---|
| Эрозия экспертной работы без поддержки | Показана в единственной профессии, проверяющей себя процедура за процедурой: шесть пунктов падения выявления аденом без поддержки после трёх месяцев работы с ней, у операторов с более чем 2 000 процедур у каждого✓ Установленный факт [1]. Уязвимость наибольшая всюду, где поддержка непрерывна, работа без неё отдельно не измеряется, а навык держится на длительном самостоятельном поиске◈ Веские доказательства [31]. | |
| Утрата ручного управления в автоматизированных системах | Ручное пилотирование быстро сползает без частой практики, и недостаток ручного опыта числился среди способствующих факторов в расследованиях потери управления◈ Веские доказательства [31]. Регуляторное средство — намеренное ручное пилотирование в обычной работе — прямо признаёт, что от орудия надо периодически отказываться, чтобы способность уцелела✓ Установленный факт [31]. | |
| Специалисты, никогда не получившие исходной способности | Все известные на сегодня итоги об утрате навыка касаются экспертов, ранее навыком владевших. Когорту, обученную с самого начала при непрерывной поддержке, ещё никто не измерял⚖ Оспаривается [1]. Ближайший аналог — оговорка о четвёртом классе, и она указывает в неверную сторону: длительная поддержка во время становления процедуры этой процедуре мешала✓ Установленный факт [13]. | |
| Уверенность, оторванная от умения | Более высокое доверие к системе ИИ предсказывает более слабую критическую проверку её выдачи, а более высокая уверенность в собственном умении — более тщательную✓ Установленный факт [6]. Поскольку разгрузка вдобавок ослабляет метакогнитивный сигнал, которым человек судит о своих возможностях, наименее способная заметить дефицит группа как раз ему и подвержена◈ Веские доказательства [12]. | |
| Институциональная слепота измерения | Почти ни одно учреждение не измеряет работу без поддержки после её внедрения. Польский итог существует лишь потому, что колоноскопии без поддержки продолжали выполняться и фиксироваться внутри исследования✓ Установленный факт [1]. Там, где встречный случай не собирают, ухудшение не просто не обнаружено: оно необнаружимо◈ Веские доказательства [21]. |
Обобщение упирается в жёсткий предел, и назвать его следует прежде, чем кто-нибудь обобщение растянет. Все полученные до сих пор итоги об утрате навыка касаются специалистов, освоивших навык до появления орудия. Опубликованных измерений когорты, обученной при непрерывной поддержке с самого начала, нет ни в одной профессии⚖ Оспаривается [1]. Возможно, такая когорта выработает иную и столь же действенную компетентность, выстроенную вокруг орудия. Возможно и другое: она никогда не приобретёт той исходной способности, на фоне которой ошибки орудия различимы. Обе догадки. Ни одна не проверена, и весомой была бы вторая.
Именно асимметрия последствий оправдывает регулирование, идущее впереди доказательств. В образовании ослабленная способность даёт выпускника, который сносно справляется с орудиями и плохо без них, в мире, где орудия обычно под рукой. В медицине и авиации отказ орудия и ослабленная запасная способность человека — связанные события: к человеку обращаются ровно тогда, когда система перестала работать◈ Веские доказательства [31]. Резервирование, ветшающее соразмерно своему неупотреблению, резервированием не является. Это отложенная единая точка отказа.
Польская находка видна лишь потому, что исследовательский протокол требовал продолжать выполнять колоноскопии без поддержки, хотя поддержка была доступна✓ Установленный факт [1]. Почти ни одно внедрение вне исследования это сопоставление не сохраняет. Больницы не изымают периодически диагностическую помощь, чтобы проверить работу без неё; школы не проводят оценивание без устройств, чтобы измерить, что эти устройства держат; компании не сравнивают сотрудников с их собственной выработкой до внедрения. Самое дешёвое доступное вмешательство в каждой из этих сред — продолжать измерять случай без поддержки◈ Веские доказательства [21].
Медицина и авиация дают доказательство принципа в профессиональном масштабе. Навык ветшает, когда поддерживавшую его операцию выполняет нечто иное; это ветшание измеряется месяцами, а не десятилетиями; и происходит оно в группах, чья квалификация сомнений не вызывает✓ Установленный факт [1][31]. Ни одна из двух областей не заключила, что орудие надо бросить: колоноскопия с поддержкой находит больше аденом, чем без неё, ради чего её и внедрили✓ Установленный факт [2]. Обе заключили, что человеческую способность надо поддерживать отдельно и намеренно, вопреки удобству орудия.
Пять государств, пять противоположных ставок
Китай обязывает, Эстония раздаёт, Южная Корея отыгрывает назад, и почти никто не задумал оценку
Национальные ответы на познание с машинной поддержкой разошлись резче, чем оправдывают данные, потому что данные пришли позже большинства решений. Китай сделал искусственный интеллект обязательным школьным предметом с шести лет и одновременно запретил младшеклассникам самостоятельно пользоваться порождающими системами✓ Установленный факт [27]. Эстония раздаёт передовые модели всем старшеклассникам✓ Установленный факт [28]. Южная Корея законом упразднила в августе 2025 года свою флагманскую программу учебников с ИИ✓ Установленный факт [26].
Министерство образования Китая выпустило в мае 2025 года две директивы, превращающие преподавание ИИ в обязательную инфраструктуру. Программа начинается в шесть лет с нижней границы не менее восьми часов в год материала, посильного возрасту, идёт через данные и программирование в четвёртом классе к алгоритмам и интеллектуальным агентам в пятом и доходит до логики машинного обучения и распознавания дезинформации в средней школе✓ Установленный факт [27]. Пекин сделал предмет обязательным для всех учеников начальной и средней школы✓ Установленный факт [27]. Те же директивы запрещают младшеклассникам самостоятельно пользоваться порождающими системами, а учителям — подменять ими основное преподавание✓ Установленный факт [27].
Такое сочетание даёт самую внутренне согласованную политику из принятых каким-либо государством. Она трактует технологию как предмет изучения, а не как замену изучению, и ставит запрет ровно туда, куда его поместили бы данные о калькуляторах в четвёртом классе, — на время становления автоматизируемых процедур◈ Веские доказательства [13]. Осмысленна ли граница в восемь часов и переживёт ли запрет соприкосновение со 190 миллионами школьников — вопросы отдельные, и ни один не оценивался. Примечательно другое: устройство политики повторяет устройство доказательной базы, по всей видимости в силу рассуждения, а не случая.
Эстония с равной решимостью сделала обратную ставку. Программа AI Leap, начатая 1 сентября 2025 года, даёт бесплатный доступ к ведущим приложениям ИИ и сопутствующее обучение навыкам 20 000 учащихся десятых и одиннадцатых классов и 3 000 учителей, а вторая волна должна прибавить 38 000 учащихся и 2 000 учителей✓ Установленный факт [28]. Программу согласовали напрямую с разработчиками передовых моделей, и она прямо объявляет себя преемницей инициативы «Тигриный скачок» (Tiger Leap), приведшей компьютеры в эстонские школы три десятилетия назад✓ Установленный факт [28]. Нацелена она на возраст, далеко отстоящий от опасной зоны четвёртого класса.
Южная Корея даёт предостерегающий случай, и это скорее провал закупки, чем педагогики. Цифровые учебники с ИИ обкатывались в первом полугодии 2025 года по английскому языку и математике в третьем и четвёртом классах и по английскому, математике и информатике в средней школе✓ Установленный факт [26]. Столкнувшись с длительным сопротивлением учителей и родителей, министерство перешло от общенационального предписания к добровольному принятию школа за школой; 4 августа 2025 года Национальное собрание сузило законное определение учебника до печатных и электронных книг, исключив интеллектуальное программное обеспечение учебной поддержки✓ Установленный факт [26]. Охват упал с 37 % до 19 % за один семестр✓ Установленный факт [26].
Волна ограничений на устройства — иная политика, обращённая к иному механизму, и доказательная база у неё тонка, хотя и не пуста. Ограничения существуют теперь в 106 странах и 39 штатах США✓ Установленный факт [36]. В Нидерландах опрос 317 средних школ после общенационального запрета показал, что три четверти сообщают о лучшей сосредоточенности, почти две трети — о лучшем климате в коллективе, а треть — о лучших учебных результатах◈ Веские доказательства [25]. Исследование 2025 года обнаружило более высокие отметки там, где учителя собирали телефоны, причём сильнее всего выиграли слабоуспевающие первокурсники и учащиеся негуманитарных и неестественнонаучных направлений◈ Веские доказательства [25]. Оценка ЮНЕСКО по-прежнему такова: итоги разнородны, а ограничение не отменяет необходимости учить обращению с цифровой средой⚖ Оспаривается [24].
Статья 4 регламента об искусственном интеллекте стала применимой 2 февраля 2025 года: каждый поставщик и каждый внедряющий обязан принять меры, обеспечивающие достаточный уровень ИИ-грамотности у собственного персонала и прочих затронутых лиц, соразмерно их роли, подготовке и используемым системам✓ Установленный факт [29]. Обязанность реальна и всеобща. Не уточнено в ней то, какие человеческие способности эта грамотность призвана сберечь, — пробел существенный, ибо данные об утрате навыка касаются эрозии профессионального умения, а не понимания орудия◈ Веские доказательства [1]. Знание о том, как работает модель, не поддерживает того поискового поведения, которое она подменяет.
Общий провал всех пяти подходов скорее оценочный, чем идеологический. Ни одна из программ не запускалась с заранее зарегистрированной схемой, способной уловить главный эффект — способность без поддержки, измеренную за годы против сопоставимой когорты. Ближайший цикл международного исследования учебных достижений ОЭСР, результаты которого ожидаются в сентябре 2026 года более чем по 760 000 учащихся в 91 стране, впервые включит сведения о том, как школьники применяют ИИ в учебной работе◈ Веские доказательства [34]. Это единственный крупный инструмент, нацеленный сегодня на вопрос, и он наблюдательный.
Что выдерживают доказательства
Переменная — не орудие, а изъятый шаг
Проверку переживают два утверждения. Разгрузка — древняя, рациональная и в основном безобидная стратегия, которую многократно принимали за упадок◈ Веские доказательства [12][32]. И орудия, подменяющие шаг извлечения или порождения, измеримо ослабляют ту способность, за которую вступаются, — у взрослых, в считаные месяцы, на профессиональном уровне мастерства✓ Установленный факт [1][8]. Утверждения эти не соперничают. Они описывают разные орудия, и весь практический вопрос сводится к тому, на какое из двух похоже конкретное внедрение.
За тезис о приспособительной разгрузке говорит самый крепкий вид доказательства, каким располагает эта область: многократное историческое опровержение тревоги. Письмо не расстроило цивилизацию✓ Установленный факт [32]. Калькуляторы улучшили успеваемость по математике на всех ступенях, кроме одной, и отношение к предмету на всех✓ Установленный факт [13]. Результат о пере и клавиатуре, десятилетие подававшийся как довод о вреде цифровых носителей для кодирования, дважды не прошёл прямую репликацию⚖ Оспаривается [15][16]. Самый цитируемый эксперимент об эффекте Google не воспроизвёлся⚖ Оспаривается [11]. Область с такой историей преувеличений заслужила скепсис к своему новейшему заявлению.
За тезис о разрушительной разгрузке говорит свод поменьше, зато лучше опознанный. Результат о спутниковой навигации имеет продольную часть и проверенное встречное объяснение◈ Веские доказательства [8]. Результат о колоноскопии получен внутри одного оператора и одного центра и касается экспертов✓ Установленный факт [1]. Позиция авиационного регулятора — вывод ведомства после расследований происшествий, а не лабораторная находка✓ Установленный факт [31]. Эксперимент Фаня разводит в контролируемых условиях качество сданной работы и перенос знаний✓ Установленный факт [7]. Ни одна из этих работ не сводится к самоотчётному опросу о собственном мышлении, из чего преимущественно и состоит сегодня тревожная литература об ИИ.
Примирение даёт обобщённое правило четвёртого класса. Поддержка, приложенная к операции, которую пользователь уже автоматизировал, почти бесплатна и нередко лучше бесплатной, ибо освобождает ресурс для следующего уровня задачи✓ Установленный факт [13][14]. Поддержка, приложенная к операции, ещё не автоматизированной, занимает место, где сложился бы автоматизм✓ Установленный факт [13]. Поддержка, приложенная к операции, автоматизированной годы назад, и приложенная непрерывно, позволяет этому автоматизму угаснуть✓ Установленный факт [1][8]. То же орудие, три группы людей, три знака.
Доводы в пользу приспособительной разгрузки
Сократ предрекал гибель памяти от письма; грамотные общества стали способнее, а не слабее✓ Установленный факт [32]. Каждое позднейшее издание довода метило в технологию, сегодня признаваемую очевидно полезной.
Семьдесят девять исследований калькуляторов дают лучшие письменные вычислительные навыки на всех ступенях, кроме четвёртого класса, и лучшее отношение и самооценку на всех✓ Установленный факт [13].
Самый цитируемый компонент эффекта Google не прошёл репликацию высокой мощности⚖ Оспаривается [11], а преимущество рукописного конспекта не прошло двух прямых репликаций⚖ Оспаривается [15][16].
Разгружают больше при высокой внутренней нагрузке и меньше, когда собственные возможности признаны достаточными, — это стратегия, а не рефлекс◈ Веские доказательства [12].
Доводы в пользу разрушительной разгрузки
Девятнадцать эндоскопистов с более чем 2 000 процедур у каждого утратили шесть процентных пунктов выявления без поддержки после рутинной работы с ИИ✓ Установленный факт [1].
Более интенсивное применение спутниковой навигации предсказывало более крутой трёхлетний спад зависимой от гиппокампа пространственной памяти, причём обратная причинность была проверена и отвергнута◈ Веские доказательства [8].
Оценки за сочинение в условии с ChatGPT выросли; прирост и перенос знаний значимо не отличались от условия без помощи✓ Установленный факт [7].
Время занятий по уязвимым для ИИ темам математики у студентов сократилось суммарно на 26,9 %, а вероятность верного ответа на заданиях под наблюдением упала на 25 %◈ Веские доказательства [21].
Три ходовых нынче утверждения не подкреплены и подлежат изъятию. Что порождающий ИИ измеримо снижает интеллект: падающие ряды на уровне населения начали падать до появления технологии✓ Установленный факт [22][18]. Что поисковые системы выхолостили память: сильная версия эффекта Google репликации не пережила⚖ Оспаривается [11]. И что трение само по себе ценно в учении: эффекты желательной трудности слабеют или обращаются вспять, когда рабочая память уже загружена⚖ Оспаривается [17]. Каждое из них — реальная находка, растянутая дальше, чем выдерживает её схема.
Практический вывод узок и непритязателен. Придерживать поддержку во время становления тех процедур, которые автоматизируются, — там и лежит единственный ясный отрицательный итог литературы о калькуляторах✓ Установленный факт [13]. Намеренно поддерживать работу без поддержки всюду, где человек служит запасным звеном, к чему пришёл авиационный регулятор и на что указывает находка о колоноскопии✓ Установленный факт [31][1]. И, прежде всего, продолжать измерять случай без поддержки, ибо это единственное наблюдение, делающее эффект видимым, и первое, сбор которого всякое внедрение прекращает◈ Веские доказательства [21].
Когнитивная разгрузка не есть единое явление с единым действием, отчего сорок лет исследований и кажутся противоречащими друг другу◈ Веские доказательства [12]. Примиряет их не изощрённость орудия, а положение изъятого шага относительно уже имеющейся у человека компетентности. Изымите шаг, который человек автоматизировал, — и вы освободите ресурс✓ Установленный факт [13]. Изымите шаг, который он как раз автоматизирует, — и вы помешаете автоматизации✓ Установленный факт [13]. Изымите непрерывно шаг, автоматизированный годы назад, — и вы дадите ему угаснуть✓ Установленный факт [1][8]. Большие языковые модели — первое широко внедрённое орудие, способное занять все три положения разом, у одного человека и за один день.
Измеримые вопросы ближайших пяти лет уже сформулированы. Приобретёт ли когорта, обученная с самого начала при непрерывной поддержке, исходную способность вообще — этого не изучало ни одно исследование⚖ Оспаривается [1]. Устоит ли спад удержания, видимый в математической панели, перед схемами, которые не будут квазиэкспериментальными⚖ Оспаривается [21]. Уловит ли международное исследование учебных достижений, ожидаемое в сентябре 2026 года, хоть что-нибудь в первой когорте, проходящей его при повседневном обиходе этих орудий◈ Веские доказательства [34]. И решит ли хоть одно учреждение где бы то ни было продолжать сбор измерений без поддержки, когда обязанность отпадёт. При нынешних данных именно это последнее ограничение и связывает руки.