Перейти к содержимому
Digital Businessby · Беларусь
НБ РБUSD2.9484EUR3.3989RUB0.0363PLN0.7910CNY0.4413Конвертер →
IT и стартапы

ИИ накачивает студенческие оценки, но не знания: данные восьми семестров

Исследование 319 курсов в американском университете показало: рост GPA после запуска ChatGPT объясняется аутсорсингом домашних заданий, а не реальным прогрессом студентов.

Казакевич Алексей
6 мин
ИИ накачивает студенческие оценки, но не знания: данные восьми семестров
Содержание
  1. Домашние задания растут, экзамены — нет
  2. Оценки теряют смысл как сигнал
  3. Что делать: не просто больше экзаменов

После появления ChatGPT в ноябре 2022 года доля студентов с оценкой «A» в американских университетах выросла на 13 процентных пунктов — примерно на 30% выше базового уровня 2022 года. Средний GPA поднялся на 0,12 пункта, а разброс оценок сузился: «A-минус» и «B-плюс» массово превращаются в чистые «A». При этом экзаменационные баллы практически не изменились.

Такие данные приводит исследователь Игорь Чириков, проанализировавший 319 курсов в 84 кафедрах за восемь осенних семестров — с 2018 по 2025 год. Уровень «ИИ-экспозиции» каждого курса определялся по структуре заданий из силлабусов осени 2022 года — до того, как ChatGPT вышел в публичный доступ. Ключевой параметр — доля письменных и программистских задач: именно в этих областях языковые модели работают лучше всего.

Домашние задания растут, экзамены — нет

Центральный вопрос исследования: отражают ли более высокие оценки реальный прогресс в обучении или просто факт того, что ИИ выполняет работу вместо студента? Чириков проверил это через структуру итоговой оценки: если ИИ действительно улучшает понимание материала, рост должен быть равномерным — и в курсах с упором на домашние задания, и в тех, где вес имеют контрольные экзамены.

Но картина оказалась иной. В курсах, где домашние задания составляют более медианной доли итоговой оценки, количество «A» выросло на дополнительные 16 процентных пунктов по сравнению с курсами ниже медианы при той же ИИ-экспозиции. В курсах с низкой долей домашних заданий эффект минимален и статистически незначим.

Дополнительным тестом послужили оценки за устные презентации — формат, где ИИ практически бесполезен. Там никакого роста не зафиксировано. Чириков называет совокупность результатов «трудно объяснимой одними лишь общими учебными успехами или эффектами сортировки».

Оценки теряют смысл как сигнал

Грейд-инфляция в американских университетах — не новость. В Гарварде доля «A» выросла с 24% в 2005 году до 60,2% в 2025-м. Прежде это объясняли мягкостью преподавателей, конкуренцией между вузами и институциональной политикой. Но ИИ работает иначе.

Все предыдущие факторы инфляции действовали на этапе выставления оценок — после того как студент сдал работу. ИИ вмешивается раньше: он меняет сам процесс создания работы, ещё до того как преподаватель её увидит. Это принципиально новый механизм.

Последствия выходят за рамки академической среды. Если оценки по письму и программированию всё больше отражают качество работы языковой модели, а не реальные навыки студента, работодатели и приёмные комиссии магистратур начнут принимать худшие кадровые решения. Для белорусских IT-компаний, активно нанимающих выпускников — в том числе иностранных вузов, — это означает, что академический бэкграунд кандидата становится менее надёжным индикатором компетентности.

Чириков также указывает на потенциальный замкнутый круг: если ИИ берёт на себя задачи, которые должны формировать навыки, выпускники окажутся слабее именно в тех областях, где автоматизация наиболее активна. Это ускорит вытеснение людей из профессий и расширит разрыв в квалификации на рынке труда.

Что делать: не просто больше экзаменов

Автор исследования предлагает не сводить решение к переводу всего на очные контрольные работы — это и недостаточно, и технически сложно. Более продуктивный путь — переосмыслить сами форматы заданий: либо ограничить применение ИИ структурно, либо намеренно встроить его в процесс с обязательной документацией хода работы и последующими вопросами, доказывающими понимание материала.

Гендиректор OpenAI Сэм Альтман в недавнем интервью признал, что за три с половиной года после запуска ChatGPT образовательная система практически не адаптировалась. Он ожидал год хаоса с читингом, а затем системной перестройки — но не может указать ни на одно значимое системное изменение. По его словам, без такой перестройки критическое мышление рискует «существенно атрофироваться».

««Я — человек, который думает через письмо. Я пишу много вещей, которые никому не показываю, но это важно для меня, чтобы разобраться в чём-то. Поэтому я рад, что научился писать. Люди говорят то же самое о программировании», — сказал Альтман.»

На государственном уровне первой жёсткие меры приняла Норвегия: страна фактически запретила ИИ-инструменты в начальной школе и ограничила их использование в средней. Премьер-министр Йонас Гар Стёре объяснил решение тем, что бесконтрольное применение ИИ подталкивает учеников пропускать важные этапы обучения.

Для белорусского контекста вопрос особенно актуален: резиденты Парка высоких технологий и IT-компании, работающие на экспорт, традиционно делают ставку на сильную техническую базу специалистов. Если академические оценки перестают быть надёжным фильтром, индустрии придётся инвестировать в собственные системы верификации навыков — технические интервью, тестовые задания и внутренние программы обучения становятся не опцией, а необходимостью.

— По материалам The Decoder: оригинальная статья. Перевод и адаптация — редакция Digital Business.

Сервис по темеКалькулятор стоимости ИИПосчитайте, сколько ваш сценарий будет стоить на GPT, Claude, DeepSeek и других моделях
ПоделитьсяVK

Свежие новости

Все новости
Сбер открыл Kandinsky WM 1.0: генерация видео для обучения роботов и беспилотников
IT и стартапы

Сбер открыл Kandinsky WM 1.0: генерация видео для обучения роботов и беспилотников

Сбер выпустил семейство генеративных моделей Kandinsky WM 1.0 для создания физически достоверного видео. Разработчики роботов и беспилотных автомобилей смогут обучать свои системы без дорогостоящих реальных испытаний.

Редакция
3 мин
Moss достигла статуса единорога: что это значит для европейского финтеха
IT и стартапы

Moss достигла статуса единорога: что это значит для европейского финтеха

Финтех-стартап Moss стал новейшим европейским единорогом, привлекая €30 млн в Series C с оценкой €1 млрд. Это отражает растущий интерес инвесторов к AI-решениям в финансовом секторе.

Казакевич Алексей
1 мин
Claude Opus 5 генерирует 3D-игры с физикой и музыкой из одного промпта
IT и стартапы

Claude Opus 5 генерирует 3D-игры с физикой и музыкой из одного промпта

Шутер от первого лица, гонки на картах, клон Minecraft с 15 биомами — всё это пользователи создают одним промптом в Claude Opus 5. Модель сама пишет геометрию, текстуры и физику в виде кода, который запускается прямо в браузере.

Редакция
4 мин
Google свернула AI-функцию в Google Earth через сутки после запуска
IT и стартапы

Google свернула AI-функцию в Google Earth через сутки после запуска

Google запустила и уже на следующий день отключила функцию AI-генерации изображений в Google Earth. Инструмент позволял вставлять любые сцены поверх реальных карт, что вызвало волну критики со стороны журналистов и исследователей.

Редакция
4 мин
Google DeepMind представила Gemini Robotics 2 для управления роботами любого форм-фактора
IT и стартапы

Google DeepMind представила Gemini Robotics 2 для управления роботами любого форм-фактора

Google DeepMind анонсировала Gemini Robotics 2 — свою наиболее продвинутую модель для робототехники. Система управляет роботами любого типа и доступна разработчикам через список ожидания.

Редакция
2 мин
Claude взломал три реальные компании во время тестирования — Anthropic раскрыла инциденты
IT и стартапы

Claude взломал три реальные компании во время тестирования — Anthropic раскрыла инциденты

Anthropic признала, что три модели на базе Claude проникли в реальную инфраструктуру сторонних компаний во время тестирования кибербезопасности. Это второй подобный инцидент за десять дней — ранее аналогичное произошло с моделями OpenAI.

Редакция
3 мин
Сэм Альтман призвал ИИ-индустрию сбавить темп — и он не одинок
IT и стартапы

Сэм Альтман призвал ИИ-индустрию сбавить темп — и он не одинок

Глава OpenAI Сэм Альтман заявил, что отрасли стоит «сбавить темп» в гонке ИИ. Поводом стал инцидент, при котором одна из моделей OpenAI вышла за пределы тестовой среды и оказалась связана с утечкой данных на Hugging Face.

Редакция
1 мин