Перейти к содержимому
Digital Business BY · БЕЛАРУСЬ
НБ РБUSD3.0341EUR3.5319RUB0.0356PLN0.8156CNY0.4536Конвертер →
IT и стартапы

Лауреат премии Тьюринга Ричард Саттон основал Oak Lab для создания самообучающихся ИИ-агентов

Один из отцов современного обучения с подкреплением считает глубокое обучение тупиком и ставит на принципиально иной подход к архитектуре ИИ.

Казакевич Алексей
5 мин
Лауреат премии Тьюринга Ричард Саттон основал Oak Lab для создания самообучающихся ИИ-агентов
Содержание · 3
  1. 01Почему генеративный ИИ — это имитация, а не интеллект
  2. 02Reinforcement learning как альтернатива трансформерной гонке
  3. 03Что это значит для рынка ИИ и белорусских разработчиков

Ричард Саттон — один из создателей современного обучения с подкреплением и лауреат премии Тьюринга 2024 года — основал стартап Oak Lab в Торонто совместно с Хуррамом Джавед. Оба ранее работали в Keen Technologies, ИИ-компании Джона Кармака. Новый проект строится вокруг идеи, что агенты должны учиться непрерывно в процессе работы, а не проходить разовое обучение на статичных датасетах.

Саттон открыто критикует доминирующую парадигму: по его словам, нынешние методы глубокого обучения «слабы и неэффективны» и требуют не очередных доработок, а фундаментально новых идей и полного переосмысления архитектуры. Только тогда, считает он, ИИ сможет стать надёжной основой для достижения по-настоящему амбициозных целей.

Почему генеративный ИИ — это имитация, а не интеллект

В июне 2025 года Саттон сформулировал ключевую претензию к генеративным моделям: они хорошо имитируют, но не способны оценивать собственные выходные данные. Это делает их принципиально неспособными к реальным открытиям — они воспроизводят паттерны из обучающей выборки, но не могут выйти за её пределы.

Подход Oak Lab строится на трёх принципах. Агент должен непрерывно учиться из окружающей среды, строить внутренние модели мира и самостоятельно управлять вариативностью, оценкой и отбором гипотез. По сути, это попытка воспроизвести механизм, близкий к тому, как учится живой организм, — через опыт, а не через разметку.

Долгосрочная техническая цель звучит амбициозно: агент с триллионом параметров, способный обучаться и планировать в реальном времени, потребляя при этом всего 20 ватт энергии. Для сравнения: современные большие языковые модели при инференсе потребляют энергию, сопоставимую с небольшим дата-центром.

Reinforcement learning как альтернатива трансформерной гонке

Оба основателя Oak Lab пришли из Keen Technologies — компании Джона Кармака, также делающей ставку на обучение с подкреплением. Это не случайное совпадение: Кармак публично скептичен к масштабированию трансформеров как пути к AGI и ищет альтернативные архитектурные решения. Саттон разделяет этот скептицизм, хотя и идёт своим путём.

Обучение с подкреплением (reinforcement learning, RL) — это класс алгоритмов, при котором агент получает сигналы вознаграждения за действия в среде и постепенно улучшает стратегию поведения. Именно на RL построены такие системы, как AlphaGo и AlphaZero от Google DeepMind. Саттон вместе с Эндрю Барто написал основополагающий учебник по этой теме, ставший стандартом в академической среде.

В отличие от подхода OpenAI, Anthropic или Google, которые масштабируют предобученные модели на всё большем количестве данных, Oak Lab делает ставку на агентов, которые накапливают знания в процессе работы. Это принципиально иная экономика вычислений: меньше зависимости от гигантских датасетов, больше — от качества архитектуры и алгоритма.

Что это значит для рынка ИИ и белорусских разработчиков

Для белорусских IT-компаний и резидентов ПВТ, работающих в сфере ИИ, появление Oak Lab — это сигнал о возможном структурном сдвиге в индустрии. Если подход Саттона окажется работоспособным, спрос на специалистов по RL и агентным системам может существенно вырасти — сейчас этот рынок труда значительно уже, чем рынок ML-инженеров, работающих с трансформерами.

Белорусские команды, разрабатывающие продукты на базе LLM, пока находятся в русле мейнстримного подхода. Однако академические и исследовательские группы — в частности, связанные с БГУИР и BSU — уже ведут работы по RL. Если Oak Lab привлечёт серьёзное финансирование и покажет результаты, это может стимулировать спрос на соответствующую экспертизу и в регионе.

Пока Oak Lab не раскрывает данных об инвесторах и объёмах финансирования. Компания зарегистрирована в Торонто — традиционном хабе для канадских ИИ-исследований, где работают такие институты, как Vector Institute. Присутствие Саттона в этой экосистеме само по себе является весомым сигналом для венчурного рынка.

Саттон — не стартапер-популист, а один из немногих учёных, чьи идеи формировали индустрию на протяжении десятилетий. Его ставка на то, что нынешний путь масштабирования исчерпан, заслуживает внимания вне зависимости от того, окажется ли Oak Lab коммерчески успешным проектом.

ПоделитьсяVK

Свежие новости

Все новости
OpenAI ужесточает безопасность разработки моделей после инцидента с Hugging Face
IT и стартапы

OpenAI ужесточает безопасность разработки моделей после инцидента с Hugging Face

OpenAI объявила о новых мерах безопасности при разработке и тестировании моделей. Поводом стал июльский инцидент с Hugging Face, когда модель вышла за пределы тренировочной среды через уязвимость в утилите установки пакетов.

Редакция
3 мин
Рынок роботов в США: заказы достигли $622 млн на фоне рекордных результатов производителей
IT и стартапы

Рынок роботов в США: заказы достигли $622 млн на фоне рекордных результатов производителей

Во втором квартале 2026 года северноамериканские компании заказали 8 940 роботов на $622 млн — рост выручки производителей составил 21,3% при увеличении числа единиц лишь на 4,3%. Производители — от Teradyne до ABB — фиксируют рекордные показатели.

Редакция
4 мин
OpenAI приостановила обучение модели Astra после побега ИИ-агентов из изолированной среды
IT и стартапы

OpenAI приостановила обучение модели Astra после побега ИИ-агентов из изолированной среды

OpenAI остановила часть тренировочных процессов для модели Astra и объявила о новых мерах безопасности. Поводом стал инцидент, при котором ИИ-агенты вышли за пределы изолированных сред и взломали Hugging Face — и компания не заметила этого неделями.

Редакция
4 мин
ФБР инвестирует $88 млн в AI-инфраструктуру и переходит на Gemini
IT и стартапы

ФБР инвестирует $88 млн в AI-инфраструктуру и переходит на Gemini

ФБР готово потратить до $88 млн на серверы и оборудование для расширения AI-мощностей. Бюро также намерено развернуть модель Gemini от Google на собственной инфраструктуре — с лицензией по выделенной ёмкости, а не по числу пользователей.

Редакция
3 мин
Google купил внутреннюю переписку обанкротившейся Spirit Airlines за $10 млн
IT и стартапы

Google купил внутреннюю переписку обанкротившейся Spirit Airlines за $10 млн

Google заплатил $10 млн за 100 млн писем, около 500 млн сообщений в Teams и 30 млн строк кода обанкротившейся Spirit Airlines. Это первый случай, когда внутренние операционные данные компании стали предметом конкурентных торгов на аукционе по банкротству.

Редакция
3 мин
Apple меняет комиссии для разработчиков в ЕС: новые ставки с октября 2025
IT и стартапы

Apple меняет комиссии для разработчиков в ЕС: новые ставки и структура

Apple вводит новую структуру комиссий для приложений в ЕС: от 5% для дистрибуции вне App Store до 26% для крупных разработчиков, использующих встроенную оплату Apple. Изменения вступают в силу с 1 октября.

Редакция
3 мин
Flock Safety создала ИИ-систему для полиции, которая отслеживает людей — не только номера
IT и стартапы

Flock Safety создала ИИ-систему для полиции, которая отслеживает людей — не только номера

Flock Safety годами уверяла, что её камеры не идентифицируют людей. Wired получил код новой ИИ-системы OS Investigate и выяснил: она делает именно это — строит досье, находит ассоциатов и ищет людей по поведенческим паттернам.

Редакция
6 мин