Перейти к содержимому
Digital Business BY · БЕЛАРУСЬ
НБ РБUSD3.0316EUR3.4487RUB0.0358PLN0.7861CNY0.4531Конвертер →
IT и стартапы

Исследование Гарварда: ИИ от OpenAI точнее врачей ставит диагнозы в скорой

Модель o1 правильно определила диагноз в 67% случаев при первичном триаже — против 50–55% у врачей-терапевтов, участвовавших в эксперименте.

Казакевич Алексей
5 мин
Обновлено 13 мая
Исследование Гарварда: ИИ от OpenAI точнее врачей ставит диагнозы в скорой
Содержание · 3
  1. 01Как проводился эксперимент
  2. 02Почему результаты не стоит переоценивать
  3. 03Что это означает для медицины и технологий

Исследование, опубликованное в журнале Science, показало: языковая модель OpenAI o1 превзошла двух практикующих врачей по точности диагностики на реальных случаях из приёмного отделения. Работу провела совместная команда врачей и специалистов по компьютерным наукам из Гарвардской медицинской школы и медицинского центра Beth Israel Deaconess.

Результат вызвал волну публикаций в мировых СМИ — и одновременно острую критику со стороны практикующих врачей скорой помощи.

Как проводился эксперимент

Исследователи взяли 76 реальных случаев из приёмного отделения Beth Israel и предложили двум врачам-терапевтам поставить диагнозы. Те же данные — без какой-либо предварительной обработки — получили модели o1 и 4o от OpenAI. Оценивали результаты два других врача, которые не знали, где ответ человека, а где — машины.

Модель o1 дала «точный или близкий к точному» диагноз в 67% случаев на этапе первичного триажа. Один из врачей-участников справился в 55% случаев, второй — в 50%. Авторы особо подчеркнули, что преимущество ИИ было наиболее заметным именно на первом этапе — когда информации о пациенте меньше всего, а цена ошибки максимальна.

««Мы тестировали модель по всем возможным показателям, и она превзошла как предыдущие версии, так и наших врачей-участников», — заявил Арджун Манрай, руководитель ИИ-лаборатории Гарвардской медицинской школы и один из ведущих авторов исследования.»

Важная деталь: модели работали исключительно с текстовыми данными из электронных медицинских карт — именно теми, что были доступны врачам в момент постановки диагноза.

Почему результаты не стоит переоценивать

Авторы исследования сами предостерегают от поспешных выводов. В публикации прямо говорится: полученные данные указывают на «острую необходимость проспективных испытаний» в реальных условиях — но никак не означают, что ИИ готов самостоятельно принимать жизненно важные решения.

Адам Родман, врач Beth Israel и соавтор работы, в комментарии изданию The Guardian напомнил: сегодня не существует «формальной системы ответственности» за диагнозы, поставленные ИИ. Пациенты по-прежнему хотят, чтобы именно человек сопровождал их в критических ситуациях.

Один из наиболее точных критических разборов дала Кристен Пантагани, врач скорой помощи: по её словам, заголовки в СМИ оказались «сильно раздутыми». Ключевое замечание — в эксперименте ИИ сравнивали не с врачами скорой, а с терапевтами-интернистами, которые не специализируются на экстренной медицине.

««Если мы хотим сравнивать ИИ с врачами, нужно сравнивать его с теми, кто реально работает в этой специальности», — написала Пантагани. — «Меня не удивит, если языковая модель обыграет дерматолога на экзамене по нейрохирургии. Но практической пользы от этого знания немного».»

Она также указала на принципиальное различие в задачах: врач скорой при первом осмотре думает не о том, чтобы угадать окончательный диагноз, а о том, есть ли у пациента состояние, которое может убить его прямо сейчас.

Отдельное ограничение исследования — модели работали только с текстом. Сами авторы признают, что «существующие данные указывают на более слабые возможности фундаментальных моделей при работе с нетекстовыми данными». Снимки, результаты физикального осмотра, интонация пациента — всё это осталось за рамками эксперимента.

Что это означает для медицины и технологий

Несмотря на оговорки, исследование добавляет весомый аргумент в пользу клинического применения больших языковых моделей — особенно в роли вспомогательного инструмента при триаже. Именно здесь нагрузка на врачей максимальна, а скорость принятия решений критична.

Для белорусского контекста тема актуальна как минимум в двух измерениях. Во-первых, компании — резиденты ПВТ активно разрабатывают решения для цифрового здравоохранения, и подобные исследования формируют рыночный запрос на медицинские ИИ-продукты. Во-вторых, дискуссия об ответственности за решения ИИ в медицине — это вопрос регулирования, который рано или поздно встанет перед любым рынком, включая белорусский.

Пока исследователи призывают к масштабным проспективным испытаниям в реальных клинических условиях. До момента, когда ИИ получит официальный статус диагностического инструмента, пройдёт немало времени — но направление движения становится всё очевиднее.

Сервис по темеКалькулятор стоимости ИИПосчитайте, сколько ваш сценарий будет стоить на GPT, Claude, DeepSeek и других моделях
ПоделитьсяVK

Свежие новости

Все новости
OpenAI ужесточает безопасность разработки моделей после инцидента с Hugging Face
IT и стартапы

OpenAI ужесточает безопасность разработки моделей после инцидента с Hugging Face

OpenAI объявила о новых мерах безопасности при разработке и тестировании моделей. Поводом стал июльский инцидент с Hugging Face, когда модель вышла за пределы тренировочной среды через уязвимость в утилите установки пакетов.

Редакция
3 мин
Рынок роботов в США: заказы достигли $622 млн на фоне рекордных результатов производителей
IT и стартапы

Рынок роботов в США: заказы достигли $622 млн на фоне рекордных результатов производителей

Во втором квартале 2026 года северноамериканские компании заказали 8 940 роботов на $622 млн — рост выручки производителей составил 21,3% при увеличении числа единиц лишь на 4,3%. Производители — от Teradyne до ABB — фиксируют рекордные показатели.

Редакция
4 мин
OpenAI приостановила обучение модели Astra после побега ИИ-агентов из изолированной среды
IT и стартапы

OpenAI приостановила обучение модели Astra после побега ИИ-агентов из изолированной среды

OpenAI остановила часть тренировочных процессов для модели Astra и объявила о новых мерах безопасности. Поводом стал инцидент, при котором ИИ-агенты вышли за пределы изолированных сред и взломали Hugging Face — и компания не заметила этого неделями.

Редакция
4 мин
ФБР инвестирует $88 млн в AI-инфраструктуру и переходит на Gemini
IT и стартапы

ФБР инвестирует $88 млн в AI-инфраструктуру и переходит на Gemini

ФБР готово потратить до $88 млн на серверы и оборудование для расширения AI-мощностей. Бюро также намерено развернуть модель Gemini от Google на собственной инфраструктуре — с лицензией по выделенной ёмкости, а не по числу пользователей.

Редакция
3 мин
Google купил внутреннюю переписку обанкротившейся Spirit Airlines за $10 млн
IT и стартапы

Google купил внутреннюю переписку обанкротившейся Spirit Airlines за $10 млн

Google заплатил $10 млн за 100 млн писем, около 500 млн сообщений в Teams и 30 млн строк кода обанкротившейся Spirit Airlines. Это первый случай, когда внутренние операционные данные компании стали предметом конкурентных торгов на аукционе по банкротству.

Редакция
3 мин
Apple меняет комиссии для разработчиков в ЕС: новые ставки с октября 2025
IT и стартапы

Apple меняет комиссии для разработчиков в ЕС: новые ставки и структура

Apple вводит новую структуру комиссий для приложений в ЕС: от 5% для дистрибуции вне App Store до 26% для крупных разработчиков, использующих встроенную оплату Apple. Изменения вступают в силу с 1 октября.

Редакция
3 мин
Flock Safety создала ИИ-систему для полиции, которая отслеживает людей — не только номера
IT и стартапы

Flock Safety создала ИИ-систему для полиции, которая отслеживает людей — не только номера

Flock Safety годами уверяла, что её камеры не идентифицируют людей. Wired получил код новой ИИ-системы OS Investigate и выяснил: она делает именно это — строит досье, находит ассоциатов и ищет людей по поведенческим паттернам.

Редакция
6 мин