Перейти к содержимому
Digital Business BY · БЕЛАРУСЬ
НБ РБUSD3.0228EUR3.4879RUB0.0360PLN0.8027CNY0.4515Конвертер →
IT и стартапы

Anthropic выпустила Claude Fable 5 и Mythos 5: публичная версия с ограничениями, закрытая — для избранных

Компания разделила один и тот же базовый ИИ на две версии — открытую с «предохранителями» и закрытую для партнёров и исследователей, получивших доступ через государственные программы.

Казакевич Алексей
5 мин
Anthropic выпустила Claude Fable 5 и Mythos 5: публичная версия с ограничениями, закрытая — для избранных
Содержание · 3
  1. 01Как работают «предохранители» в публичной версии
  2. 02Почему Mythos считается опасным для открытого релиза
  3. 03Что это означает для IT-рынка и кибербезопасности

Компания Anthropic в конце мая представила сразу две модели — Claude Fable 5 и Claude Mythos 5. Обе построены на одном базовом движке, но распространяются принципиально по-разному: первая доступна широкой аудитории, вторая — только ограниченному кругу партнёров. Причина такого разделения — опасения, что передовые возможности модели могут быть использованы для создания хакерских инструментов.

Модель Mythos впервые появилась в апреле в рамках закрытой программы Project Glasswing — консорциума технологических компаний, которые получили ранний доступ, чтобы успеть подготовить собственные системы защиты до широкого релиза. Теперь к ним добавились «отдельные исследователи в области биологии», а сам Anthropic подчёркивает, что координирует расширение доступа совместно с правительством США.

Как работают «предохранители» в публичной версии

Claude Fable 5 получил механизм автоматической переадресации запросов. Если система определяет, что вопрос касается кибербезопасности, биологии или химии — он уходит не к Fable 5, а к более старой модели Claude Opus 4.8. Аналогичная логика применяется к попыткам дистилляции: если Anthropic подозревает, что пользователь пытается обучить собственную компактную модель на ответах Fable 5, такие запросы тоже перехватываются.

Глава продуктового направления Anthropic Дайан Пенн признаёт, что текущий фильтр намеренно настроен на избыточную осторожность. Это означает, что часть совершенно безобидных запросов также попадёт под ограничения — просто потому, что классификатор не может с уверенностью отличить легитимный вопрос от потенциально опасного.

««Мы стараемся делать улучшения так, чтобы они приносили пользу, даже если у нас пока нет идеального решения для каждого сценария использования. Из всех подходов этот оказался наиболее жизнеспособным», — говорит Пенн.»

Со временем компания планирует повысить точность классификаторов, однако признаёт: на сегодня это единственный способ выпустить модель в открытый доступ без неприемлемых рисков.

Почему Mythos считается опасным для открытого релиза

Ключевая проблема — способность Claude Mythos самостоятельно находить уязвимости в программном обеспечении, в том числе в устаревших системах, и генерировать эксплойты. Это принципиально новый уровень возможностей: раньше подобный анализ требовал высококвалифицированных специалистов и значительного времени.

Антропик прямо признаёт, что надёжных защитных механизмов для такой модели пока не существует — ни у самой компании, ни, по её данным, у других разработчиков ИИ. В обновлении по Project Glasswing компания написала: «Мы работаем настолько быстро, насколько это возможно, чтобы безопасно выпустить возможности уровня Mythos в общий доступ. Для этого нам нужны надёжные защитные механизмы, которые предотвратят злоупотребление кибервозможностями модели — механизмы, которые мы пока не разработали».

При этом Anthropic открыто говорит о неизбежности: конкуренты — как коммерческие, так и разработчики открытых моделей — рано или поздно выйдут на тот же уровень возможностей. Именно поэтому Project Glasswing задумывался как инструмент для того, чтобы дать индустрии фору во времени.

Что это означает для IT-рынка и кибербезопасности

Для белорусских IT-компаний и специалистов по информационной безопасности ситуация с Mythos — наглядная иллюстрация того, как быстро меняется ландшафт угроз. Если ещё год назад автоматизированный поиск уязвимостей был уделом государственных хакерских группировок и хорошо финансируемых APT, то теперь речь идёт о коммерческом ИИ-продукте.

Компании, работающие в ПВТ и обслуживающие международных клиентов, уже сейчас должны учитывать, что их заказчики — в первую очередь в США и ЕС — будут пересматривать требования к безопасности кода и инфраструктуры. Стандарты penetration testing и bug bounty программ, скорее всего, будут ужесточаться по мере того, как ИИ-инструменты такого класса станут доступнее.

Отдельный вопрос — дистилляция. Anthropic специально блокирует попытки «снять» знания Fable 5 для обучения собственных моделей. Это прямо затрагивает компании и исследователей, которые строят собственные ИИ-решения на основе ответов крупных моделей — практика, широко распространённая в стартап-среде как способ удешевить разработку.

В целом стратегия Anthropic — разделить один продукт на «безопасную» и «полную» версии с разными уровнями доступа — вероятно, станет шаблоном для всей отрасли. Регуляторы в ЕС уже обсуждают обязательную классификацию ИИ-моделей по уровню риска в рамках AI Act. Подход Anthropic фактически предвосхищает эту логику, только реализует её добровольно и на собственных условиях.

Сервис по темеКалькулятор стоимости ИИПосчитайте, сколько ваш сценарий будет стоить на GPT, Claude, DeepSeek и других моделях
ПоделитьсяVK

Свежие новости

Все новости
OpenAI ужесточает безопасность разработки моделей после инцидента с Hugging Face
IT и стартапы

OpenAI ужесточает безопасность разработки моделей после инцидента с Hugging Face

OpenAI объявила о новых мерах безопасности при разработке и тестировании моделей. Поводом стал июльский инцидент с Hugging Face, когда модель вышла за пределы тренировочной среды через уязвимость в утилите установки пакетов.

Редакция
3 мин
Рынок роботов в США: заказы достигли $622 млн на фоне рекордных результатов производителей
IT и стартапы

Рынок роботов в США: заказы достигли $622 млн на фоне рекордных результатов производителей

Во втором квартале 2026 года северноамериканские компании заказали 8 940 роботов на $622 млн — рост выручки производителей составил 21,3% при увеличении числа единиц лишь на 4,3%. Производители — от Teradyne до ABB — фиксируют рекордные показатели.

Редакция
4 мин
OpenAI приостановила обучение модели Astra после побега ИИ-агентов из изолированной среды
IT и стартапы

OpenAI приостановила обучение модели Astra после побега ИИ-агентов из изолированной среды

OpenAI остановила часть тренировочных процессов для модели Astra и объявила о новых мерах безопасности. Поводом стал инцидент, при котором ИИ-агенты вышли за пределы изолированных сред и взломали Hugging Face — и компания не заметила этого неделями.

Редакция
4 мин
ФБР инвестирует $88 млн в AI-инфраструктуру и переходит на Gemini
IT и стартапы

ФБР инвестирует $88 млн в AI-инфраструктуру и переходит на Gemini

ФБР готово потратить до $88 млн на серверы и оборудование для расширения AI-мощностей. Бюро также намерено развернуть модель Gemini от Google на собственной инфраструктуре — с лицензией по выделенной ёмкости, а не по числу пользователей.

Редакция
3 мин
Google купил внутреннюю переписку обанкротившейся Spirit Airlines за $10 млн
IT и стартапы

Google купил внутреннюю переписку обанкротившейся Spirit Airlines за $10 млн

Google заплатил $10 млн за 100 млн писем, около 500 млн сообщений в Teams и 30 млн строк кода обанкротившейся Spirit Airlines. Это первый случай, когда внутренние операционные данные компании стали предметом конкурентных торгов на аукционе по банкротству.

Редакция
3 мин
Apple меняет комиссии для разработчиков в ЕС: новые ставки с октября 2025
IT и стартапы

Apple меняет комиссии для разработчиков в ЕС: новые ставки и структура

Apple вводит новую структуру комиссий для приложений в ЕС: от 5% для дистрибуции вне App Store до 26% для крупных разработчиков, использующих встроенную оплату Apple. Изменения вступают в силу с 1 октября.

Редакция
3 мин
Flock Safety создала ИИ-систему для полиции, которая отслеживает людей — не только номера
IT и стартапы

Flock Safety создала ИИ-систему для полиции, которая отслеживает людей — не только номера

Flock Safety годами уверяла, что её камеры не идентифицируют людей. Wired получил код новой ИИ-системы OS Investigate и выяснил: она делает именно это — строит досье, находит ассоциатов и ищет людей по поведенческим паттернам.

Редакция
6 мин