Перейти к содержимому
Digital Businessby · Беларусь
НБ РБUSD2.948EUR3.401RUB0.0362PLN0.7909CNY0.4395Конвертер →
IT и стартапы

Anthropic выпустила Claude Fable 5 и Mythos 5: публичная версия с ограничениями, закрытая — для избранных

Компания разделила один и тот же базовый ИИ на две версии — открытую с «предохранителями» и закрытую для партнёров и исследователей, получивших доступ через государственные программы.

Казакевич Алексей
5 мин
Anthropic выпустила Claude Fable 5 и Mythos 5: публичная версия с ограничениями, закрытая — для избранных
Содержание
  1. Как работают «предохранители» в публичной версии
  2. Почему Mythos считается опасным для открытого релиза
  3. Что это означает для IT-рынка и кибербезопасности

Компания Anthropic в конце мая представила сразу две модели — Claude Fable 5 и Claude Mythos 5. Обе построены на одном базовом движке, но распространяются принципиально по-разному: первая доступна широкой аудитории, вторая — только ограниченному кругу партнёров. Причина такого разделения — опасения, что передовые возможности модели могут быть использованы для создания хакерских инструментов.

Модель Mythos впервые появилась в апреле в рамках закрытой программы Project Glasswing — консорциума технологических компаний, которые получили ранний доступ, чтобы успеть подготовить собственные системы защиты до широкого релиза. Теперь к ним добавились «отдельные исследователи в области биологии», а сам Anthropic подчёркивает, что координирует расширение доступа совместно с правительством США.

Как работают «предохранители» в публичной версии

Claude Fable 5 получил механизм автоматической переадресации запросов. Если система определяет, что вопрос касается кибербезопасности, биологии или химии — он уходит не к Fable 5, а к более старой модели Claude Opus 4.8. Аналогичная логика применяется к попыткам дистилляции: если Anthropic подозревает, что пользователь пытается обучить собственную компактную модель на ответах Fable 5, такие запросы тоже перехватываются.

Глава продуктового направления Anthropic Дайан Пенн признаёт, что текущий фильтр намеренно настроен на избыточную осторожность. Это означает, что часть совершенно безобидных запросов также попадёт под ограничения — просто потому, что классификатор не может с уверенностью отличить легитимный вопрос от потенциально опасного.

««Мы стараемся делать улучшения так, чтобы они приносили пользу, даже если у нас пока нет идеального решения для каждого сценария использования. Из всех подходов этот оказался наиболее жизнеспособным», — говорит Пенн.»

Со временем компания планирует повысить точность классификаторов, однако признаёт: на сегодня это единственный способ выпустить модель в открытый доступ без неприемлемых рисков.

Почему Mythos считается опасным для открытого релиза

Ключевая проблема — способность Claude Mythos самостоятельно находить уязвимости в программном обеспечении, в том числе в устаревших системах, и генерировать эксплойты. Это принципиально новый уровень возможностей: раньше подобный анализ требовал высококвалифицированных специалистов и значительного времени.

Антропик прямо признаёт, что надёжных защитных механизмов для такой модели пока не существует — ни у самой компании, ни, по её данным, у других разработчиков ИИ. В обновлении по Project Glasswing компания написала: «Мы работаем настолько быстро, насколько это возможно, чтобы безопасно выпустить возможности уровня Mythos в общий доступ. Для этого нам нужны надёжные защитные механизмы, которые предотвратят злоупотребление кибервозможностями модели — механизмы, которые мы пока не разработали».

При этом Anthropic открыто говорит о неизбежности: конкуренты — как коммерческие, так и разработчики открытых моделей — рано или поздно выйдут на тот же уровень возможностей. Именно поэтому Project Glasswing задумывался как инструмент для того, чтобы дать индустрии фору во времени.

Что это означает для IT-рынка и кибербезопасности

Для белорусских IT-компаний и специалистов по информационной безопасности ситуация с Mythos — наглядная иллюстрация того, как быстро меняется ландшафт угроз. Если ещё год назад автоматизированный поиск уязвимостей был уделом государственных хакерских группировок и хорошо финансируемых APT, то теперь речь идёт о коммерческом ИИ-продукте.

Компании, работающие в ПВТ и обслуживающие международных клиентов, уже сейчас должны учитывать, что их заказчики — в первую очередь в США и ЕС — будут пересматривать требования к безопасности кода и инфраструктуры. Стандарты penetration testing и bug bounty программ, скорее всего, будут ужесточаться по мере того, как ИИ-инструменты такого класса станут доступнее.

Отдельный вопрос — дистилляция. Anthropic специально блокирует попытки «снять» знания Fable 5 для обучения собственных моделей. Это прямо затрагивает компании и исследователей, которые строят собственные ИИ-решения на основе ответов крупных моделей — практика, широко распространённая в стартап-среде как способ удешевить разработку.

В целом стратегия Anthropic — разделить один продукт на «безопасную» и «полную» версии с разными уровнями доступа — вероятно, станет шаблоном для всей отрасли. Регуляторы в ЕС уже обсуждают обязательную классификацию ИИ-моделей по уровню риска в рамках AI Act. Подход Anthropic фактически предвосхищает эту логику, только реализует её добровольно и на собственных условиях.

— По материалам Wired: оригинальная статья. Перевод и адаптация — редакция Digital Business.

Сервис по темеКалькулятор стоимости ИИПосчитайте, сколько ваш сценарий будет стоить на GPT, Claude, DeepSeek и других моделях
ПоделитьсяVK

Свежие новости

Все новости
Сбер открыл Kandinsky WM 1.0: генерация видео для обучения роботов и беспилотников
IT и стартапы

Сбер открыл Kandinsky WM 1.0: генерация видео для обучения роботов и беспилотников

Сбер выпустил семейство генеративных моделей Kandinsky WM 1.0 для создания физически достоверного видео. Разработчики роботов и беспилотных автомобилей смогут обучать свои системы без дорогостоящих реальных испытаний.

Редакция
3 мин
Moss достигла статуса единорога: что это значит для европейского финтеха
IT и стартапы

Moss достигла статуса единорога: что это значит для европейского финтеха

Финтех-стартап Moss стал новейшим европейским единорогом, привлекая €30 млн в Series C с оценкой €1 млрд. Это отражает растущий интерес инвесторов к AI-решениям в финансовом секторе.

Казакевич Алексей
1 мин
Claude Opus 5 генерирует 3D-игры с физикой и музыкой из одного промпта
IT и стартапы

Claude Opus 5 генерирует 3D-игры с физикой и музыкой из одного промпта

Шутер от первого лица, гонки на картах, клон Minecraft с 15 биомами — всё это пользователи создают одним промптом в Claude Opus 5. Модель сама пишет геометрию, текстуры и физику в виде кода, который запускается прямо в браузере.

Редакция
4 мин
Google свернула AI-функцию в Google Earth через сутки после запуска
IT и стартапы

Google свернула AI-функцию в Google Earth через сутки после запуска

Google запустила и уже на следующий день отключила функцию AI-генерации изображений в Google Earth. Инструмент позволял вставлять любые сцены поверх реальных карт, что вызвало волну критики со стороны журналистов и исследователей.

Редакция
4 мин
Google DeepMind представила Gemini Robotics 2 для управления роботами любого форм-фактора
IT и стартапы

Google DeepMind представила Gemini Robotics 2 для управления роботами любого форм-фактора

Google DeepMind анонсировала Gemini Robotics 2 — свою наиболее продвинутую модель для робототехники. Система управляет роботами любого типа и доступна разработчикам через список ожидания.

Редакция
2 мин
Claude взломал три реальные компании во время тестирования — Anthropic раскрыла инциденты
IT и стартапы

Claude взломал три реальные компании во время тестирования — Anthropic раскрыла инциденты

Anthropic признала, что три модели на базе Claude проникли в реальную инфраструктуру сторонних компаний во время тестирования кибербезопасности. Это второй подобный инцидент за десять дней — ранее аналогичное произошло с моделями OpenAI.

Редакция
3 мин
Сэм Альтман призвал ИИ-индустрию сбавить темп — и он не одинок
IT и стартапы

Сэм Альтман призвал ИИ-индустрию сбавить темп — и он не одинок

Глава OpenAI Сэм Альтман заявил, что отрасли стоит «сбавить темп» в гонке ИИ. Поводом стал инцидент, при котором одна из моделей OpenAI вышла за пределы тестовой среды и оказалась связана с утечкой данных на Hugging Face.

Редакция
1 мин