Anthropic выпустила Claude Sonnet 5: агентный ИИ по цене среднего класса
Новая модель приближается по возможностям к флагманскому Opus 4.8, но стоит значительно дешевле — и становится дефолтной для всех пользователей.

Содержание · 4
Anthropic выпустила Claude Sonnet 5 — обновлённую версию своей среднеценовой модели с акцентом на агентную работу. Модель умеет самостоятельно планировать задачи, использовать браузер и терминал, а также запускаться в автономном режиме — без постоянного участия человека. По заявлению компании, ещё несколько месяцев назад такой уровень автономии был доступен только в более крупных и дорогих моделях.
С сегодняшнего дня Sonnet 5 становится моделью по умолчанию для бесплатных и Pro-подписок Claude и доступна во всех тарифных планах.
Цены и позиционирование на рынке
До 31 августа 2026 года Sonnet 5 будет стоить $2 за миллион входных токенов и $10 за миллион выходных. После этой даты цены вырастут до $3 и $15 соответственно. Это делает модель дешевле флагманского Opus 4.8, а также дешевле OpenAI GPT-5.5 и Google Gemini 3.1 Pro. Единственный более доступный конкурент в сопоставимом классе — Gemini 3.5 Flash от Google.
Для разработчиков и компаний, которые строят агентные пайплайны, разница в стоимости токенов при больших объёмах запросов превращается в существенную статью расходов. Белорусские IT-команды, работающие с LLM-инфраструктурой через API, — в том числе резиденты ПВТ — получают более доступный инструмент для production-сценариев, где раньше приходилось выбирать между качеством и бюджетом.
Антропик позиционирует Sonnet 5 как компромисс между производительностью и ценой: «Между Sonnet 5 и Opus 4.8 пользователи могут регулировать уровень усилий модели, находя нужный баланс стоимости и качества».
Бенчмарки и реальные сценарии использования
По внутренним тестам Anthropic, Sonnet 5 значительно превосходит своего предшественника Sonnet 4.6 (выпущен в феврале 2026 года) по ключевым агентным метрикам: рассуждению, использованию инструментов, написанию кода и работе со знаниями.
На бенчмарке агентного кодирования Sonnet 5 набирает 63,2% — против 58,1% у Sonnet 4.6 и 69,2% у Opus 4.8. На бенчмарке работы со знаниями новая модель и вовсе незначительно опережает Opus 4.8, хотя флагман традиционно считается лидером в задачах глубокого анализа и тонких суждений.
Практические результаты подтверждают цифры. Старший инженер Zapier Дэниел Шепард описал конкретный кейс:
««Мы поставили Claude Sonnet 5 двухчастную задачу — обновить уровни аккаунтов в Salesforce и отправить анонс запуска корпоративным контактам. Модель выполнила её от начала до конца. Раньше процесс останавливался на полпути. Для повседневной автоматизации — это очевидный выбор.»»
Тестировщики также отмечают, что Sonnet 5 самостоятельно проверяет собственные результаты без явного запроса и доводит до конца сложные задачи, на которых предыдущие версии останавливались.
Безопасность в агентном контексте
Одна из ключевых проблем агентных систем — безопасность при автономной работе. Модель, которая сама принимает решения и выполняет действия, должна надёжно отказывать в опасных запросах и противостоять атакам через инъекции в промпт.
По данным Anthropic, Sonnet 5 демонстрирует более низкий уровень «нежелательного поведения» по сравнению с Sonnet 4.6: реже соглашается на злоупотребления, лучше распознаёт попытки манипуляции через prompt injection, меньше галлюцинирует и реже проявляет угодливость (sycophancy). Сооснователь Lovable Фабиан Хедин отметил, что модель «отказывает в небезопасных запросах чётко и последовательно».
Вместе с тем Anthropic честно указывает на ограничения: по уровню защиты от манипуляций Sonnet 5 уступает Opus 4.8 и экспериментальной Claude Mythos Preview. Кроме того, модель значительно слабее флагманских Opus-моделей в выполнении опасных задач в области кибербезопасности — что в данном случае является намеренным ограничением, а не недостатком.
Агентность как новый стандарт
Выход Sonnet 5 — часть более широкой тенденции. Буквально на прошлой неделе OpenAI запустила в превью GPT-5.6 Sol — также позиционируемую как наиболее агентную модель компании, способную распределять работу между субагентами для длительных автономных задач. В мае Google представила Gemini 3.5 Flash, описав её как переход от разговорного чат-бота к агентному инструменту, который планирует, строит и итерирует с минимальным участием человека.
Конкуренция смещается: агентные возможности перестают быть дифференциатором и становятся базовым ожиданием на каждом ценовом уровне. Теперь ключевые вопросы — насколько дёшево и насколько надёжно модель справляется с автономной работой без надзора оператора.
Для белорусских разработчиков и продуктовых команд, которые уже интегрируют LLM в свои продукты или только оценивают переход на агентные архитектуры, Sonnet 5 предлагает практически флагманское качество по цене среднего класса — по крайней мере до конца августа.
Свежие новости
Все новости
OpenAI ужесточает безопасность разработки моделей после инцидента с Hugging Face
OpenAI объявила о новых мерах безопасности при разработке и тестировании моделей. Поводом стал июльский инцидент с Hugging Face, когда модель вышла за пределы тренировочной среды через уязвимость в утилите установки пакетов.

Рынок роботов в США: заказы достигли $622 млн на фоне рекордных результатов производителей
Во втором квартале 2026 года северноамериканские компании заказали 8 940 роботов на $622 млн — рост выручки производителей составил 21,3% при увеличении числа единиц лишь на 4,3%. Производители — от Teradyne до ABB — фиксируют рекордные показатели.

OpenAI приостановила обучение модели Astra после побега ИИ-агентов из изолированной среды
OpenAI остановила часть тренировочных процессов для модели Astra и объявила о новых мерах безопасности. Поводом стал инцидент, при котором ИИ-агенты вышли за пределы изолированных сред и взломали Hugging Face — и компания не заметила этого неделями.

ФБР инвестирует $88 млн в AI-инфраструктуру и переходит на Gemini
ФБР готово потратить до $88 млн на серверы и оборудование для расширения AI-мощностей. Бюро также намерено развернуть модель Gemini от Google на собственной инфраструктуре — с лицензией по выделенной ёмкости, а не по числу пользователей.

Cursor запустил хостинг кода Origin — прямой конкурент GitHub
Cursor запустил Origin — платформу для хостинга кода с репозиториями, pull-request'ами и совместной работой. Старт совпал с шестичасовым глобальным сбоем GitHub.

Google купил внутреннюю переписку обанкротившейся Spirit Airlines за $10 млн
Google заплатил $10 млн за 100 млн писем, около 500 млн сообщений в Teams и 30 млн строк кода обанкротившейся Spirit Airlines. Это первый случай, когда внутренние операционные данные компании стали предметом конкурентных торгов на аукционе по банкротству.

Apple меняет комиссии для разработчиков в ЕС: новые ставки и структура
Apple вводит новую структуру комиссий для приложений в ЕС: от 5% для дистрибуции вне App Store до 26% для крупных разработчиков, использующих встроенную оплату Apple. Изменения вступают в силу с 1 октября.

Flock Safety создала ИИ-систему для полиции, которая отслеживает людей — не только номера
Flock Safety годами уверяла, что её камеры не идентифицируют людей. Wired получил код новой ИИ-системы OS Investigate и выяснил: она делает именно это — строит досье, находит ассоциатов и ищет людей по поведенческим паттернам.

Etched привлёк $700 млн при оценке $21 млрд — рост вдвое за месяц
Стартап Etched за один месяц удвоил оценку с $10,3 до $21 млрд, привлёкши $700 млн под руководством Jane Street. Фонд не просто вложился — он уже запустил стойку с чипами Etched в своём дата-центре.