Перейти к содержимому
Digital Business BY · БЕЛАРУСЬ
НБ РБUSD3.0228EUR3.4879RUB0.0360PLN0.8027CNY0.4515Конвертер →
IT и стартапы

Anthropic выпустила Claude Sonnet 5: агентный ИИ по цене среднего класса

Новая модель приближается по возможностям к флагманскому Opus 4.8, но стоит значительно дешевле — и становится дефолтной для всех пользователей.

Казакевич Алексей
5 мин
Обновлено 21 июля
Anthropic выпустила Claude Sonnet 5: агентный ИИ по цене среднего класса
TechCrunch
Содержание · 4
  1. 01Цены и позиционирование на рынке
  2. 02Бенчмарки и реальные сценарии использования
  3. 03Безопасность в агентном контексте
  4. 04Агентность как новый стандарт

Anthropic выпустила Claude Sonnet 5 — обновлённую версию своей среднеценовой модели с акцентом на агентную работу. Модель умеет самостоятельно планировать задачи, использовать браузер и терминал, а также запускаться в автономном режиме — без постоянного участия человека. По заявлению компании, ещё несколько месяцев назад такой уровень автономии был доступен только в более крупных и дорогих моделях.

С сегодняшнего дня Sonnet 5 становится моделью по умолчанию для бесплатных и Pro-подписок Claude и доступна во всех тарифных планах.

Цены и позиционирование на рынке

До 31 августа 2026 года Sonnet 5 будет стоить $2 за миллион входных токенов и $10 за миллион выходных. После этой даты цены вырастут до $3 и $15 соответственно. Это делает модель дешевле флагманского Opus 4.8, а также дешевле OpenAI GPT-5.5 и Google Gemini 3.1 Pro. Единственный более доступный конкурент в сопоставимом классе — Gemini 3.5 Flash от Google.

Для разработчиков и компаний, которые строят агентные пайплайны, разница в стоимости токенов при больших объёмах запросов превращается в существенную статью расходов. Белорусские IT-команды, работающие с LLM-инфраструктурой через API, — в том числе резиденты ПВТ — получают более доступный инструмент для production-сценариев, где раньше приходилось выбирать между качеством и бюджетом.

Антропик позиционирует Sonnet 5 как компромисс между производительностью и ценой: «Между Sonnet 5 и Opus 4.8 пользователи могут регулировать уровень усилий модели, находя нужный баланс стоимости и качества».

Бенчмарки и реальные сценарии использования

По внутренним тестам Anthropic, Sonnet 5 значительно превосходит своего предшественника Sonnet 4.6 (выпущен в феврале 2026 года) по ключевым агентным метрикам: рассуждению, использованию инструментов, написанию кода и работе со знаниями.

На бенчмарке агентного кодирования Sonnet 5 набирает 63,2% — против 58,1% у Sonnet 4.6 и 69,2% у Opus 4.8. На бенчмарке работы со знаниями новая модель и вовсе незначительно опережает Opus 4.8, хотя флагман традиционно считается лидером в задачах глубокого анализа и тонких суждений.

Практические результаты подтверждают цифры. Старший инженер Zapier Дэниел Шепард описал конкретный кейс:

««Мы поставили Claude Sonnet 5 двухчастную задачу — обновить уровни аккаунтов в Salesforce и отправить анонс запуска корпоративным контактам. Модель выполнила её от начала до конца. Раньше процесс останавливался на полпути. Для повседневной автоматизации — это очевидный выбор.»»

Тестировщики также отмечают, что Sonnet 5 самостоятельно проверяет собственные результаты без явного запроса и доводит до конца сложные задачи, на которых предыдущие версии останавливались.

Безопасность в агентном контексте

Одна из ключевых проблем агентных систем — безопасность при автономной работе. Модель, которая сама принимает решения и выполняет действия, должна надёжно отказывать в опасных запросах и противостоять атакам через инъекции в промпт.

По данным Anthropic, Sonnet 5 демонстрирует более низкий уровень «нежелательного поведения» по сравнению с Sonnet 4.6: реже соглашается на злоупотребления, лучше распознаёт попытки манипуляции через prompt injection, меньше галлюцинирует и реже проявляет угодливость (sycophancy). Сооснователь Lovable Фабиан Хедин отметил, что модель «отказывает в небезопасных запросах чётко и последовательно».

Вместе с тем Anthropic честно указывает на ограничения: по уровню защиты от манипуляций Sonnet 5 уступает Opus 4.8 и экспериментальной Claude Mythos Preview. Кроме того, модель значительно слабее флагманских Opus-моделей в выполнении опасных задач в области кибербезопасности — что в данном случае является намеренным ограничением, а не недостатком.

Агентность как новый стандарт

Выход Sonnet 5 — часть более широкой тенденции. Буквально на прошлой неделе OpenAI запустила в превью GPT-5.6 Sol — также позиционируемую как наиболее агентную модель компании, способную распределять работу между субагентами для длительных автономных задач. В мае Google представила Gemini 3.5 Flash, описав её как переход от разговорного чат-бота к агентному инструменту, который планирует, строит и итерирует с минимальным участием человека.

Конкуренция смещается: агентные возможности перестают быть дифференциатором и становятся базовым ожиданием на каждом ценовом уровне. Теперь ключевые вопросы — насколько дёшево и насколько надёжно модель справляется с автономной работой без надзора оператора.

Для белорусских разработчиков и продуктовых команд, которые уже интегрируют LLM в свои продукты или только оценивают переход на агентные архитектуры, Sonnet 5 предлагает практически флагманское качество по цене среднего класса — по крайней мере до конца августа.

Сервис по темеКалькулятор стоимости ИИПосчитайте, сколько ваш сценарий будет стоить на GPT, Claude, DeepSeek и других моделях
ПоделитьсяVK

Свежие новости

Все новости
OpenAI ужесточает безопасность разработки моделей после инцидента с Hugging Face
IT и стартапы

OpenAI ужесточает безопасность разработки моделей после инцидента с Hugging Face

OpenAI объявила о новых мерах безопасности при разработке и тестировании моделей. Поводом стал июльский инцидент с Hugging Face, когда модель вышла за пределы тренировочной среды через уязвимость в утилите установки пакетов.

Редакция
3 мин
Рынок роботов в США: заказы достигли $622 млн на фоне рекордных результатов производителей
IT и стартапы

Рынок роботов в США: заказы достигли $622 млн на фоне рекордных результатов производителей

Во втором квартале 2026 года северноамериканские компании заказали 8 940 роботов на $622 млн — рост выручки производителей составил 21,3% при увеличении числа единиц лишь на 4,3%. Производители — от Teradyne до ABB — фиксируют рекордные показатели.

Редакция
4 мин
OpenAI приостановила обучение модели Astra после побега ИИ-агентов из изолированной среды
IT и стартапы

OpenAI приостановила обучение модели Astra после побега ИИ-агентов из изолированной среды

OpenAI остановила часть тренировочных процессов для модели Astra и объявила о новых мерах безопасности. Поводом стал инцидент, при котором ИИ-агенты вышли за пределы изолированных сред и взломали Hugging Face — и компания не заметила этого неделями.

Редакция
4 мин
ФБР инвестирует $88 млн в AI-инфраструктуру и переходит на Gemini
IT и стартапы

ФБР инвестирует $88 млн в AI-инфраструктуру и переходит на Gemini

ФБР готово потратить до $88 млн на серверы и оборудование для расширения AI-мощностей. Бюро также намерено развернуть модель Gemini от Google на собственной инфраструктуре — с лицензией по выделенной ёмкости, а не по числу пользователей.

Редакция
3 мин
Google купил внутреннюю переписку обанкротившейся Spirit Airlines за $10 млн
IT и стартапы

Google купил внутреннюю переписку обанкротившейся Spirit Airlines за $10 млн

Google заплатил $10 млн за 100 млн писем, около 500 млн сообщений в Teams и 30 млн строк кода обанкротившейся Spirit Airlines. Это первый случай, когда внутренние операционные данные компании стали предметом конкурентных торгов на аукционе по банкротству.

Редакция
3 мин
Apple меняет комиссии для разработчиков в ЕС: новые ставки с октября 2025
IT и стартапы

Apple меняет комиссии для разработчиков в ЕС: новые ставки и структура

Apple вводит новую структуру комиссий для приложений в ЕС: от 5% для дистрибуции вне App Store до 26% для крупных разработчиков, использующих встроенную оплату Apple. Изменения вступают в силу с 1 октября.

Редакция
3 мин
Flock Safety создала ИИ-систему для полиции, которая отслеживает людей — не только номера
IT и стартапы

Flock Safety создала ИИ-систему для полиции, которая отслеживает людей — не только номера

Flock Safety годами уверяла, что её камеры не идентифицируют людей. Wired получил код новой ИИ-системы OS Investigate и выяснил: она делает именно это — строит досье, находит ассоциатов и ищет людей по поведенческим паттернам.

Редакция
6 мин