Перейти к содержимому
Digital Businessby · Беларусь
НБ РБUSD2.8805EUR3.2808RUB0.0369PLN0.7588CNY0.4256Конвертер →
IT и стартапы

Anthropic выпустила Claude Sonnet 5: агентный ИИ по цене среднего класса

Новая модель приближается по возможностям к флагманскому Opus 4.8, но стоит значительно дешевле — и становится дефолтной для всех пользователей.

Казакевич Алексей
5 мин
Обновлено 21 июля
Anthropic выпустила Claude Sonnet 5: агентный ИИ по цене среднего класса
TechCrunch
Содержание
  1. Цены и позиционирование на рынке
  2. Бенчмарки и реальные сценарии использования
  3. Безопасность в агентном контексте
  4. Агентность как новый стандарт

Anthropic выпустила Claude Sonnet 5 — обновлённую версию своей среднеценовой модели с акцентом на агентную работу. Модель умеет самостоятельно планировать задачи, использовать браузер и терминал, а также запускаться в автономном режиме — без постоянного участия человека. По заявлению компании, ещё несколько месяцев назад такой уровень автономии был доступен только в более крупных и дорогих моделях.

С сегодняшнего дня Sonnet 5 становится моделью по умолчанию для бесплатных и Pro-подписок Claude и доступна во всех тарифных планах.

Цены и позиционирование на рынке

До 31 августа 2026 года Sonnet 5 будет стоить $2 за миллион входных токенов и $10 за миллион выходных. После этой даты цены вырастут до $3 и $15 соответственно. Это делает модель дешевле флагманского Opus 4.8, а также дешевле OpenAI GPT-5.5 и Google Gemini 3.1 Pro. Единственный более доступный конкурент в сопоставимом классе — Gemini 3.5 Flash от Google.

Для разработчиков и компаний, которые строят агентные пайплайны, разница в стоимости токенов при больших объёмах запросов превращается в существенную статью расходов. Белорусские IT-команды, работающие с LLM-инфраструктурой через API, — в том числе резиденты ПВТ — получают более доступный инструмент для production-сценариев, где раньше приходилось выбирать между качеством и бюджетом.

Антропик позиционирует Sonnet 5 как компромисс между производительностью и ценой: «Между Sonnet 5 и Opus 4.8 пользователи могут регулировать уровень усилий модели, находя нужный баланс стоимости и качества».

Бенчмарки и реальные сценарии использования

По внутренним тестам Anthropic, Sonnet 5 значительно превосходит своего предшественника Sonnet 4.6 (выпущен в феврале 2026 года) по ключевым агентным метрикам: рассуждению, использованию инструментов, написанию кода и работе со знаниями.

На бенчмарке агентного кодирования Sonnet 5 набирает 63,2% — против 58,1% у Sonnet 4.6 и 69,2% у Opus 4.8. На бенчмарке работы со знаниями новая модель и вовсе незначительно опережает Opus 4.8, хотя флагман традиционно считается лидером в задачах глубокого анализа и тонких суждений.

Практические результаты подтверждают цифры. Старший инженер Zapier Дэниел Шепард описал конкретный кейс:

««Мы поставили Claude Sonnet 5 двухчастную задачу — обновить уровни аккаунтов в Salesforce и отправить анонс запуска корпоративным контактам. Модель выполнила её от начала до конца. Раньше процесс останавливался на полпути. Для повседневной автоматизации — это очевидный выбор.»»

Тестировщики также отмечают, что Sonnet 5 самостоятельно проверяет собственные результаты без явного запроса и доводит до конца сложные задачи, на которых предыдущие версии останавливались.

Безопасность в агентном контексте

Одна из ключевых проблем агентных систем — безопасность при автономной работе. Модель, которая сама принимает решения и выполняет действия, должна надёжно отказывать в опасных запросах и противостоять атакам через инъекции в промпт.

По данным Anthropic, Sonnet 5 демонстрирует более низкий уровень «нежелательного поведения» по сравнению с Sonnet 4.6: реже соглашается на злоупотребления, лучше распознаёт попытки манипуляции через prompt injection, меньше галлюцинирует и реже проявляет угодливость (sycophancy). Сооснователь Lovable Фабиан Хедин отметил, что модель «отказывает в небезопасных запросах чётко и последовательно».

Вместе с тем Anthropic честно указывает на ограничения: по уровню защиты от манипуляций Sonnet 5 уступает Opus 4.8 и экспериментальной Claude Mythos Preview. Кроме того, модель значительно слабее флагманских Opus-моделей в выполнении опасных задач в области кибербезопасности — что в данном случае является намеренным ограничением, а не недостатком.

Агентность как новый стандарт

Выход Sonnet 5 — часть более широкой тенденции. Буквально на прошлой неделе OpenAI запустила в превью GPT-5.6 Sol — также позиционируемую как наиболее агентную модель компании, способную распределять работу между субагентами для длительных автономных задач. В мае Google представила Gemini 3.5 Flash, описав её как переход от разговорного чат-бота к агентному инструменту, который планирует, строит и итерирует с минимальным участием человека.

Конкуренция смещается: агентные возможности перестают быть дифференциатором и становятся базовым ожиданием на каждом ценовом уровне. Теперь ключевые вопросы — насколько дёшево и насколько надёжно модель справляется с автономной работой без надзора оператора.

Для белорусских разработчиков и продуктовых команд, которые уже интегрируют LLM в свои продукты или только оценивают переход на агентные архитектуры, Sonnet 5 предлагает практически флагманское качество по цене среднего класса — по крайней мере до конца августа.

— По материалам TechCrunch: оригинальная статья. Перевод и адаптация — редакция Digital Business.

Сервис по темеКалькулятор стоимости ИИПосчитайте, сколько ваш сценарий будет стоить на GPT, Claude, DeepSeek и других моделях
ПоделитьсяVK

Свежие новости

Все новости
Резидент ПВТ: налоговые льготы, преференции и правовое регулирование деятельности
IT и стартапыРедакция

Резидент ПВТ: налоговые льготы, преференции и правовое регулирование деятельности

Парк высоких технологий представляет собой уникальную правовую форму, которая позволяет резидентам динамично развиваться в результате применения особых правовых правил и налоговых льгот.

Kimi выпустила открытую модель K3 на 2,8 трлн параметров — и подняла цены вслед за западными конкурентами
IT и стартапы

Kimi выпустила открытую модель K3 на 2,8 трлн параметров — и подняла цены вслед за западными конкурентами

Kimi K3 — мультимодальная модель с 2,8 трлн параметров и контекстным окном в 1 млн токенов. По независимым тестам она уступает только двум топовым проприетарным моделям, однако цена на неё выросла в разы по сравнению с предшественником.

Редакция
6 мин
Си Цзиньпин на WAIC-2026: четыре принципа глобального управления ИИ и новая международная организация
IT и стартапы

Си Цзиньпин на WAIC-2026: четыре принципа глобального управления ИИ и новая международная организация

Председатель КНР выступил на WAIC-2026 с программной речью об управлении ИИ и объявил о создании Всемирной организации сотрудничества в области искусственного интеллекта — её учредили 29 стран.

Редакция
5 мин
Databricks достигла оценки $188 млрд — крупнейшей среди частных AI-компаний
IT и стартапы

Databricks достигла оценки $188 млрд — крупнейшей среди частных AI-компаний

Databricks объявила о новом раунде финансирования с оценкой $188 млрд под руководством Coatue. Сумма раунда — около $3 млрд. За 18 месяцев компания провела четыре раунда и утроила капитализацию.

Редакция
6 мин
Meta и Anthropic обсуждают аренду вычислительных мощностей на $10 млрд
IT и стартапы

Meta и Anthropic обсуждают аренду вычислительных мощностей на $10 млрд

Meta ведёт переговоры с Anthropic об аренде вычислительных мощностей своих дата-центров. По данным New York Times, сумма контракта может достичь $10 млрд за два года — и это только начало новой бизнес-модели компании.

Редакция
5 мин
Thinking Machines Муради выпустила модель Inkling: лидер среди американских open-weights, но уступает Китаю
IT и стартапы

Thinking Machines Муради выпустила модель Inkling: лидер среди американских open-weights, но уступает Китаю

Thinking Machines Lab Миры Муради выпустила Inkling — мультимодальную модель на 975 млрд параметров. Она возглавила рейтинг американских open-weights моделей, но по общей производительности уступает лучшим китайским аналогам.

Редакция
6 мин
НАН Беларуси до 2030 года: спутник с разрешением 35 см, CAR-T-терапия и беспилотный трактор
IT и стартапы

НАН Беларуси до 2030 года: спутник с разрешением 35 см, CAR-T-терапия и беспилотный трактор

Беларусь определила научные приоритеты до 2030 года: ИИ и роботизация, CAR-T-терапия рака, компьютерное моделирование лекарств и новый спутник с разрешением 35 сантиметров. НАН перестраивается из исследовательского института в технологическую корпорацию.

Редакция
6 мин
ВКонтакте и MAX исчезли из Google Play после санкций ЕС против холдинга VK
IT и стартапы

ВКонтакте и MAX исчезли из Google Play после санкций ЕС против холдинга VK

16 июля приложения ВКонтакте, MAX и Одноклассников перестали открываться в Google Play. Причина — санкции Евросоюза против холдинга VK. Акции компании в тот же день упали более чем на 7%.

Редакция
5 мин