Перейти к содержимому
Digital Businessby · Беларусь
IT и стартапы

Kimi выпустила открытую модель K3 на 2,8 трлн параметров — и подняла цены вслед за западными конкурентами

Китайский стартап Moonshot AI представил флагман K3, который вплотную приближается к GPT-5.6 Sol и Claude Fable 5, но стоит уже не так дёшево, как прежние китайские модели.

Казакевич Алексей
6 мин
Kimi выпустила открытую модель K3 на 2,8 трлн параметров — и подняла цены вслед за западными конкурентами

Китайский стартап Moonshot AI официально представил языковую модель Kimi K3 — мультимодального флагмана с 2,8 триллиона параметров и контекстным окном в 1 миллион токенов. По собственным бенчмаркам компании, K3 уступает лишь двум моделям в мире — Claude Fable 5 и GPT-5.6 Sol. При этом цены на новую модель выросли настолько резко, что разговоры о «сверхдешёвом китайском ИИ» теперь звучат анахронизмом.

Модель уже доступна через веб-интерфейс Kimi.com, мобильные приложения для iOS, Android и HarmonyOS, а также через десктопный клиент Kimi Work версии 3.1.0 и выше. Открытые веса планируется опубликовать до 27 июля 2025 года.

Что показывают независимые тесты

Независимая лаборатория Artificial Analysis подтвердила высокие результаты K3, хотя и с оговорками. На Artificial Analysis Intelligence Index модель набрала 57 баллов — столько же, сколько Claude Opus 4.8 и GPT-5.5, но меньше, чем Claude Fable 5 (60) и GPT-5.6 Sol (59). Таким образом, K3 занимает четвёртое место в общем рейтинге.

На агентных задачах картина более впечатляющая. K3 получила рейтинг Elo 1 668 на GDPval v2 — это значительный скачок с 1 190 у предшественника K2.6. Модель обогнала GLM-5.2 (1 514), GPT-5.5 (1 494) и Claude Opus 4.8 (1 600), хотя до Claude Fable 5 с его 1 760 пока не дотягивается.

Artificial Analysis особо отметила рост точности K3: показатель на AA-Omniscience Index вырос с 33% до 46%, а общий балл — с +6 до +18. Однако одновременно поднялся и уровень галлюцинаций — с 39% до 51%. Иными словами, модель стала давать больше правильных ответов, но и чаще выдумывает несуществующие факты. Для задач, где критична точность — юридические документы, финансовая аналитика, технические спецификации — это существенный изъян.

По стоимости одной задачи на Intelligence Index K3 обходится в среднем $0,94, что сопоставимо с GPT-5.6 Sol ($1,04) и примерно вдвое дешевле Opus 4.8 ($1,80). Открытые конкуренты — DeepSeek V4 Pro ($0,04) и GLM-5.2 ($0,32) — по-прежнему значительно дешевле.

Архитектура и ценовая политика: конец дешёвого китайского ИИ

С технической точки зрения K3 построена на архитектуре mixture-of-experts: из 896 экспертов одновременно активируются только 16. Это позволяет держать вычислительные затраты на инференс в разумных пределах при огромном общем числе параметров. Кроме того, Kimi представила собственную архитектуру внимания — Kimi Delta Attention, которая, по заявлению компании, ускоряет декодирование в контекстах на миллион токенов до 6,3 раза. «Остатки внимания» (attention residuals) повышают эффективность обучения примерно на 25% при менее чем 2% дополнительных вычислительных затрат.

Основной сценарий применения — долгосрочная разработка программного обеспечения с минимальным участием человека. Модель умеет анализировать крупные кодовые базы, управлять терминальными инструментами и удерживать контекст задачи на протяжении многих шагов. Kimi называет систему обратной связи через скриншоты «Vision in the Loop» и позиционирует её для разработки игр, UI-дизайна и CAD. В качестве демонстрации компания показала процедурно сгенерированный 3D-мир в браузере на базе Three.js и WebGPU, симуляцию запуска ракеты «Великий поход 10» и эмулятор Game Boy Advance.

Теперь о ценах — и здесь начинается самое интересное. За 1 млн входных токенов K3 берёт $0,30 при попадании в кэш и $3,00 без него. За 1 млн выходных токенов (включая рассуждения) — $15,00. Для сравнения: предшественник K2.6 стоил $0,16/$0,95 на вход и $4,00 на выход. Рост цены на выходные токены — почти в четыре раза.

Примечательно, что K3 теперь стоит ровно столько же, сколько Claude Sonnet 5 от Anthropic — $3,00 за входные и $15,00 за выходные токены, — хотя по производительности превосходит его. Топовые западные модели по-прежнему дороже: Claude Fable 5 обходится в $10/$50, GPT-5.6 Sol — в $5/$30 за миллион токенов без кэша. Тем не менее эпоха, когда китайские провайдеры демпинговали на порядок, судя по всему, заканчивается.

Для белорусских IT-команд и стартапов из ПВТ, которые строят агентные пайплайны или интегрируют LLM в продукты, смена ценовой логики важна: если раньше китайские модели были очевидным выбором для бюджетных решений, теперь разрыв с западными конкурентами сократился до нескольких раз, а не на порядок. При этом K3 остаётся открытой моделью — после публикации весов её можно будет развернуть самостоятельно, что принципиально меняет экономику для тех, кто готов инвестировать в собственную инфраструктуру.

Для корпоративных клиентов Kimi готовит отдельную платформу Kimi Hosted Agent с изолированными средами для долгосрочных задач. Запись в лист ожидания уже открыта. На OpenRouter модель доступна под идентификатором `moonshotai/kimi-k3`, однако пока обслуживается только через инфраструктуру самого Moonshot.

— По материалам The Decoder: оригинальная статья. Перевод и адаптация — редакция Digital Business.

Сервис по темеКалькулятор стоимости ИИПосчитайте, сколько ваш сценарий будет стоить на GPT, Claude, DeepSeek и других моделях
Курс SOL/USDT · Binance
ПоделитьсяVK

Свежие новости

Все новости
Kimi K3: 2,8 трлн параметров, цена $15 за вывод · Digital Business