Kimi выпустила открытую модель K3 на 2,8 трлн параметров — и подняла цены вслед за западными конкурентами
Китайский стартап Moonshot AI представил флагман K3, который вплотную приближается к GPT-5.6 Sol и Claude Fable 5, но стоит уже не так дёшево, как прежние китайские модели.

Содержание · 2
Китайский стартап Moonshot AI официально представил языковую модель Kimi K3 — мультимодального флагмана с 2,8 триллиона параметров и контекстным окном в 1 миллион токенов. По собственным бенчмаркам компании, K3 уступает лишь двум моделям в мире — Claude Fable 5 и GPT-5.6 Sol. При этом цены на новую модель выросли настолько резко, что разговоры о «сверхдешёвом китайском ИИ» теперь звучат анахронизмом.
Модель уже доступна через веб-интерфейс Kimi.com, мобильные приложения для iOS, Android и HarmonyOS, а также через десктопный клиент Kimi Work версии 3.1.0 и выше. Открытые веса планируется опубликовать до 27 июля 2025 года.
Что показывают независимые тесты
Независимая лаборатория Artificial Analysis подтвердила высокие результаты K3, хотя и с оговорками. На Artificial Analysis Intelligence Index модель набрала 57 баллов — столько же, сколько Claude Opus 4.8 и GPT-5.5, но меньше, чем Claude Fable 5 (60) и GPT-5.6 Sol (59). Таким образом, K3 занимает четвёртое место в общем рейтинге.
На агентных задачах картина более впечатляющая. K3 получила рейтинг Elo 1 668 на GDPval v2 — это значительный скачок с 1 190 у предшественника K2.6. Модель обогнала GLM-5.2 (1 514), GPT-5.5 (1 494) и Claude Opus 4.8 (1 600), хотя до Claude Fable 5 с его 1 760 пока не дотягивается.
Artificial Analysis особо отметила рост точности K3: показатель на AA-Omniscience Index вырос с 33% до 46%, а общий балл — с +6 до +18. Однако одновременно поднялся и уровень галлюцинаций — с 39% до 51%. Иными словами, модель стала давать больше правильных ответов, но и чаще выдумывает несуществующие факты. Для задач, где критична точность — юридические документы, финансовая аналитика, технические спецификации — это существенный изъян.
По стоимости одной задачи на Intelligence Index K3 обходится в среднем $0,94, что сопоставимо с GPT-5.6 Sol ($1,04) и примерно вдвое дешевле Opus 4.8 ($1,80). Открытые конкуренты — DeepSeek V4 Pro ($0,04) и GLM-5.2 ($0,32) — по-прежнему значительно дешевле.
Архитектура и ценовая политика: конец дешёвого китайского ИИ
С технической точки зрения K3 построена на архитектуре mixture-of-experts: из 896 экспертов одновременно активируются только 16. Это позволяет держать вычислительные затраты на инференс в разумных пределах при огромном общем числе параметров. Кроме того, Kimi представила собственную архитектуру внимания — Kimi Delta Attention, которая, по заявлению компании, ускоряет декодирование в контекстах на миллион токенов до 6,3 раза. «Остатки внимания» (attention residuals) повышают эффективность обучения примерно на 25% при менее чем 2% дополнительных вычислительных затрат.
Основной сценарий применения — долгосрочная разработка программного обеспечения с минимальным участием человека. Модель умеет анализировать крупные кодовые базы, управлять терминальными инструментами и удерживать контекст задачи на протяжении многих шагов. Kimi называет систему обратной связи через скриншоты «Vision in the Loop» и позиционирует её для разработки игр, UI-дизайна и CAD. В качестве демонстрации компания показала процедурно сгенерированный 3D-мир в браузере на базе Three.js и WebGPU, симуляцию запуска ракеты «Великий поход 10» и эмулятор Game Boy Advance.
Теперь о ценах — и здесь начинается самое интересное. За 1 млн входных токенов K3 берёт $0,30 при попадании в кэш и $3,00 без него. За 1 млн выходных токенов (включая рассуждения) — $15,00. Для сравнения: предшественник K2.6 стоил $0,16/$0,95 на вход и $4,00 на выход. Рост цены на выходные токены — почти в четыре раза.
Примечательно, что K3 теперь стоит ровно столько же, сколько Claude Sonnet 5 от Anthropic — $3,00 за входные и $15,00 за выходные токены, — хотя по производительности превосходит его. Топовые западные модели по-прежнему дороже: Claude Fable 5 обходится в $10/$50, GPT-5.6 Sol — в $5/$30 за миллион токенов без кэша. Тем не менее эпоха, когда китайские провайдеры демпинговали на порядок, судя по всему, заканчивается.
Для белорусских IT-команд и стартапов из ПВТ, которые строят агентные пайплайны или интегрируют LLM в продукты, смена ценовой логики важна: если раньше китайские модели были очевидным выбором для бюджетных решений, теперь разрыв с западными конкурентами сократился до нескольких раз, а не на порядок. При этом K3 остаётся открытой моделью — после публикации весов её можно будет развернуть самостоятельно, что принципиально меняет экономику для тех, кто готов инвестировать в собственную инфраструктуру.
Для корпоративных клиентов Kimi готовит отдельную платформу Kimi Hosted Agent с изолированными средами для долгосрочных задач. Запись в лист ожидания уже открыта. На OpenRouter модель доступна под идентификатором `moonshotai/kimi-k3`, однако пока обслуживается только через инфраструктуру самого Moonshot.
Свежие новости
Все новости
OpenAI ужесточает безопасность разработки моделей после инцидента с Hugging Face
OpenAI объявила о новых мерах безопасности при разработке и тестировании моделей. Поводом стал июльский инцидент с Hugging Face, когда модель вышла за пределы тренировочной среды через уязвимость в утилите установки пакетов.

Рынок роботов в США: заказы достигли $622 млн на фоне рекордных результатов производителей
Во втором квартале 2026 года северноамериканские компании заказали 8 940 роботов на $622 млн — рост выручки производителей составил 21,3% при увеличении числа единиц лишь на 4,3%. Производители — от Teradyne до ABB — фиксируют рекордные показатели.

OpenAI приостановила обучение модели Astra после побега ИИ-агентов из изолированной среды
OpenAI остановила часть тренировочных процессов для модели Astra и объявила о новых мерах безопасности. Поводом стал инцидент, при котором ИИ-агенты вышли за пределы изолированных сред и взломали Hugging Face — и компания не заметила этого неделями.

ФБР инвестирует $88 млн в AI-инфраструктуру и переходит на Gemini
ФБР готово потратить до $88 млн на серверы и оборудование для расширения AI-мощностей. Бюро также намерено развернуть модель Gemini от Google на собственной инфраструктуре — с лицензией по выделенной ёмкости, а не по числу пользователей.

Cursor запустил хостинг кода Origin — прямой конкурент GitHub
Cursor запустил Origin — платформу для хостинга кода с репозиториями, pull-request'ами и совместной работой. Старт совпал с шестичасовым глобальным сбоем GitHub.

Google купил внутреннюю переписку обанкротившейся Spirit Airlines за $10 млн
Google заплатил $10 млн за 100 млн писем, около 500 млн сообщений в Teams и 30 млн строк кода обанкротившейся Spirit Airlines. Это первый случай, когда внутренние операционные данные компании стали предметом конкурентных торгов на аукционе по банкротству.

Apple меняет комиссии для разработчиков в ЕС: новые ставки и структура
Apple вводит новую структуру комиссий для приложений в ЕС: от 5% для дистрибуции вне App Store до 26% для крупных разработчиков, использующих встроенную оплату Apple. Изменения вступают в силу с 1 октября.

Flock Safety создала ИИ-систему для полиции, которая отслеживает людей — не только номера
Flock Safety годами уверяла, что её камеры не идентифицируют людей. Wired получил код новой ИИ-системы OS Investigate и выяснил: она делает именно это — строит досье, находит ассоциатов и ищет людей по поведенческим паттернам.

Etched привлёк $700 млн при оценке $21 млрд — рост вдвое за месяц
Стартап Etched за один месяц удвоил оценку с $10,3 до $21 млрд, привлёкши $700 млн под руководством Jane Street. Фонд не просто вложился — он уже запустил стойку с чипами Etched в своём дата-центре.