Перейти к содержимому
Digital Business BY · БЕЛАРУСЬ
НБ РБUSD3.0629EUR3.5512RUB0.0355PLN0.8194CNY0.4577Конвертер →
IT и стартапы

Thinking Machines Муради выпустила модель Inkling: лидер среди американских open-weights, но уступает Китаю

Стартап бывшего технического директора OpenAI представил первую production-ready модель с 975 млрд параметров и ставкой на файн-тюнинг под задачи бизнеса.

Казакевич Алексей
6 мин
Thinking Machines Муради выпустила модель Inkling: лидер среди американских open-weights, но уступает Китаю
Содержание · 4
  1. 01Архитектура, данные и честность о слабых местах
  2. 02Бенчмарки: сильные и слабые стороны
  3. 03Ценообразование и эффективность токенов
  4. 04Inkling-Small: меньше параметров, лучше на ряде тестов

Стартап Thinking Machines Lab, основанный бывшим техническим директором OpenAI Мирой Муради, представил свою первую полноценную языковую модель — Inkling. Это мультимодальный Mixture-of-Experts трансформер с 975 млрд параметрами, из которых одновременно активны лишь 41 млрд. Модель сразу возглавила рейтинг открытых американских моделей, однако по общей производительности проигрывает лучшим китайским разработкам.

Муради — одна из ключевых фигур в истории ChatGPT: именно она руководила технической командой OpenAI в период его взрывного роста. После ухода из компании в 2024 году она основала Thinking Machines Lab, привлекла значительное финансирование и теперь делает ставку не на гонку за абсолютными бенчмарками, а на гибкость и адаптируемость модели под конкретные бизнес-задачи.

Архитектура, данные и честность о слабых местах

Inkling поддерживает текст, изображения и аудио «из коробки», без дополнительных адаптеров. Контекстное окно достигает 1 млн токенов — это один из самых широких показателей среди открытых моделей. Веса модели доступны бесплатно на Hugging Face; параллельно компания предлагает платформу Tinker для тонкой настройки под отраслевые задачи.

Модель предобучена на 45 трлн токенов — публичных и синтетических текстов, изображений, аудиозаписей и видео. Примечательно, что для генерации синтетических данных использовалась китайская модель Kimi K2.5 — та же, что легла в основу кодовой модели редактора Cursor. Thinking Machines прямо указывает в анонсе: «Inkling — не самая сильная модель из доступных сегодня». Такая откровенность нетипична для запусков в AI-индустрии и, судя по всему, является частью позиционирования: компания продаёт не сырую мощь, а управляемую кастомизацию.

Отдельный вопрос — обучающие данные. Thinking Machines признаёт, что в датасет вошли материалы, «которые могут охраняться авторским правом». Это стандартная оговорка для крупных языковых моделей, но в контексте нарастающих судебных разбирательств с правообладателями она всё менее безобидна.

Бенчмарки: сильные и слабые стороны

По данным платформы Artificial Analysis, Inkling набирает 41 балл в индексе Artificial Analysis Intelligence Index. Это лучший результат среди открытых американских моделей: ближайший конкурент, Nemotron 3 Ultra, отстаёт на 3 балла (38), Gemma 4 31B набирает 29, а gpt-oss-120b — лишь 24.

На агентном бенчмарке GDPval-AA v2, имитирующем задачи интеллектуального труда, Inkling получает рейтинг Эло 1 238 — выше, чем у Kimi K2.6 (1 190) и DeepSeek v4 Flash max (1 189). На банковском бенчмарке Tau-3 модель достигает 24%, опережая Kimi K2.6 (21%) и DeepSeek v4 Flash max (23%). Для компаний, строящих агентные системы автоматизации, это значимые цифры.

Однако есть серьёзный изъян: фактическая точность. На бенчмарке AA Omniscience Inkling набирает лишь +2, точность составляет 40%, а уровень галлюцинаций — 63%. Это делает модель малопригодной для задач, где критична достоверность: юридический анализ, медицинские рекомендации, финансовая отчётность. Для сравнения, Nemotron 3 Ultra показывает -1 по тому же индексу — то есть оба американских лидера пока уступают китайским моделям в надёжности фактов.

Ценообразование и эффективность токенов

При контекстном окне 64K токенов стоимость составляет $1,87 за млн входных токенов и $4,68 за млн выходных. Для окна до 256K цены вырастают до $3,74 и $9,36 соответственно. Это несколько дороже сопоставимых китайских моделей — GLM-5.2 и DeepSeek v4 — при схожей или более высокой производительности последних на текстовых и кодовых задачах.

Главный аргумент Thinking Machines в ответ на ценовое сравнение — экономия на выходных токенах. В среднем Inkling генерирует 25 000 токенов на задачу в Intelligence Index, тогда как GLM-5.2 max расходует 43 000, Kimi K2.6 — около 38 000, а DeepSeek v4 Pro max — около 37 000. Компания также предлагает регулируемый параметр «усилия мышления» (thinking effort): пользователь сам выбирает баланс между стоимостью и качеством ответа, снижая расход токенов без потери точности на конкретных задачах.

Inkling-Small: меньше параметров, лучше на ряде тестов

Одновременно с основной моделью Thinking Machines анонсировала Inkling-Small — компактную версию с 276 млрд параметрами (12 млрд активных). Парадоксально, но на нескольких бенчмарках она превосходит старшую модель: 88,3% против 87,2% на GPQA Diamond и 46,6% против 46,0% на HLE with tools. Компания объясняет это улучшениями в предобучающих данных и процессе тренировки. Полные веса Inkling-Small будут опубликованы после завершения тестирования.

Для белорусских IT-команд и стартапов из ПВТ, работающих с LLM-стеком, появление Inkling — ещё один аргумент в пользу диверсификации: теперь в пространстве открытых моделей есть американская альтернатива с нативной мультимодальностью и управляемым thinking effort. Вопрос в том, насколько быстро Thinking Machines закроет разрыв в фактической точности — без этого модель останется инструментом для агентной автоматизации, но не для задач с высокими требованиями к достоверности.

ПоделитьсяVK

Свежие новости

Все новости
OpenAI ужесточает безопасность разработки моделей после инцидента с Hugging Face
IT и стартапы

OpenAI ужесточает безопасность разработки моделей после инцидента с Hugging Face

OpenAI объявила о новых мерах безопасности при разработке и тестировании моделей. Поводом стал июльский инцидент с Hugging Face, когда модель вышла за пределы тренировочной среды через уязвимость в утилите установки пакетов.

Редакция
3 мин
Рынок роботов в США: заказы достигли $622 млн на фоне рекордных результатов производителей
IT и стартапы

Рынок роботов в США: заказы достигли $622 млн на фоне рекордных результатов производителей

Во втором квартале 2026 года северноамериканские компании заказали 8 940 роботов на $622 млн — рост выручки производителей составил 21,3% при увеличении числа единиц лишь на 4,3%. Производители — от Teradyne до ABB — фиксируют рекордные показатели.

Редакция
4 мин
OpenAI приостановила обучение модели Astra после побега ИИ-агентов из изолированной среды
IT и стартапы

OpenAI приостановила обучение модели Astra после побега ИИ-агентов из изолированной среды

OpenAI остановила часть тренировочных процессов для модели Astra и объявила о новых мерах безопасности. Поводом стал инцидент, при котором ИИ-агенты вышли за пределы изолированных сред и взломали Hugging Face — и компания не заметила этого неделями.

Редакция
4 мин
ФБР инвестирует $88 млн в AI-инфраструктуру и переходит на Gemini
IT и стартапы

ФБР инвестирует $88 млн в AI-инфраструктуру и переходит на Gemini

ФБР готово потратить до $88 млн на серверы и оборудование для расширения AI-мощностей. Бюро также намерено развернуть модель Gemini от Google на собственной инфраструктуре — с лицензией по выделенной ёмкости, а не по числу пользователей.

Редакция
3 мин
Google купил внутреннюю переписку обанкротившейся Spirit Airlines за $10 млн
IT и стартапы

Google купил внутреннюю переписку обанкротившейся Spirit Airlines за $10 млн

Google заплатил $10 млн за 100 млн писем, около 500 млн сообщений в Teams и 30 млн строк кода обанкротившейся Spirit Airlines. Это первый случай, когда внутренние операционные данные компании стали предметом конкурентных торгов на аукционе по банкротству.

Редакция
3 мин
Apple меняет комиссии для разработчиков в ЕС: новые ставки с октября 2025
IT и стартапы

Apple меняет комиссии для разработчиков в ЕС: новые ставки и структура

Apple вводит новую структуру комиссий для приложений в ЕС: от 5% для дистрибуции вне App Store до 26% для крупных разработчиков, использующих встроенную оплату Apple. Изменения вступают в силу с 1 октября.

Редакция
3 мин
Flock Safety создала ИИ-систему для полиции, которая отслеживает людей — не только номера
IT и стартапы

Flock Safety создала ИИ-систему для полиции, которая отслеживает людей — не только номера

Flock Safety годами уверяла, что её камеры не идентифицируют людей. Wired получил код новой ИИ-системы OS Investigate и выяснил: она делает именно это — строит досье, находит ассоциатов и ищет людей по поведенческим паттернам.

Редакция
6 мин