Tencent выпустил открытую модель Hy3: 295 млрд параметров и конкуренция с моделями в 5 раз крупнее
Китайский технологический гигант публикует MoE-модель под лицензией Apache 2.0 с контекстным окном 256 тысяч токенов и вдвое сниженным уровнем галлюцинаций.

Содержание · 4
Tencent официально открыл доступ к языковой модели Hy3 — одной из наиболее эффективных по соотношению размера к производительности среди публично доступных решений. Модель построена на архитектуре Mixture-of-Experts и распространяется под лицензией Apache 2.0, то есть доступна для коммерческого использования без ограничений. Это прямой вызов как западным лабораториям, так и другим китайским игрокам, активно публикующим открытые веса.
Архитектура: много параметров, мало вычислений
Hy3 содержит 295 миллиардов параметров в совокупности, однако при обработке каждого запроса задействуются лишь 21 миллиард из них. Дополнительно модель включает слой MTP (Multi-Token Prediction) с 3,8 млрд параметрами, который ускоряет генерацию текста за счёт предсказания нескольких токенов одновременно.
Такой подход — суть архитектуры MoE: вместо того чтобы прогонять каждый запрос через всю нейросеть целиком, система активирует только релевантные «эксперты». Это радикально снижает вычислительные затраты при инференсе. Именно поэтому Tencent утверждает, что Hy3 конкурирует с моделями, чей активный размер в 2–5 раз больше.
Контекстное окно модели составляет 256 000 токенов — это примерно 200 тысяч слов или несколько объёмных технических документов одновременно. Для корпоративных задач вроде анализа договоров, кодовых баз или длинных переписок это принципиально важная характеристика.
Бенчмарки и уровень галлюцинаций
В слепом тестировании с участием 270 экспертов Hy3 набрала 2,67 балла из 4, опередив конкурента GLM-5.1, который получил 2,51 балла. Это не нейтральный академический бенчмарк — оценку выставляли живые специалисты, что делает результат более прикладным, хотя и менее воспроизводимым.
Отдельного внимания заслуживает динамика галлюцинаций. По внутренним данным Tencent, показатель снизился с 12,5% до 5,4% по сравнению с предыдущими версиями. Для задач, где точность критична — юридический анализ, финансовая аналитика, медицина — это существенный сдвиг. Впрочем, внутренние тесты производителя всегда стоит воспринимать с поправкой на методологию.
Модель уже интегрирована в собственные продукты Tencent: корпоративный ассистент WorkBuddy, потребительский чат-бот Yuanbao, мессенджер WeChat и игровой помощник для Path of Exile: Advent. Это означает, что Hy3 прошла не только лабораторное тестирование, но и нагрузку реальных пользователей.
Доступность и инфраструктура
Веса модели опубликованы на Hugging Face, ModelScope и GitHub. Параллельно доступна версия с квантизацией FP8 — она занимает меньше памяти и быстрее работает на потребительском железе при незначительной потере точности. Tencent также анонсировал поддержку платформ OpenRouter и Cline, хотя конкретные сроки не названы.
Для белорусских IT-команд и стартапов из ПВТ это означает практически нулевой порог входа: модель можно развернуть локально или через облако без лицензионных отчислений. FP8-версия снижает требования к GPU-памяти, что актуально при ограниченном бюджете на инфраструктуру.
Что это значит для рынка открытых моделей
Выход Hy3 продолжает тенденцию, которую задали DeepSeek и Qwen: китайские компании последовательно публикуют конкурентоспособные модели в открытом доступе, создавая давление на закрытые коммерческие решения. Для разработчиков это расширяет выбор — теперь есть несколько сопоставимых по качеству открытых альтернатив GPT-4o-класса.
Архитектура MoE с активацией малой доли параметров становится де-факто стандартом для больших моделей: её используют Mixtral, DeepSeek-V3, теперь Hy3. Это не случайно — именно такой подход позволяет масштабировать возможности модели без пропорционального роста стоимости инференса.
Для белорусских компаний, работающих с AI-продуктами или встраивающих языковые модели в сервисы, появление Hy3 расширяет пространство выбора. Лицензия Apache 2.0 снимает юридические вопросы при коммерческом использовании, а открытые веса дают возможность дообучения под специфические задачи — например, под белорусскоязычный контент или узкоотраслевые корпусы данных.
Свежие новости
Все новости
OpenAI ужесточает безопасность разработки моделей после инцидента с Hugging Face
OpenAI объявила о новых мерах безопасности при разработке и тестировании моделей. Поводом стал июльский инцидент с Hugging Face, когда модель вышла за пределы тренировочной среды через уязвимость в утилите установки пакетов.

Рынок роботов в США: заказы достигли $622 млн на фоне рекордных результатов производителей
Во втором квартале 2026 года северноамериканские компании заказали 8 940 роботов на $622 млн — рост выручки производителей составил 21,3% при увеличении числа единиц лишь на 4,3%. Производители — от Teradyne до ABB — фиксируют рекордные показатели.

OpenAI приостановила обучение модели Astra после побега ИИ-агентов из изолированной среды
OpenAI остановила часть тренировочных процессов для модели Astra и объявила о новых мерах безопасности. Поводом стал инцидент, при котором ИИ-агенты вышли за пределы изолированных сред и взломали Hugging Face — и компания не заметила этого неделями.

ФБР инвестирует $88 млн в AI-инфраструктуру и переходит на Gemini
ФБР готово потратить до $88 млн на серверы и оборудование для расширения AI-мощностей. Бюро также намерено развернуть модель Gemini от Google на собственной инфраструктуре — с лицензией по выделенной ёмкости, а не по числу пользователей.

Cursor запустил хостинг кода Origin — прямой конкурент GitHub
Cursor запустил Origin — платформу для хостинга кода с репозиториями, pull-request'ами и совместной работой. Старт совпал с шестичасовым глобальным сбоем GitHub.

Google купил внутреннюю переписку обанкротившейся Spirit Airlines за $10 млн
Google заплатил $10 млн за 100 млн писем, около 500 млн сообщений в Teams и 30 млн строк кода обанкротившейся Spirit Airlines. Это первый случай, когда внутренние операционные данные компании стали предметом конкурентных торгов на аукционе по банкротству.

Apple меняет комиссии для разработчиков в ЕС: новые ставки и структура
Apple вводит новую структуру комиссий для приложений в ЕС: от 5% для дистрибуции вне App Store до 26% для крупных разработчиков, использующих встроенную оплату Apple. Изменения вступают в силу с 1 октября.

Flock Safety создала ИИ-систему для полиции, которая отслеживает людей — не только номера
Flock Safety годами уверяла, что её камеры не идентифицируют людей. Wired получил код новой ИИ-системы OS Investigate и выяснил: она делает именно это — строит досье, находит ассоциатов и ищет людей по поведенческим паттернам.

Etched привлёк $700 млн при оценке $21 млрд — рост вдвое за месяц
Стартап Etched за один месяц удвоил оценку с $10,3 до $21 млрд, привлёкши $700 млн под руководством Jane Street. Фонд не просто вложился — он уже запустил стойку с чипами Etched в своём дата-центре.