Hunyuan 3.1: Полный обзор флагманской нейросети Tencent для текста и 3D-генерации

Подробный разбор нейросети Hunyuan 3.1 от Tencent: архитектура MoE 295B, возможности языковой модели Hy3 Preview и генератора 3D-моделей Hunyuan3D 3.1. Критерии выбора, бенчмарки, развёртывание и FAQ.

Что такое Hunyuan 3.1 и почему это два разных продукта

Под названием Hunyuan 3.1 скрываются две самостоятельные разработки Tencent: языковая модель Hy3 Preview (также известная как Hunyuan 3.0) и генератор трёхмерных моделей Hunyuan3D 3.1. Обе системы построены на архитектуре Mixture-of-Experts (MoE) и ориентированы на промышленное использование, но решают принципиально разные задачи.

Hy3 Preview — это большая языковая модель с 295 миллиардами параметров, из которых при каждом прямом проходе активируется только 21 миллиард. Она поддерживает контекст до 256 тысяч токенов и способна выполнять сложные рассуждения, писать код и работать в режиме агента. Модель была обучена с нуля за 90 дней на полностью перестроенной инфраструктуре Tencent.

Hunyuan3D 3.1 — это генератор трёхмерных моделей по текстовому описанию или изображению. Он создаёт герметичные (watertight) сетки с чистой квад-топологией, поддерживает до 1,5 миллиона полигонов и текстуры PBR разрешением до 4K. Модель использует восьмиракурсную реконструкцию для повышения точности геометрии.

Оба продукта объединяет общая философия Tencent: ориентация на реальные продуктовые сценарии, открытый исходный код и стремление к балансу между производительностью и стоимостью вычислений.

Архитектура Hy3 Preview: как устроена языковая модель

Hy3 Preview использует архитектуру Mixture-of-Experts с 192 экспертами, из которых при каждом запросе активируются 8 лучших. Это позволяет модели обрабатывать рутинные запросы через быстрые паттерны, а сложные задачи направлять на более глубокие цепочки рассуждений.

Ключевые параметры модели:

  • Общее количество параметров: 295 миллиардов
  • Активируемые параметры: 21 миллиард
  • Слой MTP (Multi-Token Prediction): 3,8 миллиарда параметров
  • Количество слоёв: 80
  • Внимание: 64 головы (GQA, 8 KV)
  • Размер скрытого слоя: 4096
  • Промежуточный размер: 13312
  • Длина контекста: 256 тысяч токенов
  • Размер словаря: 120832 токена
  • Точность: BF16

Выбор диапазона в 300 миллиардов параметров — осознанное решение команды Tencent. По их данным, при превышении примерно одного триллиона параметров задержки и пропускная способность при многоузловом развёртывании ухудшаются быстрее, чем растёт прирост качества. Поэтому Hy3 Preview намеренно ограничен по масштабу, но при этом достигает производительности, сопоставимой с более крупными моделями.

Бенчмарки Hy3 Preview: математика, код и мультиязычность

На предобученных бенчмарках Hy3 Preview демонстрирует результаты, превосходящие многие конкурирующие модели при значительно меньшем количестве активируемых параметров.

Математика:

  • MATH (4-shot): 76,28 — лучший показатель среди сравниваемых моделей
  • GSM8K (4-shot): 95,37 — также лучший результат

Код:

  • LiveCodeBench-v6: 34,86 — превосходит DeepSeek-V3 (29,31) и GLM-4.5 (27,43)
  • SWE-bench Verified: 74,4 — на уровне лучших моделей OpenAI
  • Terminal-Bench 2.0: 54,4

Мультиязычность и общие знания:

  • MMLU (5-shot): 87,42
  • MMLU-Pro (5-shot): 65,76
  • SuperGPQA (5-shot): 51,60 — лучший результат
  • MMMLU (5-shot): 80,15 — лучший результат
  • INCLUDE (5-shot): 78,64 — лучший результат

Модель также показала наивысший результат среди отечественных разработок на квалификационном экзамене по математике для аспирантов колледжа Цючжэнь университета Цинхуа, что подтверждает её способность к обобщённым рассуждениям на уровне OpenAI и DeepSeek.

Режимы рассуждения и работа с контекстом в Hy3 Preview

Hy3 Preview предлагает три режима рассуждения, которые переключаются через параметр reasoning_effort в API:

  • no_think (по умолчанию) — прямой ответ без дополнительных рассуждений, подходит для простых диалогов
  • low — лёгкий режим рассуждения для задач средней сложности
  • high — глубокое цепочечное рассуждение (deep chain-of-thought) для математики, кода и комплексных задач

Такой подход напоминает систему управления рассуждениями в моделях OpenAI и позволяет гибко настраивать поведение модели в зависимости от задачи.

Для оценки контекстного обучения команда Hunyuan разработала собственный бенчмарк CL-bench, основанный на реальных бизнес-сценариях. Он измеряет способность модели обрабатывать длинные и запутанные контексты, а также следовать сложным инструкциям. По этим показателям Hy3 Preview значительно превосходит такие модели, как Ling 2.6 Flash.

Hunyuan3D 3.1: генерация трёхмерных моделей нового поколения

Hunyuan3D 3.1 — это генератор трёхмерных моделей, который принимает на вход текстовое описание, одно изображение или до восьми ракурсов. Модель использует двухэтапную архитектуру: сначала Multi-View Diffusion генерирует несколько видов объекта, затем Sparse View Reconstruction восстанавливает геометрию и текстуры.

Ключевые возможности:

  • Восьмиракурсная реконструкция — помимо стандартных четырёх углов, добавлены верхний, нижний, левый передний и правый передний ракурсы
  • Герметичные сетки — нулевое количество отверстий и не-манифольдных рёбер, готовность к 3D-печати без ручного ремонта
  • Чистая квад-топология — оптимизированная сетка с лучшим потоком рёбер в местах сочленений
  • Умная UV-развёртка — уменьшение растяжений и швов для точного проецирования текстур
  • Улучшенная цветопередача — более точное воспроизведение цветов в картах альбедо и PBR-каналах
  • Настраиваемое количество полигонов — от 40 тысяч до 1,5 миллиона

Модель поддерживает текстуры PBR (Albedo, Normal, Roughness, Metallic) и экспорт в форматы GLB, OBJ, FBX, STL и USDZ.

Сравнение версий Hunyuan3D: 3.0, 3.1 и 3.5

Tencent выпустила несколько версий генератора 3D-моделей, каждая из которых ориентирована на разные сценарии использования.

Hunyuan3D 3.0 — базовая версия с поддержкой текста, изображений и нескольких ракурсов. Время генерации около 90 секунд, максимальное разрешение текстур 4K PBR, до 1,5 миллиона полигонов. Топология стандартная, герметичность частичная.

Hunyuan3D 3.1 — производственная версия с улучшенной геометрией. Добавлена восьмиракурсная реконструкция, гарантированная герметичность сеток, чистая квад-топология и умная UV-развёртка. Время генерации 2–3 минуты в режиме Rapid и 3–6 минут в Pro. Максимум 1,5 миллиона полигонов, текстуры 4K PBR.

Hunyuan3D 3.5 — флагманская версия с максимальной скоростью и качеством. Время генерации менее 60 секунд, текстуры до 8K PBR, до 2 миллионов полигонов. Топология стандартная, герметичность гарантирована.

Выбор между версиями зависит от приоритетов: для 3D-печати и технических задач лучше подходит 3.1, для максимальной скорости и качества — 3.5.

Развёртывание Hy3 Preview: локально и через облако

Hy3 Preview доступна для развёртывания как локально, так и через облачные сервисы. Для локального запуска рекомендуется использовать vLLM или SGLang на 8 GPU типа H20-3e или с большим объёмом памяти.

Пример запуска через vLLM:

vllm serve tencent/Hy3-preview \
  --tensor-parallel-size 8 \
  --speculative-config.method mtp \
  --speculative-config.num_speculative_tokens 1 \
  --tool-call-parser hy_v3 \
  --reasoning-parser hy_v3 \
  --served-model-name hy3-preview

Пример запуска через SGLang:

python3 -m sglang.launch_server \
  --model tencent/Hy3-preview \
  --tp 8 \
  --tool-call-parser hunyuan \
  --reasoning-parser hunyuan \
  --speculative-algorithm EAGLE \
  --served-model-name hy3-preview

После развёртывания модель предоставляет OpenAI-совместимый API. Поддерживаются как полный fine-tuning, так и LoRA-адаптация.

Для тех, кто не хочет настраивать инфраструктуру, модель доступна через Tencent Cloud и OpenRouter. Стоимость API составляет примерно одну десятую от расценок OpenAI GPT-4.

Экосистема продуктов Tencent на базе Hunyuan

Hy3 Preview не существует в вакууме — она интегрирована в несколько продуктов Tencent, что позволяет быстро получать обратную связь от реальных пользователей и улучшать модель.

  • Yuanbao — AI-чат-бот, работающий на Hy3 Preview, с акцентом на естественное общение
  • CodeBuddy — AI-ассистент для написания и отладки кода
  • WorkBuddy — AI-помощник для работы с документами и планирования
  • ima — инструмент для мультимодальной генерации контента
  • QQ Browser — браузер с AI-поиском и суммаризацией

Команда Hunyuan объединилась с продуктовыми командами Yuanbao, CodeBuddy, WorkBuddy и другими в единый цикл разработки. Это позволяет напрямую использовать метрики живых продуктов для определения приоритетов обучения.

Hunyuan3D 3.1 также доступен через сторонние платформы, такие как 3D AI Studio, где можно генерировать модели онлайн без установки.

Ограничения и известные проблемы текущих версий

Tencent открыто признаёт ограничения текущих версий Hunyuan 3.1. Для Hy3 Preview отмечены следующие проблемы:

  • Слабое восстановление после ошибок при вызовах инструментов (tool calls)
  • Чувствительность к гиперпараметрам инференса

Главный AI-учёный Shunyu Yao объясняет, что команда решила выпустить модель раньше, чтобы собрать обратную связь от сообщества до официального релиза Hunyuan 3. Параллельно ведётся масштабирование предобучения и RL, улучшение функциональности и более тесная работа с продуктовыми командами.

Для Hunyuan3D 3.1 основное ограничение — время генерации: 2–3 минуты в режиме Rapid и до 6 минут в Pro. Это медленнее, чем у флагманской версии 3.5 (менее 60 секунд). Кроме того, для достижения наилучших результатов рекомендуется использовать изображения с чётким освещением и минимальной окклюзией.

Обе модели распространяются под лицензией Tencent Hy Community License Agreement. Веса доступны на Hugging Face, ModelScope и GitCode. Коммерческое использование моделей, сгенерированных через сторонние сервисы, может требовать приобретения платных подписок.

Вопросы и ответы

Чем отличается Hy3 Preview от Hunyuan3D 3.1?

Это два разных продукта Tencent. Hy3 Preview — языковая модель для текста, кода и рассуждений. Hunyuan3D 3.1 — генератор трёхмерных моделей по тексту или изображению. Их объединяет архитектура MoE и ориентация на промышленное использование.

Сколько параметров у Hy3 Preview и сколько из них активны?

Общее количество параметров — 295 миллиардов, но при каждом прямом проходе активируется только 21 миллиард. Это достигается за счёт архитектуры Mixture-of-Experts с 192 экспертами, из которых выбираются 8 лучших.

Какие режимы рассуждения поддерживает Hy3 Preview?

Три режима: no_think (прямой ответ без рассуждений), low (лёгкое рассуждение) и high (глубокое цепочечное рассуждение для сложных задач). Переключаются через параметр reasoning_effort в API.

Можно ли использовать Hunyuan3D 3.1 для 3D-печати?

Да, это одна из сильных сторон модели. Она создаёт герметичные (watertight) сетки с чистой топологией, которые можно экспортировать в STL или OBJ и сразу отправлять на切片. Ручной ремонт обычно не требуется.

Какие форматы экспорта поддерживает Hunyuan3D 3.1?

Основной формат — GLB с PBR-текстурами. Через встроенные инструменты конвертации доступны OBJ, FBX, STL, USDZ и PLY. Все форматы совместимы с Blender, Unity, Unreal Engine и другим 3D-софтом.

Сколько стоит использование Hy3 Preview через API?

Стоимость API составляет примерно одну десятую от расценок OpenAI GPT-4. Точные цены зависят от провайдера (Tencent Cloud или OpenRouter). Для локального развёртывания затраты определяются стоимостью оборудования.

Какие известные ограничения есть у Hy3 Preview?

Основные проблемы: слабое восстановление после ошибок при вызовах инструментов и чувствительность к гиперпараметрам инференса. Tencent планирует исправить их в следующих версиях на основе обратной связи сообщества.