Hunyuan Video — это open-source text-to-video модель Tencent (HunyuanVideo) с более чем 13 млрд параметров, весами на Hugging Face и кодом на GitHub: акцент на 720p, Diffusers и ComfyUI. Ниже — как пользоваться Hunyuan Video новичку за один вечер, без выдуманных цен в рублях.

Общий маршрут — в «Как создать видео нейросетью». Соседи: Wan AI, LTX Video, Vidu, Kling. Локальный стек — ComfyUI. Доступ из РФ — в гайде про нейросети в России.

Что умеет HunyuanVideo на старте

  1. Text-to-Video — основная open-модель (HF tencent/HunyuanVideo, arxiv 2412.03603).
  2. 720p-классы разрешений — в README таблица режимов вроде 720×1280 / 1280×720 и соседние aspect.
  3. Diffusers — интеграция с декабря 2024 (HF docs pipelines/hunyuan_video).
  4. ComfyUI — native examples + community wrapper (Kijai).
  5. FP8 weights — облегчение VRAM (релиз 18.12.2024 в README).
  6. Demo/project page — aivideo.hunyuan.tencent.com для визуализаций и PDF.

Ожидание новичка: один короткий T2V-клип на подходящем GPU (или через облачный/Comfy-хост), а не продакшен-сериал с первого запуска.

Сравнение путей: demo / Diffusers / ComfyUI

Путь Вход Когда брать Ограничение
Project page / demo Браузер Посмотреть качество до установки Не замена локального пайплайна
Официальный inference Чекпоинт + CUDA GPU Повторить README-пайплайн Пик VRAM: ~60GB на 720×1280×129f; ~45GB на 544×960×129f
FP8 weights Те же скрипты + FP8 Сэкономить ~10GB VRAM (README) Всё ещё тяжёлый класс железа
Diffusers HF pipeline Быстрее встроить в Python-стек Нужна совместимая версия diffusers
ComfyUI / HunyuanVideoGP Ноды / community builds UI и «GPU poor» варианты Качество/стабильность зависят от сборки

Факты: GitHub Tencent-Hunyuan/HunyuanVideo и HF tencent/HunyuanVideo (13B+; license tencent-hunyuan-community; single-GPU peak memory 60GB @ 720×1280×129f, 45GB @ 544×960×129f; recommended 80GB; FP8 с 18.12.2024; Diffusers с 17.12.2024; ComfyUI official examples + Kijai wrapper). Цены облачных хостов в ₽ не фиксируем. Дата сверки — август 2026.

Маршрут: первый клип за вечер

  1. Честно оценить VRAM: если нет 45-80GB класса — берите ComfyUI-сборку/облако или соседний более лёгкий стек (Wan 1.3B / LTX).
  2. Поставить по README: веса HF + зависимости CUDA.
  3. Старт с меньшего режима (544×960), не сразу максимальный 720p×129f.
  4. Промпт: субъект + действие + камера + свет + запреты.
  5. 2 дубля → выбрать лучший → монтаж/звук отдельно.
  6. FP8 — если упираетесь в память по доке.
Промпт (пример):
«Wide shot of a wooden boat on calm lake at sunrise,
gentle camera drift, soft fog, natural colors,
no text overlays, no watermark.»

Чеклист:
[ ] Режим height/width/frames записан
[ ] VRAM сверен с таблицей README
[ ] 2 дубля до смены сцены
[ ] Звук отдельно, если нужен голос/музыка

HunyuanVideo vs Wan vs LTX

  • HunyuanVideo — крупный open T2V Tencent, высокий порог по VRAM в официальных цифрах.
  • Wan — лестница от 1.3B до TI2V-5B/A14B + веб wan.video; см. гайд Wan AI.
  • LTX — Fast/Pro API и open weights Lightricks; см. гайд LTX.

Доступ из России и деньги

  • Веса и код — GitHub/HF; лицензия community (tencent-hunyuan-community на карточке модели) — читайте LICENSE перед коммерцией.
  • Облачный прогон у хостеров — тарифы хоста на дату; в ₽ из чужих скринов не копируем.
  • Если локально не тянет — агрегатор (реф: syntx.ai) или более лёгкий open-стек.
  • Платите за GPU-cloud только когда нужны стабильные еженедельные клипы без своего сервера.

Типичные ошибки

  • Ставить «как Midjourney для видео» на 8-12 GB VRAM без community-оптимизаций.
  • Сразу 129 кадров на максимуме разрешения.
  • Игнорировать LICENSE community при коммерческом использовании.
  • Сравнивать качество с веб-Kling/Vidu без одинакового промпта и бюджета времени.
  • Жёсткие ₽-ценники «за генерацию» без источника.

FAQ: Hunyuan Video

Что такое Hunyuan Video простыми словами?

Открытая T2V-модель Tencent (HunyuanVideo, 13B+): текст → видео, веса на HF, код на GitHub, удобные пути через Diffusers и ComfyUI.

С чего начать новичку?

Если VRAM мало — сначала Wan 1.3B / LTX / веб-соседи. Если железо тянет — README + меньший resolution mode, затем 720p.

Сколько видеопамяти нужно?

Официальный README: порядка 60GB пик на 720×1280×129f и 45GB на 544×960×129f; рекомендуют GPU ~80GB. Community FP8/GP-сборки снижают порог, но это уже не «цифры из коробки».

Есть ли ComfyUI?

Да: официальные examples ComfyUI и community wrapper (Kijai), плюс GPU-poor проекты вроде HunyuanVideoGP.

Это бесплатно?

Веса open-source при соблюдении LICENSE. Электричество/облачный GPU — ваши расходы; прайс хоста смотрите на дату.

Где официальные материалы?

GitHub Tencent-Hunyuan/HunyuanVideo, HF tencent/HunyuanVideo, aivideo.hunyuan.tencent.com, arxiv 2412.03603.

Вывод

Hunyuan Video имеет смысл, когда нужен крупный open T2V и вы готовы к высокому порогу VRAM (или к community/облачному обходу). Старт: честный расчёт памяти → короткий режим → 2 дубля. Для серии под бренд — смотрите форматы обучения.

Артём Денисов эксперт Нетологии и автор курса Яндекс Практикума по промпт-инжинирингу. Помогает выбрать видео-стек под железо и задачу, без гонки за всеми моделями сразу.

Хотите нейросети под свои задачи, а не «для всех»?

Когда базовых гайдов уже мало, помогает разбор под вашу работу. Наставничество, курсы и подписка Артёма Денисова — все форматы на странице обучения. Креатив-pillar — Midjourney для начинающих.