Hunyuan Video — это open-source text-to-video модель Tencent (HunyuanVideo) с более чем 13 млрд параметров, весами на Hugging Face и кодом на GitHub: акцент на 720p, Diffusers и ComfyUI. Ниже — как пользоваться Hunyuan Video новичку за один вечер, без выдуманных цен в рублях.
Общий маршрут — в «Как создать видео нейросетью». Соседи: Wan AI, LTX Video, Vidu, Kling. Локальный стек — ComfyUI. Доступ из РФ — в гайде про нейросети в России.
Что умеет HunyuanVideo на старте
- Text-to-Video — основная open-модель (HF tencent/HunyuanVideo, arxiv 2412.03603).
- 720p-классы разрешений — в README таблица режимов вроде 720×1280 / 1280×720 и соседние aspect.
- Diffusers — интеграция с декабря 2024 (HF docs pipelines/hunyuan_video).
- ComfyUI — native examples + community wrapper (Kijai).
- FP8 weights — облегчение VRAM (релиз 18.12.2024 в README).
- Demo/project page — aivideo.hunyuan.tencent.com для визуализаций и PDF.
Ожидание новичка: один короткий T2V-клип на подходящем GPU (или через облачный/Comfy-хост), а не продакшен-сериал с первого запуска.
Сравнение путей: demo / Diffusers / ComfyUI
| Путь | Вход | Когда брать | Ограничение |
|---|---|---|---|
| Project page / demo | Браузер | Посмотреть качество до установки | Не замена локального пайплайна |
| Официальный inference | Чекпоинт + CUDA GPU | Повторить README-пайплайн | Пик VRAM: ~60GB на 720×1280×129f; ~45GB на 544×960×129f |
| FP8 weights | Те же скрипты + FP8 | Сэкономить ~10GB VRAM (README) | Всё ещё тяжёлый класс железа |
| Diffusers | HF pipeline | Быстрее встроить в Python-стек | Нужна совместимая версия diffusers |
| ComfyUI / HunyuanVideoGP | Ноды / community builds | UI и «GPU poor» варианты | Качество/стабильность зависят от сборки |
Факты: GitHub Tencent-Hunyuan/HunyuanVideo и HF tencent/HunyuanVideo (13B+; license tencent-hunyuan-community; single-GPU peak memory 60GB @ 720×1280×129f, 45GB @ 544×960×129f; recommended 80GB; FP8 с 18.12.2024; Diffusers с 17.12.2024; ComfyUI official examples + Kijai wrapper). Цены облачных хостов в ₽ не фиксируем. Дата сверки — август 2026.
Маршрут: первый клип за вечер
- Честно оценить VRAM: если нет 45-80GB класса — берите ComfyUI-сборку/облако или соседний более лёгкий стек (Wan 1.3B / LTX).
- Поставить по README: веса HF + зависимости CUDA.
- Старт с меньшего режима (544×960), не сразу максимальный 720p×129f.
- Промпт: субъект + действие + камера + свет + запреты.
- 2 дубля → выбрать лучший → монтаж/звук отдельно.
- FP8 — если упираетесь в память по доке.
Промпт (пример):
«Wide shot of a wooden boat on calm lake at sunrise,
gentle camera drift, soft fog, natural colors,
no text overlays, no watermark.»
Чеклист:
[ ] Режим height/width/frames записан
[ ] VRAM сверен с таблицей README
[ ] 2 дубля до смены сцены
[ ] Звук отдельно, если нужен голос/музыка
HunyuanVideo vs Wan vs LTX
- HunyuanVideo — крупный open T2V Tencent, высокий порог по VRAM в официальных цифрах.
- Wan — лестница от 1.3B до TI2V-5B/A14B + веб wan.video; см. гайд Wan AI.
- LTX — Fast/Pro API и open weights Lightricks; см. гайд LTX.
Доступ из России и деньги
- Веса и код — GitHub/HF; лицензия community (tencent-hunyuan-community на карточке модели) — читайте LICENSE перед коммерцией.
- Облачный прогон у хостеров — тарифы хоста на дату; в ₽ из чужих скринов не копируем.
- Если локально не тянет — агрегатор (реф: syntx.ai) или более лёгкий open-стек.
- Платите за GPU-cloud только когда нужны стабильные еженедельные клипы без своего сервера.
Типичные ошибки
- Ставить «как Midjourney для видео» на 8-12 GB VRAM без community-оптимизаций.
- Сразу 129 кадров на максимуме разрешения.
- Игнорировать LICENSE community при коммерческом использовании.
- Сравнивать качество с веб-Kling/Vidu без одинакового промпта и бюджета времени.
- Жёсткие ₽-ценники «за генерацию» без источника.
FAQ: Hunyuan Video
Что такое Hunyuan Video простыми словами?
Открытая T2V-модель Tencent (HunyuanVideo, 13B+): текст → видео, веса на HF, код на GitHub, удобные пути через Diffusers и ComfyUI.
С чего начать новичку?
Если VRAM мало — сначала Wan 1.3B / LTX / веб-соседи. Если железо тянет — README + меньший resolution mode, затем 720p.
Сколько видеопамяти нужно?
Официальный README: порядка 60GB пик на 720×1280×129f и 45GB на 544×960×129f; рекомендуют GPU ~80GB. Community FP8/GP-сборки снижают порог, но это уже не «цифры из коробки».
Есть ли ComfyUI?
Да: официальные examples ComfyUI и community wrapper (Kijai), плюс GPU-poor проекты вроде HunyuanVideoGP.
Это бесплатно?
Веса open-source при соблюдении LICENSE. Электричество/облачный GPU — ваши расходы; прайс хоста смотрите на дату.
Где официальные материалы?
GitHub Tencent-Hunyuan/HunyuanVideo, HF tencent/HunyuanVideo, aivideo.hunyuan.tencent.com, arxiv 2412.03603.
Вывод
Hunyuan Video имеет смысл, когда нужен крупный open T2V и вы готовы к высокому порогу VRAM (или к community/облачному обходу). Старт: честный расчёт памяти → короткий режим → 2 дубля. Для серии под бренд — смотрите форматы обучения.
Хотите нейросети под свои задачи, а не «для всех»?
Когда базовых гайдов уже мало, помогает разбор под вашу работу. Наставничество, курсы и подписка Артёма Денисова — все форматы на странице обучения. Креатив-pillar — Midjourney для начинающих.