Stable Diffusion — это семейство open-weights моделей генерации изображений от Stability AI: от классических SD 1.5 / SDXL до линейки Stable Diffusion 3.5 (Medium, Large, Large Turbo) на архитектуре MMDiT. Это не чат-бот: на выходе картинка (и пайплайны edit/ControlNet в экосистеме). Ниже — с чего стартовать новичку в 2026, без выдуманных цен на GPU и без путаницы лицензий.
Локальный граф нод — в ComfyUI для начинающих. Сосед по open-весам — Flux. Облачный креатив — Midjourney. Тех-pillar — ИИ-автоматизация.
SDXL vs SD 3.5: что выбрать
| Линейка | Для кого | Лицензия / доступ | Плюс | Минус |
|---|---|---|---|---|
| SD 1.5 + LoRA-зоопарк | Учёба на старых гайдах | Разные RAIL / community | Много туториалов | Устаревает по качеству |
| SDXL (base 1.0) | Локальный старт 1024px | CreativeML Open RAIL++-M (карточка HF) | Стабильная экосистема LoRA | Другая архитектура, чем SD 3.5 |
| SD 3.5 Medium (~2.5B) | Consumer GPU «из коробки» | Stability AI Community License | Баланс качества и железа | Нужны энкодеры / правильный workflow |
| SD 3.5 Large (~8.1B) | Качество / промпт-адherence | Community License | Сильнее на сложных сценах | Больше VRAM/диска |
| SD 3.5 Large Turbo | Быстрые черновики (~4 шага) | Community License | Скорость | Trade-off vs полная Large |
| Stability API / хостинг | Без своего GPU | Облако, кредиты | Актуальные модели | Платите API; тарифы на сайте |
Факты: stability.ai (анонс SD 3.5: Medium / Large / Large Turbo, Community License), Hugging Face stabilityai/stable-diffusion-xl-base-1.0, GitHub Stability-AI/sd3.5 (энкодеры CLIP-L/CLIP-G/T5-XXL, рекомендация ComfyUI). Дата сверки — июль 2026. Цены GPU/API в ₽ не фиксируем.
Три рабочих старта
- ComfyUI + готовый workflow. Уже ставили Desktop/Portable — подключите один SDXL или SD 3.5 template. См. гайд ComfyUI.
- Hugging Face веса. Скачайте checkpoint с карточки модели Stability AI; для SD 3.5 отдельно учтите text encoders (CLIP-L, CLIP-G, T5-XXL) или all-in-one пакеты сообщества.
- Облако / API. Нет железа — Stability API или хостинг-партнёры из анонса. Не путайте «открытые веса» с «бесплатный безлимит в облаке».
Чеклист первого вечера (Stable Diffusion):
[ ] Выбран путь: ComfyUI / (позже) API
[ ] Одна линейка: SDXL ИЛИ SD 3.5 - не обе сразу
[ ] Прочитана лицензия конкретной модели
[ ] Задача: 3 картинки с одним промптом + seed
[ ] Не ставить 20 LoRA «с форума» в первый час
Железо и реальность новичка
Локальный SD упирается в VRAM и диск, а не в «магический промпт». Практично:
- Сначала 512-1024 и один checkpoint.
- Потом LoRA / ControlNet, когда базовая генерация стабильна.
- Сравнивайте с Flux на одной задаче: иногда Flux проще для «красивой картинки», SD — для зоопарка кастомных LoRA.
Лицензии: не пропустите
У SDXL и SD 3.5 разные тексты лицензий (RAIL++-M vs Stability AI Community License). «Open-weights» ≠ «делай что угодно в коммерции без чтения». Перед коммерческим использованием откройте карточку модели на Hugging Face и страницу лицензии Stability.
Типичные ошибки
- Скачать «сборку с неизвестного сайта» вместо HF / официального репо.
- Смешать энкодеры SD 3.5 и ждать чудо.
- Гнаться за 8B Large на слабой видеокарте в первый вечер.
- Путать Midjourney (закрытый сервис) и Stable Diffusion (веса + локальный пайплайн).
FAQ: Stable Diffusion
Что такое Stable Diffusion простыми словами?
Семейство моделей Stability AI для генерации картинок по тексту. Веса можно запускать локально (часто через ComfyUI) или через облако/API.
С чего начать новичку в 2026?
ComfyUI + один workflow SDXL или SD 3.5 Medium/Turbo. Три картинки с одним промптом. LoRA — на второй вечер.
SDXL или Stable Diffusion 3.5?
Нужна привычная экосистема LoRA — часто SDXL. Нужна актуальная линейка Stability MMDiT — SD 3.5. Не ставьте обе «на всякий случай» в первый час.
Чем Stable Diffusion отличается от Flux и Midjourney?
SD и Flux — open-weights / локальные пайплайны (лицензии разные). Midjourney — облачный сервис без скачивания весов «как у Stability».
Нужна ли мощная видеокарта?
Для комфорта локально — да, запас VRAM помогает. Без железа берите API/хостинг. Конкретные ₽ за GPU не фиксируем.
Где брать официальные веса?
Hugging Face (карточки Stability AI), репозиторий Stability-AI/sd3.5 для reference inference, workflow — ComfyUI.
Вывод
Stable Diffusion — рабочий путь, если нужны свои веса, ComfyUI-граф и контроль пайплайна. Старт: одна линейка → один workflow → три картинки. Когда упрётесь в задачу «под работу», а не в зоопарк чекпоинтов — смотрите форматы обучения на странице автора.
Хотите нейросети под свои задачи, а не «для всех»?
Когда базовых гайдов уже мало, помогает разбор под вашу работу. Наставничество, курсы и подписка Артёма Денисова — все форматы на странице обучения. Тех-pillar — ИИ-автоматизация.