Stable Audio — это семейство генеративных аудио-моделей Stability AI: из текстового промпта (и иногда из загруженного аудио) получаются треки, loops и звуковые эффекты. На stability.ai/stable-audio описана линейка Stable Audio 3.0 (в т.ч. open-weights Small/Medium), а на Hugging Face доступен Stable Audio Open 1.0 (до ~47 с stereo 44.1 kHz). Ниже — как пользоваться Stable Audio новичку за один вечер, без выдуманных цен в рублях.
Соседи по классу песни — Suno и Udio. Озвучка голосом — ElevenLabs. Видео под музыку — маршрут ИИ-видео. Доступ из РФ — в гайде про нейросети в России.
Что умеет Stable Audio на старте
- Text-to-audio — описание жанра/настроения/темпа → музыка или SFX.
- Полные треки со структурой — в анонсе 2.0: до ~3 минут 44.1 kHz stereo; на странице 3.0 заявлено до ~6 минут для сложных композиций.
- Audio-to-audio / style transfer — загрузить семпл и трансформировать промптом (в линейке 2.0+; ToS: без чужого копирайта).
- Open weights — скачать веса (Stable Audio Open / 3.0 Small & Medium) и гонять локально через stable-audio-tools.
- Web app + API — быстрый старт в браузере или интеграция в пайплайн.
Ожидание новичка: фон 30-90 секунд под ролик или loop/SFX, а не «альбом с вокалом как у Suno». Stable Audio сильнее как инструмент саунд-дизайна и инструментальных треков; Suno/Udio удобнее, если цель — песня со словами «из коробки».
Слои продукта: Open, web, API
| Слой | Что даёт | Длина / формат (по доке) | Для кого |
|---|---|---|---|
| Stable Audio Open 1.0 (HF) | Open weights, text-to-audio | до ~47 с, stereo 44.1 kHz | Локальные эксперименты, GPU |
| Stable Audio 2.0 (анонс) | Full tracks + audio-to-audio | до ~3 мин, 44.1 kHz stereo | Трек со структурой intro/outro |
| Stable Audio 3.0 (витрина) | Семейство моделей, open Small/Medium | до ~6 мин (заявлено на витрине) | Эксперименты + кастом под свою библиотеку |
| Web app (stableaudio.com / Stability) | Генерация без локальной установки | Лимиты плана в кабинете | Первый вечер без GPU |
| API / cloud | Автоматизация | По platform.stability.ai | Прод и интеграции |
Факты: stability.ai/stable-audio (Stable Audio 3.0; open-weights Small/Medium; licensed training data; web app + API), stability.ai/news/stable-audio-2-0 (до 3 мин; audio-to-audio; AudioSparx licensed dataset), huggingface.co/stabilityai/stable-audio-open-1.0 (до 47s @ 44.1kHz; arXiv 2407.14358; license stable-audio-community; commercial → stability.ai/license), github.com/Stability-AI/stable-audio-tools. Цены в ₽/$ не фиксируем — смотрите актуальный кабинет/API pricing. Дата сверки — июль 2026.
Маршрут: фон под ролик за вечер
- Задача: инструментальный фон 30-60 с под Shorts или SFX (клавиатура, толпа, город).
- Слой: нет GPU → web app; есть GPU и желание копать → Open 1.0 + stable-audio-tools.
- Промпт: жанр + BPM + инструменты + настроение + запреты («без вокала», «без дропов каждые 2 секунды»).
- 2-3 дубля одной идеи. Не прыгайте по жанрам каждые 30 секунд.
- Экспорт → монтаж на клип. Если нужна песня со словами — сравните с Suno/Udio, не ждите того же от Stable Audio.
Промпт (пример):
«85 BPM lo-fi hip-hop, warm Rhodes, soft vinyl noise,
gentle sidechain kick, no vocals, loop-friendly ending.»
Чеклист:
[ ] Одна задача: фон / loop / SFX
[ ] 2-3 дубля
[ ] Лицензия: Open vs commercial (stability.ai/license)
[ ] Громкость нормализовать перед монтажом
Stable Audio vs Suno vs Udio
- Stable Audio — саунд-дизайн, инструментал, open weights, контроль через локальный стек.
- Suno — песня «под ключ» с вокалом; см. гайд Suno.
- Udio — сосед по песне, кредиты Free/Standard/Pro; см. гайд Udio.
Выбор простой: нужна песня → Suno/Udio; нужен саунд/инструментал/локальный контроль → Stable Audio.
Доступ из России и деньги
- Web: попробуйте генерацию на витрине Stable Audio / Stability; лимиты Free смотрите в кабинете.
- Open weights: скачивание с HF после принятия условий; для коммерции — отдельная лицензия Stability.
- Если оплата/доступ web недоступны — соседний музыкальный ИИ или агрегатор (реф: syntx.ai).
- Не фиксируйте цены в ₽ из чужих скринов: тарифы API/app меняются.
Типичные ошибки
- Ждать вокал и «хит» как у Suno из той же кнопки.
- Гнать Open 1.0 на слабом CPU и винить модель.
- Заливать чужой копирайт в audio-to-audio.
- Путать Open (эксперименты) и коммерческую лицензию.
- Писать жёсткие $/$₽ без сверки pricing на дату.
FAQ: Stable Audio
Что такое Stable Audio простыми словами?
Генератор музыки и звуковых эффектов от Stability AI: текст (и иногда аудио) → трек/loop/SFX. Есть web, API и open-weights модели.
С чего начать новичку?
Один инструментальный фон под ролик в web app: жанр + BPM + «no vocals» → 2-3 дубля → монтаж. Локальный Open — если есть GPU и время на установку.
Stable Audio бесплатный?
Open weights можно скачать для экспериментов (с условиями HF/лицензии). Web/API имеют свои лимиты и платные слои — смотрите кабинет и platform.stability.ai, без фиксации сумм здесь.
Чем отличается от Suno и Udio?
Suno/Udio удобнее для песен с вокалом. Stable Audio сильнее как саунд-дизайн и инструментал, плюс open weights для локального контроля.
Нужен ли GPU?
Для web — нет. Для Open 1.0 / локального inference — да (CUDA предпочтительна, как в примерах stable-audio-tools).
Где официальные материалы?
stability.ai/stable-audio, анонс 2.0 на stability.ai/news, HF stabilityai/stable-audio-open-1.0, GitHub Stability-AI/stable-audio-tools.
Вывод
Stable Audio стоит пробовать, когда нужен инструментальный фон, loop или SFX и вы готовы крутить 2-3 дубля одной идеи. Для песни со словами сначала сравните Suno/Udio. Когда упрётесь в серию под задачу — смотрите форматы обучения.
Хотите нейросети под свои задачи, а не «для всех»?
Когда базовых гайдов уже мало, помогает разбор под вашу работу. Наставничество, курсы и подписка Артёма Денисова — все форматы на странице обучения. Креатив-pillar — Midjourney для начинающих.