Stable Audio — это семейство генеративных аудио-моделей Stability AI: из текстового промпта (и иногда из загруженного аудио) получаются треки, loops и звуковые эффекты. На stability.ai/stable-audio описана линейка Stable Audio 3.0 (в т.ч. open-weights Small/Medium), а на Hugging Face доступен Stable Audio Open 1.0 (до ~47 с stereo 44.1 kHz). Ниже — как пользоваться Stable Audio новичку за один вечер, без выдуманных цен в рублях.

Соседи по классу песни — Suno и Udio. Озвучка голосом — ElevenLabs. Видео под музыку — маршрут ИИ-видео. Доступ из РФ — в гайде про нейросети в России.

Что умеет Stable Audio на старте

  1. Text-to-audio — описание жанра/настроения/темпа → музыка или SFX.
  2. Полные треки со структурой — в анонсе 2.0: до ~3 минут 44.1 kHz stereo; на странице 3.0 заявлено до ~6 минут для сложных композиций.
  3. Audio-to-audio / style transfer — загрузить семпл и трансформировать промптом (в линейке 2.0+; ToS: без чужого копирайта).
  4. Open weights — скачать веса (Stable Audio Open / 3.0 Small & Medium) и гонять локально через stable-audio-tools.
  5. Web app + API — быстрый старт в браузере или интеграция в пайплайн.

Ожидание новичка: фон 30-90 секунд под ролик или loop/SFX, а не «альбом с вокалом как у Suno». Stable Audio сильнее как инструмент саунд-дизайна и инструментальных треков; Suno/Udio удобнее, если цель — песня со словами «из коробки».

Слои продукта: Open, web, API

Слой Что даёт Длина / формат (по доке) Для кого
Stable Audio Open 1.0 (HF) Open weights, text-to-audio до ~47 с, stereo 44.1 kHz Локальные эксперименты, GPU
Stable Audio 2.0 (анонс) Full tracks + audio-to-audio до ~3 мин, 44.1 kHz stereo Трек со структурой intro/outro
Stable Audio 3.0 (витрина) Семейство моделей, open Small/Medium до ~6 мин (заявлено на витрине) Эксперименты + кастом под свою библиотеку
Web app (stableaudio.com / Stability) Генерация без локальной установки Лимиты плана в кабинете Первый вечер без GPU
API / cloud Автоматизация По platform.stability.ai Прод и интеграции

Факты: stability.ai/stable-audio (Stable Audio 3.0; open-weights Small/Medium; licensed training data; web app + API), stability.ai/news/stable-audio-2-0 (до 3 мин; audio-to-audio; AudioSparx licensed dataset), huggingface.co/stabilityai/stable-audio-open-1.0 (до 47s @ 44.1kHz; arXiv 2407.14358; license stable-audio-community; commercial → stability.ai/license), github.com/Stability-AI/stable-audio-tools. Цены в ₽/$ не фиксируем — смотрите актуальный кабинет/API pricing. Дата сверки — июль 2026.

Маршрут: фон под ролик за вечер

  1. Задача: инструментальный фон 30-60 с под Shorts или SFX (клавиатура, толпа, город).
  2. Слой: нет GPU → web app; есть GPU и желание копать → Open 1.0 + stable-audio-tools.
  3. Промпт: жанр + BPM + инструменты + настроение + запреты («без вокала», «без дропов каждые 2 секунды»).
  4. 2-3 дубля одной идеи. Не прыгайте по жанрам каждые 30 секунд.
  5. Экспорт → монтаж на клип. Если нужна песня со словами — сравните с Suno/Udio, не ждите того же от Stable Audio.
Промпт (пример):
«85 BPM lo-fi hip-hop, warm Rhodes, soft vinyl noise,
gentle sidechain kick, no vocals, loop-friendly ending.»

Чеклист:
[ ] Одна задача: фон / loop / SFX
[ ] 2-3 дубля
[ ] Лицензия: Open vs commercial (stability.ai/license)
[ ] Громкость нормализовать перед монтажом

Stable Audio vs Suno vs Udio

  • Stable Audio — саунд-дизайн, инструментал, open weights, контроль через локальный стек.
  • Suno — песня «под ключ» с вокалом; см. гайд Suno.
  • Udio — сосед по песне, кредиты Free/Standard/Pro; см. гайд Udio.

Выбор простой: нужна песня → Suno/Udio; нужен саунд/инструментал/локальный контроль → Stable Audio.

Доступ из России и деньги

  • Web: попробуйте генерацию на витрине Stable Audio / Stability; лимиты Free смотрите в кабинете.
  • Open weights: скачивание с HF после принятия условий; для коммерции — отдельная лицензия Stability.
  • Если оплата/доступ web недоступны — соседний музыкальный ИИ или агрегатор (реф: syntx.ai).
  • Не фиксируйте цены в ₽ из чужих скринов: тарифы API/app меняются.

Типичные ошибки

  • Ждать вокал и «хит» как у Suno из той же кнопки.
  • Гнать Open 1.0 на слабом CPU и винить модель.
  • Заливать чужой копирайт в audio-to-audio.
  • Путать Open (эксперименты) и коммерческую лицензию.
  • Писать жёсткие $/$₽ без сверки pricing на дату.

FAQ: Stable Audio

Что такое Stable Audio простыми словами?

Генератор музыки и звуковых эффектов от Stability AI: текст (и иногда аудио) → трек/loop/SFX. Есть web, API и open-weights модели.

С чего начать новичку?

Один инструментальный фон под ролик в web app: жанр + BPM + «no vocals» → 2-3 дубля → монтаж. Локальный Open — если есть GPU и время на установку.

Stable Audio бесплатный?

Open weights можно скачать для экспериментов (с условиями HF/лицензии). Web/API имеют свои лимиты и платные слои — смотрите кабинет и platform.stability.ai, без фиксации сумм здесь.

Чем отличается от Suno и Udio?

Suno/Udio удобнее для песен с вокалом. Stable Audio сильнее как саунд-дизайн и инструментал, плюс open weights для локального контроля.

Нужен ли GPU?

Для web — нет. Для Open 1.0 / локального inference — да (CUDA предпочтительна, как в примерах stable-audio-tools).

Где официальные материалы?

stability.ai/stable-audio, анонс 2.0 на stability.ai/news, HF stabilityai/stable-audio-open-1.0, GitHub Stability-AI/stable-audio-tools.

Вывод

Stable Audio стоит пробовать, когда нужен инструментальный фон, loop или SFX и вы готовы крутить 2-3 дубля одной идеи. Для песни со словами сначала сравните Suno/Udio. Когда упрётесь в серию под задачу — смотрите форматы обучения.

Артём Денисов эксперт Нетологии и автор курса Яндекс Практикума по промпт-инжинирингу. Помогает собрать звук под креативный пайплайн без зоопарка подписок.

Хотите нейросети под свои задачи, а не «для всех»?

Когда базовых гайдов уже мало, помогает разбор под вашу работу. Наставничество, курсы и подписка Артёма Денисова — все форматы на странице обучения. Креатив-pillar — Midjourney для начинающих.