Suno выпустила Studio 2.0 — масштабное обновление браузерной DAW для подписчиков Premier, которое превращает AI-генератор музыки в полноценную профессиональную рабочую среду с MIDI-конвеем, генерацией кастомных плагинов по естественному языку и экспортом студийного качества.

image
image
image

Что произошло

Suno выпустила Studio 2.0 с полным набором инструментов для профессионального продакшна: импорт, запись и редактирование MIDI-клипов на таймлайне, подключение MIDI-клавиатур и контроллеров, встроенный wavetable-синтезатор, набор эффектов (EQ, компрессия, delay, distortion, reverb, convolution reverb, sidechain compression) и автоматизация параметров. В бете запущен Chat Bar — система, которая по текстовым запросам генерирует инструменты, вокал, кастомные эффекты-плагины и пресеты, сохраняя их в библиотеку пользователя. Обновлён stem separation до шести треков: вокал, ударные, бас, гитара, клавишные и эффекты. Добавлен musical typing с арпеджиатором и chord mode, MIDI Learn для привязки параметров к аппаратным контроллерам. Экспорт без лимитов в формате multitrack/stems, 32-bit / 48 kHz. Сторонние VST/AU-плагины не поддерживаются. Studio 1.x будет отключена в сентябре 2026 года. Релиз совпал с объявлением о вступлении Suno в BMG Global AI Music Alliance.

Контекст

Suno ранее была известна преимущественно как AI-генератор музыки по текстовым промптам — модель, которая выдавала готовые треки, но не позволяла детально управлять процессом. Конкурирующие решения вроде Udio и AIVA работают в аналогичной парадигме «промпт → трек». Studio 2.0 меняет эту модель: MIDI-клипы используются как prompt для генерации аудио, что представляет собой novel conditioning модальность — midi-условленная аудио-генерация, технически отличающаяся от text-to-audio и требующая отдельной модели или кросс-модального энкодера. Вступление в BMG Global AI Music Alliance — первый шаг к институционализации AI-музыки на уровне крупных лейблов и правообладателей. Отключение Studio 1.x в сентябре означает полный переход всей пользовательской базы на новую архитектуру.

Почему это важно для индустрии

Запуск Studio 2.0 сигнализирует о том, что AI-генерация звука выходит за рамки прототипов и интегрируется в профессиональный workflow. Для стартапов, продающих «AI-генератор музыки», это давление: Suno уже даёт MIDI, stem separation и NLP-controlled эффект-генерацию в браузере по подписке. Конкурентное преимущество смещается к нишевым моделям или B2B-интеграциям. Ожидается, что конкуренты (Udio, AIVA) будут вынуждены выпустить аналогичные MIDI-фичи и AI-чаты. Традиционные DAW (Ableton, FL Studio, Waveform) также начнут реагировать — вероятно, добавляя AI-ассистентов. BMG Alliance может привести к появлению отраслевых стандартов оценки AI-музыкальных систем. Для ML-инженеров Studio 2.0 задаёт benchmark: если Suno справляется с latency генерации в реальном времени в браузере, это достижимо и для self-hosted решений. Паттерн «генерация инструментов и эффектов по естественному языку» через Chat Bar предполагает chain-of-thought или planning-механизм внутри системы — технически нетривиальная задача для аудио-домена.

Почему это важно для пользователей

Для продюсеров и музыкантов, работающих с AI, Studio 2.0 — первый browser-based продукт, который объединяет MIDI-редактирование, stem separation и генерацию эффектов по естественному языку в едином рабочем процессе. Создание профессиональной музыки обесценивается до уровня «текстового промпта + браузер», а новый слой ценности перемещается к контролю и кастомизации. Подписчики Premier уже могут тестировать новый рабочий процесс: подключать MIDI-клавиатуру, писать партию на таймлайне, попросить Chat Bar сгенерировать кастомный эффект и получить готовый плагин. Экспорт 32-bit / 48 kHz без лимитов позволяет использовать результат в профессиональном продакшне. Отсутствие поддержки сторонних VST/AU-плагинов и API-документации ограничивает интеграции с существующими студийными пайплайнами.

Что пока неизвестно / ограничения

Технические детали моделей, архитектуры и методов обучения полностью закрыты — Suno не опубликовала ни paper, ни benchmark-результаты. Качество Chat Bar неизвестно без независимого тестирования: архитектура multi-modal генеративной системы (text-to-audio + text-to-plugin), baseline качества и latency в реальном времени не раскрыты. Stem separation улучшён до шести треков, но без бенчмарков (MUSDB, SIGSEp) невозможно оценить прогресс относительно SOTA. Утверждение о том, что Studio 2.0 — это proof-of-concept профессиональной AI-first DAW, переоценивает ML-новизну: технически Suno, вероятно, комбинирует известные архитектуры — diffusion/autoregressive audio модели и LLM для Chat Bar. Реальной научной новизны в публикации нет, это инженерная интеграция. Open-source аналогов пока нет, API отсутствует, экосистема остаётся закрытой.

Источники

Автор

Look at AI, редакция