Компания ElevenLabs представила масштабное обновление своей платформы ElevenMusic, которое позволяет создавать музыкальные композиции с использованием кастомных голосов и сохранением единого музыкального стиля.

!image.webp&w=3840&q=80)
Что произошло
В рамках обновления платформы ElevenMusic были представлены функции Vocals и Styles. Функция Vocals позволяет пользователям создавать песни, используя собственный голос через загрузку образцов для обучения модели Music v2, либо выбирая готовые варианты из Vocal Library. Функция Styles обеспечивает консистентность звучания, позволяя сохранять единый музыкальный «почерк» и стиль между различными треками.
Контекст
С выходом Music v2 ElevenLabs переходит от простой генерации разрозненных аудиоклипов к инструментам полноценного управления музыкальной идентичностью. Новые возможности позволяют реализовать механизмы обучения на малом количестве данных (one-shot/few-shot learning) для точного клонирования тембра и манеры исполнения, что решает проблему консистентности — одну из ключевых сложностей в генеративном аудио.
Почему это важно для индустрии
ElevenLabs трансформирует процесс создания музыки, переходя от случайной генерации к управлению цифровой идентичностью. Вертикальная интеграция управления голосом и стилем создает экосистему для разработки полноценных AI-исполнителей. Это усиливает конкуренцию в сегменте AI-музыки и задает новые стандарты для профессионального производства контента.
Почему это важно для пользователей
Для независимых музыкантов и создателей контента открываются возможности создания уникальных и повторяемых цифровых персонажей со своим узнаваемым тембром. Инструменты позволяют быстро прототипировать песни и создавать брендированный аудио-контент, значительно снижая порог входа в качественный AI-продакшн.
Что пока неизвестно / ограничения
Несмотря на креативные возможности, внедрение подобных технологий несет в себе инженерные и операционные риски, такие как высокая стоимость инференса, сложности в управлении качеством генерации и юридические вопросы, связанные с использованием биометрических данных голоса.
Источники
Автор
Look at AI, редакция
