Генеративный искусственный интеллект продолжает стремительно проникать в сферу творчества. Одним из самых амбициозных проектов в этой области остаётся Lyria от DeepMind — модель, способная создавать полноценные музыкальные композиции. Теперь исследователи представили третью крупную версию системы — Lyria 3.5, которая уже интегрирована в экспериментальный сервис Google Flow Music. Новая версия обещает не только более качественное звучание, но и принципиально иной уровень взаимодействия пользователя с ИИ-композитором.
Что произошло
DeepMind официально анонсировала Lyria 3.5 как часть экосистемы Google Flow Music. Главные нововведения касаются четырёх направлений: музыкальность (musicality), работа с текстами песен (lyrics), синтез вокала (vocals) и степень творческого контроля (creative control). Модель научилась лучше соблюдать гармоническую структуру, динамику и тембральную согласованность. Кроме того, Lyria 3.5 способна генерировать вокальные партии, которые звучат естественнее, а также позволяет пользователю более гибко редактировать отдельные элементы композиции — от инструментовки до темпа.
Почему это важно
До сих пор большинство ИИ-музыкальных инструментов страдали от двух основных проблем: неестественности звучания и отсутствия тонкого контроля. Пользователь мог получить «сырую» мелодию, но не мог влиять на нюансы — например, изменить настроение припева или заменить инструмент в середине трека. Lyria 3.5 пытается решить эту проблему, предлагая продвинутые механизмы редактирования. Это приближает ИИ-генерацию к роли полноценного соавтора, а не просто генератора случайных нот. Для индустрии это означает потенциальное снижение порога входа для начинающих музыкантов и расширение инструментария для профессионалов.
«Lyria 3.5 — это шаг к тому, чтобы ИИ стал не просто инструментом, а партнёром в творческом процессе. Мы фокусируемся на том, чтобы дать пользователю больше контроля, сохраняя при этом высокое качество музыкального результата», — отмечают в DeepMind.
Технические детали и новшества
Модель Lyria 3.5 основана на архитектуре, сочетающей трансформеры с диффузионными подходами. Улучшенная музыкальность достигается за счёт более точного моделирования длинных музыкальных последовательностей и контекстной согласованности — модель «помнит» тему и развивает её, а не генерирует случайные вариации. В области вокала DeepMind применила новые методы синтеза речи и пения, которые уменьшают артефакты, характерные для предыдущих версий. Тексты песен теперь могут быть не только сгенерированы с нуля, но и адаптированы под заданную рифмовку и слоговую структуру мелодии.
Перспективы для пользователей и индустрии
Запуск Lyria 3.5 в Google Flow Music открывает новые возможности не только для музыкантов, но и для контент-мейкеров, рекламных агентств и разработчиков игр. Возможность быстро создавать качественные фоновые треки с индивидуальными настройками может существенно сократить время и бюджет продакшена. Однако возникают и вопросы: как это повлияет на рынок труда композиторов и аранжировщиков? DeepMind подчёркивает, что их цель — не замена человека, а расширение его возможностей. Тем не менее, этические и правовые аспекты (авторские права на сгенерированную музыку, использование голосов реальных певцов) остаются предметом дискуссий.
Что дальше
На данный момент Lyria 3.5 доступна в ограниченном доступе через Google Flow Music. Ожидается, что в ближайшие месяцы функционал будет расширяться, а также появятся API для сторонних разработчиков. DeepMind уже намекает на следующую версию, которая, возможно, будет включать мультимодальное взаимодействие — например, генерацию музыки по видеоряду или текстовому описанию настроения. В долгосрочной перспективе Lyria может стать одним из ключевых элементов экосистемы Google, объединив возможности YouTube, Music и других сервисов. Следите за обновлениями — музыкальный ИИ только начинает звучать в полную силу.