Генерация музыки перестала быть отдельным сервисом, ради которого надо куда-то идти. 4 сентября Google открыл модель Lyria 3.5 всем пользователям Gemini — в вебе и в мобильном приложении, по всему миру. Песня теперь появляется там же, где вы спрашиваете про погоду.
Ключевое отличие от прошлых версий — модель собирает не зацикленный мелодический фрагмент, а песню целиком: с куплетами, припевами и бриджем, в стерео высокой точности, длиной до трёх минут. В приложении можно выбрать короткий трек или длинный, задать жанр словами или взять готовый шаблон, включить вокал или оставить чистый инструментал.
По сравнению с предшественницей Google обещает более выразительный вокал и более богатые аранжировки: мелодические структуры сложнее, следование запросу точнее, голос звучит эмоционально достовернее. Одновременно модель уехала в Gemini API, Google AI Studio, Flow Music и Vids — то есть доступна и разработчикам, и внутри рабочих инструментов компании.
Два пункта, которые важнее самой модели
Первый: Google утверждает, что Lyria обучена только на лицензионном материале — правда, не раскрывая конкретных источников. На фоне того, что почти все крупные музыкальные ИИ-сервисы сейчас так или иначе объясняются с правообладателями, это заявленное отличие, а не техническая деталь.
Второй: каждый трек получает незаметную метку SynthID, по которой слушатели и площадки могут определить, что музыка создана или отредактирована ИИ. Стриминги как раз сейчас выстраивают политику по ИИ-контенту — наличие метки на выходе делает такую музыку опознаваемой по умолчанию.
Suno и Udio выигрывали не только качеством, но и тем, что были единственным местом, куда шёл человек за ИИ-песней. Google этот аргумент обнуляет: он не делает продукт лучше конкурентов, он делает его ближе — в приложении, которое у пользователя уже открыто. Дистрибуция против качества, и по этой части у Google карты сильнее.