Научилась сдержанности и дышит: настал ли у ИИ-музыки момент «Эврика»?

Обновлено:

Знакомое ощущение? Включаешь свежий ИИ-трек — звучит богато, чисто, даже цепляет. А через минуту уже тянет переключить, и возвращаться к нему потом совсем не хочется.

Дело не в бедности аранжировки. Наоборот — в её избытке. Нейросети будто боятся тишины и забивают звуком каждый сантиметр: плотные барабаны, густая гармония, эмоции на максимуме от первой до последней секунды. Каждый слой кричит «смотри, я здесь», и в итоге всё звучит натужно, как показательное выступление, а не как песня. А ведь в живой авторской песне едва ли не главное — умение вовремя не играть: придержать, оставить воздух, чтобы кульминация действительно выстрелила.

Вспомните нашумевший ИИ-«ремикс» Bubble (《泡沫》), который в итоге удалили, а его автору пришлось извиняться. Дело там было не только в авторских правах: нейросетевая аранжировка почти начисто срезала исходную драматургию — ушли и динамика, и напряжение, и слои. Да и сами границы копирайта сейчас пересобираются на ходу: 29 января 2025 года U.S. Copyright Office выпустило отчёт, где прямо сказано — сгенерированный ИИ результат охраняется, только если человек сам определил достаточно выразительных элементов, одних промптов для охраны недостаточно. U.S. Copyright Office

Аудио: ИИ-версия 《泡沫》 (Bubble)

Справедливости ради: последние пару лет ИИ-музыка старательно учится звучать по-человечески. Ранние вокальные модели тянули песню на одном бесконечном дыхании, а сейчас уже имитируют вдохи и паузы, даже выдают что-то похожее на эмоциональные оттенки. Прогресс технический — налицо. Но треков, к которым хочется возвращаться, всё равно почти нет: настоящей сдержанности модели так и не освоили, а эмоциональные горки внутри песни пока не идут ни в какое сравнение с человеческой работой.

Когда планка «а может ли ИИ вообще написать песню» взята массово, конкуренция неизбежно смещается — от генерации к композиции. И «композиция» тут про две вещи сразу: дотягивает ли модель до планки человеческого продакшна и получает ли музыкант в руки инструмент, с которым реально можно работать, а не просто готовый трек «послушал и забыл».

Недавно вышедшая модель китайской ИИ-платформы Mureka — V9.5 — впервые за долгое время показала движение сразу в обе стороны. На официальной странице продукта V9.5 её описывают так: более естественные мелодия, гармония и аранжировка, плюс подтянутые вокал и охват стилей. Официальная страница Mureka V9.5

Figure 1

Её девиз — “True to music. Open to every idea.” — уже не про «плотнее и сложнее ради самой плотности», а про сдержанность, паузы, эмоции и контроль автора над музыкой. В этом слышится и слоган самого бренда Mureka: “Eureka Flows, Music Grows.”

И вот вопрос: если ИИ-музыка переходит от стадии умеет генерировать к стадии понимает, как сочинять, то не тот ли это самый момент эврики?

Figure 2

ИИ-музыка учится главному — вовремя остановиться

Главное, что случилось с ИИ-музыкой за последние два года, — закрыт вопрос, можно ли вообще сгенерировать цельную песню.

Но возможности больших моделей выровнялись, и одним фактом «песню написал ИИ» уже никого не удивишь. Слушатели оценивают такие треки как обычную музыку: есть ли чувство? есть ли хук? хочется ли нажать repeat? Со стороны предложения картина красноречивая. По данным, которые Deezer опубликовал в июле 2026 года, на пике в июне 2026 года на платформу прилетало под 90 000 полностью сгенерированных ИИ треков в день — больше половины всех новинок за сутки. При этом на них приходилось лишь от 1 до 3 процентов реальных прослушиваний. Уметь генерировать и заставить слушать по кругу — всё ещё две разные вселенные. Deezer Newsroom

Тут и вылезает застарелая болячка нынешней ИИ-музыки: свалка инструментов, вычурная аранжировка, пережатый микс и вокал на пределе человеческих возможностей — почти каждый элемент изо всех сил доказывает собственное существование.

Figure 3

С этим багажом вопросов мы и взялись за свежую модель Mureka — Mureka V9.5.

После живого теста главная неожиданность — V9.5, похоже, и правда начинает понимать, что такое композиция. «Плотнее и сложнее» больше не единственная цель: музыка умеет и разворачиваться, и сжиматься, а это уже гораздо ближе к тому, как пишут люди. Да и связка «промпт — результат» стала заметно послушнее.

Взять Give Me a Little More Time (《再给我多一点时间》), которую мы раньше уже собирали на V9. Текст в этот раз не трогали вообще, а вот промпт переписали полностью:

"Ambient Lo-Fi atmosphere, 70 BPM slow tempo, built on Rhodes electric piano and analog synths with tape-saturation character, supported by delicate urban folk guitar, a minimal kick, and rain samples — aiming for a slow, restrained electronic ballad mood carrying the loneliness of late night."

Результат оказался интереснее, чем мы ждали.

Аудио: ИИ-песня 《再给我多一点时间》 (Give Me a Little More Time)

Начнём с тембра и фактуры. Ретро-Lo-Fi V9.5 считывает цельнее: тёплое зерно Rhodes, лёгкий перегруз и аналоговый характер плёночной сатурации — всё это ложится в звук довольно органично, а не выглядит как наспех накиданные теги стиля поверх друг друга.

На практике это означает, что связка «промпт — звук» стала куда внятнее. Когда автор описывает атмосферу, темп и настроение, модель уже умеет переносить эти абстрактные хотелки в конкретные музыкальные решения — и делает это достаточно стабильно, а не просто цепляется за пару жанровых ярлыков.

То же слышно и в логике аранжировки: даже там, где в промпте прямо не просили, Mureka V9.5 больше не гонится за плотностью ради плотности и уже осознанно рулит наполненностью.

В нашем тестовом демо Eureka (《尤里卡》) это слышнее всего на вступлении вокала и на переходах к бриджу — там явно освобождают место под главную мелодию. Подкладка не давит полным спектром без остановки, партии не мешают друг другу дышать, поэтому эмоция успевает нарасти по ходу песни, а не стоит на одном уровне напряжения с первого такта.

Аудио: ИИ-песня 《尤里卡》 (Eureka)

Вокальная сторона тоже заметно изменилась.

Послушайте демо The Life We Make. Там, где многие ИИ-модели по умолчанию выкручивают вокал на максимум — плотный тембр и непрерывная подача на форсаже как синоним «качества», — Mureka V9.5 выбирает более сдержанный и живой вариант.

Если вслушаться, подача свободнее, дикция не форсирована ради акцентов. Такое с первого раза может и не ошарашить, зато тихие места, придыхания, согласные, окраска голоса реально начинают работать на эмоцию — и у трека появляется естественная дуга.

Аудио: ИИ-песня 《The Life We Make》

Более сдержанные аранжировки, более честная отработка замысла и более живой вокал у Mureka V9.5 упираются в один вопрос: как вообще ИИ начал понимать композиционную логику песни целиком?

Чтобы ответить, придётся заглянуть под капот.

Многие ИИ-модели до сих пор сочиняют пошагово: генерируют на ходу, предсказывая следующий кусок. Трек так собирается быстро, но без единого плана глобальной структуры стыки между частями получаются рваными, эмоциональный темп гуляет, а аранжировка и вокал порой вообще разъезжаются в разные стороны.

Mureka V9.5, наоборот, продолжает и допиливает подход MusiCoT (Music Chain of Thought), который ближе к реальному продакшну. Прежде чем генерировать мелодию, инструменты или вокал, модель сначала строит каркас всей вещи — организацию частей, эмоциональную кривую, динамику, где оставить пустоту, а где поднажать, — и уже вокруг этого каркаса собирает остальное. На открытой исследовательской странице MusiCoT, кстати, отмечается: исследователи взяли десять случайных выборок из набора в 100 песен и сравнили их с базовой моделью, Suno V4, Udio V1.5 и Mureka V5.5. Исследовательская страница MusiCoT

Figure 4

Судя по результату, выигрыш не в том, что какой-то отдельный параметр стал лучше сам по себе, — а в том, что цельность песни стала ближе к логике настоящего сочинения. Аранжировка, вокал и промпт больше не тянут одеяло каждый на себя в процессе генерации, а начинают работать на одну связную музыкальную историю.

И когда в индустрии уже всерьёз говорят о паузах, эмоциональном темпе, точности по промпту и репит-ценности, критерии оценки ИИ-музыки всё плотнее подтягиваются к критериям самой музыки.

Figure 5

Момент «Эврика»: от генерации — к выращиванию идей

Для авторов большинство ИИ-инструментов до сих пор работало по до боли знакомой схеме — по сути, сочинение как дёрганье гача-автомата: повезёт — не повезёт.

Здесь и видно главный сдвиг в том, как Mureka понимает авторов. По мере перехода продукта от разовой генерации к версионному созданию руками чувствуешь простую формулу: модель берёт на себя снижение неопределённости результата, а продукт — расширение пространства решений автора, возвращая человеку больше контроля над музыкой.

В каком-то смысле Mureka переводит ИИ от генерации контента к выращиванию идей — и в этом и есть эврика-момент ИИ-музыки.

Figure 6

Слово «эврика» — от греческого heurēka, «я нашёл». Так обычно называют миг после долгих поисков, когда ключевой ответ найден и идея вспыхивает. Сочинение песен — ровно про это. Сложнее всего обычно не записать песню, а выловить из кучи смутных чувств, мелодий и обрывков то самое вот оно.

На уровне модели Mureka пытается превратить «звучит хорошо» в управляемую системную способность — воспроизводимую и способную улучшаться. Семантика текста по секциям, связка подачи вокала с эмоцией, отношения структуры и развития смысла — всё это сведено в один контур оптимизации.

Но когда модель становится достаточно сильной, самое интересное переезжает на уровень продукта. Важнее написать ещё больше хороших песен — может ли автор удобно выбирать между разными версиями. Поэтому продуктовые возможности Mureka и стоит читать как одну линию мысли.

Взять Character & MV: автор загружает одно фото и короткий сэмпл голоса, после чего виртуальный персонаж из «внешности + голоса» переиспользуется в следующих работах, складываясь в более цельную цифровую идентичность.

Видео 5

Soundtrack закрывает другой шов в творческом процессе. Раньше видеомейкер сначала монтировал картинку, а потом шёл искать более-менее подходящую фоновую музыку; теперь ИИ участвует в озвучке, отталкиваясь от сцены, движения и настроения в кадре.

В саундтреке, который мы тестировали для Growing Up (《长大》), сгенерированная музыка полностью обслуживает видеоряд, идёт за картинкой по мере развития, а не просто подсовывает стилистически похожий фоновый ковёр.

Видео 6

Mureka Co, наоборот, — ближе к ключевому этапу профессионального продакшна. Он заезжает прямо в DAW вроде Ableton Live, где естественным языком можно создавать дорожки, задавать BPM, вешать эффекты, генерировать целые вещи или отдельные стемы, а также разводить стемы и ровнять бит.

Для профи это особенно важно. Рутину забирает ИИ, суждение остаётся за автором, и генерация с продакшном перестают быть двумя разными мирами.

Видео 7

Отсюда сдвиг уже трудно не заметить. Mureka строит цельную ИИ-нативную платформу для создания.

Новички могут делать тексты, мелодию, вокал и готовые песни через разговорного агента или кастомный режим. Авторам контента доступны озвучка картинок и видео и ИИ-клипы. Профи-продюсеры уходят вглубь DAW-процесса через Studio, мультитрековое редактирование, экспорт стемов и Mureka Co.

Вся цепочка закрыта целиком — от первой искры через генерацию, доработку, видеопродакшн и профессиональный финиш. Одну идею можно быстро покрутить на платформе, а потом вести через разные версии под контролем — а за автором остаётся то, что автоматизируется хуже всего: вкус, решения, что оставить, а что вырезать, и финальное высказывание.

Поэтому и оценивать, чем Mureka отличается, бессмысленно по одному вопросу — чьи демо V9.5 эффектнее, чем у другой модели.

Figure 7

К чему всё идёт

В таком свете Mureka уже перерастает чистый генератор ИИ-музыки и движется ближе к творческой инфраструктуре эпохи ИИ-музыки: она связывает не просто модели и готовые работы, а всю цепочку — вдохновение, генерацию, редактирование и релиз.

Разница в том, что авторы, способы производства и формы контента здесь более ИИ-нативные.

А значит, следующий виток конкуренции в ИИ-музыке, скорее всего, будет не битвой моделей в лоб, а битвой за точку входа в создание.

В будущем бороться будут не только за то, чей трек звучит лучше, а за то, какой инструмент автор открывает по привычке, — за место, где идея проходит путь от первого появления через генерацию, правки и шлифовку до готовой работы.

Возможности модели, конечно, по-прежнему важны: они задают потолок того, что может ИИ-продукт. Но по мере того как разрыв между моделями сужается, удерживать пользователей будет другое — удобный ли workflow, хватает ли творческой свободы и умеет ли платформа переваривать всё более сложные запросы авторов.

Модель задаёт потолок возможностей, workflow определяет ощущения от создания, а бьются платформы в итоге за привычки авторов.

Источники