Научилась сдержанности и дышит: настал ли у ИИ-музыки момент «Эврика»?
Обновлено:
Знакомое ощущение? Включаешь свежий ИИ-трек — звучит богато, чисто, даже цепляет. А через минуту уже тянет переключить, и возвращаться к нему потом совсем не хочется.
Дело не в бедности аранжировки. Наоборот — в её избытке. Нейросети будто боятся тишины и забивают звуком каждый сантиметр: плотные барабаны, густая гармония, эмоции на максимуме от первой до последней секунды. Каждый слой кричит «смотри, я здесь», и в итоге всё звучит натужно, как показательное выступление, а не как песня. А ведь в живой авторской песне едва ли не главное — умение вовремя не играть: придержать, оставить воздух, чтобы кульминация действительно выстрелила.
Вспомните нашумевший ИИ-«ремикс» Bubble (《泡沫》), который в итоге удалили, а его автору пришлось извиняться. Дело там было не только в авторских правах: нейросетевая аранжировка почти начисто срезала исходную драматургию — ушли и динамика, и напряжение, и слои. Да и сами границы копирайта сейчас пересобираются на ходу: 29 января 2025 года U.S. Copyright Office выпустило отчёт, где прямо сказано — сгенерированный ИИ результат охраняется, только если человек сам определил достаточно выразительных элементов, одних промптов для охраны недостаточно. U.S. Copyright Office
Справедливости ради: последние пару лет ИИ-музыка старательно учится звучать по-человечески. Ранние вокальные модели тянули песню на одном бесконечном дыхании, а сейчас уже имитируют вдохи и паузы, даже выдают что-то похожее на эмоциональные оттенки. Прогресс технический — налицо. Но треков, к которым хочется возвращаться, всё равно почти нет: настоящей сдержанности модели так и не освоили, а эмоциональные горки внутри песни пока не идут ни в какое сравнение с человеческой работой.
Когда планка «а может ли ИИ вообще написать песню» взята массово, конкуренция неизбежно смещается — от генерации к композиции. И «композиция» тут про две вещи сразу: дотягивает ли модель до планки человеческого продакшна и получает ли музыкант в руки инструмент, с которым реально можно работать, а не просто готовый трек «послушал и забыл».
Недавно вышедшая модель китайской ИИ-платформы Mureka — V9.5 — впервые за долгое время показала движение сразу в обе стороны. На официальной странице продукта V9.5 её описывают так: более естественные мелодия, гармония и аранжировка, плюс подтянутые вокал и охват стилей. Официальная страница Mureka V9.5

Её девиз — “True to music. Open to every idea.” — уже не про «плотнее и сложнее ради самой плотности», а про сдержанность, паузы, эмоции и контроль автора над музыкой. В этом слышится и слоган самого бренда Mureka: “Eureka Flows, Music Grows.”
И вот вопрос: если ИИ-музыка переходит от стадии умеет генерировать к стадии понимает, как сочинять, то не тот ли это самый момент эврики?

ИИ-музыка учится главному — вовремя остановиться
Главное, что случилось с ИИ-музыкой за последние два года, — закрыт вопрос, можно ли вообще сгенерировать цельную песню.
Но возможности больших моделей выровнялись, и одним фактом «песню написал ИИ» уже никого не удивишь. Слушатели оценивают такие треки как обычную музыку: есть ли чувство? есть ли хук? хочется ли нажать repeat? Со стороны предложения картина красноречивая. По данным, которые Deezer опубликовал в июле 2026 года, на пике в июне 2026 года на платформу прилетало под 90 000 полностью сгенерированных ИИ треков в день — больше половины всех новинок за сутки. При этом на них приходилось лишь от 1 до 3 процентов реальных прослушиваний. Уметь генерировать и заставить слушать по кругу — всё ещё две разные вселенные. Deezer Newsroom
Тут и вылезает застарелая болячка нынешней ИИ-музыки: свалка инструментов, вычурная аранжировка, пережатый микс и вокал на пределе человеческих возможностей — почти каждый элемент изо всех сил доказывает собственное существование.

С этим багажом вопросов мы и взялись за свежую модель Mureka — Mureka V9.5.
После живого теста главная неожиданность — V9.5, похоже, и правда начинает понимать, что такое композиция. «Плотнее и сложнее» больше не единственная цель: музыка умеет и разворачиваться, и сжиматься, а это уже гораздо ближе к тому, как пишут люди. Да и связка «промпт — результат» стала заметно послушнее.
Взять Give Me a Little More Time (《再给我多一点时间》), которую мы раньше уже собирали на V9. Текст в этот раз не трогали вообще, а вот промпт переписали полностью:
"Ambient Lo-Fi atmosphere, 70 BPM slow tempo, built on Rhodes electric piano and analog synths with tape-saturation character, supported by delicate urban folk guitar, a minimal kick, and rain samples — aiming for a slow, restrained electronic ballad mood carrying the loneliness of late night."
Результат оказался интереснее, чем мы ждали.
Начнём с тембра и фактуры. Ретро-Lo-Fi V9.5 считывает цельнее: тёплое зерно Rhodes, лёгкий перегруз и аналоговый характер плёночной сатурации — всё это ложится в звук довольно органично, а не выглядит как наспех накиданные теги стиля поверх друг друга.
На практике это означает, что связка «промпт — звук» стала куда внятнее. Когда автор описывает атмосферу, темп и настроение, модель уже умеет переносить эти абстрактные хотелки в конкретные музыкальные решения — и делает это достаточно стабильно, а не просто цепляется за пару жанровых ярлыков.
То же слышно и в логике аранжировки: даже там, где в промпте прямо не просили, Mureka V9.5 больше не гонится за плотностью ради плотности и уже осознанно рулит наполненностью.
В нашем тестовом демо Eureka (《尤里卡》) это слышнее всего на вступлении вокала и на переходах к бриджу — там явно освобождают место под главную мелодию. Подкладка не давит полным спектром без остановки, партии не мешают друг другу дышать, поэтому эмоция успевает нарасти по ходу песни, а не стоит на одном уровне напряжения с первого такта.
Вокальная сторона тоже заметно изменилась.
Послушайте демо The Life We Make. Там, где многие ИИ-модели по умолчанию выкручивают вокал на максимум — плотный тембр и непрерывная подача на форсаже как синоним «качества», — Mureka V9.5 выбирает более сдержанный и живой вариант.
Если вслушаться, подача свободнее, дикция не форсирована ради акцентов. Такое с первого раза может и не ошарашить, зато тихие места, придыхания, согласные, окраска голоса реально начинают работать на эмоцию — и у трека появляется естественная дуга.
Более сдержанные аранжировки, более честная отработка замысла и более живой вокал у Mureka V9.5 упираются в один вопрос: как вообще ИИ начал понимать композиционную логику песни целиком?
Чтобы ответить, придётся заглянуть под капот.
Многие ИИ-модели до сих пор сочиняют пошагово: генерируют на ходу, предсказывая следующий кусок. Трек так собирается быстро, но без единого плана глобальной структуры стыки между частями получаются рваными, эмоциональный темп гуляет, а аранжировка и вокал порой вообще разъезжаются в разные стороны.
Mureka V9.5, наоборот, продолжает и допиливает подход MusiCoT (Music Chain of Thought), который ближе к реальному продакшну. Прежде чем генерировать мелодию, инструменты или вокал, модель сначала строит каркас всей вещи — организацию частей, эмоциональную кривую, динамику, где оставить пустоту, а где поднажать, — и уже вокруг этого каркаса собирает остальное. На открытой исследовательской странице MusiCoT, кстати, отмечается: исследователи взяли десять случайных выборок из набора в 100 песен и сравнили их с базовой моделью, Suno V4, Udio V1.5 и Mureka V5.5. Исследовательская страница MusiCoT

Судя по результату, выигрыш не в том, что какой-то отдельный параметр стал лучше сам по себе, — а в том, что цельность песни стала ближе к логике настоящего сочинения. Аранжировка, вокал и промпт больше не тянут одеяло каждый на себя в процессе генерации, а начинают работать на одну связную музыкальную историю.
И когда в индустрии уже всерьёз говорят о паузах, эмоциональном темпе, точности по промпту и репит-ценности, критерии оценки ИИ-музыки всё плотнее подтягиваются к критериям самой музыки.

Момент «Эврика»: от генерации — к выращиванию идей
Для авторов большинство ИИ-инструментов до сих пор работало по до боли знакомой схеме — по сути, сочинение как дёрганье гача-автомата: повезёт — не повезёт.
Здесь и видно главный сдвиг в том, как Mureka понимает авторов. По мере перехода продукта от разовой генерации к версионному созданию руками чувствуешь простую формулу: модель берёт на себя снижение неопределённости результата, а продукт — расширение пространства решений автора, возвращая человеку больше контроля над музыкой.
В каком-то смысле Mureka переводит ИИ от генерации контента к выращиванию идей — и в этом и есть эврика-момент ИИ-музыки.

Слово «эврика» — от греческого heurēka, «я нашёл». Так обычно называют миг после долгих поисков, когда ключевой ответ найден и идея вспыхивает. Сочинение песен — ровно про это. Сложнее всего обычно не записать песню, а выловить из кучи смутных чувств, мелодий и обрывков то самое вот оно.
На уровне модели Mureka пытается превратить «звучит хорошо» в управляемую системную способность — воспроизводимую и способную улучшаться. Семантика текста по секциям, связка подачи вокала с эмоцией, отношения структуры и развития смысла — всё это сведено в один контур оптимизации.
Но когда модель становится достаточно сильной, самое интересное переезжает на уровень продукта. Важнее написать ещё больше хороших песен — может ли автор удобно выбирать между разными версиями. Поэтому продуктовые возможности Mureka и стоит читать как одну линию мысли.
Взять Character & MV: автор загружает одно фото и короткий сэмпл голоса, после чего виртуальный персонаж из «внешности + голоса» переиспользуется в следующих работах, складываясь в более цельную цифровую идентичность.
Soundtrack закрывает другой шов в творческом процессе. Раньше видеомейкер сначала монтировал картинку, а потом шёл искать более-менее подходящую фоновую музыку; теперь ИИ участвует в озвучке, отталкиваясь от сцены, движения и настроения в кадре.
В саундтреке, который мы тестировали для Growing Up (《长大》), сгенерированная музыка полностью обслуживает видеоряд, идёт за картинкой по мере развития, а не просто подсовывает стилистически похожий фоновый ковёр.
Mureka Co, наоборот, — ближе к ключевому этапу профессионального продакшна. Он заезжает прямо в DAW вроде Ableton Live, где естественным языком можно создавать дорожки, задавать BPM, вешать эффекты, генерировать целые вещи или отдельные стемы, а также разводить стемы и ровнять бит.
Для профи это особенно важно. Рутину забирает ИИ, суждение остаётся за автором, и генерация с продакшном перестают быть двумя разными мирами.
Отсюда сдвиг уже трудно не заметить. Mureka строит цельную ИИ-нативную платформу для создания.
Новички могут делать тексты, мелодию, вокал и готовые песни через разговорного агента или кастомный режим. Авторам контента доступны озвучка картинок и видео и ИИ-клипы. Профи-продюсеры уходят вглубь DAW-процесса через Studio, мультитрековое редактирование, экспорт стемов и Mureka Co.
Вся цепочка закрыта целиком — от первой искры через генерацию, доработку, видеопродакшн и профессиональный финиш. Одну идею можно быстро покрутить на платформе, а потом вести через разные версии под контролем — а за автором остаётся то, что автоматизируется хуже всего: вкус, решения, что оставить, а что вырезать, и финальное высказывание.
Поэтому и оценивать, чем Mureka отличается, бессмысленно по одному вопросу — чьи демо V9.5 эффектнее, чем у другой модели.

К чему всё идёт
В таком свете Mureka уже перерастает чистый генератор ИИ-музыки и движется ближе к творческой инфраструктуре эпохи ИИ-музыки: она связывает не просто модели и готовые работы, а всю цепочку — вдохновение, генерацию, редактирование и релиз.
Разница в том, что авторы, способы производства и формы контента здесь более ИИ-нативные.
А значит, следующий виток конкуренции в ИИ-музыке, скорее всего, будет не битвой моделей в лоб, а битвой за точку входа в создание.
В будущем бороться будут не только за то, чей трек звучит лучше, а за то, какой инструмент автор открывает по привычке, — за место, где идея проходит путь от первого появления через генерацию, правки и шлифовку до готовой работы.
Возможности модели, конечно, по-прежнему важны: они задают потолок того, что может ИИ-продукт. Но по мере того как разрыв между моделями сужается, удерживать пользователей будет другое — удобный ли workflow, хватает ли творческой свободы и умеет ли платформа переваривать всё более сложные запросы авторов.
Модель задаёт потолок возможностей, workflow определяет ощущения от создания, а бьются платформы в итоге за привычки авторов.
Источники
- Оригинальная статья: "懂克制、会呼吸,AI音乐的'尤里卡时刻'到了?" (Restrained, and Able to Breathe: Has AI Music Reached Its "Eureka Moment"?) — локальная рукопись от пользователя; исходный URL не предоставлен
- U.S. Copyright Office, NewsNet Issue 1060 (29 января 2025) — анонс отчёта Copyright and Artificial Intelligence, Part 2: Copyrightability
- Deezer Newsroom (21 июля 2026) — полностью сгенерированные ИИ треки превысили половину суточных загрузок на пике в июне 2026
- Официальная страница продукта Mureka V9.5
- Открытая исследовательская страница MusiCoT (Music Chain of Thought)