Почему AI-треки звучат дёшево — и как это исправить
Слушатели от 8 до 80 лет вычисляют AI-трек за секунды. Вот глубокое лечение: стемы, живые барабаны, MIDI-бас, хирургия вокала и глубина — со скриншотами из моих реальных сессий.
Неудобный эксперимент: включите сырой экспорт из Suno кому угодно — ребёнку, бабушке, случайному пассажиру в автобусе. Большинство за пару секунд вынесет вердикт: «а, это одна из тех нейропесен». Не потому, что они аудиофилы — большинство из них не отличит компрессор от кофемолки. Они слышат это, потому что некоторых вещей просто нет в файле — а человеческое ухо раздражающе хорошо замечает отсутствие.
В прошлой статье мы мастерили трек из Suno для Spotify, и я честно предупредил: иногда мастеринг бессилен. Сегодня — сиквел. Мы вскрываем трек, разбираем его на части и меняем слабые органы. Хирургия, а не косметика. Всё, что ниже, — из моих реальных сессий, со скриншотами.

Сделали трек в Suno? Доведу его до релизного качества — от $39.
Почему один мастеринг не спасёт
Мастеринг работает с готовым стереофайлом. Он умеет выровнять, уплотнить, осветлить и сделать громче — но он не умеет придумать атаку бочки, которую никто не сгенерировал. Подъём эквалайзером на 18 кГц там, где генератор перестал рисовать, не создаёт «воздух» — он создаёт громкое ничего.
В прошлый раз я сравнил мастеринг слабой генерации с полировкой машины с убитым двигателем. Так вот, эта статья — про ремонт двигателя. Если не читали первую часть— начните с неё: половина проблем лечится на этапе мастеринга, дёшево и сердито. Но если ваш правильно отмастеренный трек всё равно звучит рядом с коммерческим релизом как пластиковое демо — добро пожаловать в глубокую реставрацию.
Как именно звучит 'дёшево'
Диффузные модели не записывают инструменты — они рисуют одну большую картину всего микса сразу. Там, где элементы пересекаются, они съедают друг друга. Поэтому у каждой сырой генерации одни и те же четыре приметы:
Бочка без удара. Особенно под вокалом — везде, где звучит голос, у бочки съеден верх. Бит ощущается мягким, даже когда измеритель клянётся, что громко.
Бас, который бубнит. Зафильтрованный, ватный, без читаемых нот. Часто это технически контрабас, звучащий так, будто играет через подушку.
Хеты из шипящего песка. Сопливые резонансы в районе 2–4 кГц, а выше ~18 кГц — тишина. 'Воздух' живой записи просто не был сгенерирован.
Один общий реверб на всём. Весь трек плавает в одном пространстве, которое нельзя выключить — одновременно размытом и безжизненном.
Чем лучше акустическая система, тем громче кричат эти проблемы. И вот стратегический вывод, на котором строится весь план: барабаны — самый широкополосный инструмент в миксе — бочка внизу, малый в середине, тарелки сверху. Замените барабаны на настоящие — и одним ходом замаскируете большинство артефактов по всему спектру. Поэтому с них и начинаем.
Шаг 1: Разделить трек на стемы
Сначала трек должен стать дорожками. Бесплатный инструмент для этого — UVR5 (Ultimate Vocal Remover). Закидываете файл, выбираете Demucs как метод обработки — и не соглашайтесь на модели по умолчанию. Откройте список, нажмите Download More Models и в Download Center скачайте htdemucs_ft — доученную модель от Meta, заметно чище стоковых. Выбираем All Stems, жмём Start Processing:

На выходе — четыре стема: вокал, барабаны, бас и всё остальное. Для замены барабанов стоит спуститься на уровень глубже и разобрать барабанный стем на бочку, малый, хеты и тарелки — rebitapp.com делает это автоматически. Вот так выглядит полностью разобранная сессия в моём Studio One:

Совет профи
Алгоритмы разделения обожают записывать саксофоны, скрипки и трубы в «вокал». Прослушайте каждый стем, прежде чем верить этикетке — всё, что попало не туда, отправляется в группу инструментов. И сразу подпишите и раскрасьте дорожки: пять скучных минут сейчас экономят час игры в «а что у нас на Track 14» потом.
Шаг 2: Заменить барабаны
Бочка идёт первой. Плагин-триггер — у меня apTrigga 3, SPL DrumXchanger тоже справится — слушает стем бочки, находит каждый удар и ставит чистый сэмпл точно в то же место. AI-бочка со съеденной атакой заменяется настоящей, а грув не сдвигается ни на миллиметр:

Естественность решают две настройки. Выберите сэмпл, похожий на оригинал — вы улучшаете бочку, а не меняете жанр. И уберите динамику до 40–50%, чтобы тихие удары остались тихими и исполнение продолжало дышать. Малый барабан — та же операция, второй куплет.
Хеты — главный стукач любого AI-трека. Тут две дороги. Если сама партия приличная, недостающий верх можно достроить, подмешав белый шум к каждому удару — детектор-синтезатор вроде Klevgrand Fosfat следит за хетами и доклеивает точно оформленный всплеск шума сверху. «Воздух», который никто не генерировал, строится с нуля:

А если партия безнадёжна — сопливая, размазанная, ритмически нетрезвая — не реанимируйте её. Сыграйте заново в любом барабанном сэмплере с живыми velocity. Это десять минут, и обычно звучит лучше, чем оригинал когда-либо звучал.
Совет профи
Тихий слой винилового шума на шине барабанов (в стиле RC-20) — двойной агент: добавляет винтажный характер и маскирует мелкие остатки артефактов. Инженеры пользовались этим трюком за десятилетия до того, как кто-то произнёс «диффузная модель».
Сделали трек в Suno? Доведу его до релизного качества — от $39.
Шаг 3: Пересобрать бас
Включите соло на отделённом басовом стеме — и скорее всего услышите нечто вроде контрабаса, бубнящего из-за стены. Хорошая новость: басовые линии у AI почти всегда простые. Снимите партию в MIDI на слух — даже вбить её нота за нотой — вопрос минут, а не часов — и отдайте её нормальному басовому инструменту. Я часто беру EZbass:

Разница мгновенная и беспощадная: на 50–100 Гц вдруг появляются настоящие ноты вместо тёплого тумана. Бочка и бас наконец жмут друг другу руки, а не борются в грязи.
Совет профи
Если новый бас звучит слишком чисто для этого трека, не хватайтесь сразу за дисторшн — подложите тихонько оригинальный AI-стем снизу. Его размытость превращается в фактуру, когда ноты несёт настоящий инструмент.
Шаг 4: Трюк с вокалом на 9 кГц
AI-вокал не перепоёшь (то есть можно — и это лучший апгрейд из возможных, но это уже другой бюджет). Зато можно отделить голос от песка. Мой фирменный ход: разделить вокал в районе 9 кГц. Ниже этой линии живёт настоящий голос — тело, подача, согласные. Выше, в AI-вокале, живёт в основном шум генерации: мерцающее шипение, которое кричит «синтетика».

С нижней половиной обращайтесь как с обычным вокалом: чистите, де-эссер, эквалайзер. Верхнюю — срезаем и достраиваем воздух деликатным эксайтером или отфильтрованным слоем шума — та же философия, что с хетами. Голос сохраняет характер, пластиковая плёнка сходит.
Совет профи
Не режьте всё выше 9 кГц на автопилоте — часть согласных несёт там настоящую энергию. Автоматизируйте срез: жёстче на длинных нотах, мягче на «с» и «т».
Шаг 5: Два реверба — две задачи
После всей этой чистки трек зазвучит странно сухо — оригинальное пространство было впечатано в генерацию, и мы только что большую его часть соскребли. Не поддавайтесь соблазну залить всё одним большим ревербом — именно так снова получается рендер. В настоящих продакшенах работают два пространства с двумя задачами: короткий эмбиенс (маленькая комната, 0,3–0,5 с), который даёт элементам тело, и длинный хвост (пластина или зал, 2–3 с), который даёт треку глубину. Оба на сендах, подмешаны под сухой сигнал:

А теперь часть, которую почти все пропускают: автоматизируйте сенды. Суше в куплете, шире в припеве, чуть больше хвоста на последнем слове перед дропом. Движение — именно оно считывается как «живое». Статичный реверб — просто ещё один способ звучать как генерация.
Шаг 6: Собрать всё обратно
Дальше — обычная сессия сведения. Сбалансируйте новые барабаны и бас с уцелевшими стемами, склейте микс-шину лёгким компрессором (1–2 дБ редукции, медленная атака) и отправьте на мастеринг — точная цепочка, цели по LUFS и настройки лимитера есть в первой части. А потом честный тест: сравните результат с исходной генерацией на одинаковой громкости. Та же песня — другая лига.
Про время, без прикрас: для того, кто делает это каждую неделю, глубокая реставрация — это несколько часов на трек. В первый раз уйдёт выходной-другой, и это нормально — вы не медленные, вы учитесь продакшену на треке, который уже любите. Честно говоря, дешевле музыкальной школы не бывает.
FAQ
Можно ли реставрировать трек из одного MP3?
Да. Разделение на стемы работает с любым стереофайлом — просто WAV даёт алгоритмам больше материала, и стемы получаются чище. Если у вас платный план Suno — всегда экспортируйте WAV. Но если от любимой генерации остался только MP3 — всё равно стоит попробовать.
Обязательно менять все инструменты?
Нет — и это хорошая новость. Барабаны — самый широкополосный инструмент в миксе: бочка живёт внизу, малый в середине, тарелки сверху. Меняете одни барабаны — и маскируете большую часть артефактов генерации по всему спектру. Бас — приоритет номер два. Остальное — бонусный раунд.
А если я не играю ни на барабанах, ни на басу?
И не нужно. Замена барабанов — это триггеринг: плагин сам находит удары, которые уже есть в треке, и ставит чистые сэмплы точно в те же места. А басовые партии в AI-треках обычно настолько простые, что их можно вбить в MIDI нота за нотой, а инструменты вроде EZbass сыграют их за вас.
Сколько времени занимает глубокая реставрация?
Для того, кто делает это каждую неделю — несколько часов на трек. В первый раз закладывайте выходные и относитесь к этому как к курсу продакшена, который стоит вам только терпения. А если это не ваше представление о веселье — ровно для этого и существует финишинг у инженера.
После всех замен это всё ещё моя песня?
Да. Композиция, мелодия, текст и аранжировка остаются нетронутыми — вы заново записываете исполнение, а не переписываете песню. Считайте это кавером на собственный трек, только сыгранным лучше. Коммерческие права на саму генерацию определяются вашим планом Suno — так же, как и до реставрации.
Хотите пропустить операцию?
Этот воркфлоу — буквально моя работа для клиентов: стемы, живые барабаны, пересобранный бас, чистка вокала, сведение и мастеринг. Бесплатное превью обработанного трека до любой оплаты.
Suno Track Finishing →Сделали трек в Suno? Доведу его до релизного качества — от $39.