Musik vertonen
mit DAWs ↓
Müssen KI-Songs nachbearbeitet werden? Eine Frage, die mit Blick in die Zukunft
praktisch nicht zu beantworten ist, da die KIs und deren Funktionsumfang stetig verbessert werden. Ausgehend
vom Zeitpunkt der Veröffentlichung dieses Beitrages im Sommer des Jahres 2026 trifft aber leider eines zu, es
wird gefühlt mehr KI-Slop (KI-Spam) produziert, als für den Markt verträglich ist.
Wer aber seine eigenen kreativen Ideen mit Hilfe einer KI umsetzen möchte, wird einen Song nur dann nicht
nacharbeiten, wenn er mit seinem Wunschsong rundherum zufrieden ist. Letzteres ist bisher nicht immer ohne
Nachbearbeitung erreichbar. Auf ein solches Beispiel werden wir in diesem Tutorial eingehen. Als DAW
benutzen wir dafür das FL-Studio, doch ähnlich sollte es in jeder anderen DAW (Digital Audio Workstation)
ebenfalls funktionieren.
Unser Wunsch war ein verträumtes Chancon über Paris, eine Sängerin in Begleitung eines Pianos als Soloinstrument.
Etwas Violine zur Abrundung, mehr nicht. In Suno wurde es nicht besser unabhängig von der Anzahl an Versuchen.
Weiterhin schwebte die Gesangsstimme nicht ruhig und verträumt über dem Piano, sondern lag gefühlt um drei bis
vier dB zu laut über diesen.
Bei der Nachbearbeitung wurden im ersten Schritt alle in Suno getrennten Stems in die DAW geladen, danach die Spur mit Drums entfernt. Warum Suno den letzten Teil des Prompts missachtete (No percussion, no ...), war und blieb für uns ein Rätsel.
Der Prompt:
Soft, dreamy intimate French chanson, Warm female vocals, Solo piano with a subtle, lyrical violin in the
background, Very minimal, Slow tempo, No percussion, no orchestral arrangement, no additional instruments

Danach das Volumen der Spuren einpegeln. Dazu auf das kleine Symbol (Icon) am Anfang der jeweiligen
Spur klicken, welches eine Wellenform darstellen soll, aber mehr an einem querliegenden Bauern vom Schachspiel
erinnert. Im sich öffnenden Menü Automate Volume wählen.
Die sichtbar werdende Volumenlinie hat nun am Spuranfang und Ende einen Anfasser für die Maus, doch bei Bedarf
können weitere gesetzt werden. Eine ähnliche Möglichkeit besitzen vermutlich die meisten DAWs und Filmschnittprogramme.

Wer lieber mit runden Werten arbeitet, kann, statt mit der Maus zu ziehen, mit einem Klick auf den jeweiligen Anfasser einen Wert eingeben und mit Enter bestätigen. In unserem Beispiel senkten wir die Gesangsspur um -3,5 dB ab.

Vor dem Mastering kann in einem Slot ein Fruity Parametric EQ 2 eingefügt und mit einem Preset ein Hoch- und
Tiefpassfilter geladen werden. Die menschliche Stimme und die meisten Musikinstrumente kommen nicht unter oder
über diese Grenzen. Eine Ausnahme bilden die tiefsten Töne eines Konzertflügels, einige große Orgelpfeifen, ebenfalls
große Konzertharfen in den tiefsten Tönen, Kontra- und E-Bass, große Trommeln und Pauken, und noch einige andere
Musikinstrumente.
Dem steht gegenüber, dass die menschliche Hörgrenze mit jedem Lebensjahrzehnt abnimmt, und im unteren Bereich bei
einigen Instrumenten die tieferen Töne eher als Vibrationen wahrgenommen werden. Bei Trommeln und Pauken sogar als
Druckgefühl oder als Erschütterungen spürbar sind.
Um zu gleichmäßigen Ergebnissen bei der nachfolgenden Messung zu kommen, daran denken, die Option "Lineare Phase" zu
aktivieren. Der Grund, durch den Filter kommt es zu einer Phasenverschiebung, die Laufzeit einzelner Frequenzen ändert
sich und die Wellenform wird spitzer, wodurch der True Peak Wert steigt. Die aktivierte Option verhindert
Phasenverzerrungen.
Auf der anderen Seite könnten sich Störgeräusche in diesen Grenzbereichen befinden, die durch einen Hoch- und
Tiefpassfilter minimiert werden.

Als Kompressor benutzen wir den vom Fruity Limiter, als obere Grenzbereiche die für YouTube durch eine KI gefundenen
Werte. Bei Überschreitung der Grenzwerte wird der Loudness Normalizer von YouTube aktiv, was schlimmstenfalls zu
Verzerrungen führen kann.
In einem konkreten Beispiel war bei einem neuen Song von einer ausländischen Sängerin der Chorus auf dem Handy leiser
als die Solo-Gesangsstimme zu hören und dasselbe Video auf dem Computer abgespielt, klang der Chorus erbärmlich verzerrt.
Stand Frühjahr 2026, möglich dass diese Probleme zwischenzeitlich von YouTube gelöst wurden.
Wie dem auch immer sei, halten wir uns an die Grenzwerte, können derartige Problemen von vornherein ausgeschlossen werden.
Es sei angemerkt, andere Plattformen haben noch niedrigere Grenzwerte, nach denen ein Creator sich erkundigen sollte.
Durch die Volumenreduzierung der Gesangsspur und der der Entfernung der Spur mit den Drums, bedurfte es nur noch einer
geringen Kompression, um True Peak vom Loudness Meter unter -1 dB zu halten und Integrated Lufs nicht über -14 dB steigen
zu lassen. Die gewählten Werte lassen sich somit nicht verallgemeinern, dienen nur als Überblick. Letztenendlich wird
jeder Nutzer mit der Zeit seine eigenen Erfahrungen sammeln, um zu den gewünschten Ergebnissen zu gelangen.
Damit der Kompressor aktiv werden kann, muss dessen Schwellenwert unter den Spitzenwerten des Eingangssignals liegen,
im Beispiel –8 dB. Dieser Wert wird mit dem "THRESH"-Regler eingestellt.
Mit dem "RATIO"-Regler wird das gewünschte Kompressionsverhältnis eingestellt, wobei bei einem Verhältnis von 1:1 noch
keine Kompression erfolgt, bei 2:1 um die Hälfte bei Überschreitung des mit dem "THRESH"-Regler Wertes. In unserem Beispiel
stellten wir auf einen Wert von 1.5:1 ein, was einem eher moderaten Verhältnis entspricht, wodurch der Kompression nicht
durchgängig arbeit.
Die Feinjustierung erfolgte mit dem "KNEE"-Regler. Falls keine besonderen Effekte erwünscht sind, sollte der Wert für
diesen Regler ebenfalls moderat eingestellt werden.
Testwerte bei Ratio unverändert 1.5:1 und Thresh -8 dB:
Da sich die Werte für Integrated Lufs in einem ähnlich niedrigen Bereich veränderten, beließen wir es dem untersten Wert. Wie bereits weiter oben beschrieben, lässt sich nichts verallgemeinern. Soll keine abrupte Änderung, z.B. bei einer Gesangstimme, sich bemerkbar machen, ist ein weich eingestelltes Knee sicherlich oft die bessere Wahl.

Vergleichswerte vor der Splittung in Stems, Nachbearbeitung und Mastering:

Abschließend zwei Hörproben als Vergleich. Veröffentlicht haben wir dieses Chanson mit dem Titel "Entre lumière et poussière" (Zwischen Licht und Staub), außer als Hörprobe in diesem Beitrag und in einem Faden im Forum von Clavio.de, bis heute nicht.
Ein Grund für die bisherige Nichtveröffentlichung, für so ein Chanson muss ein passendes Video generiert werden, was wirklich ausgesprochen gut darauf abgestimmt ist, um einen Mehrwert zu bieten. Erst beides zusammen kann seine Wirkung entfalten. Falls wir noch eins erstellen, werden wir es hier einbinden.
Musik vertonen
mit DAWs ↓