Gesang entfernen und Instrumental erstellen

Teile einen Song in Gesang und Begleitung auf. Höre zuerst einen kurzen Ausschnitt an und speichere die getrennten Spuren als Stereo-WAV – kostenlos, ohne Anmeldung und ohne Upload deiner Aufnahme.

Verarbeitung auf deinem Gerät · Ohne Konto · Ohne zusätzliches Wasserzeichen

Song oder Video wählen

Gesang oder Instrumente können in der anderen Spur verbleiben; der Klang kann sich verändern. Vor dem Download anhören.

Lädt etwa 45 MB für das Modell sowie Verarbeitungsbibliotheken herunter. Deine Aufnahme bleibt auf deinem Gerät.

Das Modell wird zwischengespeichert, wenn der Browser dies erlaubt. Deine Aufnahme wird dabei nicht gespeichert.

Zwei Spuren für Karaoke, Proben und Schnitt

Eine Begleitspur zum Mitsingen oder der Gesang allein zum Üben: DojoClip erzeugt aus einer vorhandenen Aufnahme Gesang und Instrumental. Die Instrumentalspur enthält die musikalische Begleitung, die Gesangsspur die vom Modell geschätzten Vocals. Du brauchst dafür keine einzelnen Studiotracks.

Das eignet sich, um eine kurze Passage zu proben, den Gesang in einer Demo genauer anzuhören oder Audio für einen Schnitt vorzubereiten. Eine Karaoke-Begleitung entsteht als Audiospur; synchronisierte Liedtexte werden hier nicht erstellt.

So entfernst du Gesang aus einem Lied

  1. Datei auswählen. Öffne einen Song oder ein Video vom Gerät, höchstens drei Minuten und 100 MiB. Bei Videos wird die Tonspur verarbeitet.
  2. Eine aussagekräftige Vorschau wählen. Setze den Start auf eine Stelle, an der tatsächlich gesungen wird, und teste bis zu 15 Sekunden. Ein stilles Intro sagt wenig über die Trennung aus.
  3. Die Spuren vergleichen. Höre Original, Gesang und Instrumental an. Achte darauf, ob wichtige Wörter fehlen oder in der Begleitung noch Stimmen durchscheinen.
  4. Die ganze Aufnahme trennen und speichern. Für Audiodateien erhältst du Stereo-WAV. Bei einem Video entscheidest du zusätzlich, ob du nur Audio oder wieder ein Video brauchst.

Ist die Quelle zu lang, schneide zunächst einen Ausschnitt mit dem Audio-Cutter oder Video-Trimmer.

Aus einem Video: nur Ton oder Bild mit neuer Tonspur

Unter Ausgabeformat kannst du bei Videoeingaben zwischen Nur Audio (WAV) und Video wechseln. Für ein Video wählst du anschließend Gesang oder Instrumental als Tonspur. Die Wahl ist auch nach der vollständigen Trennung möglich, ohne den Song erneut zu trennen.

Die Videoausgabe behält das ursprüngliche Bild und ersetzt den Ton. Sie wird bei unterstütztem Videocodec als MP4 oder WebM gespeichert. Nur wenn nötig, wird die Lautstärke der gewählten Tonspur gesenkt, um Übersteuerung beim Videoexport zu vermeiden. Die separaten WAV-Dateien bleiben unverändert. Für ein Video ist immer das vollständige Trennungsergebnis erforderlich; eine Vorschau bleibt eine Audioausgabe.

Worauf du beim Anhören achten solltest

Teste möglichst einen Refrain oder eine andere dichte Passage. In einer leeren Stelle klingt ein Instrumental schnell unauffällig; unter Gesang können hingegen Wortreste oder veränderte Instrumente hörbar werden. Prüfe danach die Gesangsspur auf fehlende Silben, schwankende Lautstärke oder metallische Klanganteile.

Nutze nach Möglichkeit eine wenig verzerrte Ausgangsdatei und behalte das Original. Die Trennung mit SCNet Base schätzt zwei Bestandteile der Mischung. Sie garantiert weder vollständige Isolation noch Studioqualität und trennt keine einzelnen Sänger oder Instrumente in eigene Dateien.

Dein Song bleibt lokal

Der Browser lädt ein Modell von ungefähr 45 MB und die nötigen Verarbeitungsbibliotheken. Danach verarbeitet dein Gerät die Aufnahme. Das Laden dieser Dateien ist kein Upload deiner Musik. Ein Konto ist nicht erforderlich; den Downloads wird kein DojoClip-Wasserzeichen hinzugefügt. Die Geschwindigkeit hängt von deinem Gerät ab, und der Tab muss während der Verarbeitung geöffnet bleiben.

Mit den Ergebnissen weiterarbeiten

Für gesprochenen Ton mit Rauschen nutze Hintergrundrauschen entfernen. Eine fertige Begleitspur kannst du mit dem Musikvisualisierer in ein Musikvideo umsetzen oder mit dem Audio-Cutter kürzen. Weitere Aufgaben findest du bei den kostenlosen Browser-Tools.

Fragen zur Gesangstrennung

Ist der Vocal Remover kostenlos und bleibt mein Song auf meinem Gerät?

Ja. Die Trennung und der Download sind kostenlos, ohne Konto und ohne hinzugefügtes Wasserzeichen. SCNet Base verarbeitet die Aufnahme lokal im Browser. Beim ersten Einsatz werden etwa 45 MB Modelldaten sowie Verarbeitungsbibliotheken geladen; dein Song wird dabei nicht hochgeladen.

Welche Dateien und Songlängen werden unterstützt?

Die Grenze beträgt drei Minuten und 100 MiB pro Datei. Du kannst Audio oder Video mit einer Mono- oder Stereo-Tonspur auswählen, sofern der Browser den Audiocodec lesen kann. Die Dateiendung allein garantiert keine Unterstützung. Für längere Aufnahmen kannst du vorher einen passenden Ausschnitt schneiden.

Kann ich die Trennung an einer bestimmten Stelle ausprobieren?

Ja. Lege den Beginn der Vorschau fest und teste bis zu 15 Sekunden, etwa einen Refrain mit Gesang und Instrumenten. Höre Original, Gesang und Instrumental im Vergleich an. Die Vorschau enthält nur diesen Ausschnitt; für den ganzen Song startest du anschließend die vollständige Trennung.

Bekomme ich nur das Instrumental oder auch den Gesang?

Bei Audioausgabe erhältst du zwei getrennte Stereo-WAV-Dateien: Gesang und Instrumental. Du kannst die gewünschte Spur herunterladen. Das Tool erstellt keine zusätzlichen Einzelspuren für Bass, Schlagzeug oder Gitarre.

Kann ich aus einem Video nur Audio oder wieder ein Video speichern?

Ja. Bei einem Video wählst du das Ausgabeformat „Nur Audio (WAV)“ oder „Video“. Für Videoausgabe legst du Gesang oder Instrumental als Tonspur fest. Das Originalbild bleibt erhalten; MP4 oder WebM ist je nach Videocodec verfügbar. Videoexport braucht das vollständige Ergebnis, Vorschauen sind nur Audio. Zusätzliche Tonspuren und separate Untertitelspuren werden nicht übernommen. Ins Bild eingebrannte Untertitel bleiben erhalten.

Warum sind noch Gesangsreste im Instrumental zu hören?

Das Modell schätzt die Quellen einer fertigen Mischung. Hall, Chorstimmen oder Instrumente mit ähnlichen Klanganteilen können in der jeweils anderen Spur verbleiben. Prüfe eine dichte Stelle mit Kopfhörern und vergleiche beide Ausgaben mit dem Original. Die Trennung ersetzt keine originalen Studiospuren und isoliert nicht zuverlässig einzelne Sänger.

Muss ich etwas installieren und wie lange dauert die Verarbeitung?

Du installierst keine Desktop-App. Nach dem Modelldownload rechnet dein Gerät; Dauer und Speicherbedarf hängen von Browser, Hardware und Aufnahmelänge ab. Ein aktueller Desktop-Browser ist empfehlenswert. Das Modell wird zwischengespeichert, wenn der Browser dies zulässt. Lass den Tab geöffnet und lade Ergebnisse vor dem Verlassen herunter.

Ist das auch das richtige Tool gegen Rauschen in einer Sprachaufnahme?

Für Interviews, Sprachnotizen oder Sprecheraufnahmen mit Hintergrundrauschen ist die separate Rauschreduzierung für Sprache gedacht. Dieser Vocal Remover trennt Gesang und musikalische Begleitung. Er ist kein Werkzeug zum Entfernen von Raumhall oder zum Reparieren übersteuerter Sprache.

Gesang entfernen – kostenlos, ohne Upload | DojoClip