Vocal Remover Gesang BPM-Finder BPM Tonart-Finder Key Track ID ID
30 min remaining

Erhalten Sie mehr Cloud Assist-Minuten
Pricing

Vocal Remover

Entfernen Sie mithilfe von KI den Gesang aus jedem beliebigen Song. Läuft auf Ihrem Gerät – Dateien werden niemals hochgeladen.

Ziehen Sie die Audiodatei hierhin oder klicken Sie hier, um nach einer Datei zu suchen

MP3, WAV, FLAC, OGG, M4A · Bis zu 15 Minuten

Privat - wird auf Ihrem Gerät verarbeitet, nie hochgeladen

Schnellere Verarbeitung, kleinerer Download. Bei der ersten Verwendung wird ein 14 MB großes AI-Modell heruntergeladen.

So entfernt man Gesang

  1. 1 Lade einen Song hoch (MP3, WAV, FLAC, OGG)
  2. 2 Die KI trennt Gesang, Schlagzeug, Bass und Instrumente voneinander
  3. 3 Einzelne Stems herunterladen oder abspielen

Häufig gestellte Fragen

Was ist der Unterschied zwischen dem „Schnell“- und dem „Qualitäts“-Modus?
Der „Fast“-Modus verwendet ein auf Geschwindigkeit optimiertes 14-MB-Modell – in der Regel dauert die Bearbeitung eines 4-minütigen Songs 15 bis 30 Sekunden. Der „Quality“-Modus nutzt ein größeres 32-MB-Modell, das mit vielfältigerem Material trainiert wurde und die Klarheit der Bässe besser bewahrt sowie Nachhallschwänze besser verarbeitet. Wählen Sie „Fast“ für schnelle Vorschauen und „Quality“ für die endgültige Produktion.
Wie funktioniert die Stimmbeseitigung eigentlich?
Ein neuronales Netzwerk, das anhand Tausender professioneller Multitrack-Aufnahmen trainiert wurde, lernt, die Frequenzmuster von Gesang und Instrumenten voneinander zu trennen. Es verarbeitet das Audiospektrogramm in überlappenden Abschnitten und rekonstruiert separate Wellenformen für Gesang und Instrumente.
Wird dabei meine GPU genutzt?
Wenn WebGPU verfügbar ist (auf den meisten modernen Desktop-Geräten), wird die Inferenz auf Ihrer GPU ausgeführt – deutlich schneller als bei einer reinen CPU-Verarbeitung. Auf älteren Geräten wird automatisch auf multithreaded WASM zurückgegriffen. Es ist keine Konfiguration erforderlich.
Wird dabei auch der Hintergrundgesang entfernt?
Das Modell trennt den Lead- und den Begleitsang gemeinsam vom Instrumentalteil. Bei Titeln, bei denen Sie die Harmonien beibehalten, aber nur den Lead-Gesang entfernen möchten, können die Ergebnisse variieren – das Modell behandelt alle Gesangsanteile gleich.
Funktioniert das bei Podcasts oder Sprachaufnahmen?
Ja, allerdings ist es für Musik optimiert. Bei gesprochenem Wort mit Hintergrundmusik trennt es die Stimme effektiv von der Begleitung. Bei Sprache, bei der nur Umgebungsgeräusche zu hören sind, liefert ein spezielles Tool zur Geräuschunterdrückung möglicherweise sauberere Ergebnisse.
Wie sieht es mit der Verarbeitung auf Mobilgeräten aus?
Auf Mobilgeräten ohne ausreichenden GPU-Speicher wird die Verarbeitung automatisch an Cloud Assist weitergeleitet – eine sichere serverseitige Verarbeitung, bei der die Dateien unmittelbar nach Abschluss gelöscht werden. Bei Desktop-Nutzern erfolgt die Verarbeitung vollständig auf dem Gerät.
Welche Ausgabeformate stehen zur Verfügung?
Sowohl die isolierte Gesangsspur als auch die Instrumentalspur werden als verlustfreie WAV-Dateien mit der ursprünglichen Abtastrate exportiert. Die Dateien haben dieselbe Dauer und können direkt in eine DAW geladen werden.
Brizm

Cloud Assist freischalten

Verlagern Sie schwere Verarbeitungsaufgaben auf sichere private GPUs. 15 kostenlose Minuten für den Start.

oder