Usuwanie wokalu
Usuń wokal z dowolnego utworu za pomocą sztucznej inteligencji. Działa bezpośrednio na Twoim urządzeniu — pliki nigdy nie są przesyłane do serwera.
Przeciągnij plik audio tutaj lub kliknij, aby wybrać plik
MP3, WAV, FLAC, OGG, M4A · Do 15 minut
Prywatne — przetwarzane na Twoim urządzeniu, nigdy nie są przesyłane
Szybsze przetwarzanie, mniejszy plik do pobrania. Przy pierwszym uruchomieniu pobierany jest model AI o rozmiarze 14 MB.
Przygotowywanie...
Przetwarzanie na miejscu
Jak usunąć wokal
- 1 Prześlij utwór (MP3, WAV, FLAC, OGG)
- 2 Sztuczna inteligencja wyodrębnia wokal, perkusję, bas i instrumenty
- 3 Pobierz poszczególne ścieżki lub odtwórz je
Najczęściej zadawane pytania
Jaka jest różnica między trybem „Szybki” a trybem „Jakość”?
Tryb „Szybki” wykorzystuje model o rozmiarze 14 MB, zoptymalizowany pod kątem szybkości — zazwyczaj zajmuje to 15–30 sekund w przypadku utworu trwającego 4 minuty. Tryb „Jakość” wykorzystuje większy model o rozmiarze 32 MB, wytrenowany na bardziej zróżnicowanym materiale, który lepiej zachowuje czystość basów i radzi sobie z ogonami pogłosu. Wybierz tryb „Szybki” do szybkiego odsłuchu, a tryb „Jakość” do ostatecznej produkcji.
Jak właściwie działa usuwanie głosu?
Sieć neuronowa, wytrenowana na tysiącach profesjonalnych nagrań wielościeżkowych, uczy się oddzielać wzorce częstotliwościowe wokalu od instrumentów. Przetwarza spektrogram audio w nakładających się fragmentach i odtwarza oddzielne przebiegi wokalne i instrumentalne.
Czy korzysta z mojej karty graficznej?
Jeśli WebGPU jest dostępne (na większości nowoczesnych urządzeń stacjonarnych), przetwarzanie wniosków odbywa się na procesorze graficznym (GPU) — co jest znacznie szybsze niż przetwarzanie wyłącznie na procesorze centralnym (CPU). Na starszych urządzeniach system automatycznie przechodzi na wielowątkowy WASM. Nie jest wymagana żadna konfiguracja.
Czy usunie to również chórki?
Model oddziela wokal główny i chórki od podkładu instrumentalnego. W przypadku utworów, w których chcesz zachować harmonie, ale usunąć wyłącznie wokal główny, wyniki mogą się różnić — model traktuje wszystkie elementy wokalne w podobny sposób.
Czy to działa w przypadku podcastów lub mowy?
Tak, choć jest zoptymalizowany pod kątem muzyki. W przypadku nagrań słownych z podkładem muzycznym skutecznie oddziela głos od akompaniamentu. W przypadku mowy, której towarzyszą jedynie odgłosy otoczenia, dedykowane narzędzie do usuwania szumów może zapewnić czystsze wyniki.
A co z przetwarzaniem danych na urządzeniach mobilnych?
Na urządzeniach mobilnych bez wystarczającej ilości pamięci GPU przetwarzanie jest automatycznie kierowane do usługi Cloud Assist — bezpiecznego przetwarzania po stronie serwera, w ramach którego pliki są usuwane natychmiast po zakończeniu operacji. Użytkownicy komputerów stacjonarnych przetwarzają dane w całości na swoim urządzeniu.
Jakie formaty wyjściowe są dostępne?
Zarówno wyodrębniona ścieżka wokalna, jak i ścieżka instrumentalna są eksportowane w formacie WAV bezstratnym przy zachowaniu oryginalnej częstotliwości próbkowania. Pliki mają ten sam czas trwania i można je bezpośrednio załadować do programu DAW.