Przejdź do treści
Magazyn

Piosenka, która nie boli. Tydzień z muzyką z Suno i Udio

Muzyka z AI brzmi jak muzyka, która o nic nie prosi - i właśnie dlatego tak łatwo się na nią godzimy.

8 min czytania
Piosenka, która nie boli. Tydzień z muzyką z Suno i Udio

👁 120 przeczytań

// w skrócie
  • Suno i Udio nie zabiją muzyki, ale mogą wychować pokolenie, które przestanie odczuwać różnicę między dźwiękiem a wiadomością od drugiego człowieka.
  • Po siedmiu dniach słuchania wyłącznie muzyki AI autor stwierdził, że wygenerowany kawałek jest nieodróżnialny w ślepym teście od produkcji zamówionej za 3000 zł do reklamy.
  • Muzyka z AI sprawdza się jako tło do filmów, gier, podcastów i prezentacji, ale problem zaczyna się, gdy wygenerowany utwór konkuruje z piosenką, która kogoś kosztowała życie.

Około trzeciego dnia zauważyłem, że nucę pod nosem piosenkę, której nikt nigdy nie napisał. Nie było jej w mojej głowie tydzień wcześniej, nie było jej nigdzie na świecie, a jednak siedziała mi w uchu jak refren z wakacji. Wygenerowałem ją kliknięciem, dopisałem jedną linijkę promptu, poszedłem zrobić kawę. I ta melodia - anonimowa, bezojcowska, złożona z niczego - okazała się chwytliwsza niż połowa rzeczy, które świadomie kupiłem w tym roku. Usiadłem z tą kawą i pomyślałem coś, czego przez tydzień nie umiałem odwołać: problem z muzyką z AI nie polega na tym, że jest zła. Polega na tym, że jest niepokojąco dobra i przy tym całkowicie o nic nie prosi.

Postawię tezę od razu, bo felieton to nie proces sądowy, w którym oszczędza się wyrok na koniec. Suno i Udio nie zabiją muzyki. Zrobią coś gorszego: nauczą nas słuchać muzyki, która nie chce od nas absolutnie niczego. Żadnej uwagi, żadnego wysiłku, żadnego dyskomfortu. I to jest, moim zdaniem, najniebezpieczniejsza rzecz, jaka przydarzyła się dźwiękowi od czasu wynalezienia windy z głośnikiem.

Piosenka, która nie boli. Tydzień z muzyką z Suno i Udio

Tydzień, w którym wyłączyłem wszystko, co ludzkie

Zasady ustaliłem sobie prosto. Przez siedem dni nie słucham niczego, co nagrał człowiek. Do pracy, do biegania, do gotowania, do zmywania - tylko Suno i Udio. Generuję, odsłuchuję, odrzucam, generuję znowu. Traktuję to nie jak zabawkę, tylko jak radio, które ktoś mi zainstalował w mieszkaniu i którego nie da się przełączyć na stację prowadzoną przez ludzi.

Pierwsza reakcja - i muszę być tu absolutnie uczciwy - to był zachwyt. Rzeczywisty, fizyczny zachwyt. Wpisujesz „melancholijny indie folk o poranku w mieście, kobiecy wokal, dużo przestrzeni” i po kilkudziesięciu sekundach dostajesz coś, co brzmi jak utwór, który mógłby lecieć w playliście „kawiarnia, sobota, deszcz”. Wokal oddycha. Gitara ma pogłos, który zna swoje miejsce. Jest bridge. Jest to małe napięcie przed refrenem, które w prawdziwych piosenkach bierze się z lat słuchania i wielu nieudanych prób. Tutaj bierze się z niczego, i to działa.

Kto twierdzi, że to wciąż brzmi jak tania podróbka, prawdopodobnie ostatni raz sprawdzał te narzędzia rok temu, a rok w tej dziedzinie to epoka geologiczna. Dzisiaj potrafię wygenerować kawałek, którego nie odróżniłbym w ślepym teście od produkcji zamówionej za trzy tysiące złotych do reklamy jogurtu. I to jest prawda, którą trzeba powiedzieć głośno, zanim przejdę do tego, co mnie w tym przeraża: ta muzyka jest technicznie lepsza, niż zasługuje na to sposób, w jaki powstaje.

Co jest naprawdę dobre (i nie ma sensu udawać, że nie)

Najlepsze, co ma AI, to natychmiastowość dopasowana do nastroju. Przez lata nosiłem w głowie mgliste „chciałbym coś takiego, ale nie do końca to”. Znacie to uczucie: szukacie utworu, który istnieje tylko jako przeczucie kształtu. Suno i Udio po raz pierwszy pozwalają wyprodukować dokładnie to przeczucie. Nie znaleźć podobne - wyprodukować dokładnie to. To jest jakościowa zmiana i byłbym nieuczciwy, gdybym ją bagatelizował.

Druga rzecz, która działa lepiej, niż powinna, to pastisz. Poproś o „utwór w duchu lat siedemdziesiątych, ciepła analogowa produkcja” i dostaniesz coś, co ma tę mgiełkę, ten szum taśmy, tę leniwą sekcję rytmiczną. AI jest genialnym imitatorem gatunku, bo gatunek to z definicji zbiór statystycznych regularności, a statystyka to jedyne, co te modele naprawdę potrafią. Country brzmi jak country. Synthwave brzmi jak synthwave. Wszystko brzmi jak swój własny stereotyp, wykonany bez skazy.

I tu przemyciłem już pierwszą rysę, bo pochwała i zarzut są tym samym zdaniem wypowiedzianym dwoma tonami głosu. To, co czyni tę muzykę tak dobrą w naśladowaniu, czyni ją jednocześnie niezdolną do zaskoczenia. AI nie może zagrać fałszywej nuty, która okaże się genialna. Nie ma w niej pomyłki, która stanie się manierą, ani wady, która stanie się podpisem. A przecież cała historia muzyki, którą kocham, to historia wad. Chropowaty głos, który nie powinien śpiewać. Perkusista, który spieszy w refrenie, bo się cieszy. Producent, który zostawił brzęczenie wzmacniacza, bo pasowało.

Muzyka z AI jest jak twarz bez zmarszczek: technicznie doskonała i dlatego trudno przy niej ustalić, ile ma lat, skąd jest i czy w ogóle coś przeżyła.

Trzeciego wieczoru puściłem sobie wygenerowaną balladę i przez chwilę było naprawdę pięknie. A potem wsłuchałem się w tekst. I to był moment, w którym zachwyt zaczął się kruszyć.

Piosenka, która nie boli. Tydzień z muzyką z Suno i Udio

Fałsz, którego nie da się odsłuchać

Teksty to pięta achillesowa, ale nie w sposób, w jaki się tego spodziewałem. Nie chodzi o gramatykę - ta bywa poprawna. Chodzi o to, że teksty z AI mówią o uczuciach, nie mając za sobą żadnego. To słowa o tęsknocie napisane przez coś, co nigdy nie tęskniło. Rymy są zgrabne, obrazy ładne - „deszcz na szybie”, „światła miasta”, „twoje oczy jak” - i wszystkie są cytatem z cytatu z cytatu. To jest emocja odbita w tysiącu luster, w której gdzieś na dnie nie ma już żadnego oryginału.

Zacząłem to nazywać w głowie „muzyką, która nie boli”. Bo prawdziwa piosenka gdzieś cię uwiera. Jest w niej linijka za odważna, dźwięk za ostry, decyzja, z którą się nie zgadzasz, wybór, który ktoś podjął wbrew tobie i wbrew sobie. Muzyka z AI jest gładka jak kamień z rzeki. Nic w niej nie wystaje, bo wszystko, co wystawało, zostało uśrednione do zera przez sam sposób, w jaki model liczy prawdopodobieństwo następnej nuty. To nie jest utwór - to jest mediana wszystkich utworów tego typu, jakie kiedykolwiek nagrano.

I tu dochodzę do sedna, które budowałem od pierwszego akapitu. Słuchamy muzyki nie tylko uszami. Słuchamy jej z całą świadomością, że po drugiej stronie ktoś jest. Że ktoś nie spał, że się rozstał, że przegrał, że coś zrozumiał o trzeciej nad ranem i musiał to nagrać, zanim zniknie. Ta wiedza nie jest dodatkiem do dźwięku - ona jest częścią dźwięku. Kiedy wiem, że po drugiej stronie nie ma nikogo, ta sama melodia znaczy coś zupełnie innego. Staje się ładnym ułożeniem powietrza. Niczym więcej.

Uczciwie: dla kogo to naprawdę jest

Co sam z tego zbudowałem

Osiem narzędzi, które powstały z problemów opisywanych na tym blogu - razem z tym, czego nie udało się dowieźć.

Zobacz portfel

Nie chcę być prorokiem końca świata, bo to najtańsza rola w felietonie o technologii. Więc powiem, gdzie ta muzyka jest po prostu dobrym narzędziem i gdzie nie mam z nią żadnego problemu.

Podkład pod film na YouTube? Znakomicie. Muzyka do gry, do podcastu, do prezentacji, do sklepu, do windy - wszędzie tam, gdzie dźwięk ma być tłem, a nie treścią, AI jest niemal doskonałe i, powiedzmy to szczerze, uwalnia twórców od kosztów, których często i tak nie mieli z czego pokryć. Ktoś, kto do tej pory kradł podkłady albo używał tych samych trzech darmowych pętli co wszyscy, dostał teraz nieskończoną szafę tła. To dobra wiadomość i nie zamierzam jej odbierać z powodu własnej estetyki.

Widzę też coś, czego się nie spodziewałem: te narzędzia potrafią być szkicownikiem. Wyobraźcie sobie kogoś, kto ma w głowie melodię, ale nie umie grać na żadnym instrumencie. Do tej pory ta melodia umierała w jego głowie. Teraz może ją usłyszeć na zewnątrz, poprawić, pokazać komuś. To nie jest odebranie muzyki ludziom - to jest jej oddanie ludziom, którzy nie mieli do niej klucza. I byłbym hipokrytą, gdybym udawał, że mnie to nie porusza.

Problem zaczyna się dokładnie w momencie, w którym tło zaczyna udawać treść. Kiedy wygenerowany utwór trafia na playlistę obok piosenki, która kogoś kosztowała życie, i konkuruje z nią o te same trzydzieści sekund cudzej uwagi. Nie dlatego, że jest lepszy. Dlatego, że jest tańszy, nieskończenie liczny i nie potrzebuje jeść.

Google · Twoje źródłaPromptowy wyżej w Twoim Google - jednym kliknięciemDodaj do preferowanych źródeł

Co zostało po siódmym dniu

Ostatniego wieczoru wyłączyłem eksperyment i puściłem sobie pierwszą lepszą płytę nagraną przez żywych ludzi. I poczułem coś, czego się nie spodziewałem: ulgę tak fizyczną, jakbym po tygodniu w klimatyzowanym pokoju wyszedł na deszcz. Bo w tej muzyce coś było nie tak, jak trzeba. Wokalista wziął oddech w złym miejscu. Struna zabrzęczała. Ktoś się pomylił i tego nie wyciął. I nagle zrozumiałem, że przez cały tydzień słuchałem dźwięku pozbawionego czasu. Muzyka z AI nie ma przeszłości. Nie powstała w żadnym roku, nie odpowiada na nic, nie jest z niczego zła ani na nic wściekła. Jest wiecznie teraz i wiecznie nijaka.

Nie boję się, że AI napisze lepszą piosenkę ode mnie ulubionych artystów. Boję się czegoś znacznie bardziej prawdopodobnego: że wychowa pokolenie, które przestanie odczuwać różnicę. Które nauczy się, że muzyka to usługa dopasowana do nastroju, a nie wiadomość od drugiego człowieka. Że przestanie oczekiwać, by cokolwiek w piosence uwierało, bo pozna tylko tę, która została zaprojektowana, żeby nigdy nie boleć.

Więc moja uczciwa recenzja tygodnia brzmi tak. Suno i Udio są zdumiewające. Są przydatne. Są, w wielu zastosowaniach, po prostu dobre i nie mam zamiaru tego ukrywać za snobizmem. Ale nie są muzyką w tym sensie, w jakim to słowo mnie kiedykolwiek obchodziło. Są jej idealnie wykonaną maską. A maska ma tę jedną wadę, że im lepiej dopasowana, tym łatwiej zapomnieć, że pod spodem nie ma twarzy. Będę ich używał do tła. I nigdy nie pozwolę im zająć miejsca, w którym po drugiej stronie miał być ktoś.

// Newsletter

Cały tydzień w AI, w jednym mailu

Wybrane premiery, narzędzia i analizy. Raz w tygodniu, prosto do skrzynki.

Zapisz się za darmo →
Za darmo. Wypisujesz się jednym kliknięciem.

Najczęstsze pytania

Czy muzyka generowana przez Suno i Udio brzmi przekonująco?

Tak - autor po tygodniu testów stwierdził, że nie odróżniłby wygenerowanego kawałka od produkcji zamówionej za 3000 zł. Narzędzia są na tyle zaawansowane, że ktoś, kto sprawdzał je rok temu, może nie rozpoznać obecnego poziomu jakości.

Czym różni się muzyka AI od muzyki nagrywanej przez ludzi?

Muzyka AI jest pozbawiona wad, które nadają charakter - nie ma w niej pomyłki, która stałaby się manierą, ani chropowatości głosu, która stałaby się podpisem artysty. Teksty mówią o uczuciach, nie mając za sobą żadnego doświadczenia, a sama melodia jest medianą wszystkich podobnych utworów, jakie kiedykolwiek nagrano.

Do czego przydaje się muzyka generowana przez AI?

Sprawdza się wszędzie tam, gdzie dźwięk ma być tłem, a nie treścią - do filmów na YouTube, gier, podcastów, prezentacji i sklepów. Może też służyć jako szkicownik dla osób, które mają melodię w głowie, ale nie umieją grać na żadnym instrumencie.

Co autor czuł po tygodniu słuchania wyłącznie muzyki AI?

Po siódmym dniu, gdy puścił płytę nagraną przez żywych ludzi, poczuł fizyczną ulgę - porównywalną do wyjścia na deszcz po tygodniu w klimatyzowanym pokoju. Uświadomił sobie, że przez cały tydzień słuchał dźwięku pozbawionego czasu i przeszłości.

// czytaj też

Podobne tematy na Promptowym

Piotr Olszewski

Piotr Olszewski

ADMINISTRATOR

Piotr Olszewski - twórca i autor Promptowego, polskiego serwisu o sztucznej inteligencji. Codziennie śledzi premiery modeli, narzędzia i regulacje AI, i tłumaczy je prostym, konkretnym językiem.

// mapa strony

🛒 Sklep Kinetyka Google AI Gemini Pro 170 zł CapCut Pro 460 zł/rok n8n Cloud Starter 320 zł/rok Zobacz wszystko →
promptowy w liczbach 0tekstów w archiwum0newsów z ostatnich 7 dni0modeli wideo w obserwatorium0zagadek w grach
× powiększenie