Synthesia po polsku: jak zrobić wideo z awatarem i zasady wizerunku
Krok po kroku: scenariusz po polsku, wybór awatara i głosu, generowanie, własny awatar z nagraniem zgody. Co regulamin Synthesii mówi o wizerunku.

👁 114 przeczytań
- Wideo z awatarem AI w Synthesii powstaje z tekstu: wklejasz scenariusz po polsku, wybierasz postać i głos, klikasz Generate i po kilku minutach pobierasz MP4.
- Darmowy plan Basic daje 10 minut wideo miesięcznie, 9 awatarów i polskiego lektora, ale każdy film zawiera znak wodny Synthesii.
- Plan Starter kosztuje 29 USD miesięcznie (ok. 833 zł netto) i odblokowuje własne awatary, Full HD oraz brak logo Synthesii.
Wideo z awatarem AI w Synthesii powstaje z tekstu: wklejasz scenariusz po polsku, wybierasz postać i głos, klikasz „Generate” i po kilku minutach pobierasz plik MP4. Nie ma kamery ani montażu. Poniżej cała ścieżka krok po kroku, w tym tworzenie awatara z własną twarzą, a także to, co regulamin Synthesii mówi o zgodzie na wizerunek i o tym, do czego awatarów używać nie wolno.
W skrócie
Pierwszy film zrobisz w kwadrans na darmowym koncie: 10 minut wideo miesięcznie, 9 awatarów, polski lektor, znak wodny. Bez znaku wodnego i z własnym awatarem potrzebny jest Starter (29 USD miesięcznie albo 216 USD za rok, ok. 833 zł netto), który daje 3 awatary własne. Własny awatar wymaga nagrania zgody na żywo z odczytaniem kodu z ekranu i jest gotowy w ciągu doby. Synthesia nie pozwala zrobić awatara innej osoby, nawet za jej ustną zgodą, ani celebryty czy osoby zmarłej.
Krok 1: konto i pierwszy projekt
Zakładasz konto na synthesia.io bez podawania karty. Plan Basic daje 1200 kredytów miesięcznie, co odpowiada 10 minutom wideo, bo według bazy wiedzy producenta sekunda filmu kosztuje 2 kredyty. Po zalogowaniu wybierasz „New video” i albo zaczynasz od pustej sceny, albo od szablonu (onboarding, instrukcja produktu, komunikat wewnętrzny). Szablon to gotowy układ slajdów z miejscem na awatara, tytuł i punkty; wystarczy podmienić tekst.
Jeśli chcesz najpierw sprawdzić, czy wideo z awatarem w ogóle pasuje do Twojego materiału, przeczytaj tekst o tym, kiedy Synthesia ma sens. Krótko: dobrze działa w instrukcjach i szkoleniach, słabo w treściach, które mają kogoś poruszyć.
Krok 2: scenariusz po polsku
Każda scena ma pole na tekst, który awatar wypowie. Piszesz po polsku, a język i głos wybierasz z listy nad polem: polski ma kilka lektorów stockowych w różnych tonach. Trzy rady wynikające z dokumentacji i poradników:
- Do 50 słów na scenę, czyli ok. 20 sekund mówienia. Dłuższe bloki brzmią monotonnie, a podział na sceny ułatwia poprawki.
- Nazwy własne, skróty i liczby zapisuj tak, jak mają być przeczytane („dwa tysiące dwudziesty szósty”, „Es-Ka-Ka”). Tu syntezatory mylą się najczęściej.
- Pauzy wstawiaj znacznikami w edytorze, a nie wielokropkami.
Asystent AI w edytorze potrafi rozpisać scenariusz z krótkiego opisu albo z wklejonego dokumentu, ale tekst po nim trzeba przeczytać: pisze poprawną, choć sztywną polszczyzną.
Krok 3: awatar, tło, napisy i generowanie
W panelu mediów wybierasz awatara (9 w Basic, 125+ w Starterze), ustawiasz go w kadrze i dobierasz tło: jednolity kolor, zdjęcie, własna grafika. Możesz dodać tekst, obrazy i nagrania ekranu. „Preview” pokazuje synchronizację narracji ze scenami bez zużywania kredytów; „Generate” uruchamia render, który według producenta trwa od 3 do 20 minut zależnie od długości. Przy generowaniu Synthesia pyta, czy dołączyć napisy. Gotowy film pobierasz jako MP4 (w Basic z logo Synthesii, od Startera w Full HD bez logo) albo udostępniasz linkiem.
Ważne przy poprawkach: każde ponowne wygenerowanie zużywa kredyty według aktualnej długości filmu. Dlatego lepiej poprawić wszystko w podglądzie, a dopiero potem renderować.
Krok 4: awatar z własną twarzą
Od Startera masz 3 awatary własne (personal avatars). Są dwie drogi:
- Z wideo - nagrywasz się kamerką w edytorze albo wgrywasz jedno ciągłe nagranie (bez sklejek), w kadrze jesteś tylko Ty, twarz w naturalnej odległości. Synthesia zaleca czytać skrypt po angielsku, niemiecku, francusku lub hiszpańsku; z tego nagrania powstaje też klon Twojego głosu, który potem mówi w 29 językach, w tym po polsku.
- Ze zdjęcia - jedno wyraźne zdjęcie od pasa w górę, najlepiej z widocznymi zębami (lepsza synchronizacja ust). Opcjonalnie nagrywasz próbkę głosu; bez niej awatar mówi głosem stockowym.
W obu wariantach ostatnim krokiem jest nagranie zgody na żywo: czytasz z ekranu oświadczenie i jednorazowy kod. Zgody nie da się wgrać z pliku, nawet gdy samo nagranie awatara było wgrywane. Osoba na nagraniu zgody musi być tą samą, która jest na materiale awatara. Awatar jest gotowy zwykle w ciągu 24 godzin; przy ręcznej weryfikacji dłużej.
Co mówi regulamin o wizerunku i zgodzie
To nie porada prawna, tylko streszczenie dokumentów Synthesii: regulaminu dla klientów, polityki dopuszczalnego użycia i zasad moderacji awatarów ze zdjęcia.
- Zgoda osoby: regulamin wymaga, by klient zebrał wszystkie potrzebne zgody, a osoba, której głos lub wizerunek trafia do awatara, była pełnoletnia i udzieliła zgody „dobrowolnie i świadomie”.
- Awatar ze zdjęcia tylko dla siebie: według zasad moderacji z lipca 2026 taki awatar musi utworzyć osobiście osoba, której wizerunek jest używany. Odrzucane są zdjęcia celebrytów, postaci historycznych i osób zmarłych, obrazy wygenerowane przez AI oraz przypadki, gdy na nagraniu zgody jest ktoś inny niż na zdjęciu.
- Dane biometryczne: polityka prywatności opisuje nagranie weryfikacyjne jako dane biometryczne i wymaga wyraźnej zgody (odrębne zaznaczenie w formularzu), m.in. ze względu na RODO.
- Czego nie wolno: podszywania się pod osoby i firmy, dezinformacji i propagandy, usuwania znaku wodnego identyfikującego treść jako wygenerowaną, spamu. Awatarów stockowych nie można używać w telewizji, materiałach informacyjnych, zbiórkach i kampaniach politycznych bez pisemnej zgody, ani w płatnych reklamach w mediach społecznościowych bez zgody. Dozwolone są szkolenia wewnętrzne, testy i scenki edukacyjne z wyraźnym oznaczeniem, że postać nie opisuje prawdziwej osoby.
- Kontrola nad awatarem: producent deklaruje, że właściciel awatara może w każdej chwili zażądać usunięcia swoich danych z platformy.
Osobną warstwą jest unijne prawo. Od sierpnia 2026 AI Act wymaga oznaczania treści syntetycznych; jak to działa w praktyce, opisałem w przewodniku po AI Act.
Najczęstsze pytania
Czy Synthesia mówi po polsku?
Tak. Polski jest wśród 160+ języków lektorów, w dubbingu i w tłumaczeniu jednym kliknięciem. Sklonowany głos z własnego awatara również mówi po polsku.
Czy mogę zrobić awatar kolegi z pracy albo klienta?
Nie za niego. Zasady moderacji wymagają, by awatar ze zdjęcia tworzyła osobiście osoba, której wizerunek jest używany, a zgoda była nagrana na żywo przez tę samą osobę. Regulamin dodatkowo obciąża klienta obowiązkiem zebrania zgód.
Ile trwa zrobienie własnego awatara?
Nagranie i zgoda zajmują kilka minut, przetwarzanie zwykle do 24 godzin.
Czy darmowy film ma znak wodny?
Tak. Plan Basic dodaje logo Synthesii. Usunięcie logo i pobieranie w Full HD są od planu Starter. Ceny wszystkich planów w złotych zebrałem w cenniku Synthesii.
Źródła i data sprawdzenia
Baza wiedzy: awatar z wideo, awatar ze zdjęcia, zasady moderacji awatarów ze zdjęcia, dokumentacja awatarów własnych, regulamin dla klientów, polityka dopuszczalnego użycia, polityka prywatności, cennik, poradnik Feisworld (2026), opis produktu w Kinetyce. Kurs dolara: NBP 3,857 zł. Sprawdzone 25 września 2026.
Cały tydzień w AI, w jednym mailu
Wybrane premiery, narzędzia i analizy. Raz w tygodniu, prosto do skrzynki.
Zapisz się za darmo →Najczęstsze pytania
Czy Synthesia obsługuje język polski?
Tak, polski jest jednym z ponad 160 języków dostępnych w Synthesii. Można go użyć zarówno w lektorach stockowych, jak i w sklonowanym głosie z własnego awatara.
Ile kosztuje usunięcie znaku wodnego z wideo w Synthesii?
Usunięcie logo Synthesii i pobieranie w Full HD są dostępne od planu Starter, który kosztuje 29 USD miesięcznie lub 216 USD za rok. Plan Basic zawsze dodaje znak wodny do gotowego pliku MP4.
Czy mogę zrobić awatar AI z twarzy innej osoby w Synthesii?
Nie - zasady moderacji wymagają, by awatar ze zdjęcia tworzyła osobiście osoba, której wizerunek jest używany. Zgoda musi być nagrana na żywo przez tę samą osobę, a odrzucane są m.in. zdjęcia celebrytów i osób zmarłych.
Ile czasu zajmuje wygenerowanie własnego awatara w Synthesii?
Nagranie materiału i potwierdzenie zgody zajmuje kilka minut, a przetwarzanie przez Synthesię trwa zwykle do 24 godzin. Przy ręcznej weryfikacji czas ten może być dłuższy.
