Wideo i film12:00
Jak zrobić wersję językową wideo bez ponownego nagrania
Podmiana ścieżki dźwiękowej i dopasowanie ust to dziś kwestia jednego dnia, nie nowej sesji zdjęciowej. Od 2 sierpnia 2026 taki materiał trzeba jednak oznaczyć — i zebrać zgodę osoby, której głos i twarz w nim występują.

To poradnik z własnego podwórka — opisujemy, jak sami układamy takie projekty. Nie jest poradą prawną; przy materiale na rynki spoza Unii sprawdźcie też prawo miejscowe.
Sytuacja jest zwykle ta sama: istnieje nagranie po polsku, potrzebna jest wersja angielska i niemiecka, a ponowne zebranie ekipy i osoby przed kamerą kosztuje więcej niż całe pierwotne nagranie. Techniczna część rozwiązania jest dziś rutynowa — nowa ścieżka lektorska w docelowym języku, do tego dopasowanie ruchu ust do nowej fonetyki. Trudniejsze są dwie rzeczy, o których zwykle nikt nie myśli na etapie wyceny: zgoda i oznaczenie.

Co trzeba mieć przed startem
Głos i twarz konkretnej osoby to jej dane osobowe, a w ujęciu RODO dane pozwalające ją zidentyfikować. Zgoda z pierwotnej sesji obejmowała nagranie po polsku — nie obejmuje wypuszczenia tej samej osoby mówiącej po niemiecku zdania, których nigdy nie powiedziała. Potrzebny jest osobny, pisemny zakres: jakie języki, jakie kanały, jak długo, co się dzieje z modelem głosu po zakończeniu kampanii. To jedna strona dokumentu i jedyny moment, w którym da się ją tanio załatwić — po publikacji jest już tylko drożej.
Drugi warunek dotyczy odbiorcy. Akt o sztucznej inteligencji w artykule 50 ustęp 4 nakazuje podmiotom stosującym system, który generuje lub manipuluje obrazem, dźwiękiem albo wideo o charakterze deepfake, ujawnić, że treść została sztucznie wygenerowana lub zmanipulowana. Definicja z artykułu 3 obejmuje materiał przypominający istniejące osoby, który odbiorca mógłby uznać za autentyczny — a zdubbingowana wypowiedź realnej osoby wpada w nią wprost. Te przepisy stosuje się od 2 sierpnia 2026, więc obowiązują już teraz.
Jak to wygląda w produkcji
Kolejność, która się u nas sprawdza: najpierw tłumaczenie tekstu i korekta przez native speakera — nie dlatego, że model źle tłumaczy, tylko dlatego, że w reklamie liczy się rejestr, a nie dosłowność. Potem ścieżka lektorska, potem dopasowanie ust, na końcu montaż i oznaczenie. Odwrotna kolejność kosztuje podwójnie: poprawka jednego zdania po zsynchronizowaniu ust oznacza powtórzenie całego kroku synchronizacji.

Oznaczenie nie musi psuć materiału. Ustęp 4 mówi o ujawnieniu jasnym i wyraźnym, nie o znaku wodnym przez pół kadru — plansza na końcu, zdanie w opisie pod filmem i informacja na stronie, z której wideo jest osadzone, załatwiają sprawę. Osobno działa obowiązek z ustępu 2, który obciąża dostawcę narzędzia: to on ma oznaczyć wynik w formacie nadającym się do odczytu maszynowego. Warto o to zapytać przy wyborze dostawcy, bo tego akurat nie da się dorobić samemu po fakcie.
Kiedy to NIE ma sensu
Jeżeli materiał ma żyć jeden sezon na jednym rynku, koszt zgody, korekty i oznaczenia bywa wyższy niż nagranie krótkiej wersji od nowa z lokalnym lektorem i bez pokazywania mówiącej twarzy. Podmiana ścieżki opłaca się przy katalogu materiałów i kilku rynkach naraz — tam jednorazowe ustalenie zasad rozkłada się na kilkadziesiąt plików. Przy jednym filmie zwykle nie.

Jak robimy ścieżki lektorskie i wersje językowe, opisujemy przy klonowaniu głosu i automatyzacji wideo. Zasady, na jakich sami oznaczamy materiały tworzone przez system, są na stronie treści generowanych przez AI.
Sources
Documents consultés lors de la rédaction. Le texte ci-dessus est le nôtre; ces plateformes ne sont pas responsables de son contenu et ne l'ont pas validé.
