Zum Inhalt springen

Wideo i film12:00

Jak zrobić wersję językową wideo bez ponownego nagrania

Podmiana ścieżki dźwiękowej i dopasowanie ust to dziś kwestia jednego dnia, nie nowej sesji zdjęciowej. Od 2 sierpnia 2026 taki materiał trzeba jednak oznaczyć — i zebrać zgodę osoby, której głos i twarz w nim występują.

Bild generiert durch KI.

To poradnik z własnego podwórka — opisujemy, jak sami układamy takie projekty. Nie jest poradą prawną; przy materiale na rynki spoza Unii sprawdźcie też prawo miejscowe.

Sytuacja jest zwykle ta sama: istnieje nagranie po polsku, potrzebna jest wersja angielska i niemiecka, a ponowne zebranie ekipy i osoby przed kamerą kosztuje więcej niż całe pierwotne nagranie. Techniczna część rozwiązania jest dziś rutynowa — nowa ścieżka lektorska w docelowym języku, do tego dopasowanie ruchu ust do nowej fonetyki. Trudniejsze są dwie rzeczy, o których zwykle nikt nie myśli na etapie wyceny: zgoda i oznaczenie.

Bild generiert durch KI.

Co trzeba mieć przed startem

Głos i twarz konkretnej osoby to jej dane osobowe, a w ujęciu RODO dane pozwalające ją zidentyfikować. Zgoda z pierwotnej sesji obejmowała nagranie po polsku — nie obejmuje wypuszczenia tej samej osoby mówiącej po niemiecku zdania, których nigdy nie powiedziała. Potrzebny jest osobny, pisemny zakres: jakie języki, jakie kanały, jak długo, co się dzieje z modelem głosu po zakończeniu kampanii. To jedna strona dokumentu i jedyny moment, w którym da się ją tanio załatwić — po publikacji jest już tylko drożej.

Drugi warunek dotyczy odbiorcy. Akt o sztucznej inteligencji w artykule 50 ustęp 4 nakazuje podmiotom stosującym system, który generuje lub manipuluje obrazem, dźwiękiem albo wideo o charakterze deepfake, ujawnić, że treść została sztucznie wygenerowana lub zmanipulowana. Definicja z artykułu 3 obejmuje materiał przypominający istniejące osoby, który odbiorca mógłby uznać za autentyczny — a zdubbingowana wypowiedź realnej osoby wpada w nią wprost. Te przepisy stosuje się od 2 sierpnia 2026, więc obowiązują już teraz.

Jak to wygląda w produkcji

Kolejność, która się u nas sprawdza: najpierw tłumaczenie tekstu i korekta przez native speakera — nie dlatego, że model źle tłumaczy, tylko dlatego, że w reklamie liczy się rejestr, a nie dosłowność. Potem ścieżka lektorska, potem dopasowanie ust, na końcu montaż i oznaczenie. Odwrotna kolejność kosztuje podwójnie: poprawka jednego zdania po zsynchronizowaniu ust oznacza powtórzenie całego kroku synchronizacji.

Bild generiert durch KI.

Oznaczenie nie musi psuć materiału. Ustęp 4 mówi o ujawnieniu jasnym i wyraźnym, nie o znaku wodnym przez pół kadru — plansza na końcu, zdanie w opisie pod filmem i informacja na stronie, z której wideo jest osadzone, załatwiają sprawę. Osobno działa obowiązek z ustępu 2, który obciąża dostawcę narzędzia: to on ma oznaczyć wynik w formacie nadającym się do odczytu maszynowego. Warto o to zapytać przy wyborze dostawcy, bo tego akurat nie da się dorobić samemu po fakcie.

Kiedy to NIE ma sensu

Jeżeli materiał ma żyć jeden sezon na jednym rynku, koszt zgody, korekty i oznaczenia bywa wyższy niż nagranie krótkiej wersji od nowa z lokalnym lektorem i bez pokazywania mówiącej twarzy. Podmiana ścieżki opłaca się przy katalogu materiałów i kilku rynkach naraz — tam jednorazowe ustalenie zasad rozkłada się na kilkadziesiąt plików. Przy jednym filmie zwykle nie.

Bild generiert durch KI.

Jak robimy ścieżki lektorskie i wersje językowe, opisujemy przy klonowaniu głosu i automatyzacji wideo. Zasady, na jakich sami oznaczamy materiały tworzone przez system, są na stronie treści generowanych przez AI.

Quellen

Quellen, die wir bei der Erstellung herangezogen haben. Der obige Text stammt von uns; die genannten Seiten haften nicht für den Inhalt und haben ihn nicht autorisiert.

Unverbindliches Gespräch

Workshop mit Paul vereinbaren

Dreißig Minuten oder ein kompletter Workshop: Sie entscheiden. Wählen Sie den Termin direkt im Kalender, die Bestätigung folgt sofort.

Paul Lazniak

Gründer von HEXART