Prezentacja, którą i tak ktoś czyta na głos
Szkolenie wewnętrzne, materiał wysyłany klientowi, opis procesu dla nowej osoby w zespole — treść powstaje najpierw jako slajdy, a potem ktoś je omawia. Kiedy trzeba z tego zrobić nagranie, praca zaczyna się drugi raz: lektor czyta skrypt, montażysta układa ścieżkę dźwiękową, a na końcu dopasowuje pojawienie się każdego punktu do chwili, w której pada odpowiadające mu zdanie. To ostatnie zajmuje najwięcej czasu i jest najbardziej kruche — poprawka jednego zdania przesuwa wszystko, co po nim następuje.
Slides powstało po to, żeby ta część nie była robotą ręczną. Aplikacja stoi pod adresem slides.hexart.pl i jest dostępna po zalogowaniu. Jej własny opis mieści się w jednym zdaniu: „Create animated slide videos with voice-synced reveals. Powered by ElevenLabs and OpenRouter.” Po polsku — film ze slajdów, w którym elementy odsłaniają się zsynchronizowane z głosem lektora. Limitów długości materiału, cennika ani listy obsługiwanych języków nie podajemy tutaj: narzędzie prowadzimy u siebie i zakres ustalamy przy konkretnym zleceniu.
Dwie warstwy pod spodem
Za tekst odpowiada warstwa językowa spięta przez OpenRouter, czyli jeden interfejs do wielu modeli. Głos pochodzi z ElevenLabs. Film składa się z połączenia obu: element slajdu wchodzi w tym momencie, w którym lektor wymawia zdanie, które go dotyczy. Kolejność jest odwrotna niż w zwykłym montażu — to narracja wyznacza animację, a nie animacja wymusza tempo czytania.
- Odsłonięcie wynika z narracji
Punkty na slajdzie nie mają ręcznie ustawianych klatek kluczowych. Moment ich pojawienia się bierze się z tego, co i kiedy zostało wypowiedziane.
- Poprawka tekstu zamiast poprawki montażu
Skoro synchronizacja powstaje z narracji, zmiana akapitu w skrypcie nie oznacza przechodzenia przez całą oś czasu ani ponownej sesji nagraniowej.
- Warstwa modeli jest wymienna
OpenRouter daje dostęp do wielu modeli przez jeden interfejs, więc wybór konkretnego z nich jest ustawieniem, a nie założeniem wpisanym w architekturę narzędzia.
Gdzie to się sprawdza
Narzędzie ma sens tam, gdzie prezentacja i tak jest czytana na głos, a nagranie lektora i montaż zabierają więcej czasu niż przygotowanie samej treści: szkolenia wewnętrzne, materiały dla klienta, dokumentacja procesu, którą łatwiej pokazać, niż opisać. Im częściej taki materiał się zmienia, tym wyraźniejsza jest różnica, bo aktualizacja sprowadza się do podmiany zdania w skrypcie. Najwięcej daje przy seriach: przy krótkich filmach o tej samej strukturze, w których zmienia się treść, a nie forma. Przy pojedynczym materiale różnica jest mniejsza, bo skrypt i tak trzeba napisać, a slajdy ułożyć.
Odsłuch przed złożeniem filmu
Narzędzie skraca montaż, nie zastępuje autora prezentacji. Skrypt, kolejność argumentów i to, co ostatecznie zostaje na slajdzie, ustala osoba przygotowująca materiał. Wygenerowaną narrację przesłuchujemy przed złożeniem filmu — tak samo jak odsłuchuje się nagranie żywego lektora — i wskazujemy fragmenty do powtórzenia, kiedy intonacja rozmija się z sensem zdania. Materiał wychodzi dopiero po tym przejściu.
Oznaczenie materiału z syntetycznym głosem
Film z głosem wygenerowanym maszynowo podlega obowiązkowi oznaczenia — wynika to z art. 50 rozporządzenia (UE) 2024/1689. Traktujemy to jako część zamówienia, a nie dopisek na końcu: sposób oznaczenia ustalamy razem z zamawiającym, zanim materiał trafi do odbiorców. Zasady, według których oznaczamy własne treści w tym serwisie, opisaliśmy osobno na stronie o wykorzystaniu AI.
Sam głos, czyli klonowanie barwy lektora i synteza mowy, jest u nas osobną usługą — opisuje ją strona klonowanie głosu i lektor TTS. Slides zawęża tę usługę do jednego formatu: prezentacji, która ma zostać wydana jako film.
Gdzie stoi narzędzie
Slides działa pod adresem slides.hexart.pl, dostęp jest po zalogowaniu. Jeżeli chcecie zobaczyć narzędzie na własnej prezentacji, napiszcie — pokażemy je na waszym materiale.
slides.hexart.plOznaczanie treści generowanych
Głos syntetyczny wymaga oznaczenia materiału — art. 50 rozporządzenia (UE) 2024/1689. Zasady, które stosujemy u siebie, zebraliśmy w jednym miejscu.
AI w hexart.plWarstwa głosu osobno
Ta sama kompetencja bez prezentacji: klonowanie barwy lektora i synteza mowy jako pojedyncza usługa, do szkoleń, instrukcji i spotów.
Klonowanie głosu i lektor TTS