O czym jest ten film
- Nate Herk pokazuje filmy zmontowane z pomocą Claude Opus 5.5, w tym animowany wstęp do własnego materiału.
- Wyjaśnia, jak udostępnić Claude Code narzędzie Hyperframes, które tworzy animacje na podstawie kodu HTML.
- Pokazuje, jak opisać pożądany montaż zwykłym językiem: wskazać momenty, elementy graficzne i zamierzony efekt.
- Tłumaczy, dlaczego przed montażem warto przygotować transkrypcję nagrania.
- Demonstruje, jak agent dobiera przebitki, zrzuty ekranu oraz obrazy i ujęcia generowane przez AI.
- Na przykładzie filmu inspirowanego cudzą realizacją pokazuje, jak stworzyć instrukcję montażową do ponownego wykorzystania.
- Porównuje kilka opracowań tego samego nagrania: animację przypominającą rysunek na tablicy, materiał szkoleniowy i krótki film o szybszym tempie.
- Przedstawia film promujący wydarzenie, złożony z obszernego archiwum nagrań, oraz reklamową realizację inspirowaną marką Lululemon.
- Sprowadza swoją metodę do pięciu kroków: transkrypcji, usunięcia zbędnych fragmentów, zaplanowania scen, korzystania z zapisanych instrukcji i sprawdzenia wyniku.
- Zaznacza, że nawet udane wersje wymagają oceny człowieka: w przykładach znalazły się niezręczne cięcia i nieścisłości wizualne.
10 najważniejszych takeaways — z kontekstem zastosowania
1.Zacznij od transkrypcji
Na czym polega: Zapis wypowiedzi pozwala agentowi powiązać animacje z konkretnymi słowami i znaleźć fragmenty, z których da się zbudować opowieść.
Jak stosować: Przed montażem zleć transkrypcję nagrania. Autor wymienia Whisper i ElevenLabs jako możliwe narzędzia, a potem każe agentowi dopasować elementy graficzne do wypowiedzi.
Na co uważać: Sprawdź rozpoznane nazwy i ważne sformułowania. Błąd w transkrypcji może przejść do napisów albo animacji.
2.Najpierw oczyść materiał
Na czym polega: Agent może usunąć pomyłki, przerwy i inne fragmenty, które spowalniają film.
Jak stosować: Zleć mu przygotowanie czystej wersji nagrania, zanim zacznie dodawać grafikę. Możesz też poprzestać na tym etapie i dalszy montaż wykonać samodzielnie.
Na co uważać: Obejrzyj miejsca po cięciach. W jednym z pokazanych filmów autor zauważył niezręcznie urwane wypowiedzi.
3.Opisuj konkretne momenty, nie tylko ogólny styl
Na czym polega: Polecenie może wskazywać, przy jakich słowach mają pojawić się logo, napis czy przebitka.
Jak stosować: Napisz, co ma się wydarzyć w określonym fragmencie wypowiedzi i gdzie ma znaleźć się dany element. Autor tak zaplanował animacje przy nazwach modeli oraz wyróżnienie słów „najlepsze efekty”.
Na co uważać: Samo „zrób angażujący film” pozostawia wiele decyzji agentowi. Jeśli jakiś element jest obowiązkowy, nazwij go wprost.
4.Określ odbiorcę i wrażenie, jakie ma wywołać film
Na czym polega: W przykładach autor opisuje zarówno układ scen, jak i charakter całości: prosty film dla dziecka, dynamiczne portfolio albo materiał rozpoznawalnie związany z YouTube.
Jak stosować: Podaj odbiorcę, tempo, poziom szczegółowości i cechy wizualne marki. Gdy trudno Ci wskazać dokładny układ, opisz pożądany nastrój i pokaż przykład.
Na co uważać: Ocena stylu pozostaje subiektywna. Sprawdź, czy efekt rzeczywiście pasuje do Twojej marki i celu filmu.
5.Przekaż agentowi zasady czytelności
Na czym polega: W animowanym wstępie autor poprosił o półprzezroczyste tło pod napisami i logo, aby nie ginęły na obrazie.
Jak stosować: W poleceniu uwzględnij kontrast, wielkość napisów i miejsce na ekranie. Obejrzyj gotowy film w rozmiarze, w którym zobaczy go odbiorca.
Na co uważać: Efektowna animacja nie pomoże, jeśli tekst trudno przeczytać albo zasłania istotną część ujęcia.
6.Pozwól agentowi szukać materiałów, ale sprawdź wybór
Na czym polega: W pokazanych realizacjach agent pobierał przebitki, zrzuty ekranu i zdjęcia, a także tworzył nowe obrazy i ujęcia.
Jak stosować: Wskaż, skąd ma brać materiały oraz kiedy może je generować. Przed publikacją obejrzyj każdą używaną scenę i porównaj ją z tym, co film ma przedstawiać.
Na co uważać: Obraz wygenerowany przez AI może wyglądać przekonująco, choć nie pokazuje rzeczywistego produktu lub zdarzenia. Przy filmie inspirowanym Lululemon autor sam zaznacza, że jedynie przypuszcza, jak agent przygotował część ujęć.
7.Zapisuj sprawdzone rozwiązania jako instrukcje do ponownego użycia
Na czym polega: Autor analizował film, którego styl mu się podobał, i na tej podstawie stworzył „skill” — zapisaną instrukcję dla agenta dotyczącą podobnych realizacji.
Jak stosować: Po udanym montażu poproś agenta o zapisanie zasad dotyczących tempa, typografii, przejść i doboru materiałów. Uzupełniaj instrukcję po kolejnych projektach.
Na co uważać: Taki zestaw zasad nie zastąpi briefu dla nowego filmu. Sprawdź, czy rozwiązania z poprzedniej realizacji pasują do aktualnego tematu.
8.Testuj różne formy na tym samym nagraniu
Na czym polega: Autor wykorzystał opowieść o przygotowaniu tostów z awokado do trzech różnych montaży.
Jak stosować: Przygotuj osobne polecenia dla filmu instruktażowego, materiału szkoleniowego i krótkiej wersji do szybkiego oglądania. Porównaj, która forma najlepiej wyjaśnia treść.
Na co uważać: Kontroluj szczegóły ilustracji. W wersji z rysunkowymi animacjami autor zauważył zbyt małe jajka i polewę pokazaną tylko na części tostu.
9.Przy dużym archiwum wyznacz cel opowieści
Na czym polega: Agent złożył film promujący wydarzenie z folderu zawierającego około 105 GB nagrań i innych materiałów.
Jak stosować: Udostępnij uporządkowany zbiór plików i określ, dla kogo powstaje film oraz co ma przekazać. Poproś o wybór wypowiedzi i scen, które wspólnie budują spójną historię.
Na co uważać: Duża ilość materiału nie gwarantuje dobrej narracji. Sprawdź kolejność scen, kontekst cytatów i płynność cięć.
10.Włącz sprawdzanie do samego procesu montażu
Na czym polega: Według autora agent może obejrzeć własny wynik, wykryć usterki i poprawić film, zanim pokaże go użytkownikowi.
Jak stosować: Poproś o kontrolę gotowej wersji: zrzuty ekranu z ważnych momentów, sprawdzenie synchronizacji, czytelności i ciągłości wypowiedzi, a następnie poprawki.
Na co uważać: Automatyczna kontrola nie jest ostateczną akceptacją. Autor poprawiał film z wydarzenia po pierwszej wersji i nadal wskazywał miejsca wymagające dopracowania.
Redakcyjne tłumaczenie
Montaż opisany zwykłym językiem
Od dawna sprawdzam, jak modele AI radzą sobie z montowaniem moich filmów. Pracowałem już z bardzo mocnymi modelami, takimi jak Fable 5.1 i GBD-6 Astra, ale Claude Opus 5.5 dał mi jedne z najlepszych efektów, jakie dotąd widziałem. Pokazany na początku przykład powstał po jednym poleceniu.
Model przygotował animowaną grafikę i oprawę dźwiękową. Potrafił też znaleźć przebitki — dodatkowe ujęcia ilustrujące wypowiedź — pobrać zrzuty ekranu, a w razie potrzeby wygenerować obrazy lub wideo. Podoba mi się jego wyczucie wizualne oraz to, że sprawdza własną pracę. Pokażę, jak przygotować taki zestaw narzędzi i opisać zadanie zwykłym językiem.
Wstęp, który właśnie obejrzeliście, także został zmontowany z pomocą Opus 5.5. W Claude Code widać elementy graficzne przygotowane na potrzeby tego filmu. W poleceniu podałem wiele szczegółów, ale model dodał również własne pomysły.
Hyperframes i polecenie do animowanego wstępu
Do animacji używam Hyperframes. Narzędzie pozwala Claude Code pisać kod HTML i na jego podstawie tworzyć animacje. Aby zacząć, można znaleźć repozytorium Hyperframes w serwisie GitHub, skopiować jego adres i poprosić Claude Code o skonfigurowanie narzędzia do pracy z filmem.
Udostępniam też bezpłatny zestaw „Hyperframes Student Kit” z instrukcjami i przykładami z mojego procesu montażowego. Można go znaleźć w mojej społeczności, wśród materiałów do filmów na YouTube lub zasobów poświęconych AI.
W poleceniu dotyczącym wstępu najpierw poprosiłem o transkrypcję nagrania. Dzięki temu animacje mogą pojawiać się dokładnie wtedy, gdy mówię o danej rzeczy. Do przygotowania zapisu można wykorzystać na przykład API ElevenLabs albo Whisper. ElevenLabs rozlicza użycie usługi, a Whisper można uruchomić lokalnie bez takiej opłaty, choć w moim doświadczeniu działa wolniej. O konfigurację również można poprosić Claude Code.
Potem opisałem konkretne sceny. Gdy wymieniam modele Fable 5.1 i GBD-6 Astra, chciałem, żeby ich nazwy pojawiły się tam, gdzie wskazuję ręką. Poprosiłem też o animowane logo Claude i logo OpenAI. Zależało mi na półprzezroczystych kartach za tymi elementami, żeby napisy i znaki były czytelne na tle nagrania.
W chwili, w której mówię o „najlepszych efektach”, poleciłem wyświetlić i wyróżnić te słowa na dole ekranu. Model dodał pod napisem delikatne tło, ułatwiające jego odczytanie.
W dalszej części chciałem zobaczyć po bokach ekranu przykłady przebitek, zrzutów oraz generowanych obrazów i filmów. Polecenie obejmowało również znalezienie nagrania ekranu i odpowiedniego zrzutu. Chodziło mi o to, by film pokazywał możliwości modelu w chwili, gdy o nich opowiadam.
To właściwie całe moje polecenie. Model wykonał wskazane zadania, a przy okazji dodał rzeczy, o które nie prosiłem: subtelne zbliżenie na początku czy animację w stylistyce interfejsu Claude przy wzmiance o jednym poleceniu. Sam wymyślił również sposób przedstawienia nagrania ekranu, zrzutu i generowanych materiałów. Do fragmentu o sprawdzaniu pracy dołożył animację z obrazami kontrolnymi. Moim zdaniem dzięki tym decyzjom wstęp jest ciekawszy. Otrzymałem go bez kolejnego polecenia.
Film inspirowany przykładem i zapisana instrukcja montażowa
Kolejny przykład to krótki film w formie portfolio, utrzymany w stylistyce YouTube. On również powstał po jednym poleceniu. Model znalazł zrzuty wielu miniatur moich filmów, a następnie wyróżnił miniaturę, na której trzymam przycisk YouTube i dziękuję widzom. Umieścił ją pośrodku i wykonał zbliżenie. To trafny wybór dla filmu o moim kanale. Powstały także animacje, muzyka i efekty dźwiękowe.
Punktem wyjścia był film, który zobaczyłem w serwisie X. Stworzył go Ken, korzystając z Hyperframes i Opus. Spodobał mi się, więc pobrałem go i przekazałem Claude Code z prośbą o analizę: co sprawia, że ten materiał działa tak dobrze? Następnie poprosiłem o zapisanie tych obserwacji jako instrukcji, której będzie można używać przy następnych projektach.
Tak powstał „motion show reel” — zestaw zasad tworzenia podobnych filmów. Poleciłem potem agentowi przygotować własną wersję o YouTube. Miał zebrać potrzebne obrazy i przebitki oraz zadbać o typografię, kolory, język i inne cechy, dzięki którym skojarzenie z YouTube będzie natychmiastowe. Zapisaną instrukcję także zamierzam udostępnić w mojej społeczności.
Do części scen model wygenerował obrazy, a potem przekazał je do narzędzia Kling, żeby zamienić je w ruchome ujęcia. W ten sposób powstała między innymi animacja przycisku odtwarzania. Gotowe fragmenty wróciły do Claude, który połączył je w jeden film.
Portfolio dla firmy i materiały z jej strony
Przygotowałem też podobny film bez korzystania z zapisanej przed chwilą instrukcji. Poprosiłem o dynamiczne, piętnastosekundowe portfolio, które pokazałoby umiejętności projektanta animacji. Pomysł na takie polecenie zaczerpnąłem z demonstracji opublikowanej w serwisie X.
Dodałem, że film ma dotyczyć naszej firmy, AIS. Agent miał w miarę możliwości używać prawdziwych materiałów i znaków naszych produktów. Pozwoliłem mu także generować brakujące elementy oraz korzystać z Hyperframes i innych narzędzi do animacji, muzyki i efektów dźwiękowych.
Wynik powstał po jednym poleceniu. Model sięgnął po zdjęcia i grafikę z naszej strony internetowej, uwzględnił liczbę członków społeczności i przygotował sceny pasujące do przyjętej kolorystyki. Pojawił się też trójwymiarowo wyglądający fragment, prawdopodobnie zrobiony przez wygenerowanie obrazu i wprawienie go w ruch. Szczególnie spodobały mi się kompozycja scen oraz sposób, w jaki obraz współgra z dźwiękiem.
Udostępniam również bezpłatną instrukcję „ScrollCraft”, której używam przy projektowaniu stron internetowych, w tym witryny AI Automation Society. Obejmuje wskazówki dotyczące animacji związanych z przewijaniem strony, układu warstw, typografii, odstępów i wrażenia głębi.
Film z archiwum wydarzenia AIS Live
Jednym z moich ulubionych sprawdzianów jest zadanie, w którym daję Claude Code dostęp do folderu z około 105 GB nagrań i innych materiałów z wydarzenia AIS Live. Proszę, żeby przejrzał całość i złożył krótki film, który opowiada historię wydarzenia.
Ten przykład wymagał więcej pracy niż poprzednie. Po pierwszym poleceniu przekazałem jedną serię uwag, a następnie poprosiłem o poprawienie jeszcze jednej rzeczy. Łącznie były to trzy polecenia.
W gotowym filmie pojawiają się urywki wypowiedzi uczestników: powitanie z AIS Live, reakcje na rozmowy i wrażenia po dwóch dniach spotkania. Ktoś wspomina o podpisanej umowie, ktoś inny o emocjach, które towarzyszyły mu jeszcze po zakończeniu wydarzenia. Zbudowanie opowieści z tak dużego i różnorodnego zbioru plików jest trudnym zadaniem. Ten film ma też promować kolejną edycję, zapowiadaną na 17 i 18 października.
Nie wszystko wyszło idealnie. W kilku miejscach wypowiedzi zostały niezręcznie ucięte i można by je poprawić. Podoba mi się jednak sposób, w jaki model zestawił wiele ekranów w rodzaj tunelu oraz prowadził zbliżenia między kolejnymi obrazami. Dobrze wybrał też fragmenty rozmów, które oddają energię wydarzenia.
Najbardziej lubię zakończenie: wiele scen łączy się w znak AIS Live z małą czerwoną kropką. Kamera zbliża się do niej, a na ekranie pojawia się napis zapraszający widza do udziału.
Trzy montaże tego samego nagrania
Możliwości AI łatwiej ocenić, gdy zmienia się sposób opracowania tego samego materiału. Nagrałem więc prostą wypowiedź o tym, jak robię tosty z awokado, i przygotowałem trzy wersje filmu.
W pierwszej poprosiłem o czytelne animacje przypominające rysunki wykonywane na tablicy. Film miał tłumaczyć przepis tak prosto, by zrozumiało go dziecko. W części scen rysunki miały zajmować cały ekran, a w innych — jego lewą połowę, podczas gdy po prawej pozostawałaby moja twarz. Pozwoliłem też agentowi wygenerować potrzebne obrazy lub ujęcia.
W nagraniu wyjaśniam, że po wyjęciu chleba z tostera nie kładę go od razu płasko na talerzu, bo spód mógłby zmięknąć. Następnie przygotowuję jajka, rozgniatam awokado, smaruję nim chrupiący chleb, dodaję przyprawę do bajgli, ocet balsamiczny i na końcu jajka. Agent przedstawił kolejne czynności prostymi, pogodnymi animacjami. Mam dwie uwagi: jajka na ilustracji są bardzo małe, a polewa balsamiczna trafia tylko na kawałek tostu. Mimo to całość dobrze pokazuje, ile można osiągnąć jednym poleceniem.
Druga wersja przypomina materiał szkoleniowy. Poprosiłem, by obraz z kamery najpierw wypełniał ekran, a potem został umieszczony w zaokrąglonym kadrze. Tło miało być oszczędne. Najważniejsze informacje miały pojawiać się jako duże, krótkie punkty, a proste obrazy wygenerowane przez AI i delikatne animacje miały pomagać w wyjaśnieniu kolejnych czynności. Także tę wersję otrzymałem po jednym poleceniu. Wszystkie dodatkowe obrazy i ujęcia zostały wygenerowane przez AI.
W trzeciej wersji chciałem uzyskać krótki film o szybkim tempie, zrozumiały i przyciągający uwagę. Nie polecałem agentowi korzystania z innych zapisanych instrukcji. W tych próbach pracowałem zwykle przy wysokim poziomie wysiłku modelu. Wynik nie był doskonały, ale sprawnie przechodził między scenami i wykorzystywał różne przebitki. Pokazuje to również możliwy dalszy sposób pracy: obejrzeć pierwszą wersję, zgłosić uwagi i zapisywać powtarzające się preferencje na przyszłość.
Przykład inspirowany marką Lululemon
Przygotowałem jeszcze film dotyczący odzieży Lululemon, żeby sprawdzić, jak agent poradzi sobie z fizycznymi produktami i rozpoznawalnym stylem marki. Wszystkie ruchome ujęcia w tym przykładzie zostały wygenerowane przez AI.
Przypuszczam, że agent znalazł na stronie marki rzeczywiste ubrania i zdjęcia modeli, a następnie na tej podstawie stworzył sceny biegu i skoków. Na końcu połączył je ze zdjęciami katalogowymi. To moja ocena procesu na podstawie wyniku, a nie pewność co do każdego wykonanego kroku.
W poleceniu opisałem przede wszystkim wrażenie, jakie film ma wywołać: dużo energii, szybkie tempo, muzyka dopasowana do rytmu montażu i efekty dźwiękowe. Przy ręcznej realizacji trzeba byłoby osobno przygotować wiele takich elementów.
Pięć kroków, do których wracam przy montażu
Pierwszy krok to transkrypcja. Gdy zaczynam od istniejącego nagrania, agent musi wiedzieć, co i kiedy zostało powiedziane. Dzięki temu może dopasować animacje do wypowiedzi oraz wybrać fragmenty potrzebne do opowiedzenia historii. Można użyć Whisper, ElevenLabs albo innego narzędzia.
Drugi krok to oczyszczenie materiału. Proszę o usunięcie pomyłek, zbędnych przerw i chwil, w których nic się nie dzieje. Czasami wykorzystuję AI tylko do tego zadania, a resztę montażu robię sam. Samo znalezienie i wycięcie takich miejsc zajmuje w edytorze sporo czasu.
Trzeci krok to zaplanowanie scen i akcentów. W przypadku wstępu do tego filmu określiłem, co ma pojawić się przy danych słowach. Zostawiłem modelowi miejsce na własne pomysły, ale mógłbym też ograniczyć go wyłącznie do wskazanych elementów. Im lepiej opiszę, jaki wynik uznam za udany, tym większa szansa, że otrzymam film zgodny z zamierzeniem.
Czwarty krok to korzystanie z zapisanych instrukcji. Jeśli często montuję podobne filmy, zapisuję zasady ich przygotowywania. Można zacząć od analizy materiału, który się podoba, a potem uzupełniać instrukcję po każdym projekcie: wskazać agentowi, co zadziałało, co się nie sprawdziło i co powinien zmienić następnym razem. Dzięki temu nie muszę powtarzać tych samych uwag przy każdym filmie.
Piąty krok, być może najważniejszy, to sprawdzenie gotowej wersji. Agent może robić zrzuty ekranu, oglądać wynik i nanosić poprawki. W ten sposób pierwsza próba staje się punktem wyjścia do kolejnych wersji, zanim film trafi do mnie. Potem i tak oglądam całość i oceniam ją sam.
Zastosowań jest znacznie więcej niż pokazałem. Dziś można skorzystać z animowanego montażu nawet bez wcześniejszego doświadczenia w edycji wideo. Warto zacząć od własnego nagrania, jasno opisać oczekiwany efekt, a następnie obejrzeć wynik i go dopracować.