O czym jest ten film
- Umiejętność Codexa to zapisany sposób wykonania zadania, z którego agent może korzystać wielokrotnie.
- Najłatwiej ją zbudować, zaczynając od przykładu gotowego wyniku i odtwarzając drogę do niego.
- Jedna umiejętność powinna mieć jasno określone zadanie oraz sytuację, w której należy jej użyć.
- Stopień szczegółowości instrukcji zależy od tego, ile w danej pracy jest sztywnych reguł, a ile oceny i wyboru.
- W instrukcji warto przewidzieć sprawdzenie wyniku i poprawki przed przekazaniem go człowiekowi.
- Kontrola obejmuje zarówno rzeczy mierzalne, jak i ocenę jakości, wyglądu czy stylu.
- Tę samą umiejętność można uruchomić na różnych modelach, aby porównać jakość, czas i koszt.
- Instrukcję należy poprawiać na podstawie konkretnych błędów oraz udanych rozwiązań z kolejnych uruchomień.
- Autor pokazuje te zasady na umiejętności, która zamienia film z YouTube w artykuł publikowany na X.
- Próba z trzema modelami pokazuje, że droższy model nie musi wypaść lepiej w pojedynczym teście, a wybór warto oprzeć na kilku różnych materiałach.
10 najważniejszych takeaways — z kontekstem zastosowania
1.Zacznij od gotowego przykładu
Na czym polega: Agentowi łatwiej odtworzyć pożądany wynik, gdy widzi dobrze wykonany raport, arkusz lub artykuł.
Jak stosować: Pokaż mu zaakceptowany materiał i poproś, by ustalił, jakie dane, obliczenia, decyzje i etapy pracy doprowadziły do tej wersji.
Na co uważać: Sam przykład nie wyjaśnia wszystkich reguł. Dopowiedz, które cechy są obowiązkowe, a które wynikają z przypadku.
2.Określ, po czym poznasz zakończoną pracę
Na czym polega: Jasny opis wyniku ogranicza rozbieżność między tym, co masz na myśli, a tym, co agent uzna za poprawne.
Jak stosować: Wskaż wymagane elementy, format i kryteria akceptacji. Przy raporcie tygodniowym mogą to być konkretne kolumny, obliczenia i sposób prezentacji.
Na co uważać: Ogólne polecenie, takie jak „zrób pulpit z danymi”, zostawia agentowi decyzje, które mogą być dla ciebie istotne.
3.Jednej umiejętności powierz jedno zadanie
Na czym polega: Wąsko określony zakres ułatwia agentowi wybór właściwej instrukcji i jej konsekwentne wykonanie.
Jak stosować: Rozbij większy proces na czynności, na przykład osobno opracowanie artykułu z filmu, a osobno pisanie innych tekstów na X.
Na co uważać: Instrukcja mająca „prowadzić marketing” obejmuje zbyt wiele różnych decyzji. Trudno wskazać, kiedy dokładnie agent powinien jej użyć.
4.Zadbaj o jasny warunek użycia
Na czym polega: Opis umiejętności ma podpowiadać agentowi, w jakiej sytuacji powinien ją uruchomić.
Jak stosować: Nazwij zadanie wprost, na przykład: „zamień film z YouTube w dłuższy artykuł na X”. Sprawdź, czy zwykła prośba sformułowana w ten sposób wystarcza do jej wywołania.
Na co uważać: Zbyt szeroki opis może sprawić, że agent wybierze tę instrukcję także do pokrewnych, lecz odmiennych zadań.
5.Dostosuj szczegółowość do rodzaju pracy
Na czym polega: Przenoszenie danych według stałych reguł wymaga dokładnych kroków. Dobór ilustracji i redagowanie tekstu wymagają miejsca na ocenę.
Jak stosować: Przy przewidywalnym procesie podaj kolejność działań i warunki. Przy pracy twórczej opisz cel oraz kryteria jakości, pozostawiając agentowi wybór sposobu wykonania.
Na co uważać: Zbyt ogólna instrukcja zwiększa ryzyko błędu w prostym procesie. Zbyt sztywna może zepsuć wynik tam, gdzie każdy materiał jest inny.
6.Wpisz kontrolę jakości w samą umiejętność
Na czym polega: Agent powinien sprawdzić własny wynik lub przekazać go do oceny innemu agentowi, a następnie poprawić wykryte błędy.
Jak stosować: Określ, co ma zostać sprawdzone przed oddaniem pracy: kompletność, zgodność ze źródłem, układ tekstu, obrazy czy kwestie prywatności.
Na co uważać: Raport z kontroli nie zastępuje przejrzenia ważnego materiału przez człowieka. Autor pokazuje, że agent może przeoczyć źle dobrane obrazy mimo wykonania innych sprawdzeń.
7.Oddziel sprawdzenie faktów od oceny jakości
Na czym polega: Część wymagań można policzyć lub potwierdzić, a inne wymagają osądu.
Jak stosować: Osobno sprawdzaj mierzalne warunki, na przykład liczbę ilustracji, i osobno oceniaj czytelność, styl oraz to, czy zrzut ekranu ma sens bez dodatkowych objaśnień.
Na co uważać: Nie sprowadzaj subiektywnej oceny do samej liczby elementów. Artykuł może mieć wszystkie wymagane obrazy, a mimo to wyglądać źle.
8.Porównuj modele na rzeczywistych zadaniach
Na czym polega: Ten sam zapis pracy może dawać różne wyniki zależnie od modelu, szczególnie gdy zadanie wymaga korzystania z przeglądarki i oceny obrazów.
Jak stosować: Uruchom umiejętność na kilku modelach i porównaj efekt, czas wykonania oraz koszt. Potem sprawdź, czy niższy poziom wysiłku nadal zapewnia odpowiednią jakość.
Na co uważać: Jeden udany przebieg nie przesądza o wyborze modelu. Testuj na różnych przykładach odpowiadających twojej codziennej pracy.
9.Przekazuj uwagi, które da się zamienić w reguły
Na czym polega: Poprawki mają służyć także następnym uruchomieniom, a nie tylko bieżącemu materiałowi.
Jak stosować: Wskaż konkretny błąd, wyjaśnij jego skutek i poproś o zmianę instrukcji. Na przykład: „Nie wybieraj klatki z połowy animacji; obraz ma być zrozumiały bez oglądania sąsiednich sekund”.
Na co uważać: Komentarz „wygląda słabo” nie mówi agentowi, co powinien zmienić. Zapisuj też rozwiązania, które wyszły dobrze.
10.Zwiększaj samodzielność stopniowo
Na czym polega: Zaufanie do umiejętności rośnie wraz z liczbą udanych wykonań i poprawek.
Jak stosować: Na początku uważnie przeglądaj każdy wynik. Gdy instrukcja działa stabilnie, ograniczaj własną kontrolę do spraw najważniejszych, zachowując odpowiednie zabezpieczenia.
Na co uważać: Zadania wymagające oceny mogą za każdym razem przebiegać inaczej. Dobrze działająca umiejętność nadal potrzebuje informacji zwrotnej, gdy zmieniają się materiały lub wymagania.
Redakcyjne tłumaczenie
Czym jest umiejętność agenta?
Pokażę sześć kroków, które pomagają tworzyć skuteczniejsze umiejętności dla Codexa. Najpierw wyjaśnię, dlaczego każdy z nich jest ważny, a później sprawdzę je na przykładzie w aplikacji. Zacznijmy jednak od tego, czym w ogóle jest umiejętność.
Wyobraź sobie kucharza, który robi świetne naleśniki z kawałkami czekolady. Chcesz osiągnąć podobny wynik, więc prosisz go o przepis. Dzięki niemu wiesz, jakich składników użyć i co po kolei zrobić. Dla agenta takim przepisem jest umiejętność: zapis sposobu pracy, z którego może skorzystać przy kolejnym zleceniu.
Instrukcje umiejętności znajdują się w pliku SKILL.md. To zwykły tekst zapisany w formacie Markdown. Znaki takie jak # czy - oznaczają w nim nagłówki i punkty listy. Gdy prosisz agenta o wykonanie zadania, może przeczytać ten plik i postępować według opisanej procedury. Nie musi za każdym razem od początku zgadywać, jaki wynik masz na myśli.
Taka instrukcja może być bardzo prosta: na przykład pomagać przeredagować e-mail tak, by był bardziej profesjonalny i nadal brzmiał jak wiadomość od ciebie. Może też opisywać wieloetapową pracę, choćby badanie rynku i analizę kilkudziesięciu spółek. Chodzi o zapisanie powtarzalnego procesu w sposób, który pozwoli powierzyć go agentowi.
1.Zacznij od wyniku i odtwórz drogę do niego
Najpierw ustal, jak ma wyglądać gotowa praca. Co dokładnie oznacza w tym przypadku „zrobione”?
Jeśli poprosisz kucharza o danie z kurczaka, może przygotować kanapkę albo pieczone udka. Ty zaś chciałeś kurczaka po parmeńsku podanego na makaronie. Problemem nie jest wykonanie, lecz niejasne zamówienie. Gdy pokażesz gotowe danie, łatwiej ustalić składniki, sposób przygotowania i czas gotowania. Tak powstaje przepis.
Podobnie jest z umiejętnością służącą do przygotowania raportu na koniec tygodnia. Jeśli masz już dobrze zrobiony arkusz, pokaż go agentowi. Widać w nim wymagane kolumny, obliczenia i układ. Powiedz: „To jest wynik, który chcę otrzymywać. Pomóż mi opisać, jak dojść do niego z danych wejściowych”.
Agent może wtedy pytać, skąd pochodzą dane, jak je wybrano, co zostało obliczone i według jakich zasad sformatowano arkusz. Odpowiedzi staną się podstawą instrukcji. Łatwiej w ten sposób zbudować umiejętność niż zacząć od ogólnej prośby o „pulpit do analizy YouTube”, gdy ty i agent możecie wyobrażać sobie zupełnie różne rzeczy.
Sam zwykle najpierw wykonuję zadanie, oglądam gotowy wynik i dopiero wtedy zastanawiam się, jak zamienić cały proces w umiejętność. Dzięki temu od początku wiadomo, do czego agent ma dążyć.
2.Wybierz jedno zadanie i jasny warunek użycia
Plik SKILL.md ma dwie części. Na początku znajduje się krótki blok metadanych zapisany w YAML, oddzielony liniami z trzema myślnikami. Dalej są właściwe instrukcje. W aplikacji Codex można zobaczyć zarówno sformatowany tekst, jak i jego surową postać.
Metadane podają między innymi nazwę umiejętności i opis tego, kiedy należy jej użyć. Mogą zawierać także wskazówkę dotyczącą argumentu przekazywanego przy uruchomieniu. W mojej umiejętności, która zmienia film z YouTube w dłuższy artykuł na X, takim argumentem bywa adres filmu.
Agent rozpoznaje z opisu, że ta umiejętność pasuje do prośby. Następnie czyta pełne instrukcje i dowiaduje się, co zrobić z podanym adresem: pobrać materiał, przygotować transkrypcję, wybrać zrzuty ekranu i opracować artykuł. Ten konkretny plik jest długi. Poprawiałem go prawdopodobnie ponad 25 razy; nie powstał w jednej próbie.
Mimo tej długości umiejętność ma jedno określone zadanie: zamienić film z YouTube w artykuł na X. Nie służy do zarządzania całym marketingiem. Dużą funkcję w firmie warto rozłożyć na mniejsze czynności, a dla poszczególnych zadań przygotować osobne instrukcje. Później można łączyć je w dłuższy proces.
Im wyraźniej określisz zadanie, tym łatwiej opisać sytuację, w której agent powinien wybrać właśnie tę umiejętność. To pomaga zarówno przy automatycznym uruchamianiu, jak i przy sprawdzaniu, co agent faktycznie robi.
3.Daj agentowi tyle swobody, ile wymaga zadanie
Kolejny krok to ocena, jak przewidywalny jest proces. Czy za każdym razem dostajesz podobne dane, wykonujesz te same działania i oczekujesz wyniku o stałej postaci? A może po drodze stale trzeba coś oceniać i podejmować różne decyzje?
Niektóre zadania można niemal w całości opisać regułami: „Jeżeli wartość przekracza 10, zrób to” albo „przenieś dane z tych komórek do wskazanych pól w CRM”. W takim przypadku instrukcja powinna być szczegółowa. Agent ma wykonać kolejne kroki dokładnie, bo dodatkowa swoboda stwarza okazję do błędnej interpretacji.
Inaczej wygląda pisanie artykułu z filmu. Każdy materiał jest inny. Inne fragmenty zasługują na rozwinięcie, inne kadry warto pokazać, a jeszcze inne trzeba przyciąć lub zasłonić. Nie miałoby sensu nakazywać agentowi robienia zrzutów dokładnie po pierwszej, drugiej i piątej minucie oraz wstawiania ich w ustalone miejsca tekstu. Takie obrazy często nie pasowałyby do treści.
W zadaniach tego rodzaju opisuję oczekiwany efekt i kryteria jakości, ale zostawiam agentowi miejsce na wybór. Pomocne pytanie brzmi: gdy wykonujesz tę pracę samodzielnie, czy zawsze postępujesz według tych samych reguł, czy dostosowujesz działania do materiału? Odpowiedź podpowiada, jak szczegółowo napisać instrukcję.
(Informacja dodatkowa: W tym miejscu autor poleca bezpłatny materiał o zdobywaniu pierwszego klienta na usługi automatyzacji. Zapowiada w nim wskazówki dotyczące krótkiej oferty, filmu pokazującego umiejętności wykonawcy oraz działania bez gotowych studiów przypadku.)
4.Zaplanuj sprawdzenie wyniku
Dla mnie kontrola jakości jest najważniejszą częścią umiejętności. Chcę dostać materiał, który przeszedł już wstępne sprawdzenie i poprawki. Wtedy mogę go szybko przejrzeć i zdecydować, czy nadaje się do wysłania lub publikacji.
Agent może ocenić własną pracę. Można też zlecić sprawdzenie innemu agentowi. Po ocenie pierwszy poprawia wynik, a cały cykl powtarza się, jeśli nadal są błędy. Czasem wystarcza druga wersja, a przy trudniejszych zadaniach potrzeba ich znacznie więcej. Chodzi o to, by nie każdą oczywistą usterkę musiał wyłapywać człowiek.
Nie wszystkie kontrole są jednak takie same. Obiektywny warunek da się potwierdzić: sprawdzić liczbę źródeł, obecność wymaganych elementów czy to, czy wskazane fakty zostały zweryfikowane. Przykładowo można polecić zebranie 500 źródeł, wybranie z nich 250 najlepszych i powierzenie drugiemu agentowi sprawdzenia faktów użytych w tekście. To wymagania, których wykonanie da się ustalić.
Są też kryteria wymagające oceny. Czy strona wygląda dobrze? Czy film się poprawnie odtwarza? Czy artykuł czyta się płynnie i brzmi jak mój tekst? Czy przycięte zrzuty ekranu pokazują to, co trzeba? Nie da się odpowiedzieć na te pytania samym liczeniem elementów.
W umiejętności przygotowującej artykuł na X mam oba rodzaje kontroli. Mogę wskazać wymaganą liczbę zrzutów, ale muszę też opisać, jak agent ma ocenić ich wybór, kadrowanie, położenie w tekście i zgodność z omawianym fragmentem. Dlatego polecam mu otworzyć artykuł w aplikacji, przewinąć go, przeczytać i obejrzeć. Następnie poprawiam instrukcję na podstawie tego, co zauważę w gotowym materiale.
Jeśli trudno ci wymyślić sposób kontroli, pomyśl, jak sprawdziłbyś pracę człowieka, któremu zlecono to samo zadanie. Te kryteria opisz agentowi. Nie gwarantuje to bezbłędnego wyniku, ale może wyraźnie podnieść jakość materiału, który trafia do twojej oceny.
5.Sprawdź, czy wystarczy lżejszy model
Modele różnią się możliwościami i kosztem. Dlatego po zbudowaniu działającej umiejętności sprawdzam, czy równie dobry wynik uzyskam na tańszym modelu.
Jeżeli instrukcja dobrze działa na Astrze, uruchamiam ją na Soulu. Gdy wynik nadal spełnia moje wymagania, sprawdzam Terrę, a potem Lunę. Nie ma powodu używać droższego modelu, jeśli lżejszy wykonuje to samo zadanie równie dobrze. Trzeba jednak rzeczywiście porównać wyniki, bo nie każda umiejętność nadaje się do takiej zamiany.
Prosty opis filmu na YouTube wraz ze znacznikami czasu mogę przygotować na Lunie. Przy artykule na X zwykle wybieram co najmniej Soula, a częściej Astrę. To zadanie wymaga pracy w przeglądarce, wybierania i przycinania obrazów, umieszczania ich we właściwych miejscach, a czasem również zasłaniania wrażliwych szczegółów. W moich dotychczasowych próbach mocniejsze modele radziły sobie z tym lepiej.
Po wybraniu modelu można jeszcze sprawdzić poziom wysiłku przeznaczanego na zadanie. Jeśli wynik przy wysokim ustawieniu jest dobry, testuję średnie. Szukam najlżejszej konfiguracji, która nadal osiąga oczekiwaną jakość.
6.Poprawiaj umiejętność po każdym użyciu
Ostatnią zasadę porównuję do nauki jazdy na rowerze. Na początku jesteś blisko, uważnie obserwujesz i szybko reagujesz. Potem dajesz konkretne wskazówki. Gdy uczeń nabiera wprawy, możesz stopniowo ograniczać pomoc, choć nadal dbasz o odpowiednie zabezpieczenia.
Tak samo traktuję umiejętności agenta. Po uruchomieniu mówię, co wyszło dobrze, co mi nie odpowiada i jak należy zmienić instrukcję przed następną próbą. Robię to niemal za każdym razem.
Przy pracy opartej na ocenie trudno uznać instrukcję za ostatecznie skończoną. Materiały bywają różne, sam proces może się zmieniać, pojawiają się też nowe modele. Im więcej decyzji agent podejmuje sam, tym ważniejsze są kolejne próby i informacja zwrotna. Większe zaufanie nie oznacza, że można całkowicie przestać przyglądać się wynikom.
Gdzie znajduje się umiejętność i jak agent ją wybiera
Pokażę teraz przykład w Codexie. W moim projekcie umiejętności znajdują się w folderze .agents/skills. W projektach używanych z Claude Code trzymam je w .claude/skills. Mogę skopiować instrukcje między tymi miejscami. Można je także przechowywać na poziomie globalnym, aby były dostępne w różnych projektach, zamiast tylko w jednym.
Jeśli nie pamiętasz, gdzie leży konkretny plik, możesz po prostu poprosić Codexa o znalezienie jego ścieżki.
Niedawno uruchomiłem umiejętność przygotowującą artykuł na X i widzę komunikat, że szkic został zapisany. Ten materiał zdążyłem już opublikować. Przeczytałem go i nie musiałem nic zmieniać. Agent przygotował układ, wybrał z filmu zrzuty ekranu i umieścił je przy odpowiednich fragmentach. Jeden z obrazów dodatkowo wyróżnił, choć nie wskazałem ręcznie tego konkretnego miejsca. Takie działania są opisane w instrukcji.
Umiejętność zadziałała tu na Astrze. Chcę jednak sprawdzić, co się stanie, gdy to samo polecenie dostaną Soul, Terra i Luna. Pracy jest sporo: trzeba opracować transkrypcję, utworzyć tekst, przygotować miniaturę, dobrać obrazy, sformatować artykuł i ułożyć wszystko w aplikacji. Agent musi też wielokrotnie oceniać, czy rezultat wygląda dobrze. To dobry przykład zadania, którego nie da się rozpisać wyłącznie na sztywne reguły.
Po około dziesięciu minutach wszystkie trzy modele nadal pracują. Widzę, że przeglądają obrazy i oceniają, które kadry przydadzą się w artykule. Sprawdzę gotowe szkice, gdy zakończą pracę.
Próba z Luną: dobry układ, drobne potknięcia
Luna kończy po 28 minutach i 33 sekundach. Otwieram szkic. Jest miniatura i tytuł artykułu o zaprojektowaniu z Claude jednoosobowego biznesu wartego milion dolarów. Nie podoba mi się, że tytuł powtarza pierwsze zdanie tekstu. W jednym miejscu widzę też dziwny odstęp.
Dalej są krótkie wprowadzenie i nagłówki. Pierwszy zrzut ekranu pojawia się przy omówieniu trzech rodzajów pomysłów i rzeczywiście pokazuje całą trójkę. W kolejnych miejscach sprawdzam, czy ilustracje odpowiadają temu, o czym mówi tekst: ocenę agenta, zestaw testów, wynik pierwszej próby i ponowne uruchomienie po zmianie zasad.
Jeden zrzut wypada słabiej. Tekst mówi o utworzeniu raportu, ale na obrazie samego raportu właściwie nie widać. Są też kadry dotyczące obsługi klienta, wyszukiwania firm oraz cen. Przy cenach agent zastosował wyróżnienie fragmentu obrazu.
Przy ocenie patrzę nie tylko na obrazy. Sprawdzam również, czy tekst brzmi jak ja. Umiejętność korzysta z moich wskazówek dotyczących stylu na LinkedIn, YouTube i sposobu mówienia. W tej próbie jestem pod wrażeniem tego, jak Luna dobrała i rozmieściła zrzuty. Całość nie jest idealna, ale wypada dobrze.
Próba z Terrą: sprawne ukrywanie danych, słabszy dobór obrazów
Terra kończy po około 26 minutach, czyli nieco szybciej od Luny. Wszystkie trzy próby uruchomiłem z wysokim poziomem wysiłku.
Miniatura jest taka sama, ale już pierwszy obraz w artykule wygląda źle: kadr sprawia wrażenie przypadkowo uciętego. Następny również nie wypada dobrze. Na tym etapie Luna prezentuje się lepiej.
Są jednak trafne decyzje. Terra przybliża fragment pokazujący zmianę wyniku z 88 na 94. W kilku miejscach zasłania wrażliwe szczegóły i informuje o tym na obrazie. Stosuje też wyróżnienie wybranych elementów. To przydatne możliwości.
Pod koniec pojawia się wyraźny problem: cztery obrazy są ustawione jeden po drugim w sposób, który nie pasuje do tekstu. Jeden wygląda źle, a inny został uchwycony w połowie animacji. Agent powinien był wychwycić te usterki podczas kontroli. Gdybym miał wybierać tylko między tymi dwiema próbami, wybrałbym Lunę, choć Terra jest droższa i uchodzi za mocniejszy model.
Próba z Soulem: więcej trafnych zbliżeń
Soul kończy po 38 minutach. W tej wersji widzę ilustrację trzech kryteriów omawianych w artykule. Agent częściej przybliża istotne fragmenty zrzutów, dzięki czemu pokazuje konkretny element ekranu, zamiast całego widoku. Zasłania też szczegóły, które nie powinny być widoczne.
Przy opisie jednego raportu wybiera jednak kadr z informacją o 14 zaliczonych i dwóch niezaliczonych testach, zamiast pokazać wynik 88, o którym mowa w tekście. W innym miejscu trafnie wyróżnia późniejszy wynik 94. Widać również obrazy dotyczące sprzedaży, obsługi klienta i danych finansowych. Całość wypada przyzwoicie.
Po obejrzeniu tych wersji zaczynam się zastanawiać, czy Luna nie zrobiła tego zadania lepiej od Soula. Nie wyciągnę jednak takiego wniosku na podstawie jednego filmu. Czasem przygotowuję samouczek z widokami aplikacji, a czasem bardziej montowany materiał. Dobór obrazów i sposób pisania będą się wtedy różnić.
Przeprowadzałem podobne próby na kilku filmach i z mojego doświadczenia Astra nadal najczęściej wypada najlepiej. Zwykle używam jej z niskim poziomem wysiłku oraz trybem przyspieszonym. Ten test przypomina jednak, że warto co jakiś czas porównać modele ponownie i robić to na różnych przykładach.
Co pokazały raporty z kontroli
Każdy z trzech modeli przygotował raport z kontroli jakości. Luna dołączyła także plan ilustracji i wybrane klatki filmu. W raporcie Soula widać między innymi sprawdzenie tytułu, treści, 76 bloków tekstu, 11 zrzutów ekranu wstawionych do artykułu i siedmiu nagłówków drugiego poziomu. Jest tam również ocena wyglądu, prywatności i pokrycia tematu.
Taki raport pozwala mi zobaczyć, co agent sprawdził przed oddaniem pracy. Nie oznacza, że wszystko zrobił bezbłędnie — wystarczy przypomnieć obrazy w wersji Terry. Jestem jednak przekonany, że bez zapisanej procedury kontroli moja umiejętność znacznie gorzej radziłaby sobie z umieszczaniem zrzutów we właściwych miejscach.
Jak powstała instrukcja do artykułów na X
Przygotowałem ręcznie kilka artykułów na podstawie własnych filmów. Sam oglądałem nagrania, wybierałem klatki i wstawiałem je w odpowiednich fragmentach tekstu. Następnie pokazałem gotowe materiały agentowi i poprosiłem go o analizę: co w nich działa, jak wybrałem obrazy i dlaczego trafiły właśnie w te miejsca. Od gotowych przykładów doszliśmy do opisu procesu.
Zakres umiejętności jest wąski. Służy do zamiany filmu z YouTube w artykuł na X. Do pisania innych artykułów na tę platformę mam osobną instrukcję. Dzięki temu wystarczy, że poproszę o przerobienie wskazanego filmu na artykuł, a agent zwykle sam wybiera właściwą umiejętność. Mogę też uruchomić ją bezpośrednio poleceniem z ukośnikiem.
Proces pozostawia agentowi dużo swobody, bo każdy film wymaga innych decyzji redakcyjnych i wizualnych. Jednocześnie instrukcja zawiera kontrolę jakości. Porównuję także modele, na których ją uruchamiam, i regularnie dopisuję uwagi po przejrzeniu wyniku. Tak łączy się wszystkie sześć kroków.
Na przykład po wersji Terry wskazałbym agentowi konkretne błędy: pierwsze zrzuty są źle przycięte, cztery obrazy pod koniec stoją obok siebie bez uzasadnienia, a jeden z nich przedstawia niedokończoną animację. Wyjaśniłbym zasadę: czytelnik powinien rozumieć, co pokazuje zrzut, bez oglądania kilku sekund filmu przed daną klatką i po niej. Poprosiłbym następnie o przeanalizowanie tych uwag i poprawienie samej umiejętności.
Warto wskazywać zarówno to, co wyszło dobrze, jak i to, co trzeba zmienić. Jeśli poprawisz tylko bieżący artykuł, przy następnym uruchomieniu możesz znów napotkać ten sam problem. Gdy poprawisz instrukcję, z uwagi skorzystają kolejne wykonania zadania.
To sześć zasad, które stosuję przy tworzeniu umiejętności Codexa, pokazanych na przykładzie pracy wykonywanej przeze mnie niemal po każdym nowym filmie na YouTube. Na zakończenie autor zaprasza także na swój drugi kanał, gdzie pokazuje wydarzenia związane z AI, wyjazdy i spotkania z innymi twórcami.