Agenci AI dla zabieganych – opanuj podstawy w 27 minut

2026-09-29 • Mikołaj Abramczuk • AI po polsku •tutorial •waga 3/5 •20 min czytania

Kompaktowy poradnik startu z agentami AI dla początkujących i zapracowanych: jak wybrać między Claude Code a Codexem, jak bezpiecznie zainstalować agenta i jak od zwykłego promptu dojść do własnego skilla.

Robocza publikacja redakcyjna na podstawie publicznego transkryptu YouTube. Źródło: YouTube.

O czym jest ten film

  1. Poradnik startowy dla osób, które chcą zacząć pracę z agentami AI, ale tłumaczą się brakiem czasu na „ogarnięcie tematu”.
  2. Pierwsza decyzja — Claude Code czy Codex — według prostej reguły opartej na posiadanej subskrypcji, a przy jej braku na typie planowanych zadań.
  3. Trzy drogi instalacji: terminal, wtyczka w edytorze typu VS Code i aplikacja desktopowa — dla początkujących najprostsza jest aplikacja.
  4. Istota różnicy między aplikacją a czatem w przeglądarce: agent działa w naszym folderze, widzi pliki bez wgrywania, sam je tworzy, ma dostęp do terminala i pracuje w pętli prób aż do skutku.
  5. Wątek bezpieczeństwa: trzy warianty instalacji (główny komputer, osobny profil bez uprawnień administratora, dedykowana maszyna) plus zasady higieny pobierania.
  6. Demistyfikacja działania agenta: układ uprząż — model — narzędzia oraz pętla zleceń, pokazana na przykładzie raportu z reklam na Facebooku.
  7. Konkretne pierwsze kroki: folder roboczy, utworzenie projektu, „przywitanie się” i test, czy agent rozpoznaje swoje środowisko.
  8. Rada na oswojenie: celowo błahe pierwsze zadanie i obserwowanie, jakich narzędzi i źródeł agent używa.
  9. Rozróżnienie agenta-programisty (pisze oprogramowanie) i agenta-asystenta (wykonuje powtarzalne zadania biurowe) oraz metoda budowy pierwszego skilla od zwykłego promptu.
  10. Pliki AGENTS.md i CLAUDE.md jako trwała pamięć instrukcji (do ok. 200 linii), uzupełnione sekcją partnerską Hostinger i informacją o darmowym mini-kursie autora.

10 najważniejszych takeaways — z kontekstem zastosowania

1.Wybór agenta rozstrzygnij w minutę — decyduje subskrypcja

Na czym polega: Masz płatną subskrypcję Claude — bierz Claude Code. Płacisz za ChatGPT — bierz Codexa. Bez żadnej z nich: Claude Code, jeśli planujesz budować aplikacje, strony i makiety; Codex, jeśli agent ma przejmować powtarzalne, biurowe obowiązki.

Jak stosować: Zanim zaczniesz porównywać funkcje, sprawdź, za co już płacisz — to najszybsze kryterium i chroni przed dublowaniem wydatków.

Na co uważać: Przy braku subskrypcji różnica między narzędziami jest — zdaniem autora — niewielka; nie warto blokować startu tygodniem researchingu.

2.Aplikacja na komputerze, nie czat w przeglądarce

Na czym polega: Agent uruchomiony w folderze projektu widzi pliki bez ich wgrywania, sam tworzy nowe, korzysta z terminala, sam pobiera potrzebne narzędzia i skrypty, jest zbudowany pod pracę w pętli prób i błędów oraz pod automatyzacje — chmurowe i lokalne.

Jak stosować: Trzymaj pliki projektów w folderze, w którym uruchamiasz agenta — kontekst jest wtedy zawsze na miejscu, bez ręcznego „dokarmiania” czatu.

Na co uważać: Dostęp do terminala to jednocześnie największa siła i największe ryzyko tej konfiguracji — sekcja o bezpieczeństwie nie jest tu opcjonalna.

3.Agent prowadzi własne notatki i wraca do nich między sesjami

Na czym polega: Ponieważ agent może tworzyć pliki bezpośrednio na twoim komputerze, sam zapisuje instrukcje, preferencje i wnioski z waszej współpracy. Otwierając kolejne rozmowy, sam do tych zapisków wraca — nie zaczynasz od zera.

Jak stosować: Pracuj w ramach jednego projektu (folderu), a ważne ustalenia formułuj wprost, żeby agent miał co zapisać.

Na co uważać: Notatki to zwykłe pliki tekstowe — jeśli rozrosną się bez kontroli, zaczną pochłaniać limity użycia (autor ostrzega o tym przy plikach AGENTS.md i CLAUDE.md).

4.Pod maską nie ma magii: uprząż, model i narzędzia

Na czym polega: Model AI przy każdej nowej sesji jest jak „inteligentne niemowlę” — nie pamięta rozmów, nie wie, gdzie jest ani co może. Wszystko dostarcza mu uprząż (ang. harness): instrukcje, uprawnienia, listę narzędzi, skille i plik AGENTS.md. Model tylko zleca wywołanie narzędzia, uprząż je wykonuje i zwraca wynik — i tak w kółko, aż do odpowiedzi.

Jak stosować: Przy pierwszych zadaniach czytaj podgląd pracy: jakie narzędzia agent wzywa, jakie komendy wykonuje, z jakich źródeł czerpie. To najszybsza nauka jego możliwości i ograniczeń.

Na co uważać: Widzimy jedynie wiadomość i efekt końcowy; bez rozumienia tej pętli agent pozostaje czarną skrzynką i trudno ocenić, do czego go realnie użyć.

5.Trzy poziomy bezpiecznej instalacji

Na czym polega: Po pierwsze — główny komputer i profil, ale tylko gdy nie trzymasz tam danych wrażliwych albo świadomie akceptujesz ryzyko (minimalizują je tryby zgód i ograniczenie dostępu do wybranych folderów). Po drugie — osobny profil na tym samym komputerze, bez uprawnień administratora. Po trzecie — dedykowana maszyna: stary, zakurzony laptop albo Mac mini z czystym profilem, wyłącznie dla agentów. Dane wrażliwe trzymaj na zewnętrznych dyskach, odłączanych na czas sesji.

Jak stosować: Wybierz wariant proporcjonalny do wrażliwości swoich danych; autor sam uruchamia agentów na osobnym sprzęcie.

Na co uważać: Większość użytkowników instaluje agentów „na żywioł”, w ogóle nie myśląc o danych — to żaden argument, żeby robić to samo.

6.Higiena: oficjalne źródła i czujność w sieci

Na czym polega: Aplikacje pobieramy wyłącznie z oficjalnych stron Claude i ChatGPT. Szczególnej ostrożności wymagają momenty, gdy agent przegląda internet albo coś pobiera — zwłaszcza na głównym profilu.

Jak stosować: Twórz dla agentów dedykowane foldery i tylko w nich je uruchamiaj; trzymaj się oficjalnych instalatorów.

Na co uważać: Pobieranie treści z sieci to klasyczna furtka dla niechcianych rzeczy — nie bagatelizuj tego przy zleceniach wymagających przeglądarki.

7.Pierwsza sesja: folder, projekt, przywitanie

Na czym polega: Po instalacji stwórz folder roboczy z podfolderami na poszczególne projekty, w aplikacji utwórz projekt wskazując ten folder, oznacz go jako zaufany (sami go stworzyliśmy i jest pusty), napisz „siema, co tam” i zapytaj, czy agent coś w tym folderze widzi.

Jak stosować: Odpowiedź na testowe pytanie od razu pokaże, czy połączenie działa i czy agent wie, w jakim środowisku pracuje.

Na co uważać: Zaufaniem obejmuj wyłącznie foldery, które znasz — nie katalogi systemowe ani miejsca z danymi.

8.Na rozgrzewkę zleć coś błahego

Na czym polega: Zanim weźmiesz się za poważne zadania, pozwól sobie na naiwne polecenie — na przykład „znajdź kompilację goli z Ligi Mistrzów 2008 roku” — i poobserwuj zarówno pracę agenta, jak i interfejs: dodawanie plików, ustawianie celu, tryb planowania, tryby zgód, wybór modelu, czat głosowy.

Jak stosować: potraktuj to jako sesję rozpoznawczą: patrz, jakie narzędzia się wywołują i skąd agent bierze dane.

Na co uważać: To nie jest test możliwości — pierwszy lepszy prompt nie powie ci, na co agent naprawdę stać.

9.Zanim zaczniesz: programista czy asystent?

Na czym polega: Przy każdym nowym projekcie warto się na chwilę zatrzymać i rozstrzygnąć rolę: agent ma pisać kod (np. stworzyć CRM-a) — to agent-programista; ma wykonywać powtarzalne czynności biurowe (np. dodawać klientów do CRM-a, analizować, podsumowywać) — to agent-asystent.

Jak stosować: Ta decyzja porządkuje dalsze kroki: przy programiście kluczowe są pliki AGENTS.md/CLAUDE.md, przy asystencie — skille.

Na co uważać: To podział umowny, pomocniczy, a nie techniczna kategoria — nie pozwól, żeby cię sztywno ograniczał.

10.Droga do pierwszego skilla: prompt → rozmowa → utrwalenie

Na czym polega: Zadanie wybierz trzema pytaniami: co zleciłbyś od razu komuś nowo zatrudnionemu; co robisz na skróty, bo brakuje czasu na porządnie; co robisz regularnie i za każdym razem tak samo. Potem zleć je zwykłym promptem (np. „przygotuj jednostronicową ściągę o firmie i osobie przed spotkaniem”), dopracuj w zwykłej rozmowie, a na koniec poleć: „na podstawie całej tej rozmowy stwórz skilla — wyciągnij wnioski z moich poprawek i twoich błędów”. Skilla wywołujesz ukośnikiem i nazwą, a kolejne uwagi wgrywasz poleceniem „zaktualizuj skilla”.

Jak stosować: Po utworzeniu skilla otwieraj nowe rozmowy w tym samym projekcie — dostaniesz wypracowany wcześniej efekt, tylko z podmienionymi danymi wejściowymi.

Na co uważać: AGENTS.md (Codex) i CLAUDE.md (Claude Code) trzymaj w granicach około 200 linii — przeładowany plik instrukcji błyskawicznie wypala limity użycia.

Redakcyjne tłumaczenie

Wstęp: odcinek dla tych, którzy nie mają czasu

Ten materiał jest dla wszystkich, którzy mówią, że nie mają czasu na agentów AI — że temat wydaje się ciekawy, ale nie ma kiedy go ogarnąć. Dlatego w możliwie krótkim czasie przechodzimy przez kilka kwestii: Claude Code czy Codex, jak bezpiecznie zainstalować takiego agenta, jakie pierwsze kroki podjąć i po co w ogóle je podejmować. Wyjaśnię też, dlaczego warto ściągnąć aplikację na komputer zamiast pracować w przeglądarce oraz jak podchodzić do zadań, które będziemy chcieli agentom powierzać. Skoro to odcinek dla zabieganych — nie przedłużam i zaczynamy.

(Informacja dodatkowa: Claude Code i Codex to „agentowe” aplikacje — odpowiednio Anthropic i OpenAI — które działają bezpośrednio na plikach i w terminalu komputera użytkownika.)

Claude Code czy Codex?

Pierwsze pytanie: który wybrać? Najprościej rzecz biorąc — sprawdź, czy masz którąkolwiek z płatnych subskrypcji. Płacisz za Claude — wybieraj Claude Code, bez zastanowienia. Płacisz za ChatGPT — wybieraj Codexa. I na tym można temat zamknąć.

Jeśli nie masz żadnej płatnej subskrypcji, zastanów się, do czego agent ma służyć. Kiedy planujesz budować aplikacje, strony internetowe czy makiety, skłaniałbym się ku Claude Code. Kiedy agent ma przejmować za ciebie powtarzalne, typowo biurowe zadania — minimalnie bardziej ku Codexowi, choć tu różnica nie jest wielka. Na samym początku kieruj się jednym: sprawdzasz, czy już płacisz Claude’owi albo ChatGPT, i według tego wybierasz.

Terminal, wtyczka w edytorze czy aplikacja?

Druga ważna kwestia: jak takiego agenta pobrać. Są trzy drogi.

Najbardziej techniczna, dla najbardziej technicznych — terminal. Można wejść na stronę instalacyjną, pobrać agenta na swój komputer, uruchomić go w odpowiednim folderze i rozmawiać z nim stamtąd. Na początek nie ma co sobie komplikować.

Można też odpalić wtyczkę w IDE, czyli zintegrowanym środowisku programistycznym. W VS Code obok plików danego folderu mamy okno czatu z Claude Code; z Codexem rozmawia się analogicznie. Również tego na start bym nie polecał.

Jeśli chcemy szybko zacząć, najprościej jest po prostu pobrać aplikację.

Po co pobierać aplikację, skoro jest czat w przeglądarce?

Zanim wystartujecie, pytanie zasadnicze: po co w ogóle pobierać aplikację? Przecież można wejść na chatgpt.com i pracować w przeglądarce. Można jak najbardziej — ale to rozwiązanie dość ograniczone. Warto więc podkreślić, co daje instalacja na komputerze.

Przede wszystkim pracę w naszym środowisku. Nie musimy biec do czatu w przeglądarce, wgrywać plików z zewnątrz, tłumaczyć, gdzie co jest, i dostosowywać się do narzędzia. Agent po prostu zaczyna pracować tam, gdzie my pracujemy. Claude Code i Codexa uruchamiamy w konkretnym folderze — a więc jeśli są w nim pliki projektu, to one tam po prostu są i agent ma do nich stały, bezpośredni dostęp. Niczego nie trzeba wgrywać: agent jest w tym projekcie razem z nimi.

To z kolei pozwala mu tworzyć własne pliki — a więc i prowadzić pamięć. Agent pisze sobie zwykłe instrukcje tekstowe i zapisuje je w folderze. Dzięki temu między sesjami, otwierając nowe rozmowy, łatwo wraca do własnych zapisków: preferencji, wniosków, instrukcji obsługi poszczególnych narzędści.

Skoro pobieramy go na nasz komputer, ma też dostęp do terminala — może na przykład samodzielnie ściągać potrzebne narzędzia czy skrypty, które odpala, żeby wykonać daną czynność. Nie musimy się tym martwić, bo działa tu proaktywnie.

Kolejny argument: zoptymalizowanie pod pracę w pętli. Agent jest zbudowany tak, żeby krążyć i próbować różnych sposobów, byle dotrzeć do celu, który mu wyznaczyliśmy. Jeśli nie uda mu się stworzyć jakiegoś PDF-a, będzie kombinować dalej, aż w końcu mu się uda.

I wisienka na torcie: praca automatyczna. Możemy zbudować agentowi automatyzacje — chmurowe albo lokalne, działające na naszym komputerze. Poza tym jest autonomiczny — to w końcu agent, taka „zośia samosia”, wiele potrafi wykonać sam.

Jak bezpiecznie wpuścić agenta na komputer

Jestem świadomy, że te argumenty mogą kogoś zatrzymać i skłonić do myśli: nie chcę wpuszczać takiego stwora na komputer, bo może narobić niepożądanych rzeczy, a ja chcę mieć kontrolę nad tym, co się na nim dzieje. I właśnie dlatego czwarty temat: bezpieczeństwo.

Wariant pierwszy: pobieramy na głównym komputerze, tak po prostu, bez kombinowania — także na głównym profilu. Ale wtedy musi być spełniony jeden z warunków: albo nie trzymamy na tym komputerze wrażliwych danych, po prostu ich tam nie posiadamy, albo jesteśmy gotowi podjąć ryzyko. Sporo twórców i youtuberów w ogóle nie myśli o bezpieczeństwie danych — ściągają i żyją. To oczywiście jakieś ryzyko, które można zminimalizować, wybierając odpowiednie tryby zgód albo ograniczając dostęp do wybranych folderów. Jeśli natomiast chcemy mieć całkowitą pewność, że agent nie zajrzy tam, gdzie nie powinien, dane wrażliwe trzymajmy na zewnętrznych dyskach — odłączanych na czas pracy z agentem.

Wariant drugi: osobny profil na tym samym komputerze. Na Macu tworzymy nowe konto, nazwijmy je choćby „Agent Mikołaja”, logujemy się na nie, pobieramy tam Codexa albo Claude Code — i temu profilowi nie nadajemy uprawnień administratora.

Wariant trzeci: osobny komputer. Najlepiej stary, zakurzony — jakiś gamerski laptop. Dmuchamy, odkurzamy, włączamy, tworzymy całkowicie czysty profil i mamy maszynę wyłącznie dla agenta. Ja sam tak robię. Można też kupić Maca mini albo inny dedykowany sprzęt i tam agentów uruchamiać.

Oczywiście istnieją inne rozwiązania — VPS czy maszyna wirtualna — ale nie chciałem tego komplikować. Podsumowując: albo główny komputer i profil, albo oddzielny profil, albo oddzielny komputer przeznaczony stricte dla agentów.

I jeszcze trzy uwagi z zakresu bezpieczeństwa. Po pierwsze, pobieramy wyłącznie z oficjalnych stron Claude i ChatGPT. Po drugie, szczególnie uważamy, gdy agent przegląda cokolwiek w internecie albo coś stamtąd pobiera — zwłaszcza na głównym profilu. Po trzecie, uruchamiamy agentów w folderach stworzonych specjalnie dla nich — o tym za chwilę.

Sekcja partnerska: Hostinger

Po jakimś czasie współpracy z agentami przychodzi dzień, w którym budzimy się z setkami pomysłów — na aplikacje, automatyzacje, kolejnych agentów. Wtedy może was zainteresować Hostinger: platforma łącząca hosting stron, serwery, domeny i skrzynkę pocztową w jednym miejscu, tak żeby zająć się realizacją pomysłów, a nie administracją. Plan o nazwie „Bez limitu” pozwala tworzyć strony bez ograniczeń, daje darmową domenę na rok przy zakupie na dwanaście miesięcy, 50 GB miejsca i codzienne kopie zapasowe — całą stronę administracyjną załatwia za nas. Każdy plan można testować trzydzieści dni w ramach gwarancji zwrotu pieniędzy bez pytań, a w koszyku warto wpisać kod rabatowy MIKOLE10 (dodatkowe 10 procent). Jeśli interesują was serwery VPS — choćby pod własnego agenta Hermes albo pod n8n — to również jest dostępne; sam mam tam VPS-a, na którym stoi mój agent Hermes. A jeśli macie już stronę albo serwer, można podłączyć serwer MCP i zarządzać wszystkim wprost z czatu w Codexie czy Claude: wdrażać nowe wersje, poprawiać istniejące elementy, zarządzać domenami i ich ustawieniami oraz samym serwerem. Bezstresowe rozwiązanie — dlatego je lubię. Link w opisie, a dzięki Hostinger za sponsorowanie tej części.

(Informacja dodatkowa: MCP, czyli Model Context Protocol, to standard pozwalający podłączać do modeli AI zewnętrzne narzędzia i serwery. n8n to narzędzie do budowania automatyzacji, często uruchamiane na własnym serwerze.)

Pod maską: uprząż, model i narzędzia

Krok numer pięć mam wrażenie, że jest często pomijany — bo od razu skaczemy na główkę do agentów i w ogóle się nie zastanawiamy, co dzieje się pod spodem. Potem mamy wrażenie czarnej magii, czarnej skrzynki. Ten punkt służy obaleniu tego mitu.

Załóżmy, że wysyłamy agentowi wiadomość: „Przeszukaj bibliotekę reklam na Facebooku i przygotuj mi raport o pięciu najlepszych reklamach”. Klikamy „Wyślij” — i zobaczcie, co się wtedy dzieje.

Cały ten tajemniczy stwór składa się w gruncie rzeczy z dwóch elementów: uprzęży i modelu AI. Uprząż — mówiąc najprościej, program, który umożliwia modelowi wykonywanie określonych czynności — jest wszystkim. To ona odpowiada za całą „magię”. Bo sam model można porównać do bobasa: przy każdej nowej sesji, za każdym razem, gdy zaczynamy rozmowę od „siemka”, jest bezradny. Nie pamięta, gdzie przed chwilą z nami rozmawiał ani o czym. Nie wie nawet, gdzie jest i który jest dzień. Nie wie, że może przejrzeć internet. Nic tak naprawdę nie wie — ale to bobas z dużym mózgiem. Inteligentny bobas.

A to uprząż dostarcza modelowi za każdym razem, niewidocznie dla nas, całą resztę: instrukcje mówiące mu, kim jest; informacje o środowisku, w którym pracujemy; uprawnienia — co może robić, a czego nie; jakich narzędzi może używać; jakie ma umiejętności, tzw. skille; oraz dodatkowe instrukcje z pliku o nazwie AGENTS.md, czyli zwykłego pliku tekstowego przyczepianego do każdej naszej wiadomości. To wszystko jest zasługą uprzęży — to dzięki niej model tyle wie i tyle może. Uprząż przekleja też naszą wiadomość i przekazuje ją dalej.

Jak wygląda cała pętla? Najpierw my wysyłamy wiadomość, a uprząż doręcza ją modelowi wraz ze wszystkimi opisanymi informacjami. Model, dowiedziawszy się, do czego ma dostęp, postanawia użyć narzędzia o nazwie „przeglądarka”. Sam nie potrafi go wywołać — potrafi to zrobić tylko uprząż — więc wysyła jej zlecenie: potrzebuję narzędzia przeglądarka, wywołaj je z taką i taką instrukcją. Uprząż przetwarza zlecenie i przesyła instrukcję do przeglądarki: wykonaj wyszukiwanie reklam z Facebooka. Przeglądarka odhacza zadanie i zwraca wynik uprzęży, a uprząż — bo to ona ją wywołała — przekazuje wyniki modelowi. Model je analizuje, wyciąga wnioski i pisze nam, użytkownikom: wybrałem pięć najlepszych reklam, oto gotowy raport.

My tak naprawdę nie mamy pojęcia, co się działo po drodze. Widzimy tylko, że wysłaliśmy wiadomość, coś tam się mieli, mieli, mieli — i w końcu dostajemy pięć reklam. Niemniej z własnej perspektywy wielokrotnie zauważyłem, że świadomość tego, co zachodzi pod spodem, jest kluczowa dla zrozumienia, do czego agentów można wykorzystać. I żeby dowieść, że nie zmyślam: na ekranie widać, jak po wysłaniu polecenia agent dopytuje o branżę, wczytuje narzędzie, wykonuje komendy, przegląda internet, znowu wykonuje komendy, na bieżąco informuje, co się dzieje, odczytuje pliki i w końcu zwraca odpowiedź. Warto mieć świadomość, że pętla pracy agentowej — pętla porozumienia między uprzężą, modelem i narzędziami — działa właśnie tak.

Pierwsze uruchomienie: folder, projekt, przywitanie

Mamy za sobą wybór i pobranie agenta — czas na faktyczne odpalenie. Poza ściągnięciem aplikacji, otwarciem jej i zalogowaniem na swoje konto (to oczywiste) warto na początku zrobić trzy rzeczy.

Pierwsza: stworzyć folder roboczy, w którym będziemy uruchamiać sesje z agentami i dzielić je na poszczególne projekty. Nic trudnego — otwieramy Findera na Macu albo Eksplorator na Windowsie. U mnie to folder „Claude Desktop”, a w nim nowy podfolder, nazwijmy go „Demo YouTube na żywo”. Nazwa może być jakakolwiek, nieistotna.

Odpalamy teraz — powiedzmy — Codexa (z Claude Code jest identycznie). Ponieważ otwieramy ten folder po raz pierwszy, tworzymy nowy projekt, wskazujemy świeżo powstały folder i klikamy „Utwórz projekt”. Ufamy mu, bo sami go stworzyliśmy i jest pusty.

Druga rzecz: przywitajmy się. Trzeba być uprzejmym, kulturalnym — piszemy „siema, co tam”. Sprawdzamy, czy wszystko działa i jest podłączone, i pytamy na starcie, czy agent coś widzi w tym folderze. W moim przypadku nie skłamał: rozpoznał, w jakim konkretnym środowisku pracuje, i że jest ono zupełnie puste.

Oswajanie interfejsu i pierwsze błahe zadanie

Zanim wejdziemy głębiej, poświęćmy chwilę na oswojenie się — żeby zobaczyć, że to, co widzimy w Codexie czy Claude Code, wcale nie jest przerażające. Poklikajmy: można dodawać pliki, ustawić cel, włączyć tryb planowania, przełączać tryby zgód — wszystko jest opisane, jak działa i po co. Można wybrać model, z którym rozmawiamy, dokładnie tak samo jak w przeglądarce. Można dyktować albo włączyć czat głosowy, który działa bardzo fajnie. Chcę, żebyście zobaczyli, że to nic nowego ani nic strasznego.

A skoro się oswoiliśmy, to zanim zabierzemy się za pierwsze sensowne zadanie, pozwólmy sobie jeszcze na chwilę naiwności i zlećmy pierwsze lepsze polecenie z kategorii normalności — cokolwiek przyjdzie do głowy — żeby zobaczyć, jak agent działa, co robi i jak się zachowuje. Np.: „znajdź mi kompilację goli z Ligi Mistrzów 2008 roku”. Tak, bardzo głupie — ale sprawdźmy. Chodzi o podejrzenie z otwartą głową, być może odrobinę naiwną: z jakich źródeł korzysta, jakie narzędzia wzywa, w jaki sposób pracuje. Ja już wiem, co dzieje się pod spodem, ale wam polecam poklikać samemu. Mikrokrok, a istotny — oswojenie robi swoje.

Agent-programista czy agent-asystent?

Krok siódmy jest dla tych, którzy chcą dojrzeć we współpracy z agentami i nie zlecać pierwszych lepszych zadań, tylko faktycznie rozumieć, co się dzieje pod spodem.

Na początku bardzo ważne rozróżnienie. Jeśli tworzymy nowy projekt — jak mój „Demo YouTube na żywo” — zawsze warto się na minutkę zatrzymać i pomyśleć, czy ma to być agent, który za nas programuje, czy agent będący naszym asystentem. Podział jest umowny, ale przynajmniej mnie pomaga zrozumieć, po co w ogóle tego agenta tworzę.

Przykład: CRM, czyli oprogramowanie dla firm do zarządzania relacjami z klientami. Czy chcę, żeby agent zakodował mi CRM-a — wtedy to agent-programista? Czy chcę, żeby nim zarządzał i administrował: dodawał klientów, analizował, tworzył podsumowania — wtedy to agent-asystent? Ogólniej: czy agent ma za nas coś stricte programować i tworzyć oprogramowanie, czy raczej wykonywać zadania biurowe i powtarzalne czynności — wtedy skłaniałbym się właśnie w stronę asystenta.

Temat agenta-programisty to materiał na dodatkowe kilka godzin, więc tutaj streściłem tylko podejście do agenta-asystenta — tego, który za nas wykonuje powtarzalną lub jakąkolwiek inną pracę.

Jak wybrać pierwsze zadanie

Na początek kwestia wyboru zadania — oczywista, ale trzeba ją jakoś rozstrzygnąć. Można wymyślić je samemu, z głowy. Można też wejść na moją stronę cloudmaster.pl, gdzie w darmowym mini-kursie znajdziecie prompt pomagający wybrać zadanie. Albo zadać sobie trzy pytania: co zleciłbyś od razu, gdybyś mógł kogoś zatrudnić? Co robisz na szybko, bo nie masz czasu zrobić tego porządnie? Co robisz regularnie i za każdym razem tak samo? W filmie podaję też listę przykładowych odpowiedzi — można zatrzymać, przeczytać, może coś zainspiruje.

Od zwykłego prompta do skilla

Można to sobie skomplikować — i pewnie ja też gdzieś to komplikowałem — ale dochodzę do wniosku, że można zacząć jeszcze prościej niż najprościej: od zwykłego promptu. Mając wybrane zadanie, po prostu przechodzimy do agenta i mówimy mu, co chcemy zrobić. Na przykład: „Chcę, żebyś pomógł mi przed każdym spotkaniem sprawdzić firmę i osobę, z którą rozmawiam, i przygotować jednostronicową ściągę”. I tyle.

Teraz przechodzimy z nim przez cały proces, promptując dokładnie tak, jak robilibyście to w zwykłym czacie: odpowiadajcie na pytania, mówcie, co wam się podoba, co byście zmienili, co jest nie tak. Zwykła rozmowa. I kiedy dotrzecie do miejsca, w którym wynik jest zadowalają — faktycznie pomógł i faktycznie będziecie z tego korzystać — napiszcie albo powiedzcie mu coś takiego (i tutaj słuchajcie uważnie):

„Na podstawie całej tej naszej rozmowy chcę, żebyś stworzył mi skilla, który będzie robił dokładnie to, co osiągnęliśmy. Wyciągnij wnioski z całej wymiany wiadomości — z błędów, które popełniłeś, z moich poprawek, z tego, jak chciałem, żeby wynik wyglądał. I stwórz mi skilla.”

I to wszystko, moi drodzy. Trywialnie proste, nic skomplikowanego — a świetny punkt wyjścia dla każdego, kto chce sensownie zacząć współpracę z agentami. Bo gdy skill powstanie, możemy otworzyć dowolną nową rozmowę w tym projekcie i go przywołać: piszemy ukośnik i nazwę skilla, a dostajemy raz za razem odpowiedź wypracowaną we wcześniejszej rozmowie — tylko z podmienionymi danymi wejściowymi. I to jest rzecz do zapamiętania na start: zaczynamy od zwykłego promptowania i zwykłej rozmowy, a kiedy dopracujemy efekt do zadowalającego poziomu, ubieramy to w skilla. Potem otwieramy nową rozmowę, wykonujemy to samo zadanie, wywołujemy skilla — a jeśli coś dalej nie gra, po prostu promptujemy poprawki i mówimy: „zaktualizuj skilla o te moje poprawki”. Tak go doszlifowujemy, aż robi dokładnie to, czego sobie życzymy.

Pliki AGENTS.md i CLAUDE.md

Nie chcę tu komplikować, ale przy pracy z agentem-programistą większą uwagę poświęciłbym plikom o nazwach AGENTS.md i CLAUDE.md oraz skillom. To jedyne, co na samym początku trzeba zapamiętać. Są one tak ustawione, że bezpośrednio oddziałują na pracę agentów. AGENTS.md i CLAUDE.md to zwykłe pliki tekstowe ze zwykłymi instrukcjami — możemy je napisać sami albo sprawić, żeby agent napisał je sam dla siebie. Przy każdej wiadomości wysyłanej do Claude’a albo Codexa plik ten jest załączany u góry. W Codexie musi nazywać się AGENTS.md, w Claude Code — CLAUDE.md. I to jest cała filozofia.

W praktyce wykorzystuje się to tak: jeśli podczas rozmowy dojdziemy do istotnego wniosku, mówimy „zapamiętaj to w AGENTS.md”. To po prostu sposób na przekazywanie wniosków i utrwalanie najważniejszych instrukcji — czegokolwiek. Przy agencie-programiście ważniejsze jest tworzenie tego pliku, a skille tylko do określonych czynności. Przy agencie-asystencie zauważyłem odwrotnie: dużo bardziej pomocne są skille, a AGENTS.md czy CLAUDE.md pełni rolę uzupełnienia — najważniejszych reguł i kontekstu, który zawsze chcemy mieć pod ręką.

I ostatnia uwaga: AGENTS.md i CLAUDE.md najlepiej, żeby miały do dwustu linijek, nie więcej. To pliki, których nie wolno przeładowywać, bo limity użycia agentów będą topnieć bardzo szybko.

Zakończenie

Wiem, że dużo informacji i być może warto obejrzeć jeszcze raz — nie chciałem jednak niczego przed wami ukryć, tylko pokazać, jak sensownie zacząć. Jeśli chcecie pójść dalej: wchodzicie na cloudmaster.pl, gdzie pod darmowym mini-kursem można odebrać plan budowy pierwszego agenta oraz wspomniany prompt do wyboru pierwszego zadania. Zapraszam też na kurs o Claude dla nieprogramujących freelancerów i przedsiębiorców; niedługo pojawi się kurs o Codexie, a warsztaty — w momencie nagrania wyprzedane — być może mają już wznowioną sprzedaż. Dziękuję za dzisiaj, mam nadzieję, że pomogłem, i zapraszam do newslettera oraz subskrypcji kanału, jeśli materiał wam się spodobał. Cześć!