I Tested 100+ Hermes Agent Skills.... You Need These 13

2026-08-07 Jack Roberts AI zagraniczne tutorial waga 3/5 22 min czytania

Przegląd 13 umiejętności dla agenta Hermes — od audytu bezpieczeństwa i odchudzania kontekstu po porannego brifingu i miksturę modeli. Dla osób, które już używają agenta i chcą wycisnąć z niego więcej.

Robocza publikacja redakcyjna na podstawie publicznego transkryptu YouTube. Źródło: YouTube.

O czym jest ten film

  1. Autor twierdzi, że przetestował setki umiejętności (skills) dla agenta Hermes i większość uznaje za bezwartościową — wybiera trzynaście, które jego zdaniem realnie zmieniają jakość pracy.
  2. Pierwsza grupa umiejętności dotyczy higieny wejścia: „bramkarz” sprawdzający nowe umiejętności pod kątem wstrzykiwania promptów i szukający lepszych alternatyw w sieci.
  3. Druga grupa poprawia jakość komunikacji z agentem: grill me (dopytywanie o intencje), dokument przekazania między agentami oraz tryb /teach, zamieniający agenta w nauczyciela.
  4. Umiejętność meta: kreator umiejętności, czyli zestaw reguł, według których agent tworzy kolejne umiejętności — z naciskiem na oszczędność tokenów i unikanie rozrostu.
  5. Sponsorowana sekcja o uruchomieniu agenta na serwerze VPS, żeby działał 24 godziny na dobę niezależnie od tego, czy laptop jest otwarty.
  6. „Doktor kontekstu” — audyt wszystkiego, co ładuje się przy każdej turze rozmowy, inspirowany usunięciem przez Anthropic ponad 80% promptu systemowego Claude Code bez utraty jakości.
  7. Umiejętność „ostatnie 30 dni”, która przeczesuje X, YouTube, Reddita, Hacker News, rynki predykcyjne i commity na GitHubie, ważąc wyniki popularnością.
  8. /learn — zamiana dowolnego materiału (np. filmu z YouTube) albo właśnie wykonanej pracy w trwałą umiejętność agenta.
  9. Warstwa twórcza: „dyrektor artystyczny” łączący uniwersalne zasady projektowe z biblioteką komponentów 21st.dev oraz „studio” do generowania obrazów i wideo przez CLI Higgsfielda.
  10. Najbardziej ceniona przez autora umiejętność to poranny brifing z kalendarza i skrzynki, a zamykająca listę „Ministry of Experts” zderza odpowiedzi kilku modeli i syntetyzuje je jednym modelem wiodącym.

Redakcyjne tłumaczenie

Wstęp

Przetestowałem setki umiejętności dla agenta Hermes i większość z nich to kompletne śmieci. Jeśli chcesz odblokować pełne możliwości Hermesa, musisz używać właściwych umiejętności. W tym filmie pokażę trzynaście najlepszych — takich, dzięki którym przestaniesz marnować czas, zaoszczędzisz pieniądze i wyprzedzisz resztę o lata świetlne. Nalej sobie tej pięknej kawy i zaczynajmy.

Celem jest w pełni obsadzony agent Hermes. Wszystko oznaczę znacznikami czasu w opisie i podam linki do każdej z umiejętności, żeby dało się je łatwo pobrać.

(Informacja dodatkowa: „umiejętność” — ang. skill — to spakowany zestaw instrukcji i plików, który agent ładuje na żądanie, żeby wykonać określony typ zadania w ustalony sposób.)

1.Bramkarz

Wyobraź sobie, że twój agent Hermes to sala, w której trwa impreza. Bramkarz pilnuje, żeby każda umiejętność, która chce do niej wejść, była nieszkodliwa — a więc żeby po prostu działała. Ale robi coś jeszcze: sam wyszukuje w sieci inne umiejętności, sprawdzając, czy nie ma lepszych alternatyw. Dzięki temu w praktyce zawsze pracujesz na najlepszym dostępnym materiale.

Jak to wygląda w działaniu? Skanuje pod kątem wstrzykiwania promptów. Najpierw robi rozeznanie w rynku. Przeprowadza z tobą rozmowę, żeby zrozumieć, czego właściwie oczekujesz od danej umiejętności. Na tej podstawie podejmuje jedną z trzech decyzji: automatycznie przepuszcza, pyta o zgodę albo odrzuca i przenosi do kwarantanny.

Hermes radzi sobie z tym całkiem dobrze i bez tej umiejętności, ale te dodatkowe zabezpieczenia sprawiają, że do środka trafia wyłącznie to, co najlepsze.

(Informacja dodatkowa: wstrzykiwanie promptów — prompt injection — to atak polegający na ukryciu w treści, którą model czyta, poleceń przejmujących kontrolę nad jego zachowaniem.)

2.„Przemaglej mnie”

Jeśli sztuczna inteligencja nie rozumie, czego chcesz, Hermes nigdy nie dostarczy ci tego, czego naprawdę potrzebujesz. Umiejętność grill me sprawia, że agent — na twoje żądanie — sam zacznie zadawać pytania doprecyzowujące. Efekt jest prosty: w końcu robi dokładnie to, o co ci chodziło. To umiejętność z zestawu Matta.

Przykład: wchodzę do mojego agentowego systemu operacyjnego albo na Telegrama i piszę po prostu: „Hej, myślę o założeniu nowego biznesu. Przemagluj mnie z tego pomysłu, żeby sprawdzić, czy jest dobry”. To wszystko. Agent odpowiada serią pytań.

A propos — żeby zainstalować umiejętność, wystarczy ją podrzucić i powiedzieć: „Zainstaluj tę umiejętność”, a następnie wkleić link do repozytorium albo samą treść.

Najlepiej myśleć o Hermesie jak o stażyście ze stu pięćdziesięcioma punktami IQ ponad normę: jest genialny, ale tylko wtedy, gdy wie, co ma robić. Zadając pytania — kto dokładnie jest klientem? jaki powtarzalny, bolesny problem rozwiązujesz? — i proponując własne odpowiedzi, przeprowadza cię przez temat krok po kroku.

3.Ciągłość, czyli dokument przekazania

Kiedy przechodzisz od jednego agenta do drugiego, nie tylko musisz się powtarzać — może też dojść do poważnych nieporozumień. Dlatego potrzebne jest porządne przekazanie zmiany.

Wystarczy powiedzieć: „Podsumuj wszystko, co dziś zrobiliśmy, i napisz mi dokument przekazania, który mogę przenieść do Claude Code i podać dalej innemu agentowi”. Dosłownie taki prompt — Hermes sięgnie po odpowiednią umiejętność i napisze szczegółowy dokument.

A jeśli się zastanawiasz: nie, nie przeprowadziłem się do hotelu. Jestem teraz w Czarnogórze, na wydarzeniu poświęconym sztucznej inteligencji. To był szalony tydzień, mam dla was mnóstwo ciekawych rzeczy do opowiedzenia — ale spokojnie, była piękna kawa i świetna pogoda. Co, nawiasem mówiąc, bywa niebezpieczne, bo trzeba mieć krem z filtrem pod ścisłą kontrolą.

Dokument przekazania obejmuje: stan prac, podjęte decyzje, następne kroki, sugerowane umiejętności oraz sekrety.

4.Tryb nauczyciela: /teach

Większość ludzi zadaje ChatowiGPT albo Hermesowi pytanie i dostaje w odpowiedzi jeden akapit. Ta umiejętność pozwala zamienić agenta w profesora — odblokowujesz nowe wnioski, a cała współpraca staje się znacznie skuteczniejsza. Wyobraź sobie, że zamiast rzucać ci gotowe spostrzeżenia, agent naprawdę cię uczy.

Właśnie to robi /teach z zestawu Matta. Najpierw ustalasz misję: po co się tego uczymy? Każda lekcja zostaje zakotwiczona w twoim rzeczywistym celu. Potem — jedna rzecz naraz. Na koniec zapis tego, co faktycznie zostało w głowie.

W praktyce mówię Hermesowi: „Użyj umiejętności teach me i naucz mnie, jak najlepiej rozwijać konto na Instagramie”. Agent od razu sięga po umiejętność i odpowiada: zanim przejdziemy do lekcji pierwszej, potrzebujemy misji — ta umiejętność uczy w kierunku konkretnego rezultatu, a nie próżnych obserwujących. Rekomendacja: uczyń z Instagrama swój kanał odkrywania. I zaczyna wywiad: czego właściwie chcesz? Może zasięgu i wzrostu. Świetnie. To po prostu znacznie bardziej uporządkowany sposób pracy z Hermesem — albo z Claude’em, jeśli tego używasz — i lepsze rezultaty.

5.Umiejętność meta: kreator umiejętności

Piąta pozycja to umiejętność meta, która poprawia wszystkie pozostałe: zdolność tworzenia dobrych umiejętności. Wyobraź sobie, że zamieniasz Hermesa w najlepszego na świecie autora umiejętności. Da się to zrobić jednym konkretnym promptem — to po prostu zbiór reguł, który agent wciąga za każdym razem, gdy tworzy coś nowego.

Mówię na przykład: „Stwórz umiejętność na podstawie naszej wcześniejszej rozmowy o modelach AI. Użyj do tego swojej umiejętności skill creator”.

Ważna uwaga: teoretycznie nie musisz mówić „użyj kreatora umiejętności”, agent powinien to sam wywnioskować. Ale modele są probabilistyczne, co oznacza, że czasem po prostu postanawiają nie zrobić tego, o co prosisz. Jeśli ci na czymś zależy, bądź dyrektywny — powiedz wprost, żeby użył danej umiejętności. Choć Hermes generalnie radzi sobie z tym dobrze.

Kreator sprawdza też, czy lepiej rozbudować istniejącą umiejętność, czy stworzyć nową — dzięki czemu Hermes przycina zbiory i nie dochodzi do rozrostu umiejętności. Mechanika jest naprawdę przemyślana: najpierw kolejność wewnątrz umiejętności, potem reguły ładowane na żądanie, potem pliki podlinkowane i wczytywane dopiero wtedy, gdy są potrzebne, a na końcu opis. Ten opis jedzie z tobą w każdej turze rozmowy, więc trzeba przyciąć każde słowo. Umiejętności nie powinny być rozwlekłe — chodzi o oszczędność tokenów.

6.Hermes działający 24 godziny na dobę (materiał sponsorowany)

Szósta pozycja to możliwość uruchomienia agenta w trybie ciągłym. Ja mam jednego chodzącego w domu na Macu, ale nie każdy ma taką możliwość — a gdy zamkniesz laptopa, tracisz najpotężniejszą cechę Hermesa, czyli to, że pracuje dla ciebie non stop. Rozwiązaniem jest wirtualny serwer prywatny (VPS). Możesz na nim postawić zarówno sam agentowy system operacyjny Hermesa, jak i samego agenta. Laptop zamknięty, jesteś pod ziemią — nieważne, agent działa.

Konfiguracja jest zaskakująco prosta. Jestem teraz w Czarnogórze — stąd to tło — i spotkałem tam zespół pewnej firmy hostingowej. Powiedziałem im, że powinni zasponsorować materiał, bo dostaję to pytanie bez przerwy. Podziękowania dla Hostingera za sponsorowanie tej części filmu.

(Informacja dodatkowa: poniższy opis to instruktaż sponsorowany, wraz z kodem afiliacyjnym autora — warto go czytać jako reklamę konkretnego dostawcy, nie jako rekomendację techniczną wolną od interesu.)

Plan KVM 2 w zupełności wystarcza dla agenta Hermes — sam zwykle z niego korzystam. Wybierasz plan, potem okres rozliczeniowy: miesięczny, roczny albo dwuletni. Im dłuższy okres, tym lepsza oferta. Przy planie rocznym i dwuletnim można użyć kodu „Jack Roberts”, który daje dodatkowe 10% zniżki na całe zamówienie.

Istotne jest to, że agent Hermes instaluje się automatycznie przy wdrożeniu. Kredyty Nexus nie są potrzebne, więc je odznaczam — będziemy korzystać z OpenAI. Następnie wybierasz lokalizację serwera, najlepiej tę z najlepszym opóźnieniem; ja wybieram Niemcy. Przy 24 miesiącach dostajesz dodatkową promocję. Klikasz „dalej”, logujesz się i system zaczyna konfigurować twój VPS.

W panelu wchodzisz w listę zadań do wykonania, klikasz „konfiguracja”, po prawej stronie znowu „konfiguracja”. Wybierasz Niemcy (albo swoją lokalizację), wpisujesz „Hermes” — pojawiają się trzy opcje: Hermes Agent, Hermes Web UI i Hermes Workspace. Wybieramy Hermes Agent, klikamy „wybierz”. Dostajesz nazwę użytkownika administratora i hasło — skopiuj hasło — a potem klikasz „wdróż”. Hostingowiec stawia VPS za ciebie.

Z tego panelu zarządzasz całością. Widać, że agent działa, i że można się do niego bezpiecznie łączyć z innych lokalizacji. Klikasz w terminal — to po prostu miejsce, w którym rozmawiasz z komputerem. Tak jak masz komputer, przy którym teraz siedzisz, tak terminal jest sposobem rozmowy z komputerem, na którym stoi Hermes. Nie daj się zastraszyć terminalowi. To jak rozmowa z chatbotem, tylko trzeba być precyzyjnym w poleceniach.

W opisie zamieszczam pełny przewodnik połączenia, który można przejść krok po kroku. Kopiujesz cztery ostatnie znaki identyfikatora, przechodzisz do przewodnika, kopiujesz pierwszą komendę, wklejasz ją do terminala i zamiast „xxx” wpisujesz swoje cztery znaki — u mnie to MVP1 — i zatwierdzasz. Potem wchodzimy do kontenera Hermesa: kopiujesz drugą komendę, wklejasz, zatwierdzasz. Na koniec sama konfiguracja Hermesa: kopiujesz trzecią komendę, wklejasz — i gotowe, masz pełny kreator konfiguracji.

Możesz zrobić szybką konfigurację, która wystarcza do pracy z agentem, albo pełną: schodzisz do wybranej pozycji, spacja zaznacza, i przechodzisz przez wszystkie ustawienia. Bardzo polecam podpiąć OpenAI, bo dzięki temu wykorzystasz swoją subskrypcję ChataGPT — wybierasz opcję OpenAI Codex i po prostu podłączasz subskrypcję zgodnie z instrukcją. Telegrama podłącza się banalnie łatwo i wtedy masz całego agenta w telefonie, dostępnego zawsze, w pełni hostowanego, z panelem sterowania po stronie serwera.

7.Doktor kontekstu

Wyobraź sobie lekarza wewnątrz Hermesa, który potrafi obejrzeć wszystko, co się w nim znajduje, i zadbać, żeby było tak wydajne, jak to tylko możliwe. Nieważne, czy pracujesz w panelu Hermesa, czy w Claude Code.

Ciekawostka: inżynierowie Anthropiku usunęli ponad 80% promptów systemowych Claude Code bez żadnej straty w jakości kodowania. Zobaczyłem, co zrobił Claude, i pomyślałem: zróbmy to samo w Hermesie.

Umiejętność przeprowadza sześć badań. Po pierwsze, pamięć zawsze aktywna: plik soul.md, profil, pamięć stała — wszystko, co ładuje się przy każdej turze. Po drugie, znaczniki opisów umiejętności — każdy opis jedzie z tobą w każdej turze, więc flagowane są te powyżej 300 znaków. Dalej: nieaktualne umiejętności, ślad zajmowany przez schematy narzędzi oraz kontrola ujawniania informacji.

Mając komplet danych, doktor robi jedną z pięciu rzeczy: wycina (a właściwie przenosi do kwarantanny, nigdy nie kasuje twardo), scala, przenosi, odracza albo przycina.

A jeśli to wszystko brzmi dla ciebie jak chiński, w opisie zostawiam link do pełnego kursu o agencie Hermes. Obejmuje wszystko — od podstaw i konfiguracji, przez wzmacnianie agenta, po budowanie stron internetowych i funkcje, których nigdy wcześniej nie pokazywałem publicznie. Do tego dostajesz pełny dostęp do agentowego systemu operacyjnego Hermesa z porządnym wprowadzeniem.

Sedno jest takie: możesz po prostu wejść do Hermesa i poprosić, żeby uruchomił tę umiejętność na wszystkim, co ma. Wróci z konsultacją i naprawdę ciekawymi ustaleniami. I uprzedzam — każda kolejna umiejętność na tej liście jest mocniejsza od poprzedniej.

8.Ostatnie 30 dni

Kiedy zadajesz pytanie Hermesowi czy Claude’owi, jakość odpowiedzi zależy od jakości materiału, do którego dotrą. Dlatego ósma umiejętność jest wyjątkowa.

„Ostatnie 30 dni” przechodzi przez X, YouTube i Reddita i znajduje to, co ludzie faktycznie powiedzieli. Patrzy na głosy poparcia i podaje ci realnie najlepszy przegląd ostatniego miesiąca. W grę wchodzą punkty na Reddicie, polubienia na X, transkrypcje z YouTube’a, Hacker News, kursy na rynkach predykcyjnych i commity na GitHubie. Przeszukuje wszystkie te platformy naraz.

Najlepiej pokazać to na przykładzie. Jednym z ograniczeń Telegrama jest to, że prowadzisz jedną rozmowę naraz — i właśnie dlatego bardzo lubię agentowy system operacyjny. Mogę w jednym oknie napisać: „Wyjaśnij mi umiejętność ostatnie 30 dni”, wysłać zapytanie w świat, a potem otworzyć zupełnie nowy czat i prowadzić inną rozmowę. Po lewej stronie mam dostęp do wszystkich poprzednich wątków, mogę przeskoczyć do Claude Code i robić to wszystko równolegle. Widzę też zużycie tokenów, to, na czym agent się synchronizuje, i dokładnie to, co robi. Jeśli nie masz takiego systemu, bardzo polecam go sobie zbudować.

I proszę — mamy raport „ostatnie 30 dni” w umiejętnościach agenta Hermes. Mówi, co się zmieniło przez trzydzieści dni: cytowania zakotwiczone w źródłach, umiejętności stały się oszczędniejsze kontekstowo, cykl życia umiejętności, odkrywanie umiejętności staje się bardziej behawioralne, co ludzie faktycznie oglądają. Wszystko jest jeszcze rankingowane według źródła: YouTube, Hacker News i tak dalej. Dosłownie jeden prompt i możesz odejść od komputera.

Dwa zastrzeżenia. U mnie zablokowane były Reddit i ogólne wyszukiwanie w sieci. Na Reddita są dwa sposoby: możesz podać poświadczenia — jeśli się zalogujesz i przekażesz ciasteczko sesji, umiejętność użyje go do pobrania danych; trzeba to skonfigurować w samej umiejętności. Jeśli chodzi o ogólną sieć, ja korzystam z Firecrawla, ale oczywiście możesz po prostu włączyć zwykłe wyszukiwanie, żeby poszerzyć zakres.

(Informacja dodatkowa: przekazywanie własnego ciasteczka sesji narzędziu automatycznemu oznacza oddanie mu dostępu do konta i zwykle łamie regulamin serwisu — warto rozważyć ryzyko przed konfiguracją.)

9./learn — zamiana czegokolwiek w umiejętność

Dziewiąta umiejętność uczy się dowolnej rzeczy, którą jej wskażesz. Przykład: wchodzę na YouTube, otwieram kanał Veritasium. Świetny film, ale załóżmy, że chcę tylko streszczenia. Mogę napisać: „Streść ten film w pięciu zwięzłych punktach i podaj mi pierwsze oraz ostatnie zdanie”. Wyciągnięcie informacji z YouTube’a jest więc bardzo proste.

Ale co, jeśli w materiale jest coś, o czym chcę później rozmawiać albo się tego nauczyć? Wtedy kopiuję adres, przechodzę do Hermesa, wpisuję /learn, wklejam link — i Hermes idzie się tego nauczyć. To umiejętność na tyle świetna, że wbudowano ją w samego Hermesa.

Działa też po wykonaniu jakiejś pracy. Powiedzmy, że właśnie zbudowaliście miniaturę albo obrazek — mówisz po prostu: „Naucz się tej umiejętności”, i wszystko, co agent przed chwilą zrobił, zamienia się w umiejętność. To niesamowite. Ja z zasady zapisuję część takich informacji do pamięci mojego agentowego systemu operacyjnego, który chodzi na moim komputerze — albo na twoim VPS-ie, jeśli tam go hostujesz — żeby móc do nich wracać z pytaniami, kiedy tylko chcę.

10.Dyrektor artystyczny

Dziesiąta pozycja to trudna, ale wspaniała zdolność budowania rzeczy, które naprawdę dobrze wyglądają. Ludzie potwornie komplikują sobie projektowanie, tymczasem właściwa umiejętność daje lepsze efekty przy mniejszym wysiłku.

Ja używam tu Power Design — narzędzia, które sam zbudowałem. Przyjrzałem się uniwersalnym zasadom projektowania. Na przykład na apple.com rzuca się w oczy złoty podział: nagłówki i podtytuły pozostają wobec siebie w proporcji 1,61 do 1. To tylko jedna z zasad, które przewijają się przez wszystkie najlepsze systemy projektowe. Power Design sprowadza dwadzieścia takich uniwersalnych zasad do postaci gotowej supermocy — proporcje, gęstość tekstu, gęstość obrazu — i pozwala tworzyć piękne, proste projekty.

Do tego dochodzi 21st.dev, przepiękne repozytorium interaktywnych elementów i komponentów, które można pobrać i wykorzystać. Chodzi o zachowanie pewnej swobody twórczej, ale z gotowymi animacjami przewijania, rozwijaniem sekcji i całą resztą: sekcjami klientów, trybami ciemnymi, sekcjami funkcji, stopkami, czym tylko chcesz. Ta umiejętność łączy oba źródła, zachowując lekkość i sprawiając, że projekty wyglądają znakomicie.

Żeby jej użyć, musisz autoryzować CLI 21st.dev — to tylko fachowa nazwa interfejsu wiersza poleceń, czyli sposobu, w jaki narzędzie się łączy. Poprosi cię o zalogowanie się mailem albo przez GitHuba i tyle.

I proszę, mamy stronę. Fajny klimat w tle, przewijamy w dół, ładne animacje, odrobina interaktywności. Pamiętaj, że da się w ten sposób budować w pełni rozwinięte strony — to tylko przykład dobrych zasad projektowych, na których można oprzeć resztę. Gdybyśmy jeszcze trochę nad tym popracowali, wyglądałoby to wspaniale, ale idea jest jasna.

11.Poranny brifing

Szczerze mówiąc, jedenasta umiejętność jest najbardziej wartościowa ze wszystkich, jakich używałem: poranny brifing. Mój agent codziennie sprawdza wszystkie spotkania w kalendarzu i wszystkie maile w skrzynce, po czym mówi: „Jack, dziś dzieje się to i to, a oto rzeczy, które musisz zrobić”.

Żeby to podłączyć, musisz dać Hermesowi dostęp do Gmaila czy Outlooka. Osobiście korzystam tu z usługi Zapier. Zabawna historia — na Zapierze zbudowałem swój pierwszy startup technologiczny, więc mam do niego trochę sentymentu. Ale jest przydatny z wielu powodów, głównie dlatego, że pozwala połączyć się z rzeczami, do których czasem nie da się podpiąć bezpośrednio. Dobrym przykładem jest API Skoola — bardzo poręczne, jeśli prowadzisz społeczność. Część rzeczy podepniesz wprost, ale tu chodzi o oszczędność czasu. Przy Outlooku możesz na przykład dokładnie określić, do czego dajesz dostęp, a do czego nie.

Sam mechanizm w Hermesie wygląda tak: dajesz dostęp do aplikacji, Hermes pisze brifing i dostarcza go na telefon — albo możesz z nim po prostu porozmawiać, gdziekolwiek jesteś. Mówisz mu: „Chcę dostawać poranny brifing codziennie rano. Sprawdź mój kalendarz, sprawdź maile i przejrzyj nasze rozmowy z ostatnich siedmiu dni albo ostatniego miesiąca. Na tej podstawie powiedz mi, na czym mam się dziś skupić. I jedną rzecz, którą mógłbym poprawić”.

Możesz nawet poprosić Hermesa, żeby uruchomił podagenta pracującego w tle, kiedy ty śpisz. Dzięki temu o siódmej rano dostajesz gotowy brifing. Może wstajemy o szóstej, może o piątej — nie wiem, kiedy wstajesz, ale kiedykolwiek to jest, brifing czeka. Naprawdę uważam, że to jedna z najbardziej pomocnych rzeczy, jakie można zrobić z agentem Hermes.

12.Studio — obrazy i wideo

Dwunasta umiejętność to zdolność tworzenia dowolnych obrazów i filmów. Nazywam to studiem. Może chodzić o edycję miniatur, generowanie wideo — cokolwiek.

Ja osobiście lubię Higgsfielda, bo interfejs jest przepiękny i po prostu lepiej mi się z nim pracuje. Ta strona, którą tu widzicie, powstała właśnie w ten sposób — całe generowanie wideo wyszło absolutnie rewelacyjnie. Zostawię link na ekranie, jeśli chcecie się dowiedzieć, jak dokładnie ją zbudować; napisałem do tego całą umiejętność i oddaję ją całkowicie za darmo.

Najlepsze jest to, że Hermesa można podłączyć do Higgsfielda przez CLI. Klikasz w sekcję Hermesa, kopiujesz polecenie, wklejasz je do agenta — otworzy się nowe okno, klikasz i jesteś połączony. Ja mam to już zrobione.

Potem mogę podać dowolny obrazek. Weźmy tę grafikę ogłaszającą dostępność na Windowsie i powiedzmy: „Użyj CLI Higgsfielda i Nano Banany, żeby zmienić tekst. Zamiast »teraz dostępne na Windows albo Mac« napisz »Jack kocha piękną kawę«. Nie zmieniaj niczego więcej”. Wysyłam. Twój agent potrafi teraz przez to CLI nanosić poprawki na dowolne obrazy i generować nowe. Wracamy — i proszę: „Jack kocha piękną kawę”. Nigdy nie padły prawdziwsze słowa. Uważam, że to niesamowite, jak łatwo można sięgnąć po te modele wewnątrz Hermesa. A jeśli wejdziesz z powrotem do Higgsfielda, w sekcji obrazów zobaczysz wszystko, co przed chwilą zrobiłeś.

13.Ministerstwo ekspertów

To prowadzi nas do trzynastej umiejętności — Ministry of Experts — która jest przeogromnie przydatna. Wyobraź to sobie tak: zamiast rozmawiać z jednym inteligentnym człowiekiem, który z natury rzeczy ogarnia tylko tyle, ile ogarnia, bierzemy najinteligentniejszy istniejący model i dostawiamy mu innych ekspertów, z którymi rozmawia. Jakość odpowiedzi rośnie, bo pojedynczy model może o czymś zapomnieć albo mieć własne skrzywienia. Kiedy dokładamy trzy różne modele, dynamika się zmienia.

Zbudowałem to u siebie w agencie, bo uważam, że takie spojrzenie jest ogromnie pomocne. W Ministerstwie Ekspertów — a można to robić bezpośrednio w Hermesie, ja po prostu lubię mieć to u siebie — wybieram model wiodący. Powiedzmy, że biorę Claude Fable. Klikam, widzę, że jest numerem jeden w rankingu, mogę sprawdzić jego statystyki, kopiuję i wklejam.

Mechanizm jest taki: zadajesz pytanie, na przykład „co powinienem zrobić w swoim biznesie, żeby podwoić zysk netto?”. Claude Fable 5 najpierw cię przemagluje — korzystając z umiejętności, o której mówiliśmy wcześniej. Potem zada to samo pytanie modelowi DeepSeek V4, następnie GLM 5.2 i GPT 5.5. Możemy też skonfigurować, ilu tokenów mają użyć: od czegoś w rodzaju „złotego środka” — z odwołaniami do źródeł i ostrą puentą — po pełny tryb, jeśli chcesz odpowiedzi na miarę „Odysei”. Na końcu Fable 5 patrzy na te trzy odpowiedzi i formułuje na ich podstawie własną. To naprawdę świetne.

Żeby to uruchomić, wystarczy wpisać ukośnik i MOA — to przepuszcza pytanie przez skonfigurowaną mieszankę agentów. Piszesz: „Chcę wiedzieć, jak podwoić zysk netto, powiedz mi jak”. Fajne jest też to, że rozwiązanie oszczędza tokeny, bo sprytnie przenosi zawartość pamięci podręcznej. Autorzy naprawdę włożyli w to dużo pracy, żeby korzystanie z trzech modeli naraz nie oznaczało przepalania kredytów.

Patrzę na odpowiedź: wraca z listą dźwigni uszeregowanych według siły oddziaływania, z zaznaczeniem, których modeli użyto i dlaczego.

(Informacja dodatkowa: „mieszanka agentów” — mixture of agents — to technika, w której kilka modeli odpowiada niezależnie na to samo pytanie, a model wiodący scala ich odpowiedzi w jedną.)

Zakończenie

Znamy już trzynaście umiejętności agenta Hermes. Kolejna rzecz do nauczenia to jedna z najbardziej dochodowych zdolności, jakie można mieć: budowanie pięknych stron internetowych. Czy to dla własnego biznesu, czy dla kogoś innego — zrobimy to razem w kolejnym filmie.

10 najważniejszych takeaways — z kontekstem zastosowania

1.Traktuj cudze umiejętności jak niezaufany kod

Na czym polega: „Bramkarz” skanuje każdą nową umiejętność pod kątem wstrzykiwania promptów, robi rozeznanie w alternatywach i decyduje: przepuścić, zapytać albo odrzucić do kwarantanny.

Jak stosować: Ustaw regułę, że żadna umiejętność z internetu nie trafia do agenta bez przejścia przez warstwę kontroli. Przy pierwszym uruchomieniu przeczytaj też sam raport, a nie tylko werdykt.

Na co uważać: Skaner sprawdzający cudzy kod sam jest tylko kolejnym promptem — nie daje gwarancji. Przy umiejętnościach mających dostęp do poczty, plików czy poświadczeń nic nie zastąpi przeczytania źródła własnymi oczami.

2.Wymuszaj dopytywanie, zamiast liczyć na domysły

Na czym polega: Umiejętność grill me każe agentowi zadawać pytania doprecyzowujące, zanim zacznie pracę. Autor porównuje agenta do bardzo inteligentnego stażysty — genialnego tylko wtedy, gdy wie, co robić.

Jak stosować: Uruchamiaj ją przy zadaniach o niejasnych kryteriach sukcesu: decyzjach biznesowych, strategiach, projektach bez ustalonego zakresu. Jeden prompt startowy plus seria odpowiedzi daje więcej niż długi, dopracowany prompt.

Na co uważać: Przy zadaniach rutynowych i dobrze określonych to strata czasu i tokenów. Nie włączaj jej domyślnie na wszystko.

3.Kończ sesję dokumentem przekazania

Na czym polega: Jednym poleceniem agent generuje dokument obejmujący stan prac, podjęte decyzje, kolejne kroki, sugerowane umiejętności i sekrety — do przeniesienia do innego agenta lub narzędzia.

Jak stosować: Wpleć to w rytm pracy: koniec dnia albo koniec większego etapu to moment na przekazanie. Szczególnie sensowne, gdy krążysz między różnymi środowiskami.

Na co uważać: Sekcja „sekrety” to potencjalna mina — sprawdź, czy w dokumencie nie lądują klucze API czy hasła w formie jawnej, zanim wkleisz go gdziekolwiek dalej.

4.Wszystko, co ładuje się w każdej turze, to koszt stały

Na czym polega: „Doktor kontekstu” audytuje pamięć zawsze aktywną, opisy umiejętności (flagując te powyżej 300 znaków), nieaktualne umiejętności i ślad schematów narzędzi. Inspiracją było usunięcie przez Anthropic ponad 80% promptów systemowych Claude Code bez utraty jakości.

Jak stosować: Uruchamiaj audyt okresowo, zwłaszcza gdy zauważysz, że agent zaczyna gubić wątek albo koszty rosną bez powodu. Pięć dostępnych operacji — wytnij, scal, przenieś, odłóż, przytnij — daje bardziej chirurgiczne narzędzie niż samo kasowanie.

Na co uważać: Kwarantanna zamiast twardego usuwania jest tu celowa. Nie pozwalaj agentowi kasować rzeczy nieodwracalnie, dopóki sam nie przejrzysz, co proponuje wyciąć.

5.Opis umiejętności to najdroższy tekst, jaki napiszesz

Na czym polega: Kreator umiejętności narzuca kolejność ładowania: reguły na żądanie, podlinkowane pliki wczytywane dopiero gdy są potrzebne, a opis przycięty co do słowa — bo to on jedzie z agentem w każdej turze.

Jak stosować: Przy pisaniu własnych umiejętności trzymaj opis krótki i jednoznaczny, a szczegóły przenoś do plików ładowanych leniwie. Pozwól kreatorowi decydować, czy rozbudować istniejącą umiejętność, zamiast tworzyć nową.

Na co uważać: Zbyt agresywne przycinanie opisu psuje coś innego — agent przestaje rozpoznawać, kiedy sięgnąć po daną umiejętność. Krótko, ale precyzyjnie.

6.Bądź dyrektywny, bo modele są probabilistyczne

Na czym polega: Autor zaznacza, że teoretycznie nie trzeba wskazywać umiejętności z nazwy — agent powinien sam wywnioskować — ale modele bywają nieprzewidywalne i czasem po prostu tego nie robią.

Jak stosować: Gdy zależy ci na konkretnym wyniku, nazwij umiejętność wprost w prompcie. Automatyczny wybór zostaw zadaniom, w których pomyłka nic nie kosztuje.

Na co uważać: To nie jest wada konfiguracji, którą da się „naprawić”. Traktuj wskazywanie z nazwy jako normalną praktykę, nie jako obejście.

7.Wyszukiwanie ważone popularnością daje inny obraz niż zwykłe wyszukiwanie

Na czym polega: Umiejętność „ostatnie 30 dni” przeczesuje X, YouTube, Reddita, Hacker News, rynki predykcyjne i commity na GitHubie, uwzględniając głosy poparcia, i szereguje wyniki według źródła.

Jak stosować: Dobra do orientacji w szybko zmieniającej się dziedzinie — jeden prompt zastępuje godzinę przeglądania. Wynik z rankingiem źródeł pozwala szybko ocenić, na czym opiera się każde twierdzenie.

Na co uważać: Autor sam raportuje zablokowanego Reddita i ogólne wyszukiwanie — obejście przez własne ciasteczko sesji oznacza oddanie narzędziu dostępu do konta i zwykle łamie regulamin serwisu. Poza tym „ważone popularnością” to nie to samo co „prawdziwe”: dostajesz obraz konsensusu, nie faktów.

8.Zamieniaj wykonaną pracę w trwałą umiejętność

Na czym polega: /learn przyswaja materiał spod wskazanego adresu, ale działa też po wykonaniu zadania — polecenie „naucz się tej umiejętności” zamienia właśnie przeprowadzoną procedurę w wielokrotnego użytku umiejętność.

Jak stosować: Po każdym udanym, powtarzalnym zadaniu (miniatura, format grafiki, procedura raportowa) od razu je utrwal. To najtańszy sposób budowania własnej biblioteki.

Na co uważać: Bez dyscypliny prowadzi wprost do rozrostu umiejętności, przed którym ostrzega punkt czwarty. Utrwalaj to, co naprawdę powtarzalne, i regularnie przycinaj resztę.

9.Poranny brifing to najwyższa dźwignia — i największa ekspozycja danych

Na czym polega: Agent codziennie przegląda kalendarz, skrzynkę i ostatnie rozmowy, po czym dostarcza brief z priorytetami na dzień. Autor uznaje to za najbardziej wartościową rzecz na całej liście.

Jak stosować: Skonfiguruj podagenta pracującego w nocy, żeby brief czekał gotowy o poranku. Dodaj do promptu pytanie „jedna rzecz, którą mógłbym poprawić” — to zamienia raport w narzędzie decyzyjne.

Na co uważać: Wymaga dostępu do poczty i kalendarza, często przez pośrednika w rodzaju Zapiera. Ograniczaj uprawnienia do minimum (Outlook pozwala określić zakres szczegółowo) i zastanów się, czy służbowa skrzynka w ogóle może przechodzić przez taki łańcuch.

10.Kilka modeli naraz zbija skrzywienia jednego

Na czym polega: Ministry of Experts kieruje pytanie do modelu wiodącego, ten zadaje je równolegle trzem innym modelom, a następnie syntetyzuje odpowiedzi. Uruchamia się poleceniem /MOA, a poziom szczegółowości jest konfigurowalny.

Jak stosować: Rezerwuj to dla pytań otwartych i o wysokiej stawce — decyzji strategicznych, w których pominięcie jednego wariantu realnie kosztuje. Odpowiedź wskazuje, który model wniósł co, więc da się prześledzić uzasadnienie.

Na co uważać: To wielokrotność kosztu jednego zapytania — deklarowana optymalizacja pamięci podręcznej łagodzi to, ale nie znosi. Zgoda kilku modeli też nie jest dowodem: trenowane na podobnych danych bywają zgodnie w błędzie.