O czym jest ten film
- Autor przedstawia pięć usprawnień agenta Hermes, które mają zwiększyć produktywność i tempo pracy.
- Poziom 1 — nowe modele: Grok 4.5, ChatGPT 5.6 oraz Kimi K3, każdy z innym zastosowaniem i profilem kosztowym.
- Kimi K3 pokazany jest jako tani „koń pociągowy” do zadań projektowych (design), porównywany z Fable 5 i Opus 4.8.
- Poziom 2 — równoległe wywołania narzędzi (parallel tool calls), które skracają czas realizacji wielu zadań naraz.
- Poziom 3 — szybsze wyszukiwanie w sieci z użyciem Firecrawl, które ekstrahuje tylko istotny tekst i tożsamość marki.
- Poziom 4 — „intelligence brief”: poranny brief oparty na podłączonej poczcie i kalendarzu przez Zapier MCP.
- Poziom 5 — „completion contracts”: zlecanie zadań z weryfikacją, ograniczeniami i dowodem wykonania.
- Bonus — integracja z pamięcią Obsidian przez wtyczkę w narzędziu głosowym Glider.
- Autor pokazuje, jak zbierać wiedzę z przeglądarki (strony, filmy YouTube) prosto do bazy wiedzy agenta.
- Materiał jest w dużej mierze promocją własnego kursu (Hermes masterclass) i startupu Glider.
(Informacja dodatkowa: „Hermes”, „Aentic OS” oraz nazwy modeli jak „ChatGPT 5.6”, „Grok 4.5”, „Kimi K3”, „Fable 5”, „Opus 4.8” są tu prezentowane jako produkty w ekosystemie autora; część nazw pojawia się w transkrypcji w formach przekręconych przez automatyczne rozpoznawanie mowy.)
Redakcyjne tłumaczenie
Wstęp
Hermes to według mnie najlepszy agent AI na świecie — a właśnie stał się jeszcze lepszy. W tym filmie pokażę pięć nowych, potężnych usprawnień, które oszczędzą ci czas, uczynią cię niewiarygodnie produktywnym i nie pozwolą ci zostać w tyle. Najlepsze jest to, że dodaje się je banalnie prosto. Bierz kawę i zaczynajmy.
Pokażę to na pięciu poziomach — pięciu poziomach aktualizacji, które musisz naprawdę zrozumieć. Jeśli dotrwasz do końca, będziesz mieć znacznie potężniejszego agenta Hermes.
Poziom 1 — nowe „mózgi” (modele)
Człowiek nie może wymienić sobie mózgu, ale Hermes może. Trzy modele, które musisz mieć teraz na radarze, to: Grok 4.5, ChatGPT 5.6 oraz Kimi K3. Pokażę, jak dodać wszystkie trzy naraz.
Kimi K3 to w praktyce nowy agent projektowy. Sądzimy, że został zdystylowany z Opusa. Na benchmarkach wypada podobnie do droższych modeli, a jest niesamowitą maszyną do projektowania w znacznie niższej cenie.
Otwieram Aentic OS i wybieram model. GPT 5.6 obsłużymy z poziomu subskrypcji ChatGPT — to model, którego teraz używam domyślnie w Hermesie. Jest bardzo mocny i wiele nim zrobisz w ramach subskrypcji. Jeśli masz plan Max, możesz ustawić poziom rozumowania na „medium” lub „high”; jeśli plan za 20 dolarów — ustaw nieco niżej. To kluczowa integracja.
Drugim modelem jest Grok 4.5, podpinany przez subskrypcję X — konfiguruje się go dokładnie tak samo. Zapytałem go: „którego modelu obecnie używam?”, i szybko potwierdził. Grok jest bardzo szybki i tani. Co ważne, potrafi sięgać bezpośrednio do platformy X i wyciągać stamtąd wszystko, czego potrzebujesz. Poprosiłem: „znajdź trzy interesujące aktualizacje dotyczące agenta Hermes z ostatnich pięciu dni, o wysokiej dynamice wyświetleń”. W odpowiedzi dostałem między innymi informację, że Hermes wyceniany jest teraz na 1,5 miliarda dolarów.
(Informacja dodatkowa: autor przedstawia się jako Jack; twierdzi, że zbudował to na bazie swojego poprzedniego startupu technologicznego. Podawanej wyceny 1,5 mld USD nie da się zweryfikować na podstawie samego materiału.)
Trzeci model — Kimi K3 — obsługujemy przez OpenRouter. Warto mieć bezpośrednie subskrypcje dla ChatGPT i Groka, a każdy inny model podpinać przez OpenRouter (można też korzystać z samego Hermesa i tym wspierać zespół, ale OpenRouter to świetna droga do dowolnego modelu). Kimi K3 pozwala rzucić wyzwanie możliwościom projektowym Fable 5 przy dużo niższej cenie — jedyny minus to nieco dłuższy czas pracy.
Przetestowałem go prostym promptem: „stwórz jednostronicową, piękną prezentację dla glido.com — wejdź na stronę, pobierz font i identyfikację marki”. Żadnego dodatkowego kontekstu. Miarą jakości modelu jest to, jak krótki i jak niejasny prompt można mu dać, a on i tak zrozumie, o co chodzi — trochę jak z zatrudnieniem dobrego szefa marketingu, któremu wystarczy powiedzieć „rozwijaj nasz biznes online”. Efekt był imponujący: model idealnie pobrał logotypy, teksty i całą oprawę, a przycisk „Try Glider Free” działał. To trwa trochę dłużej, ale Kimi jest tańszy od Opusa 4.8 i kosztuje około 30% ceny Fable 5 przy — zdaniem wielu — porównywalnej jakości. Uważam to za pozycję obowiązkową w arsenale.
(Informacja dodatkowa: „Aentic OS” / „Aentic terminal” to nazwa firmowego środowiska agentowego autora — w transkrypcji zapisywana niejednolicie.)
Poziom 2 — szybkość (równoległe wywołania narzędzi)
Używanie mocnych modeli to jedno, ale jeśli działają wolno, i tak będziemy czekać. Tu wkracza aktualizacja szybkości. Chodzi o równoległe wywołania narzędzi. Wcześniej Hermes wywoływał usługi jedna po drugiej — najpierw Gmail, potem kolejną, potem następną. Teraz robi to wszystko jednocześnie.
Zanim przetestujemy: jeśli nie masz najnowszej wersji, wejdź do terminala i powiedz Hermesowi „chcę zaktualizować do najnowszej wersji” — sam przeprowadzi pełną aktualizację.
Test przeprowadziłem na Telegramie (kolejnym miejscu, gdzie można rozmawiać z Hermesem). Poprosiłem o cztery rzeczy jednocześnie: trzy najnowsze aktualizacje w Hermesie, sprawdzenie nieprzeczytanych maili, moje najbliższe wydarzenie w Google Calendar oraz temperaturę w Dubaju. Dzięki nowemu systemowi te wywołania dzieją się równolegle, więc wszystko wykonuje się dużo szybciej. Po kilku minutach dostałem aktualizacje i temperaturę w Dubaju (przy okazji musiałem odświeżyć połączenie w Zapierze). To działa cicho i szybko w tle.
Poziom 3 — szybsze wyszukiwanie w sieci
Wyszukiwanie w sieci stało się — według Hermesa — 60 razy szybsze. Wcześniej Hermes scrapował stronę i płacił kolejnemu modelowi AI za jej streszczenie, co trwało długo. Teraz możemy iść krok dalej, używając narzędzia takiego jak Firecrawl, by uzyskać więcej danych i wniosków szybciej, oszczędzając czas i pieniądze. Autor podaje: odczyt 60 razy szybszy, 49 razy taniej, kilkanaście sekund zamiast prawie trzech minut.
Dałem Hermesowi prompt: „zbadaj Kimi K3 w porównaniu z Fable 5, spójrz na ceny, korzystaj z wielu źródeł, użyj Kimi K3 do zaprojektowania pięknej, jednostronicowej interaktywnej prezentacji HTML, dołóż też Opus 4.8, użyj logotypów, wykorzystaj Firecrawl”. Firecrawl jest o tyle dobry, że scrapując stronę, nie oddaje całego „śmietnika” HTML — tagów, reklam, zbędnego kontekstu — tylko wyciąga kluczowy tekst i przekazuje go agentowi. Potrafi też wyodrębnić identyfikację marki: logo, obrazek OG, kolory, typografię, użyte fonty. W jednym z przykładów pokazano oszczędność 93% tokenów. To w praktyce „przeglądarka internetowa dla agentów”.
(Informacja dodatkowa: Firecrawl to zewnętrzne narzędzie do scrapowania i strukturyzowania treści stron pod kątem modeli AI.)
W prezentacji wygenerowanej przez agenta pokazane jest porównanie kosztów przy 10 milionach tokenów: Kimi K3 — 54 USD, Fable 5 — 180 USD, Opus 4.8 — 90 USD. Wniosek: nie ma jednego uniwersalnego zwycięzcy, jest dopasowanie do zadania — Kimi to najlepszy stosunek jakości do ceny i rozsądny wybór domyślny, zwłaszcza do projektowania. Wszystkie artefakty tworzone z Hermesem (prezentacje, faktury, PDF-y) są schludnie zapisywane w Aentic OS i dostępne na kliknięcie.
Poziom 4 — brief wywiadowczy (intelligence brief)
Znamy ideę porannego briefu — budzimy się i dostajemy wiadomość od Hermesa. Jeśli jednak nie podłączyłeś poczty i kalendarza, tracisz najważniejszą część.
Konfiguracja: wejdź na mcp.zapier, dodaj potrzebne aplikacje. Ja dodałem Gmail i nadałem odpowiednie uprawnienia. Kluczowa zasada bezpieczeństwa: nie dawaj agentowi możliwości wysyłania maili — tylko odczyt i tworzenie wersji roboczych. Uprawnienia, które nadaję: szybki draft, etykiety, wyszukiwanie maili oraz Google Calendar. Następnie w zakładce połączeń klikasz „regenerate token”, dostajesz linijkę kodu i podpinasz ją do Hermesa.
(Informacja dodatkowa: „Zapy”/„Zapia” w transkrypcji to Zapier — usługa MCP do łączenia agenta z aplikacjami.)
Potem dajesz prompt: „chcę codziennie rano brief — sprawdź maile i kalendarz, powiedz, co mam na dziś i na czym się skupić. Co tydzień przeanalizuj to, co mi mówiłeś, przeprowadź ze mną krótki wywiad, jak dobry był brief i jak go poprawić, i ulepszaj każdy kolejny na tej podstawie”. Efekt to codzienna „inteligencja zarządcza”: pogoda, ważne rzeczy w skrzynce, plan i priorytety dnia. Kilka razy uratowało mi to skórę — dowiedziałem się o mailu, o którym nie miałem pojęcia. Sekret, który większość pomija, to rozszerzenie kontekstu: brief bierze pod uwagę nie tylko to, co mówisz dziś, ale i wszystko z całego tygodnia, miesiąca i wszystkich rozmów.
Poziom 5 — „completion contracts” (dowód wykonania)
Poziom piąty to poprawa jakości działania agenta poprzez wymóg dowodu. Zlecasz cel, a agent musi pokazać dowód, że faktycznie go osiągnął. To tak zwane „completion contracts” (kontrakty ukończenia).
Działa to tak: wpisujesz /g (goal — cel) i podajesz prompt. Na przykład: „posortuj mój folder Downloads i podfoldery według typu; zweryfikuj, że katalogi zostały uporządkowane; granica działania: tylko folder Downloads”. Możesz dodać verify (jak weryfikujemy, że zadanie skończone), constraints (czego wyraźnie NIE wolno robić) oraz boundaries (zakres działania), oddzielając je średnikiem, tak by „sędzia” wiedział, że zadanie zostało wykonane. Na moich oczach folder Downloads uporządkował się jak nigdy — i dostałem dowód wykonania. Kluczowe jest to, że do każdego celu dodajesz podkategorie (weryfikacja, ograniczenia, granice), które pilnują, by agent naprawdę go osiągnął.
Bonus — pamięć, która się kumuluje (Obsidian + Glider)
W tle widać przez cały czas mój „mózg” w Obsidianie — to zbiór wszystkich informacji o mnie, które żyją na moim komputerze i do których Hermes ma dostęp.
Zbudowałem do tego wtyczkę. Gdy zaznaczę tekst na dowolnej stronie, mogę powiedzieć głosowo „dodaj to do mojej pamięci Obsidian”. Używam do tego Glidera — naszego narzędzia do dyktowania mową — które ma warstwę pozwalającą budować własne narzędzia. Mogę pobierać adresy URL i dorzucać treści prosto do skarbca Obsidian. Mogę też poprosić: „streść — daj TL;DR tej strony w trzech punktach”.
(Informacja dodatkowa: Glider to startup speech-to-text autora; funkcja opisywana jest jako eksperymentalna — w wersji beta.)
Podobnie z YouTube: wchodzę na film, klikam przycisk „dodaj to do mojej bazy wiedzy Obsidian”, zezwalam na stałe — i treść trafia do agenta. Potem mogę zapytać Hermesa: „sprawdź moją pamięć Obsidian, chcę wskazówki o rozwoju na X, a przy okazji podaj źródło i tytuł”. Agent odpowiada na podstawie zapisanej wiedzy i wskazuje źródło (w przykładzie film „I reply to 100 tweets a day for 7 days”). Nie musiałem nawet wracać do interfejsu Hermesa.
Jeśli nie używasz Glidera, możesz po prostu skopiować URL dowolnego filmu, wejść do Hermesa i wpisać /learn, a potem wkleić link z poleceniem „naucz się i przyswój te informacje”.
Aby to uruchomić: pobierz Glidera za darmo, w ustawieniach (sekcja „general”, na dole) włącz tryb beta. Można też budować „skille”. W dokumentacji kopiujesz link, wchodzisz do Hermesa lub trybu code i mówisz np.: „naucz się tych dokumentów i napisz mi skill, który pozwoli sprawdzać pogodę, i zapisz go na pulpicie w folderze glido skills”. Agent generuje skill, importujesz go, a potem możesz przywołać Glidera i zapytać: „jaka jest teraz temperatura w Budapeszcie?”. Odpowiedź (w przykładzie 29°C) pojawia się dzięki zbudowanemu skillowi pogodowemu.
(Informacja dodatkowa: w transkrypcji temperatura Budapesztu pada raz jako 20°C, raz jako 29°C — to artefakt automatycznego zapisu.)
Wizja jest taka, by wszystko, co robimy w przeglądarce — artykuły, filmy — przenosić prosto do wiedzy agenta Hermes, w pełni zintegrowanej z Aentic OS. Funkcja jest w becie, ale ma ogromny potencjał.
Zakończenie
Te nowe funkcje są świetne, ale bez znajomości fundamentów Hermesa — od poziomu początkującego po eksperta — nie wykorzystasz pełni tej technologii. Dlatego w dalszej części autor odsyła do swojego kursu (Hermes masterclass) i zapowiada film pomagający określić, na jakim poziomie jesteś i jak przejść na następny.
(Informacja dodatkowa: film ma wyraźnie promocyjny charakter — powtarzają się odesłania do płatnego kursu autora oraz do jego startupu Glider.)
10 najważniejszych takeaways — z kontekstem zastosowania
1.Dobierz model do zadania, nie odwrotnie
Na czym polega: Autor rekomenduje trzymanie kilku modeli równolegle — GPT 5.6 jako domyślny, Grok 4.5 do szybkich zapytań i danych z X, Kimi K3 do projektowania w niskiej cenie.
Jak stosować: Skonfiguruj minimum dwa–trzy modele w środowisku agentowym i świadomie przełączaj: tanie/szybkie do researchu i drobnych pytań, mocniejsze do złożonego rozumowania i produkcji finalnej.
Na co uważać: Tańsze modele bywają wolniejsze (Kimi K3) i mogą różnić się jakością zależnie od zadania. Podawane ceny i benchmarki pochodzą od autora — zweryfikuj aktualne cenniki samodzielnie, bo modele zmieniają się szybko.
2.Oceniaj model po „tolerancji na niejasny prompt”
Na czym polega: Miarą jakości jest to, jak krótkie i ogólne polecenie model potrafi poprawnie zinterpretować.
Jak stosować: Testuj nowy model celowo lakonicznym poleceniem i sprawdzaj, ile dopowiada sam. To szybki sposób na porównanie modeli między sobą.
Na co uważać: „Zgadywanie” intencji bywa też ryzykiem — przy zadaniach o wysokiej stawce niejasny prompt może prowadzić do błędnych założeń. Do zadań krytycznych precyzuj wymagania mimo wszystko.
3.Włącz równoległe wywołania narzędzi
Na czym polega: Agent wykonuje wiele wywołań (poczta, kalendarz, pogoda, wyszukiwanie) jednocześnie, a nie po kolei.
Jak stosować: Formułuj polecenia zbiorczo („zrób jednocześnie te cztery rzeczy”), by wymusić równoległość i skrócić czas oczekiwania. Najpierw zaktualizuj agenta do najnowszej wersji.
Na co uważać: Równoległe wywołania mogą napotkać wygasłe połączenia (w materiale trzeba było odświeżyć integrację w Zapierze). Miej pod ręką sposób na szybkie ponowne uwierzytelnienie usług.
4.Skróć i potań wyszukiwanie w sieci przez Firecrawl
Na czym polega: Firecrawl wyciąga ze stron sam kluczowy tekst (bez reklam i śmieciowego HTML) oraz identyfikację marki, co oszczędza tokeny i czas.
Jak stosować: Podłącz Firecrawl do researchu i generowania materiałów wizualnych — szczególnie gdy potrzebujesz logo, kolorów i fontów marki do prezentacji.
Na co uważać: Liczby „60× szybciej / 49× taniej / 93% tokenów mniej” pochodzą z materiału promocyjnego — traktuj je jako orientacyjne. Scrapowanie cudzych stron i marek wymaga też uwagi na kwestie praw i regulaminów.
5.Poranny brief zbudujesz tylko po podłączeniu poczty i kalendarza
Na czym polega: Po integracji Gmaila i Google Calendar (przez Zapier MCP) agent dostarcza codzienny brief z priorytetami, pogodą i ważnymi mailami.
Jak stosować: Podłącz konta, wygeneruj token i poproś o brief z cotygodniową pętlą samodoskonalenia (agent pyta, co poprawić, i uczy się z kontekstu tygodnia/miesiąca).
Na co uważać: Dawanie agentowi dostępu do skrzynki i kalendarza to realne ryzyko prywatności — trzymaj się zasady najmniejszych uprawnień (patrz punkt 6).
6.Nigdy nie dawaj agentowi prawa wysyłania maili
Na czym polega: Autor wprost zaleca nadawać tylko uprawnienia do odczytu, tworzenia wersji roboczych i etykiet — nie do wysyłki.
Jak stosować: Przy konfiguracji integracji odznacz uprawnienia „send”; ogranicz się do: draft, labels, wyszukiwanie maili, odczyt kalendarza. Wysyłkę zostaw jako świadome, ręczne działanie.
Na co uważać: To jedyna wyraźna wskazówka bezpieczeństwa w materiale — potraktuj ją jako minimum, nie maksimum. Regularnie przeglądaj, jakie zgody nadałeś każdej aplikacji.
7.Zlecaj cele z dowodem wykonania („completion contracts”)
Na czym polega: Do celu dołączasz weryfikację, ograniczenia (czego nie robić) i granice zakresu, a agent zwraca dowód ukończenia.
Jak stosować: Przy zadaniach dotykających plików/systemu zawsze definiuj boundaries (np. „tylko folder Downloads”) i sposób weryfikacji, zanim uruchomisz zadanie.
Na co uważać: Zadania operujące na plikach są ryzykowne — bez precyzyjnych granic agent może ruszyć nie te katalogi. „Dowód wykonania” to raport agenta, więc dla operacji nieodwracalnych i tak sprawdź efekt samodzielnie.
8.Zbuduj kumulującą się pamięć (np. w Obsidianie)
Na czym polega: Trwała baza wiedzy o tobie i twoich materiałach, do której agent ma dostęp, znacząco poprawia trafność odpowiedzi.
Jak stosować: Zapisuj wartościowe treści z przeglądarki i filmów do jednej bazy (skarbca), a potem odpytuj agenta z prośbą o wskazanie źródła i tytułu, by móc zweryfikować pochodzenie.
Na co uważać: Jakość odpowiedzi zależy od jakości tego, co wrzucasz — „śmieci na wejściu, śmieci na wyjściu”. Dbaj o porządek i wiarygodność źródeł w bazie.
9.Wciągaj wiedzę z przeglądarki bez opuszczania kontekstu
Na czym polega: Zaznaczony tekst, URL lub film YouTube można dorzucić do bazy agenta jednym poleceniem (głosowo przez Glidera lub komendą /learn z wklejonym linkiem).
Jak stosować: Jeśli nie chcesz instalować Glidera, użyj wbudowanej ścieżki: skopiuj URL i w Hermesie wpisz /learn z poleceniem przyswojenia treści.
Na co uważać: Opisywana wtyczka Glider jest w becie i pochodzi od autora — funkcje mogą się zmieniać lub zawodzić. Nie buduj krytycznych procesów wyłącznie na eksperymentalnym narzędziu.
10.Traktuj materiał jako poradnik, ale i jako reklamę
Na czym polega: Film łączy realne wskazówki z intensywną promocją płatnego kursu autora i jego startupu Glider.
Jak stosować: Wybierz z materiału konkretne, przenośne praktyki (równoległe wywołania, zasada najmniejszych uprawnień, completion contracts, trwała pamięć) i zastosuj je niezależnie od konkretnego produktu.
Na co uważać: Deklarowane liczby (wycena 1,5 mld USD, mnożniki szybkości i kosztów) nie są w materiale niezależnie potwierdzone — traktuj je jako marketing i weryfikuj przed podjęciem decyzji.