154 lines
11 KiB
Markdown
154 lines
11 KiB
Markdown
---
|
||
title: "15 poziomów agenta Hermes: od chatbota do 24/7 systemu autonomicznego"
|
||
source: "https://nitingavhane.medium.com/15-levels-of-hermes-agent-from-chatbot-to-24-7-autonomous-system-da15c3c204f6"
|
||
author:
|
||
- "[[Nitin Gavhane]]"
|
||
published: 2026-06-25
|
||
created: 2026-07-31
|
||
description: "Historia tylko dla członków"
|
||
tags:
|
||
- "clippings"
|
||
---
|
||
Cześć wszystkim, nazywam się Nitin Gavhane i na tym blogu chcę pokazać Wam coś, czego większość właścicieli firm całkowicie pomija, zakładając Hermes Agent.
|
||
|
||
Używają go jako chatbota. Wpisz pytanie, otrzymaj odpowiedź, zamknij zakładkę. To poziom 1. Jest ich jeszcze 14 — a różnica między tym, gdzie większość ludzi się kończy, a tym, gdzie to może faktycznie zmierzać, jest naprawdę zaskakująca.
|
||
|
||
Zmapowałem wszystkie 15 poziomów, podzielonych na trzy fazy. Każdy z nich rozwija poprzedni, ale możesz zacząć na poziomie, który pasuje do twojego zestawu.
|
||
|
||

|
||
|
||
## Faza 1: Fundacja (Poziomy 1–3)
|
||
|
||
Masz zainstalowanego Hermesa. Odpowiada na twoje pytania.
|
||
|
||
## Poziom 1 — Prompty jednorazowe
|
||
|
||
Wpisujesz prompt, agent odpowiada. Podstawowe rzeczy.
|
||
|
||
Ale większość ludzi przeoczy: Hermes nie jest wyszukiwarką. Chatbot *rozmawia* o różnych rzeczach. Hermes *robi* różne rzeczy — czyta pliki, pisze kod, uruchamia polecenia terminala, przeszukuje internet, zapisuje wyniki na twoim komputerze.
|
||
|
||
Różnica polega na tym, jak je wywołasz. "Jakie są najlepsze CRM-y dla solo założycieli?" – to zapytanie wyszukiwarki. "Zbadaj top 5 CRM-ów dla solo założycieli, porównaj ceny i funkcje, zapisz raport do folderu raportów" to zadanie agenta. To samo pytanie, zupełnie inny wynik. Teczka czeka na ciebie trzy minuty później.
|
||
|
||
Błąd: wpisywanie promptów tak, jakbyś używał Google.
|
||
|
||
## Poziom 2 — Pamięć i SOUL.md
|
||
|
||
To właśnie tutaj przestaje być generyczne.
|
||
|
||
SOUL.md to plik, który piszesz — około 50 do 80 linijek — który mówi agentowi, kim jesteś. Twój model biznesowy, segmenty klientów, marże, preferencje – czego nigdy nie powinien robić. Ładuje się na początku każdej sesji.
|
||
|
||
Bez niej, jeśli zapytasz "czy powinienem podnieść ceny?", otrzymasz wpis na blogu o strategii cenowej. Dzięki temu — zakładając, że wpisałeś faktyczne liczby i podział klientów — otrzymujesz coś w stylu: "Twój poziom wejściowy konwertuje 12%. Podniesienie go o 10 dolarów ryzykuje zmianę w segmencie B, co stanowi 60% Twoich przychodów. Najpierw testowałbym na segmencie A."
|
||
|
||
To samo pytanie. To zupełnie inna odpowiedź.
|
||
|
||
MEMORY.md i USER.md przechowują fakty na różnych sesjach — projekty, preferencje, bieżący kontekst. Agent przestaje prosić cię o ponowne wyjaśnianie za każdym razem, gdy otwierasz nowy czat.
|
||
|
||
## Poziom 3 — Komendy cięciem
|
||
|
||
Większość użytkowników nigdy ich nie odkrywa. To naprawdę szkoda, bo samo w sobie zmienia, ile uda się zrobić podczas sesji.`/background`
|
||
|
||
Podczas pisania propozycji wpisujesz. Twoja główna sesja trwa dalej. Pięć minut później pojawia się panel z analizą konkurencyjną. Wklejasz to do propozycji bez przerwa.`/background research [competitor] pricing and positioning`
|
||
|
||
Jest też (automatycznie uruchamia zadanie następcze po zakończeniu obecnego) oraz (przekierowuje agenta w trakcie biegu bez przerywania). Takie istnieją. Warto wiedzieć.`/queue` `/steer`
|
||
|
||
## Faza 2: Dźwignia (poziomy 4–7)
|
||
|
||
Hermes zaczyna działać mądrzej. Przestajesz robić rzeczy, które on może znieść.
|
||
|
||
## Poziom 4 — Umiejętności i odpowiedni model dla każdej z nich
|
||
|
||
Umiejętności to pakiety wiedzy, które agent ładuje, gdy jest to potrzebne. Umiejętność badawcza obciąża metodologię badawczą. Umiejętność przeglądu kodu ładuje wzorce bezpieczeństwa.
|
||
|
||
Ale prawdziwym odkryciem nie są same umiejętności — to przekierowanie każdej z nich do innego modelu. Wyszukiwarka nie potrzebuje najdroższego modelu. DeepSeek V4 Flash kosztuje 0,10 dolara za milion tokenów i radzi sobie z rutynowym badaniem bez problemu. Analiza złożona lub końcowa recenzja jest warta przeprowadzenia na Opus. Jeśli wykonujesz 30+ zadań badawczych miesięcznie, różnica szybko się sumuje.
|
||
|
||
Błąd: spalanie drogich tokenów na zadaniach, które ich nie potrzebują.
|
||
|
||
## Poziom 5 — MCP: łączenie rzeczywistych narzędzi
|
||
|
||
Serwery MCP łączą Hermesa z Gmailem, Slackiem, Notion, ClickUp, GitHubem, Twoim kalendarzem i wieloma innymi usługami. Agent teraz pracuje z twoimi danymi, nie tylko z otwartym internetem.
|
||
|
||
Przykład praktyczny: "co się stało na Slacku w tym tygodniu, kiedy byłem w dół?" Agent czyta Twoje kanały, filtruje według wzmianek i kluczowych tematów, porównuje zapisane cele i dostarcza 10-linijkowe podsumowanie. Nie przełączam się między tabami. Nie przewijałem 200 wiadomości.
|
||
|
||
Jedna rzecz do zwrócenia uwagi: nie podłączaj 15 narzędzi naraz. Każdy MCP dodaje definicje, które model musi odczytać w każdej turze. Zainstaluj to, czego faktycznie używasz, wyłącz to, czego nie używasz.
|
||
|
||
## Poziom 6 — Podagenci działający równolegle
|
||
|
||
Hermes może generować oddzielnych agentów potomnych, z których każdy ma własny kontekst i narzędzia. Człowiek bada. Można krytykować. Nadrzędny współrzędne i syntetyzują.
|
||
|
||
Prawdziwy przykład: potrzebujesz badań konkurencyjnych dotyczących trzech firm. Jeden agent na każdego konkurenta, wszyscy działają na DeepSeek. Rodzic na Sonet łączy trzy raporty. Dziesięć minut zamiast trzydziestu — a powolny wynik jednej firmy nie utrzymuje konkurencji z pozostałymi.
|
||
|
||
## Poziom 7 — Async: działa, gdy cię nie ma
|
||
|
||
To jest zmiana sposobu myślenia, która oddziela poziom 6 od poziomu 7.
|
||
|
||
`/goal` Pozwala ustawić trwały cel — coś w stylu "Znajdź 100 klinik w Toronto, zbuduj stronę docelową dla każdej z nich, sporządz spersonalizowane e-maile kontaktowe" — a agent biegnie do niego automatycznie, tura po turze, aż jest gotowy lub Ty go zatrzymasz.
|
||
|
||
Prace crona idą dalej. Ustal sobie zadanie na bieg o 7 rano każdego ranka. Mądrzejszą częścią jest bramka wakeAgent: lekki skrypt najpierw sprawdza, czy coś się zmieniło. Nic się nie zmieniło = zero wywołań LLM = $0. Konkurencja zaktualizowała stronę z cenami = agent budzi się, bada sprawę, wysyła brief na Twój Telegram przed pierwszą kawą.
|
||
|
||
Przestałeś pytać. Zaczęły się dziać rzeczy.
|
||
|
||
## Faza 3: Autonomia (Poziomy 8–15)
|
||
|
||
Hermes biegnie bez ciebie. System z czasem się poprawia.
|
||
|
||
## Poziom 8 — Wiele profili, wyspecjalizowanych dla każdego zadania
|
||
|
||
Zamiast jednego agenta robiącego wszystko, budujesz osobne profile. Profil Scouta skanuje sygnały co kilka godzin. Analityk syntetyzuje wyniki o 10:00. Briefer przekazuje Telegramowi o 8:00 pięciopunktowe podsumowanie.
|
||
|
||
Nie dzielą się pamięcią. Każdy wykonuje jedną pracę z odpowiednim modelem do danego zadania.
|
||
|
||
Czytasz podsumowanie przy kawie. Trzech różnych agentów zbudowało go przez noc.
|
||
|
||
## Poziom 9 — Baza wiedzy, która z czasem staje się mądrzejsza
|
||
|
||
To potrzeba kilku miesięcy, żeby naprawdę poczuć. Umiejętność Wiki LLM buduje zestaw powiązanych plików markdown — artykułów, transkrypcji, notatek badawczych, podsumowań spotkań — które rosną za każdym razem, gdy je udostępniasz.
|
||
|
||
Miesiąc pierwszy: 50 wpisów, przydatne. Miesiąc trzeci: 300+ wpisów z krzyżowymi odniesieniami. Kiedy pytasz "jak konkurent X obsługuje onboarding?", agent nie szuka tylko w internecie. Pobiera twoje własne notatki badawcze, rozmowę z klientem sprzed dwóch miesięcy, w której pojawił się konkurent X, oraz artykuł, który indeksowałeś w zeszłym miesiącu. Żadne wyszukiwanie w sieci nie znajduje takiej kombinacji.
|
||
|
||
## Poziom 10 — Kanban w różnych profilach
|
||
|
||
Wspólna tablica zadań z łańcuchami zależności. Karta "Buduj strony docelowe" czeka, aż "Zbadaj 100 klinik" zostanie ukończona. Agenci podejmują pracę, gdy zależności są czyste.
|
||
|
||
Warto to robić kwartalne projekty z 10+ zadaniami, które się rozwijają. To przesada jak na prosty, trzyetapowy pipeline — nie dodawaj złożoności tam, gdzie nie jest to potrzebne.
|
||
|
||
## Poziom 11 — Głos
|
||
|
||
Wyślij wiadomość głosową na Telegramie, WhatsAppie lub Discordzie. Agent transkrybuje, przetwarza i może odpowiadać dźwiękiem.
|
||
|
||
Jadąc na spotkanie: "czy powinienem wiedzieć coś z wczorajszych badań, zanim rozmowa o 11 rano się pojawi?" Agent odpowiada 30-sekundowym podsumowaniem audio. Słuchasz zamiast czytać. Ręce na kierownicy.
|
||
|
||
## Poziom 12 — Automatyzacja przeglądarki
|
||
|
||
W przypadku stron bez API agent otwiera przeglądarkę, nawiguje i pobiera potrzebne informacje. Konkurent bez publicznych danych cenowych: agent otwiera swoją stronę cenową, porównuje ją z poprzednim miesięcznym migawką w twojej wiki, oznacza wszelkie zmiany w twoim porannym briefingu.
|
||
|
||
Jest wolniejszy i bardziej delikatny niż bezpośrednie wywołanie API. Używaj go tylko, gdy nie istnieje API.
|
||
|
||
## Poziom 13 — Hermes jako API
|
||
|
||
Twój zestaw Hermes jest wystawiony jako punkt końcowy HTTP, kompatybilny z formatem OpenAI. Każdy frontend, który mówi o OpenAI, może się z nim połączyć.
|
||
|
||
Twoje badania konkurencyjne działają jako API. Niestandardowy wewnętrzny dashboard go zasłuchuje. Twój zespół widzi najnowsze informacje na żywej stronie. Nikt nie musi otwierać Telegrama.
|
||
|
||
## Poziom 14 — integracja z IDE
|
||
|
||
Hermes działa wewnątrz VS Code, Zeda lub JetBrains. Podczas pisania strony z cenami pytasz: "jak konkurent X strukturuje swoje poziomy?" Agent sprawdza twoją wiki Obsidian, pobiera notatki badawcze, odpowiada — bez opuszczania edytora czy otwierania zakładki przeglądarki.
|
||
|
||
## Poziom 15 — Twoje rozwiązanie jako produkt rozpowszechnialny
|
||
|
||
Wszystko — SOUL.md, umiejętności, zadania cron, struktura wiki, powiązane narzędzia — zapakowane jako repozytorium git.
|
||
|
||
Nowy członek zespołu wykonuje jedno polecenie. Mają tam twoje profile Scouta, Analityka i Briefera, strukturę wiki, zadania crona i szablony SOUL.md zainstalowane w 10 minut. Możesz też wysłać go klientowi lub sprzedać.
|
||
|
||
Jedna zasada: brak kluczy API w dystrybucji. Dane uwierzytelniające pozostają na każdym komputerze. Repozytorium niesie charakter i workflow. Użytkownik przynosi własne klucze.
|
||
|
||
## Gdzie większość ludzi faktycznie się zatrzymuje
|
||
|
||
Poziomy 1 i 2.
|
||
|
||
Piszą SOUL.md, używają Hermesa jako inteligentnego chatbota, oszczędzają 30 minut dziennie. To nie jest nic — ale stanowi około 10% dostępnej ceny.
|
||
|
||
Przeskok z poziomu 3 do 7 to moment, w którym dzienne oszczędności przechodzą z minut do godzin. Zadania w tle, asynchroniczne cele, zadania cron z bramkami wakeAgent — to wszystko nakłada się w sposób, który trudno wyjaśnić, dopóki nie działa przez miesiąc.
|
||
|
||
Przeskok z 7 do 10 to moment, gdy agent przestaje być narzędziem, którego używasz, a staje się systemem, który działa. Przeglądasz prace, które powstały bez ciebie.
|
||
|
||
Gdybym miał zaczynać od nowa, użyłbym trybu Blank Slate podczas instalacji: wszystko wyłączone oprócz modeli i podstawowych narzędzi do plików. Dodawaj po jednej rzeczy na raz. Dokładnie wiedz, co się włączyło i dlaczego. To najtańszy i najbardziej kontrolowany sposób, by osiągnąć poziom 15 bez wydawania pieniędzy na cechy, o których jeszcze nie pomyślałeś. |