11 KiB
title, source, author, published, created, description, tags
| title | source | author | published | created | description | tags | ||
|---|---|---|---|---|---|---|---|---|
| 15 poziomów agenta Hermes: od chatbota do 24/7 systemu autonomicznego | https://nitingavhane.medium.com/15-levels-of-hermes-agent-from-chatbot-to-24-7-autonomous-system-da15c3c204f6 |
|
2026-06-25 | 2026-07-31 | Historia tylko dla członków |
|
Cześć wszystkim, nazywam się Nitin Gavhane i na tym blogu chcę pokazać Wam coś, czego większość właścicieli firm całkowicie pomija, zakładając Hermes Agent.
Używają go jako chatbota. Wpisz pytanie, otrzymaj odpowiedź, zamknij zakładkę. To poziom 1. Jest ich jeszcze 14 — a różnica między tym, gdzie większość ludzi się kończy, a tym, gdzie to może faktycznie zmierzać, jest naprawdę zaskakująca.
Zmapowałem wszystkie 15 poziomów, podzielonych na trzy fazy. Każdy z nich rozwija poprzedni, ale możesz zacząć na poziomie, który pasuje do twojego zestawu.
Faza 1: Fundacja (Poziomy 1–3)
Masz zainstalowanego Hermesa. Odpowiada na twoje pytania.
Poziom 1 — Prompty jednorazowe
Wpisujesz prompt, agent odpowiada. Podstawowe rzeczy.
Ale większość ludzi przeoczy: Hermes nie jest wyszukiwarką. Chatbot rozmawia o różnych rzeczach. Hermes robi różne rzeczy — czyta pliki, pisze kod, uruchamia polecenia terminala, przeszukuje internet, zapisuje wyniki na twoim komputerze.
Różnica polega na tym, jak je wywołasz. "Jakie są najlepsze CRM-y dla solo założycieli?" – to zapytanie wyszukiwarki. "Zbadaj top 5 CRM-ów dla solo założycieli, porównaj ceny i funkcje, zapisz raport do folderu raportów" to zadanie agenta. To samo pytanie, zupełnie inny wynik. Teczka czeka na ciebie trzy minuty później.
Błąd: wpisywanie promptów tak, jakbyś używał Google.
Poziom 2 — Pamięć i SOUL.md
To właśnie tutaj przestaje być generyczne.
SOUL.md to plik, który piszesz — około 50 do 80 linijek — który mówi agentowi, kim jesteś. Twój model biznesowy, segmenty klientów, marże, preferencje – czego nigdy nie powinien robić. Ładuje się na początku każdej sesji.
Bez niej, jeśli zapytasz "czy powinienem podnieść ceny?", otrzymasz wpis na blogu o strategii cenowej. Dzięki temu — zakładając, że wpisałeś faktyczne liczby i podział klientów — otrzymujesz coś w stylu: "Twój poziom wejściowy konwertuje 12%. Podniesienie go o 10 dolarów ryzykuje zmianę w segmencie B, co stanowi 60% Twoich przychodów. Najpierw testowałbym na segmencie A."
To samo pytanie. To zupełnie inna odpowiedź.
MEMORY.md i USER.md przechowują fakty na różnych sesjach — projekty, preferencje, bieżący kontekst. Agent przestaje prosić cię o ponowne wyjaśnianie za każdym razem, gdy otwierasz nowy czat.
Poziom 3 — Komendy cięciem
Większość użytkowników nigdy ich nie odkrywa. To naprawdę szkoda, bo samo w sobie zmienia, ile uda się zrobić podczas sesji./background
Podczas pisania propozycji wpisujesz. Twoja główna sesja trwa dalej. Pięć minut później pojawia się panel z analizą konkurencyjną. Wklejasz to do propozycji bez przerwa./background research [competitor] pricing and positioning
Jest też (automatycznie uruchamia zadanie następcze po zakończeniu obecnego) oraz (przekierowuje agenta w trakcie biegu bez przerywania). Takie istnieją. Warto wiedzieć./queue /steer
Faza 2: Dźwignia (poziomy 4–7)
Hermes zaczyna działać mądrzej. Przestajesz robić rzeczy, które on może znieść.
Poziom 4 — Umiejętności i odpowiedni model dla każdej z nich
Umiejętności to pakiety wiedzy, które agent ładuje, gdy jest to potrzebne. Umiejętność badawcza obciąża metodologię badawczą. Umiejętność przeglądu kodu ładuje wzorce bezpieczeństwa.
Ale prawdziwym odkryciem nie są same umiejętności — to przekierowanie każdej z nich do innego modelu. Wyszukiwarka nie potrzebuje najdroższego modelu. DeepSeek V4 Flash kosztuje 0,10 dolara za milion tokenów i radzi sobie z rutynowym badaniem bez problemu. Analiza złożona lub końcowa recenzja jest warta przeprowadzenia na Opus. Jeśli wykonujesz 30+ zadań badawczych miesięcznie, różnica szybko się sumuje.
Błąd: spalanie drogich tokenów na zadaniach, które ich nie potrzebują.
Poziom 5 — MCP: łączenie rzeczywistych narzędzi
Serwery MCP łączą Hermesa z Gmailem, Slackiem, Notion, ClickUp, GitHubem, Twoim kalendarzem i wieloma innymi usługami. Agent teraz pracuje z twoimi danymi, nie tylko z otwartym internetem.
Przykład praktyczny: "co się stało na Slacku w tym tygodniu, kiedy byłem w dół?" Agent czyta Twoje kanały, filtruje według wzmianek i kluczowych tematów, porównuje zapisane cele i dostarcza 10-linijkowe podsumowanie. Nie przełączam się między tabami. Nie przewijałem 200 wiadomości.
Jedna rzecz do zwrócenia uwagi: nie podłączaj 15 narzędzi naraz. Każdy MCP dodaje definicje, które model musi odczytać w każdej turze. Zainstaluj to, czego faktycznie używasz, wyłącz to, czego nie używasz.
Poziom 6 — Podagenci działający równolegle
Hermes może generować oddzielnych agentów potomnych, z których każdy ma własny kontekst i narzędzia. Człowiek bada. Można krytykować. Nadrzędny współrzędne i syntetyzują.
Prawdziwy przykład: potrzebujesz badań konkurencyjnych dotyczących trzech firm. Jeden agent na każdego konkurenta, wszyscy działają na DeepSeek. Rodzic na Sonet łączy trzy raporty. Dziesięć minut zamiast trzydziestu — a powolny wynik jednej firmy nie utrzymuje konkurencji z pozostałymi.
Poziom 7 — Async: działa, gdy cię nie ma
To jest zmiana sposobu myślenia, która oddziela poziom 6 od poziomu 7.
/goal Pozwala ustawić trwały cel — coś w stylu "Znajdź 100 klinik w Toronto, zbuduj stronę docelową dla każdej z nich, sporządz spersonalizowane e-maile kontaktowe" — a agent biegnie do niego automatycznie, tura po turze, aż jest gotowy lub Ty go zatrzymasz.
Prace crona idą dalej. Ustal sobie zadanie na bieg o 7 rano każdego ranka. Mądrzejszą częścią jest bramka wakeAgent: lekki skrypt najpierw sprawdza, czy coś się zmieniło. Nic się nie zmieniło = zero wywołań LLM = $0. Konkurencja zaktualizowała stronę z cenami = agent budzi się, bada sprawę, wysyła brief na Twój Telegram przed pierwszą kawą.
Przestałeś pytać. Zaczęły się dziać rzeczy.
Faza 3: Autonomia (Poziomy 8–15)
Hermes biegnie bez ciebie. System z czasem się poprawia.
Poziom 8 — Wiele profili, wyspecjalizowanych dla każdego zadania
Zamiast jednego agenta robiącego wszystko, budujesz osobne profile. Profil Scouta skanuje sygnały co kilka godzin. Analityk syntetyzuje wyniki o 10:00. Briefer przekazuje Telegramowi o 8:00 pięciopunktowe podsumowanie.
Nie dzielą się pamięcią. Każdy wykonuje jedną pracę z odpowiednim modelem do danego zadania.
Czytasz podsumowanie przy kawie. Trzech różnych agentów zbudowało go przez noc.
Poziom 9 — Baza wiedzy, która z czasem staje się mądrzejsza
To potrzeba kilku miesięcy, żeby naprawdę poczuć. Umiejętność Wiki LLM buduje zestaw powiązanych plików markdown — artykułów, transkrypcji, notatek badawczych, podsumowań spotkań — które rosną za każdym razem, gdy je udostępniasz.
Miesiąc pierwszy: 50 wpisów, przydatne. Miesiąc trzeci: 300+ wpisów z krzyżowymi odniesieniami. Kiedy pytasz "jak konkurent X obsługuje onboarding?", agent nie szuka tylko w internecie. Pobiera twoje własne notatki badawcze, rozmowę z klientem sprzed dwóch miesięcy, w której pojawił się konkurent X, oraz artykuł, który indeksowałeś w zeszłym miesiącu. Żadne wyszukiwanie w sieci nie znajduje takiej kombinacji.
Poziom 10 — Kanban w różnych profilach
Wspólna tablica zadań z łańcuchami zależności. Karta "Buduj strony docelowe" czeka, aż "Zbadaj 100 klinik" zostanie ukończona. Agenci podejmują pracę, gdy zależności są czyste.
Warto to robić kwartalne projekty z 10+ zadaniami, które się rozwijają. To przesada jak na prosty, trzyetapowy pipeline — nie dodawaj złożoności tam, gdzie nie jest to potrzebne.
Poziom 11 — Głos
Wyślij wiadomość głosową na Telegramie, WhatsAppie lub Discordzie. Agent transkrybuje, przetwarza i może odpowiadać dźwiękiem.
Jadąc na spotkanie: "czy powinienem wiedzieć coś z wczorajszych badań, zanim rozmowa o 11 rano się pojawi?" Agent odpowiada 30-sekundowym podsumowaniem audio. Słuchasz zamiast czytać. Ręce na kierownicy.
Poziom 12 — Automatyzacja przeglądarki
W przypadku stron bez API agent otwiera przeglądarkę, nawiguje i pobiera potrzebne informacje. Konkurent bez publicznych danych cenowych: agent otwiera swoją stronę cenową, porównuje ją z poprzednim miesięcznym migawką w twojej wiki, oznacza wszelkie zmiany w twoim porannym briefingu.
Jest wolniejszy i bardziej delikatny niż bezpośrednie wywołanie API. Używaj go tylko, gdy nie istnieje API.
Poziom 13 — Hermes jako API
Twój zestaw Hermes jest wystawiony jako punkt końcowy HTTP, kompatybilny z formatem OpenAI. Każdy frontend, który mówi o OpenAI, może się z nim połączyć.
Twoje badania konkurencyjne działają jako API. Niestandardowy wewnętrzny dashboard go zasłuchuje. Twój zespół widzi najnowsze informacje na żywej stronie. Nikt nie musi otwierać Telegrama.
Poziom 14 — integracja z IDE
Hermes działa wewnątrz VS Code, Zeda lub JetBrains. Podczas pisania strony z cenami pytasz: "jak konkurent X strukturuje swoje poziomy?" Agent sprawdza twoją wiki Obsidian, pobiera notatki badawcze, odpowiada — bez opuszczania edytora czy otwierania zakładki przeglądarki.
Poziom 15 — Twoje rozwiązanie jako produkt rozpowszechnialny
Wszystko — SOUL.md, umiejętności, zadania cron, struktura wiki, powiązane narzędzia — zapakowane jako repozytorium git.
Nowy członek zespołu wykonuje jedno polecenie. Mają tam twoje profile Scouta, Analityka i Briefera, strukturę wiki, zadania crona i szablony SOUL.md zainstalowane w 10 minut. Możesz też wysłać go klientowi lub sprzedać.
Jedna zasada: brak kluczy API w dystrybucji. Dane uwierzytelniające pozostają na każdym komputerze. Repozytorium niesie charakter i workflow. Użytkownik przynosi własne klucze.
Gdzie większość ludzi faktycznie się zatrzymuje
Poziomy 1 i 2.
Piszą SOUL.md, używają Hermesa jako inteligentnego chatbota, oszczędzają 30 minut dziennie. To nie jest nic — ale stanowi około 10% dostępnej ceny.
Przeskok z poziomu 3 do 7 to moment, w którym dzienne oszczędności przechodzą z minut do godzin. Zadania w tle, asynchroniczne cele, zadania cron z bramkami wakeAgent — to wszystko nakłada się w sposób, który trudno wyjaśnić, dopóki nie działa przez miesiąc.
Przeskok z 7 do 10 to moment, gdy agent przestaje być narzędziem, którego używasz, a staje się systemem, który działa. Przeglądasz prace, które powstały bez ciebie.
Gdybym miał zaczynać od nowa, użyłbym trybu Blank Slate podczas instalacji: wszystko wyłączone oprócz modeli i podstawowych narzędzi do plików. Dodawaj po jednej rzeczy na raz. Dokładnie wiedz, co się włączyło i dlaczego. To najtańszy i najbardziej kontrolowany sposób, by osiągnąć poziom 15 bez wydawania pieniędzy na cechy, o których jeszcze nie pomyślałeś.
