Lekcja 27 · krok 2około 60 min pracy

Godzina na własnej instancji: od /health do jednej sygnatury w logu

Ćwiczenie do lekcji Diagnostyka OpenClaw: /health, logi i procedura, gdy agent milczy. Teorię masz za sobą — teraz wykonaj to na własnym agencie albo w dowolnym czacie z modelem. Bez tego kroku kurs zostaje wiedzą, która nie zmienia niczego w Twojej pracy.

Co powinieneś już wiedzieć z teorii

  • GET /health na porcie 18789 zwraca {"ok":true,"status":"live"} bez zakładania sesji. Monitoring pingujący /v1/chat/completions co 15 minut tworzy około 96 sesji dziennie po 4–22 KB każda.
  • Datowane pliki logów w /tmp/openclaw są usuwane po 24 godzinach — bez własnego logging.file nie zbadasz zdarzenia sprzed dwóch dni.
  • Rotacja startuje przy logging.maxFileBytes, domyślnie 100 MB, i zostawia pięć ponumerowanych archiwów od .1 do .5.
  • consoleStyle ma trzy style — pretty, compact, json — ale w configu ustawiasz pretty albo json; compact włącza się sam poza terminalem, a openclaw doctor --fix mapuje zapisanego compact na pretty.

Co masz zrobić

Celem nie jest naprawienie czegokolwiek, tylko sprawdzenie, że umiesz to zrobić, zanim będzie trzeba. Wywołaj awarię, którą sam kontrolujesz, i przejdź całą ścieżkę: endpoint, plik logu, sygnatura, naprawa. Rób to na instancji testowej albo w porze, w której nikt do agenta nie pisze.

Mam własną instancję OpenClaw i chcę przećwiczyć diagnostykę bez psucia pracy agenta. Zaproponuj trzy bezpieczne, odwracalne sposoby wywołania awarii, które da się odczytać z logów: jeden dotyczący routingu wiadomości, jeden dotyczący konfiguracji i jeden dotyczący dostępności gatewaya. Przy każdym podaj dokładnie, co mam zobaczyć w logu i jaką komendą to cofnąć. Nie proponuj niczego, co dotyka poświadczeń kanałów ani katalogu credentials.

Gotowe, gdy:

Gdzie to się najczęściej sypie

Zanim uznasz ćwiczenie za zrobione, sprawdź, czy nie wpadłeś w któreś z tych miejsc. Każde widzieliśmy więcej niż raz.

  • Monitoring podpięty pod /v1/chat/completions zamiast /health. Wygląda tak samo, a po miesiącu masz spuchnięty magazyn sesji i ryzyko przepełnienia okna kontekstu z powodu własnego uptime checka.
  • Wpisane z rozpędu /healthz zamiast udokumentowanego /health. Alert krzyczy, że agent nie żyje, a agent w tym czasie normalnie pracuje.
  • Szukanie szczegółów w pliku logu po dorzuceniu --verbose. Ta flaga rusza tylko konsolę i styl logów WebSocket; plik dalej stoi na logging.level.
  • Wpisanie nadawcy w allowFrom przy problemie z grupą. W grupach filtruje groupAllowFrom, a allowFrom jest tylko zapasem — na Slacku dochodzi jeszcze wymóg identyfikatora C12345678 zamiast nazwy kanału.

Nie masz jeszcze na czym ćwiczyć?

Agent w chmurze EU startuje w około minutę. Pierwsza subskrypcja pakietu Premium ma 5 dni za darmo, a kurs czytasz dalej niezależnie od tego.

Zobacz plany