Lekcja 4 · krok 2około 20 min pracy
Rachunek z pięćdziesięciu zapytań
Ćwiczenie do lekcji Który model wybrać i ile to naprawdę kosztuje. Teorię masz za sobą — teraz wykonaj to na własnym agencie albo w dowolnym czacie z modelem. Bez tego kroku kurs zostaje wiedzą, która nie zmienia niczego w Twojej pracy.
Co powinieneś już wiedzieć z teorii
- Zacznij od środkowej półki cenowej. Cennik Anthropic z lipca 2026 wycenia Haiku 4.5 na 1 i 5 USD za milion tokenów, Sonnet 5 na 3 i 15, Opus 5 na 5 i 25, Fable 5 na 10 i 50 — różnica między skrajnymi półkami to dziesięciokrotność.
- Ten sam pięciokrokowy scenariusz uruchomiony jako agent kosztował w pomiarze LeanOps 0,158 USD wobec 0,049 USD za pojedyncze zapytanie do czatu, czyli 3,2 raza więcej.
- Zanim zmienisz model, przytnij kontekst: według LeanOps ponownie wysyłana historia odpowiada za 62% rachunku za tokeny.
- Iternal AI szacuje proste zadanie agenta na 5–15 tys. tokenów, a agenta robiącego 100 zadań dziennie na około 30 mln tokenów miesięcznie. Przemnóż to przez swoją stawkę przed decyzją.
Co masz zrobić
Zamiast liczyć koszty w arkuszu, puścisz pięćdziesiąt prawdziwych zapytań przez dwa modele i porównasz dwie liczby naraz: rachunek i liczbę odpowiedzi do poprawki. Popołudnie pracy zwykle kończy wszystkie dyskusje o wyborze modelu w firmie.
Poniżej pary odpowiedzi na te same pytania, wygenerowane przez dwa różne modele. Model A jest zawsze pierwszy, model B drugi. [wklej pary] Dla każdej pary wskaż, która odpowiedź jest lepsza, i uzasadnij jednym zdaniem, odnosząc się do konkretu: poprawności faktu, długości, formatu lub tonu. Jeśli różnica jest nieistotna, napisz „remis”. Na końcu podaj wynik zbiorczy: ile razy wygrał A, ile B, ile remisów. Nie poprawiaj odpowiedzi i nie proponuj własnych wersji.
Gotowe, gdy:
Gdzie to się najczęściej sypie
Zanim uznasz ćwiczenie za zrobione, sprawdź, czy nie wpadłeś w któreś z tych miejsc. Każde widzieliśmy więcej niż raz.
- Wybór modelu z rankingu bez uruchomienia własnego zadania: płacisz za przewagę w testach, które nie mają nic wspólnego z Twoimi mailami.
- Szacowanie kosztu z ceny za tysiąc tokenów: pomijasz historię rozmowy doklejaną przy każdej wiadomości i po miesiącu rachunek jest kilkukrotnie wyższy od prognozy.
- Zmiana modelu bez powtórzenia testów: długość i format odpowiedzi rozjeżdżają się z dnia na dzień, a dowiadujesz się o tym od klienta.
- Podpinanie własnego klucza wyłącznie dla oszczędności przy małym ruchu: dokładasz sobie konto, limity i fakturę więcej, a różnica na rachunku idzie w grosze.
Nie masz jeszcze na czym ćwiczyć?
Agent w chmurze EU startuje w około minutę. Pierwsza subskrypcja pakietu Premium ma 5 dni za darmo, a kurs czytasz dalej niezależnie od tego.
Zobacz plany