Ta karta służy do zlecenia jednego ambitnego zadania od początku do końca, a nie do pojedynczych linii w rozmowie — te trzymam w ściądze „Prompty warte trzymania pod ręką”. Tutaj składam z nich brief na całą robotę i dokładam dwie rzeczy, których ściąga nie rusza: ile myślenia zamawiasz i co może iść równolegle. Punktem odniesienia jest Claude, ale samo sterowanie działa na każdym nowoczesnym modelu rozumującym.
Ile myślenia zamawiasz — pokrętło wysiłku
Same poziomy — i to, że wysoki jest sensownym domyślnym wyborem — opisuję w artykule o pisaniu promptów. Tutaj jest to, czego tam nie ma: jak wykalibrować poziom pod własne zadania. W części interfejsów wybierasz go z listy, w części opisujesz go słowami w prompcie.
Zacznij od wysokiego. Ten sam reprezentatywny przypadek przepuść jeszcze raz na średnim i porównaj oba wyniki — nie ich długość, tylko to, co nadaje się do użycia. Jeśli jakość się trzyma, zejdź na niski. Na bardzo wysoki — jedyny poziom powyżej wysokiego — wchodź dopiero wtedy, gdy dodatkowe rozumowanie daje wynik lepszy w użyciu, a nie samą dłuższą odpowiedź.
Do tego dwa zastrzeżenia. Niski wysiłek rzadziej sięga po wyszukiwanie i wczytywanie źródeł, a częściej odpowiada z pamięci, więc tam, gdzie o poprawności decyduje świeży research albo staranne wyciągnięcie danych z dokumentu, poziom trzeba podnieść. Bardzo wysoki potrafi z kolei zużyć dodatkowe tokeny na namysł przed dłuższym tekstem, nie poprawiając samego tekstu.
Własny, powtarzalny przypadek testowy powie ci o właściwym poziomie więcej niż czyjeś ulubione ustawienie.
Słaba wersja: „myśl najdłużej, jak potrafisz”.
Wklej to:
Użyj najniższego poziomu wysiłku, który niezawodnie daje wymaganą jakość. Podnieś go przy trudnym rozumowaniu i na krokach, gdzie potrzebne są świeże źródła albo staranne wyciągnięcie danych. Obniż przy rutynowym wykonaniu.
Co może iść równolegle
Równoległość występuje w dwóch postaciach, które różnią się skalą. Pierwsza to niezależne wywołania narzędzi w tym samym czasie: kilka wyszukiwań, odczyty plików, sprawdzenia. Druga to oddanie samodzielnego wątku pracy wyspecjalizowanemu agentowi, podczas gdy agent prowadzący dalej pilnuje całości.
Myśl o tym jak o taśmie montażowej: jeden proces nie wymaga, żeby jeden agent wykonał każdy krok. Niezależne kawałki idą do osobnych agentów, powstają jednocześnie, a prowadzący składa je na końcu. Praca kończy się szybciej, a każdy agent dostaje węższą odpowiedzialność. Kilka wątków rozpoznania może biec obok siebie, a prowadzący nie musi trzymać w kontekście każdego pośredniego szczegółu.
Druga połowa reguły mówi, kiedy równoległości nie używać, i właśnie ją zwykle się pomija:
- Nie zrównoleglaj kroków, które zależą od wcześniejszego wyniku — uruchomione za wcześnie, pracują na złym wejściu.
- Nie deleguj czegoś, co domkną dwa wywołania narzędzia — samo przekazanie zadania kosztuje wtedy więcej niż jego zrobienie.
- Nie dziel pracy, która wymaga cały czas wspólnego kontekstu — za ten sam kontekst zapłacisz dwa razy, a na stykach części i tak zostaną szwy.
- Nie mnóż agentów do liczby, przy której koordynacja kosztuje więcej, niż oszczędza równoległość — za sklejanie i pilnowanie wątków płacisz własną uwagą, nie tokenami agentów.
Oddanie wątku nie zdejmuje odpowiedzialności. Agent prowadzący nadal odpowiada za scalony wynik i musi go sprawdzić, zanim ci go odda.
Słaba wersja: „rozbij to na tylu agentów, ilu się da, i puść wszystko naraz”.
Wklej to:
Wskaż, które części tego zadania są od siebie niezależne, i uruchamiaj niezależne wywołania narzędzi w tym samym czasie. Większe samodzielne wątki zleć osobnym agentom, a w czasie ich pracy rób dalej to, co się da. Kroki zależne od wcześniejszego wyniku zostaw po kolei. Za sprawdzenie scalonego wyniku odpowiadasz ty, nie agenci, którym zleciłeś wątki.
Cały brief w jednym kawałku
To jest wersja do wklejenia, kiedy oddajesz jedno duże zadanie. Podmieniasz [nawiasy] na własne słowa.
Cel. Muszę osiągnąć [cel], a ma to znaczenie, bo [kontekst]. Definicja gotowego. Praca jest skończona, kiedy [obserwowalne warunki]. Domknięcie. Zrób to od początku do końca. Rutynowe, odwracalne decyzje podejmuj sam. Zatrzymaj się tylko przed działaniem nieodwracalnym, przy istotnej zmianie zakresu albo gdy potrzebujesz informacji, którą mam tylko ja. Wysiłek. Użyj najniższego poziomu, który niezawodnie daje wymaganą jakość. Podnieś przy trudnym rozumowaniu, obniż przy rutynowym wykonaniu. Weryfikacja. Sprawdź każdy istotny wynik, zanim powiesz, że gotowe. Napraw to, co nie przeszło, i wprost powiedz, czego nie zweryfikowałeś. Wykonanie. Niezależne operacje uruchamiaj w tym samym czasie. Większe samodzielne wątki zleć osobnym agentom i pracuj dalej, kiedy trwają. Kroki zależne rób po kolei.
Linia „definicja gotowego” i linia weryfikacji mają tu po jednym zdaniu, bo pełne wersje leżą osobno: warunki „gotowe” rozkładam na części w briefie dla agenta pracującego bez nadzoru, a weryfikację — w ściądze. Jeśli któraś z tych dwóch linii nie działa u ciebie tak, jak chcesz, dłuższej wersji szukaj w tamtych tekstach.
Zanim wyślesz
- Czy końcowy wynik jest jednoznaczny?
- Czy model wie, po co ta praca i dla kogo?
- Czy warunki „gotowe” da się sprawdzić z zewnątrz?
- Czy poziom wysiłku odpowiada trudności zadania?
- Czy jest realna metoda weryfikacji, a nie prośba o pewność?
- Które wątki mogą biec niezależnie od siebie?
- Czy agent prowadzący nadal odpowiada za scalony wynik?