Przewodnik
Decyzje i porównania
Jak wybrać partnera do wdrożenia agentów AI: karta oceny
Karta oceny partnera do wdrożenia agentów AI: dziesięć kryteriów, jak wygląda dobra odpowiedź, o co pytać przy wyborze i które sygnały powinny cię zatrzymać.
- Daj wszystkim kandydatom ten sam opis jednego procesu, inaczej odpowiedzi są nieporównywalne.
- Oceniaj dowody, nie deklaracje: ewaluacja przed budową, ślad audytowy, koszt na zadanie, własność repozytorium.
- Dobry partner potrafi powiedzieć, że agent nie jest potrzebny.
Partnera do wdrożenia agentów AI najlepiej wybierać nie po etykiecie, tylko po dowodach. Daj każdemu kandydatowi ten sam opis jednego procesu i oceń odpowiedzi w dziesięciu kryteriach: od tego, czy partner potrafi powiedzieć, że agent nie jest potrzebny, przez ewaluację przed budową i ślad audytowy, po koszt jednego zadania i to, czyje będzie repozytorium.
Zanim zaczniesz szukać partnera
Ten przewodnik zakłada, że decyzja o pracy z partnerem zewnętrznym już zapadła. Jeśli nie, zacznij od przewodnika build vs buy. Zakłada też, że masz jeden konkretny proces, w którym chcesz wykorzystać agentową AI. Karta działa tylko wtedy, gdy każdy kandydat odpowiada na temat tego samego procesu, bo inaczej porównujesz prezentacje, a nie odpowiedzi. Jeśli nie masz pewności, czy zadanie w ogóle wymaga agenta, najpierw sprawdź, czy wystarczy asystent albo workflow, i przejdź checklistę agent czy skrypt.
Karta oceny partnera: dziesięć kryteriów
Karta oceny ma dziesięć wierszy, a każdy kończy się pytaniem o dowód. Zero punktów za deklarację, jeden za opis, dwa za artefakt, który widziałeś. Zanim zaczniesz liczyć, zaznacz kryteria obowiązkowe: zero w którymkolwiek z nich wyklucza kandydata.
Wiersze nie tłumaczą, dlaczego pilotaże stają w miejscu. To opisujemy w przewodniku dlaczego pilotaże AI się nie skalują. Tu każdy wiersz mówi, czego wymagać od partnera i jaki dowód odebrać, zanim podpiszesz umowę.
Skala ocen: 0 = brak odpowiedzi albo sama deklaracja · 1 = opisane, ale bez artefaktu · 2 = poparte artefaktem, który widziałeś (próbka, zanonimizowany dokument, demo na twoich danych).
Przewodnik nie narzuca wag. Przed oceną dopisz „M” przy wierszach, które są dla ciebie obowiązkowe.
| Kryterium | Jak wygląda dobra odpowiedź | O jaki dowód poprosić | Ocena 0-2 |
|---|---|---|---|
| 1. Czy partner sprawdza, czy to w ogóle zadanie dla agenta | Mówi na piśmie, kiedy wystarczy workflow albo skrypt, i dlaczego | Zanonimizowany przykład, w którym zarekomendował prostszy wzorzec | 0 / 1 / 2 |
| 2. Realna ścieżka do danych | Pilotaż korzysta z prawdziwego dostępu z uprawnieniami, a nie z danych wklejonych jednorazowo | Planowana metoda dostępu, lista uprawnień i sposób ich odebrania | 0 / 1 / 2 |
| 3. Ewaluacja przed budową | Zbiór testowy z oczekiwanymi wynikami i próg jakości uzgodnione przed budową, plus reguła zatrzymania (jak ocenić, czy agent działa) | Zanonimizowany zbiór albo raport z ewaluacji z wcześniejszej pracy | 0 / 1 / 2 |
| 4. Człowiek w pętli i bariery | Nazwane punkty, w których człowiek w pętli decyduje z kontekstem, a nie klika „OK”, oraz reguły blokujące nadużycia | Mapa zatwierdzeń dla twojego procesu (architektura agentowa pod audyt) | 0 / 1 / 2 |
| 5. Ślad audytowy i obserwowalność | Każda akcja agenta zapisana: kto pytał, co zwrócił model, kto zatwierdził. Obserwowalność i monitoring także po starcie | Zanonimizowany log lub trace oraz informacja, kto go czyta po starcie (monitoring agentów) | 0 / 1 / 2 |
| 6. Integracje i uprawnienia | Dostęp przez kontrolowany interfejs, np. MCP albo bramkę, z minimalnymi uprawnieniami. Klucze nie trafiają do promptów ani arkuszy (MCP i integracje agentowe) | Diagram integracji i lista uprawnień agenta | 0 / 1 / 2 |
| 7. Niezależność od modelu i dostawcy | Model da się wymienić bez rozbijania kontroli. Powiązania handlowe z dostawcami modeli, chmury lub platform są ujawnione (build vs buy) | Pisemne ujawnienie powiązań i opis, jak przebiegłaby zmiana modelu | 0 / 1 / 2 |
| 8. Koszt na jednostkę pracy | Koszt utrzymania policzony na jedno zadanie przed startem, z pozycjami zależnymi od zużycia, a nie tylko koszt budowy | Model kosztu dla twojego procesu z założeniami (ile kosztuje AI w produkcji) | 0 / 1 / 2 |
| 9. Własność i przekazanie | Nazwany właściciel procesu po twojej stronie. Kod, prompty, ewaluacje i runbooki w twoim repozytorium. Gotowy plan przekazania | Klauzula umowy o IP i lokalizacji repozytorium oraz checklista przekazania | 0 / 1 / 2 |
| 10. Ład i ochrona danych | Klasyfikacja danych, granice uprawnień oraz pytania o RODO i AI Act od pierwszego dnia, a nie doklejone na końcu (governance agentów AI) | Podejście do klasyfikacji danych dla twojego procesu i osoba, która je zatwierdza (AI a RODO, EU AI Act dla firm, prywatność danych) | 0 / 1 / 2 |
Zasada operatora: partner, który nie potrafi powiedzieć, kiedy agent jest zbędny, nie powie ci też, kiedy przestać budować.
Typy partnerów, krótko
Software house, duża firma doradcza (Big 4), niezależny architekt, partner wdrożeniowy dostawcy platformy i zespół własny mogą dowieźć agenta. Etykieta nie przewiduje wyniku, więc oceniaj każdego na tych samych dziesięciu kryteriach.
| Typ partnera | Co zwykle wnosi | Które wiersze karty sprawdzić najpierw |
|---|---|---|
| Software house | Zespół inżynierski, który buduje i dowozi kod | 1, 3, 8 |
| Duża firma doradcza (Big 4) lub integrator | Koordynację wielu obszarów i programów w skali organizacji | 2, 8, 9 |
| Niezależny architekt lub butik | Projekt architektury i kontroli, mały zespół | 5, 6, 9 |
| Partner wdrożeniowy dostawcy platformy | Znajomość jednej platformy i jej narzędzi | 6, 7, 8 |
| Zespół własny plus freelancerzy | Znajomość procesu i danych od środka | 3, 5, 10 |
Kolumna „co zwykle wnosi” opisuje rolę, nie jakość. Ten sam typ partnera może dostać bardzo różne wyniki w karcie.
Pytania na pierwsze spotkanie
Każde pytanie odpowiada jednemu wierszowi karty, więc odpowiedź od razu da się ocenić w skali 0-2.
- „Kiedy ostatnio odradziliście klientowi agenta i co zaproponowaliście zamiast niego?” (wiersz 1)
- „Na jakich danych zrobicie pilotaż i jak odbierzemy wam dostęp?” (wiersz 2)
- „Jaki próg jakości zatrzyma wdrożenie i kto go ustala?” (wiersz 3)
- „Gdzie dokładnie człowiek zatwierdza skutki działań agenta?” (wiersz 4)
- „Kto patrzy na logi po starcie i co robi, gdy coś zauważy?” (wiersz 5)
- „Jakie uprawnienia dostanie agent i gdzie będą przechowywane klucze?” (wiersz 6)
- „Co się stanie, gdy zmienimy model?” (wiersz 7)
- „Ile kosztuje jedno załatwione zadanie?” (wiersz 8)
- „W czyim repozytorium będą kod i ewaluacje?” (wiersz 9)
- „Które dane z tego procesu uznajecie za wrażliwe i kto u nas to zatwierdzi?” (wiersz 10)
Sygnały ostrzegawcze
Najpoważniejszy sygnał ostrzegawczy to partner, który proponuje agenta do wszystkiego i nie umie pokazać ewaluacji przed budową. Drugi: koszt utrzymania podany dopiero po starcie.
- Agent do wszystkiego. Każdy problem kończy się propozycją agenta, nawet gdy wystarczy reguła albo skrypt.
- Demo nigdy na twoich danych. Pokaz działa na przykładowym zbiorze, a na pytanie o twoje dane pada odpowiedź „po podpisaniu”.
- Ewaluacja dopiero po budowie. Jakość ma ocenić „użytkowanie”, bez zbioru testowego i bez progu.
- „Człowiek w pętli” to przycisk OK. Osoba zatwierdza bez kontekstu i bez realnej możliwości zmiany decyzji.
- Zamknięta platforma bez wyjścia. Nie da się wyeksportować promptów, ewaluacji ani logów.
- Koszt utrzymania „wyjdzie w praniu”. Oferta obejmuje budowę, a koszt jednego zadania ma się okazać po starcie.
- IP zostaje u partnera. Kod i ewaluacje są licencjonowane, a nie przekazywane.
- Inny zespół na spotkaniu, inny przy budowie. Nikt nie wskazuje, kto faktycznie zbuduje i będzie utrzymywał agenta.
Jak przeprowadzić wybór krok po kroku
Wybór partnera to pięć kroków: jeden proces, krótka lista, ten sam materiał dla wszystkich, ocena z kryteriami obowiązkowymi i wąskie pierwsze zlecenie.
- Opisz jeden proces na jednej stronie. Wejście, wyjście, kto dziś go wykonuje, jakie systemy i dane są w grze i jaki jest skutek błędu.
- Wybierz kilku kandydatów. Warto, żeby reprezentowali różne typy z tabeli powyżej, bo wtedy porównujesz podejścia, a nie tylko oferty.
- Wyślij wszystkim ten sam opis i tę samą kartę. Poproś o odpowiedź wiersz po wierszu, z dowodem albo z informacją, że go nie ma.
- Oceń odpowiedzi i dowody. Najpierw kryteria obowiązkowe: zero w którymkolwiek wyklucza kandydata. Dopiero potem sumuj pozostałe wiersze.
- Zacznij od wąskiego zlecenia z ramą czasową i warunkami zatrzymania. Co kupić najpierw, opisujemy w przewodniku audyt AI czy PoC, a jak ustawić warunki zatrzymania i jedną metrykę, w przewodniku mały pilotaż, twardy dowód.
Jeśli chcesz przejść tę kartę na jednym ze swoich procesów, opisz go nam.
Pojęcia w tym przewodniku
Masz konkretny proces, transakcję albo wąskie gardło? Opisz swój przypadek.
Opisz swój przypadek Zobacz, jak pomagamyNajczęstsze pytania
- Jak wybrać partnera do wdrożenia agentów AI?
- Przygotuj opis jednego procesu, wyślij go kilku kandydatom razem z kartą oceny i porównaj odpowiedzi w dziesięciu kryteriach, prosząc o dowód przy każdym. Najważniejsze to ewaluacja przed budową, realny dostęp do danych, ślad audytowy, koszt na zadanie i to, że kod oraz ewaluacje zostają w twoim repozytorium.
- Software house, duża firma doradcza (Big 4) czy niezależny architekt?
- Każdy z nich może dobrze wdrożyć agenta. Typ partnera mówi więcej o skali i sposobie pracy niż o jakości. Decyduj na podstawie karty oceny, a nie etykiety.
- Czego wymagać od partnera, zanim zacznie budować?
- Pisemnego zakresu jednego procesu, uzgodnionego zbioru testowego z progiem jakości, planu dostępu do danych z uprawnieniami i szacunku kosztu jednego zadania. Bez tych czterech rzeczy budowa jest zakładem, nie projektem.
- Kto powinien być właścicielem kodu, promptów i ewaluacji?
- Firma, która wdraża agenta. Kod, prompty, zbiory ewaluacyjne i runbooki powinny trafiać do jej repozytorium, z zapisem w umowie, żeby zmiana partnera nie oznaczała budowy od zera.
- Jak porównać oferty, które opisują różne rzeczy?
- Sprowadź je do wspólnego mianownika: ten sam opis procesu dla wszystkich i ta sama karta oceny. Oferta, która nie odpowiada na któreś kryterium obowiązkowe, odpada niezależnie od ceny.