Tester jakości promptów
Wklej swój prompt, a narzędzie oceni go pod kątem obecności kontekstu, konkretnego zadania, formatu i szczegółów — na podstawie prostych, jawnych reguł.
Jak działa ocena
To narzędzie nie wysyła Twojego promptu do żadnego modelu AI — sprawdza go lokalnie względem jawnych, prostych reguł opisanych w poradniku jak pisać dobre prompty: obecność kontekstu, jasnego zadania, oczekiwanego formatu i konkretnych liczb, przy jednoczesnym karaniu mglistych sformułowań. To uproszczona heurystyka, nie ocena merytorycznej poprawności treści — dobra ocena nie gwarantuje, że odpowiedź modelu będzie satysfakcjonująca, ale zwiększa na to szansę.
Czego ten tester nie sprawdza
Ocena dotyczy wyłącznie budowy polecenia. Narzędzie nie wie, o czym piszesz, i nie sprawdzi czterech rzeczy, które w praktyce decydują o wyniku:
- Czy zadanie w ogóle jest wykonalne. Prompt „podaj kurs euro na jutro” dostanie dobrą ocenę struktury i bezużyteczną odpowiedź.
- Czy fakty w kontekście są prawdziwe. Jeśli wkleisz błędne dane wejściowe, model policzy na nich dalej — struktura promptu będzie bez zarzutu.
- Czy prompt jest bezpieczny. Tester nie wykryje, że wkleiłeś dane osobowe albo fragment poufnej umowy.
- Języka innego niż polski. Reguły są zbudowane na polskich sformułowaniach, więc przy tekście angielskim ocena bywa zaniżona.
Co zrobić z niską oceną
Niska ocena prawie zawsze bierze się z jednej z trzech rzeczy. Brak kontekstu naprawia się jednym zdaniem o tym, kim jesteś i po co Ci ta odpowiedź. Brak formatu — dopisaniem, czego oczekujesz: tabeli, listy, akapitu, określonej liczby wariantów. Mglistość — zamianą słów w rodzaju „ładnie”, „profesjonalnie”, „lepiej” na sprawdzalne kryterium, na przykład „bez branżowego żargonu” albo „tak, żeby zrozumiał to ktoś spoza działu”.
Dobra ocena nie jest celem samym w sobie. Bywa, że krótki prompt w toczącej się rozmowie wystarczy w zupełności, bo kontekst został podany wcześniej — tester ocenia pojedyncze polecenie, nie całą wymianę.