Prompt engineering w praktyce: jak odrobotyzowaliśmy agenta AI
10 iteracji system promptu agenta AI: dlaczego model kopiuje przykłady, czemu warunek działa lepiej niż przymiotnik i jak testować prompt, żeby wynik nie kłamał.
Wiedza
Piszemy o tym, co działa w enterprise - Temporal, Camunda, UiPath, Agentic AI i automatyzacji procesów na serio.
10 iteracji system promptu agenta AI: dlaczego model kopiuje przykłady, czemu warunek działa lepiej niż przymiotnik i jak testować prompt, żeby wynik nie kłamał.
8 wpisów
Automatyzacja procesów biznesowych (BPA) podnosi efektywność zespołów o 20-50%, redukując przy tym błędy, koszty i czas realizacji zadań. Jak działa RPA, jakie procesy warto oddać botom i ile to kosztuje.
Autonomiczny system potrafi przetworzyć zamówienie, reklamację czy zgłoszenie serwisowe w trzy sekundy. Bez stabilnej, wielokanałowej komunikacji z klientem ta szybkość zatrzymuje się na ostatnim metrze — na zajętej linii i w rozproszonych skrzynkach.
Mieliśmy jedną maszynę, kilkadziesiąt modeli i zestaw testów z poprzedniego tygodnia. Na co patrzeć przy wyborze lokalnego modelu, co przestawić w Ollamie, żeby przestał wisieć, i jak to działa po tygodniu używania.
Chcieliśmy wreszcie zmierzyć, jak zachowuje się nasz agent, i sprawdzić go na czterech modelach. Dwa identyczne przebiegi dały ten sam wynik 2/18. Pięć scenariuszy zachowało się przy tym inaczej. Przy tym samym agencie sama zmiana sędziego przesuwała wynik z 61% na 11%.
Model językowy nie sprawdza faktów, tylko przewiduje kolejne słowa — może z pełnym przekonaniem potwierdzić promocję, która skończyła się miesiąc temu. RAG dostarcza mu aktualną wiedzę z dokumentów, zanim odpowie, ale wdrożenie to coś więcej niż podłączenie plików do bazy.
Tool call zwrócił poprawny stan rozmowy, a model i tak napisał, że cel jest uzgodniony. Jak zbudowaliśmy jawny stan rozmowy przez tool calling w Spring AI — i dwa różne sposoby, jakimi to potrafi zawieść.
104 linie Javy, Spring AI 2.0 i własny LLM zamiast chmury. Co powstało w trzy dni, ile z tego to kod, a ile instrukcja systemowa agenta.
Operacje masowe: Kafka, kolejka czy Temporal? (ADR)
Brak wyników dla wybranych filtrów.