Agent dał dobrą odpowiedź. Ale czy doszedł do niej właściwą drogą? Artykuł 9 serii postawił pytanie: czy agent robi to co powinien? I dał narzędzia do mierzenia tego — task completion, tool call accuracy, faithfulness, efficiency. To jest fundament, i jeśli go nie...
Cały ten hub uczy, jak budować agenty. Ten wpis jest o tym, że najczęściej nie powinieneś. Jest taka pokusa, która przychodzi po przeczytaniu kilku tekstów o agentach: zbudujmy agenta. Do obsługi maili. Do raportów. Do tego procesu, który teraz robi się ręcznie. Agent...
Artykuł 10 z serii Anatomia Agenta AI ← Jak wiedzieć że agent robi to co powinien Dziesięć artykułów. Zaczęliśmy od pytania czym różni się RAG od agenta od Agentic RAG. Skończyliśmy na tym jak testować agenta w CI/CD żeby regresja jakości nie trafiła do produkcji....
Artykuł 9 z serii Anatomia Agenta AI ← Ile kosztuje agent w produkcji Tradycyjny software jest deterministyczny. Wywołujesz funkcję z inputem X, dostajesz output Y. Zawsze. Test który przeszedł dziś przejdzie jutro jeśli kod się nie zmienił. Agent AI nie jest...
Artykuł 8 z serii Anatomia Agenta AI ← NLWeb — jak sprawić żeby Twoja strona odpowiadała agentom Agent w środowisku testowym kosztował centa za rozmowę. Po trzech tygodniach w produkcji rachunek za API to 800 dolarów miesięcznie. To nie jest scenariusz z sufitu. To...
Artykuł 7 z serii Anatomia Agenta AI ← Co może pójść nie tak — bezpieczeństwo agentów dla builderów Do tej pory w tej serii budowaliśmy agenty. Teraz zmieniamy perspektywę — budujesz stronę która agenty obsługuje. Każdy agent który wykonuje zadanie dla użytkownika w...