5 maj 2026
38 min
I avsnitt 153 pratar Erik och Dick om hur man bygger och kvalitetssäkrar AI-agenter. Med exempel på hur chatbotar kan “luras” går de igenom vad evaluations (evals) är, hur LLM-as-a-judge fungerar och hur företag använder detta för att förbättra sina AI-system över tid. De diskuterar också feedbackloopar, skillnaden mellan offline och online-utvärdering samt varför human in the loop fortfarande är avgörande. Ett avsnitt för dig som vill förstå hur AI-produkter fungerar bakom kulisserna
Lyssna på fler avsnitt från
Agilpodden
Visar 1–10 av 243 avsnitt
25 juni 2026
55 min
20 april 2026
32 min
2 april 2026
52 min
2 mars 2026
74 min
12 februari 2026
26 min
4 februari 2026
41 min
16 december 2025
59 min
1 december 2025
52 min
13 november 2025
43 min
23 oktober 2025
30 min