
Betygsätt avsnittet
Bli först med att betygsätta
Om avsnittet
- Podd
- Agilpodden
- Publicerad
- 5 maj 2026
- Längd
- 38 min
153. Kan man lura AI? – Evaluations och LLM-as-a-judge
Om avsnittet
I avsnitt 153 pratar Erik och Dick om hur man bygger och kvalitetssäkrar AI-agenter. Med exempel på hur chatbotar kan “luras” går de igenom vad evaluations (evals) är, hur LLM-as-a-judge fungerar och hur företag använder detta för att förbättra sina AI-system över tid. De diskuterar också feedbackloopar, skillnaden mellan offline och online-utvärdering samt varför human in the loop fortfarande är avgörande.
Ett avsnitt för dig som vill förstå hur AI-produkter fungerar bakom kulisserna
Kommentarer
Inga kommentarer ännu. Bli först med att skriva något om avsnittet.
Fler avsnitt
- 156. AI-agenter som förändrar jobbet med David Wallén från Intric7 sep. 2026 · 59 min
- 155. 10%+ risk att AI utrotar mänskligheten och vi fortsätter ändå!14 aug. 2026 · 1 h 1 min
- 154. GoClimate om 6-timmarsdag, cirklar och klimatnytta.25 juni 2026 · 55 min
- 152. Agil AI-organisationsdesign20 apr. 2026 · 32 min
- 151. Dumhetsparadoxen – varför smarta organisationer gör så dumma saker2 apr. 2026 · 52 min
- 150. Berget AI med Christian Landgren2 mars 2026 · 1 h 14 min
- 149. Agila AI-agenterna - OpenClaw12 feb. 2026 · 26 min
- 148. Agila året 2026 & Claude4 feb. 2026 · 41 min