153. Kan man lura AI? – Evaluations och LLM-as-a-judge

Betygsätt avsnittet

Bli först med att betygsätta

Om avsnittet

Publicerad
5 maj 2026
Längd
38 min

153. Kan man lura AI? – Evaluations och LLM-as-a-judge

Agilpodden5 maj 202638 min

Om avsnittet

I avsnitt 153 pratar Erik och Dick om hur man bygger och kvalitetssäkrar AI-agenter. Med exempel på hur chatbotar kan “luras” går de igenom vad evaluations (evals) är, hur LLM-as-a-judge fungerar och hur företag använder detta för att förbättra sina AI-system över tid. De diskuterar också feedbackloopar, skillnaden mellan offline och online-utvärdering samt varför human in the loop fortfarande är avgörande.

Ett avsnitt för dig som vill förstå hur AI-produkter fungerar bakom kulisserna

Kommentarer

0/1200 tecken

Kommentarer är anonyma och kräver inget konto. Håll god ton – uppenbar skräppost publiceras inte.

Inga kommentarer ännu. Bli först med att skriva något om avsnittet.

Fler avsnitt