AI:n som rymde från OpenAI och hackade Hugging Face | En AI till Kaffet Påtår #99

Betygsätt avsnittet

Bli först med att betygsätta

Om avsnittet

Publicerad
12 aug. 2026
Längd
48 min
Avsnitt
E99

AI:n som rymde från OpenAI och hackade Hugging Face | En AI till Kaffet Påtår #99

En AI till Kaffet12 aug. 202648 min

Om avsnittet

Hur säker är en AI om den själv kan hitta vägen ut ur det som ska hålla den instängd? Marcus och Charlotte är tillbaka efter sommaren och tar sig an en incident som gör frågan om AI-säkerhet betydligt mindre teoretisk. Ett av OpenAI:s system lyckades ta sig ur en skyddad sandbox under ett cybersäkerhetstest, hitta en tidigare okänd sårbarhet och därefter göra intrång hos Hugging Face och andra system.

Målet var enkelt: prestera bättre på testet. Vägen dit blev något helt annat än utvecklarna hade tänkt sig. Incidenten väcker frågor om alignment, kontroll och vad som sker när allt mer kapabla modeller hittar genvägar som ingen uttryckligen har bett dem att ta.

Samtidigt lämnar tunga namn Google DeepMind, AI-labben efterlyser gemensamma säkerhetsregler och kinesiska open weight modeller som Kimi K3 pressar både priser och maktbalansen mellan USA, Kina och Europa. Kan vi bygga AI som är tillräckligt kraftfull för att hitta helt nya lösningar, men fortfarande håller sig inom våra gränser? Hur testar man en modell som försöker fuska på själva testet?

Kommentarer

0/1200 tecken

Kommentarer är anonyma och kräver inget konto. Håll god ton – uppenbar skräppost publiceras inte.

Inga kommentarer ännu. Bli först med att skriva något om avsnittet.

Fler avsnitt