
Betygsätt avsnittet
Bli först med att betygsätta
Om avsnittet
- Publicerad
- 12 aug. 2026
- Längd
- 48 min
- Avsnitt
- E99
AI:n som rymde från OpenAI och hackade Hugging Face | En AI till Kaffet Påtår #99
Om avsnittet
Hur säker är en AI om den själv kan hitta vägen ut ur det som ska hålla den instängd? Marcus och Charlotte är tillbaka efter sommaren och tar sig an en incident som gör frågan om AI-säkerhet betydligt mindre teoretisk. Ett av OpenAI:s system lyckades ta sig ur en skyddad sandbox under ett cybersäkerhetstest, hitta en tidigare okänd sårbarhet och därefter göra intrång hos Hugging Face och andra system.
Målet var enkelt: prestera bättre på testet. Vägen dit blev något helt annat än utvecklarna hade tänkt sig. Incidenten väcker frågor om alignment, kontroll och vad som sker när allt mer kapabla modeller hittar genvägar som ingen uttryckligen har bett dem att ta.
Samtidigt lämnar tunga namn Google DeepMind, AI-labben efterlyser gemensamma säkerhetsregler och kinesiska open weight modeller som Kimi K3 pressar både priser och maktbalansen mellan USA, Kina och Europa. Kan vi bygga AI som är tillräckligt kraftfull för att hitta helt nya lösningar, men fortfarande håller sig inom våra gränser? Hur testar man en modell som försöker fuska på själva testet?
Kommentarer
Inga kommentarer ännu. Bli först med att skriva något om avsnittet.
Fler avsnitt
- Anders Sandberg: Risken att AI utplånar mänskligheten är omkring 10% | En AI till Kaffet #10416 sep. 2026 · 1 h 48 min
- Valspecial: ChatGPT 6 Astra skakar om politiken precis inför valet | En AI till Kaffet Påtår #1039 sep. 2026 · 40 min
- Elias Malm: Self-Learning AI Is Already Marketing Brands Fully Autonomously // Självlärande AI marknadsför redan varumärken helt autonomt | En AI till Kaffet #1022 sep. 2026 · 47 min
- Kan Sverige bli Europas AI-makt? | En AI till Kaffet Påtår #10126 aug. 2026 · 31 min
- José González: Tänk om AI får oss att börja sjunga tillsammans igen? | En AI till Kaffet #10019 aug. 2026 · 1 h 1 min
- Anders Hansen: AI kan hacka hjärnans akilleshälar | En AI till Kaffet #985 aug. 2026 · 44 min
- Patrick Couch: “Snacka inte om AGI förrän vi kommer ned till 100W” | En AI till Kaffet #9729 juli 2026 · 1 h 21 min
- Sten Friberg: Kan ChatGPT förstärka en psykos? | En AI till Kaffet #9622 juli 2026 · 57 min