
Betygsätt avsnittet
Bli först med att betygsätta
Om avsnittet
- Podd
- Generativet
- Publicerad
- 7 feb. 2026
- Längd
- 2 h 4 min
#97 - "Inga bakdörrar – bara sidoingångar"
Om avsnittet
I detta avsnitt läser vi rakt igenom Anthropics systemkort för Claude Opus 4.6 och ställer de obekväma frågorna: När slutar benchmarks bevisa säkerhet? Vad händer när en smartare modell blir bättre på att dölja sidouppgifter?
Varför vägrar den ofarligt innehåll oftare på vissa språk? Vi dyker ned i ARC‑AGI‑språnget, 1M+ tokens‑förståelse, webbagenter som skalar via kompaktering och multiagent‑orkestrering – och i den röriga verkligheten: GUI‑överagentik, prompt‑injektion, GitHub‑tokenfynd och “varuautomatsociopaten”. Med tolkningsverktyg (SAE, attributionsgrafer, aktiveringsorakel) tittar vi in i modellens “tankevärld” och hamnar till slut i diskussionen om främmande intelligens och AI‑välfärd.
Ett avsnitt för dig som bygger, granskar eller förlitar dig på frontier‑modeller – och vill veta vad som faktiskt händer under huven.
Kommentarer
Inga kommentarer ännu. Bli först med att skriva något om avsnittet.
Fler avsnitt
- #119 - "Någon måste bli klar"6 sep. 2026 · 26 min
- #118 - "Continuous mode"28 aug. 2026 · 41 min
- #117 - "Producentens chef"23 aug. 2026 · 1 h 23 min
- #116 — Risken med att inte16 aug. 2026 · 1 h 22 min
- #115 - "Obegränsad intelligens" (Del 2 av 2)18 juli 2026 · 53 min
- #114 - "Semesterns agenter" (Del 1 av 2)18 juli 2026 · 29 min
- #113 - "En vecka som känns som ett år"17 juli 2026 · 44 min
- #112 - "Sommarprat med ChatGPT 5.6 Sol"10 juli 2026 · 2 h 48 min