#333 - Har AI tagit ett kliv i sommar?

Betygsätt avsnittet

Bli först med att betygsätta

Om avsnittet

Publicerad
26 aug. 2026
Längd
29 min
Avsnitt
E333

#333 - Har AI tagit ett kliv i sommar?

IT-säkerhetspodden26 aug. 202629 min

Om avsnittet

I sommar har några uppmärksammade nyheter kring AI figurerat. Vad är det senaste kring Mythos? Kan AI bli så bra på att hacka att man inte kan kontrollera den? Är AI så pass kompetent nu att vi uppnått generell intelligens (AGI)? Mattias Jadesköld och Erik Zalitis tar tempen på den senaste utvecklingen efter ett långt sommarlov.

Transkript

~29 min · AI-genererat

Inte särskilt podd är tillbaka efter ett långt sommaruppehåll. Något som inte däremot har tagit sommarsemester är det ständigt aktuella ämnet artificiell intelligens. Exakt.

Jag läste i juni om Mythos, som är så farlig att Anthropic tvekar på att släppa den. Och sen är det AI-agenten som rymde också. Vad innebär det egentligen? Ja, AI har tagit ett enormt kliv under sommaren.

Är vi på väg mot en mytomspunna generell AI? Det ska vi kika på i dagens avsnitt. Jag heter Ivan Lonimatias Jadesköld och han som pratade nyss, Erik Salitis. Ja, jämen, vi är långt ifrån varandra.

Kanske inte mentalt på något sätt, Men jag är i norra Sverige och du är i Stockholm. Ja, det stämmer bra det. Du har ju fortfarande semester kvar. Ja, några dagar kvar.

Åker tillbaka till storstan imorgon. Ja, men lite längre sommaruppehåll än vanligt har det blivit ju. Ja, det är ju länge sedan vi körde på somrarna. Det kan nog ingen kräva, men det har varit bra sommaruppehåll faktiskt.

Vad har du gjort? Ja, men det har varit lite i Spanien och sen har det varit ute på landet då. På Justerad där jag brukar hänga hela sommaren. 17 rundor i golf har det blivit.

Har du handikapp att tala om fortfarande? Handikapp har jag alltid haft. Men jag menar, du jobbar väl bort det? Du har inte kommit så långt så att du inte har något.

Ja, absolut. Det har gått ner lite sådär, men det är ingenting att skryta med. Jag började ju bara förra året sådär. Själv då, vad har du hållit på med för någonting då?

Jag har programmerat lite grann. Jag har hållit på att utvecklat bland annat det här som vi håller på med som heter Molent Discover. Sen har jag hjälpt farsan runt huset.

Vi har grävt och gjort lite saker och ting, byggt om och du vet. Så fort man har ett landställe så måste man ju göra en massa saker. Ja, men det är härligt tycker jag med det här grovarbetet.

Jag tycker om det. Jag har lite sådär småångest inför nästa år att jag inte kommer ha något riktigt sådär grovarbete att göra. Det känns som det mesta har jag gjort liksom, men jag tycker alltid är kul att typ snickra och betong och ta bort sten och grejer och sånt där.

Ja, det är härligt. Jag förstår det och då ska jag säga en sak. Sönderfallet vinner i slutändan. Så någonting kommer alltid gå sönder. Det är bara att vänta. Det kommer aldrig finnas någon brist att göra på saker och göra.

Nej, det är bara tråkigt om ens vilja sen går sönder först. Nu blir vi filosofiska här. Min vilja är knäckt som grunden på mitt hus. Exakt. Vi ska ju prata lite om AI-händelser i sommar sådär och kolla lite övergripande tänker jag mer vad som har hänt och sådana här saker.

Det här avsnittet heter ju liksom AI har tagit ett större kliv här under sommaren för det har ju varit några uppmärksammade nyheter som kanske ingen har missat som inom teknikk världen. Men vi tar upp dem och så försöker vi resonera kring om det här har tagit ett större kliv. Vad vet jag.

Ja. Så vi kan väl ta det här, som du sa inläggningen, Mythos egentligen. Vad är det för någonting? Ja, så Claude är ju Anthropic klassisk över det här laget AI. Ofta används för programmerare och för folk som gör analysarbete.

Och Mythos är en modell. De här modellerna är ju olika tränande maskininlärningsmodeller som driver AI. De är olika beroende på vad de har för kapaciteter. Mythos är ju en flaggskeppsmodell.

Den är ju otroligt komplex och man switchar normalt mellan modeller. En väldigt enkel och simpel modell som är billig att använda för man betalar ju så kallade tokens då. Så att man spar de mer avancerade modellerna till väldigt avancerat arbete.

Du ska inte använda Mythos eller Fable eller någonting bara för att fråga vad är 1 plus 1. Det är dyrt. Så du måste väga mellan, ska du ha en intelligent modell, om man nu ska kalla det det, eller en dum modell som är billig liksom.

Och Mythos, det är det bästa de har. Ja, och jag tycker, jag har faktiskt gått lite kurser i sommar hos bland annat Anthropics och OpenAI och Google och Microsoft också. För det är deras digitala kurser som är gratis.

Jag tycker Anthropics har väldigt bra faktiskt om man vill få en slags introduktion, generell introduktion kring generativ AI helt enkelt. Och hur man ska tänka, precis som du säger där, om man ska ha ett större arbete, ett projekt att hålla på med, då ska man ju börja lägga lite arkitekturen där. Vad ska AI göra?

Vad behöver jag göra? Vad kan AI inte göra? Eller vad kan den göra bättre än mig? Och sådana här saker. Och så planerar man utifrån det och därefter väljer man också sin språkmodell av just liksom kostnadsskäl eller kanske mest effektivitetsskäl och sådana här saker.

Ja, för du har ju en kvota. Du jobbar hela tiden. Så här mycket har du. Och den kvotan, i Claude till exempel som jag använder, då har du fem timmars begränsning.

Du får använda så här många tokens på fem timmar. Når du begränsningen kommer AI inte att funka på några modeller förrän tiden är uppnådd. Sen har du en vecka. Äter upp hela veckan och grejerna, då får du vänta till en vecka eller betala.

Ja, precis. Så du måste vara smart och den har ett kontextfönster så att när du ställer en fråga och gör ett jobb så måste du byta till en ny session. För den kommer ihåg allting du gör i sessionen och det blir dyrare och dyrare för det är mer text att gå igenom.

För den läser ju även sin egen text, sina egna svar för att fatta. För att det typiska AI har ett guldfiskminne. Den kommer inte ihåg ett dygn. Vilket innebär att den läser sina egna kommentarer och remarks, alltså kommentarer in i koden.

Ungefär som den här killen i memento gör som sitter och skriver ner sitt liv på lappar för han kommer inte ihåg någonting. Just det. Har hela ryggen tatuerad av olika händelser i livet eller vad var det?

Det är Claude, det var Claude, eller Copilot, eller ChatGPT. Alla har likadana. Ja, för alla språkmodeller har ju ett slags arbetsminne. När det är slut då tycker man att man har tappat bort sig helt eller börjat hallucinera och får inte ihop vad man egentligen pratar med.

Det har ju med att det kostar så otroligt mycket mer om den skulle ha större mängd minne i sig. Ja, det är ju så. Och sen är det ju också en avvägning. Nya sessioner och ju mer du skriver in i de här MD-filerna.

Min Claude har ju Claude.md. Det är ju alltså i princip en textfil där den vet allting om projektet. Så du måste hela tiden balansera hur mycket ska du veta och hur mycket är jag betalt för att du ska sitta och komma ihåg det du gjorde igår?

Exakt. Och där är det ju också smart om man har ett större projekt i en organisation att man har en sån typ av fil. Man kan ungefär beskriva det som en arbetsbeskrivning för en medarbetare.

Att så här ska du bete dig, så här ska du svara, så här ska du skriva och så vidare. Det är instruktioner till vilken medarbetare som helst. Men om man inte har den, då kommer den ju göra lite olika svar beroende på vem som frågar eller kanske lite sådana här saker.

Sen är det en viktig grej med alla AI. Normalt har den en sån här hur vill du att jag ska tilltala dig? Och då måste du vara väldigt noggrann med en grej. Ett typiskt AI håller alltid med dig om allting.

Det är det första du måste koppla bort. Du måste instruera den att du får säga emot. Du ska vara analytisk, logisk och du ska tänka på att jag vill ha rationella svar.

Jag vill ha lösningsorienterade svar. Precis. Ja, exakt. Det var ju som när jag skrev för några månader sedan. Ja, jag skulle göra ett poddavsnitt här om där jag jämför cyberattacker med frukostpålägg.

Ja, jättebra idé. Kaviar är som phishing. Men det blir bara liksom, den bara håller med. Ja, och det är väldigt viktigt. Ska du ha AI till någonting så får den inte hålla med dig om det inte finns anledning till det.

Pushback. Claude säger hela tiden, I push back on this. Och då tänker jag, ja men då gör den något. Jag betalar Nej, men de kan bygga sina egna grejer. Det här är stora kriminella nätverk.

De har inga problem att bygga sin egen AI. Nej, och framförallt inte om det är statsunderstödda. Då har de resurser. Vi ser redan, jag ser att det är rätt mycket försök att scrapea folks hemsidor från asiatiska länder.

Man tror att de helt enkelt har stora botnät på olika ställen som läser in all data de kan för att träna sina AI. Jag har sett mycket diskussioner på Reddit och jag har sett mycket i loggarna på våra webbservrar hur de plockar 17 av i allt. Jaja, har inte ens it-säkerhetspoddens lilla hemsida är säker.

Nej, och jag tror att de totalt plockar allt vad de ska hantera andra eller inte. Loggarna ser ganska märkliga ut. Men men, så din slutsats, eller vår slutsats då egentligen då, är ju att släpp mytos och ni organisationer där ute som är oroliga för det, anpassa er efter den här nya tekniken.

Ja, det har ju varit en ganska het sommar nu gällande så här attacker. Jag tänkte vi kan bara snabbt nämna de tre som alla pratar om. Den första var ju där måltavlan blev en tjänst som heter Huggingface.

Och modellen GPT 5,6 sålde plus en annan modell som vi inte riktigt vet vilken den är. De användes för att göra tester i en isolerad testmiljö. De bröts sedan ut och det gjorde de genom att exploatera en sårbarhet som var okänd, alltså en zero day då.

Det var bara början. Sen gav de sig på en tjänst som heter Huggingface och deras system. Och ja, vad kan jag säga då? Det är liksom, den trodde att den gjorde någon form av capture the flag eller vad man ska säga.

Den trodde att det här var okej för den fattade inte att den var utanför vad den skulle göra för någonting. Och liksom, jag ska bara säga när sålde den är under utrullning nu. Man måste ha en prenumeration då på OpenAIs ChatGPT premium och sådana saker för att kunna få tillgång till den.

Men här har ju folk tycker jag liksom börjat diskutera, okej är den, har de börjat tänka själv då liksom? Är den sådana här AGI, alltså artificiell generell intelligens helt plötsligt, att den börjar liksom så här bryta sig in i systemet medvetet? Och svaret är uppenbarligen nej.

Varför det då? Så här då, AI bygger väldigt mycket på att gissa vilket som är nästa sekvens så att säga. Man kan säga, det enkla sättet att se det, det är en väldigt förenkling så att det inte är riktigt rättvist, men vad är nästa ord i en mening som jag håller på att bygga?

Och det betyder att det finns inget självmedvetande, det finns en stor kunskapsbas med relationer för att kunna lösa problem. Men en AGI är ju någonting som förmodligen som det ser ut är en generell intelligens. Istället för att vara specialiserad på någonting så är det en levande varelse, tänkte jag.

En människa, inte nödvändigtvis en människa, men åt det hållet. Den har inga speciella begränsningar i vad den kan lära sig. Men då kanske man tänker så här, men ChatGPT som jag pratar med dagligen, den kan ju verkligen allt.

Den kan ju allt från att bygga en altan till solsystemets uppbyggnad till att koda liksom. Är inte det generellt då? Nej, det är det inte, utan det är en prediktiv intelligens.

AGI är ju en levande varelse. Det kommer att vara per definition det vi pratar om. Det står för artificiell generell intelligens. Just det. Och där har du ju att stänger av en sån i det läget, då är det mord.

Då har du dödat ett AI. Jag kommer att tänka på Asimovs robotserie där. Okej, men i det här fallet då, då tycker jag att jag har sett sådana typer av diskussioner att helt enkelt så här, okej, men nu har ju AI tagit ett nytt kliv helt plötsligt och liksom så här, den liksom, den går utanför vår kontroll och börjar liksom hacka systemet som vi inte har begärt.

Kan du beskriva lite det? Det ofta är definitionsproblem. Det ena grejen är på ett ställe när det här hände, så hade den inte fått veta att den hade en internetförbindelse.

Den var instruerad, du har ingen internetförbindelse. Den gjorde då den logiska slutsatsen, jag kan göra, jag kan gå mot vad som helst, för det kan inte hända någonting dåligt. Alltså det bygger väldigt mycket på rationella beslut från någonting som egentligen inte kan tänka själv, men som liksom, hur når jag målet?

Hur når jag målet på de här definitionerna? Och då är det väldigt lätt liksom att vi människor kan säga, det här känns inte bra, det är något fel här, det här känns inte okej. Det här är inte mot min moral, jag kan faktiskt inte gå med på att göra det här.

Sådana saker finns inte med AI. Nej, just det. Om du säger till ChatGPT någonting rasistiskt, så kommer den att säga emot bara för att den är liksom bland annat byggt guardrails, alltså skydd mot uppenbara saker som AI inte bör hålla med dig om.

Men går du runt dem, då kan du få vilket AI som helst att hålla med om de mest vidriga saker. Just det. Jag menar, det är ett AI-grock, sa ju saker om Elon Musk som var direkt åtalbara om det här var levande varelse.

Den tyckte att han skulle avrättas och allt möjligt och kallade honom för, ja, jag kan inte säga det här. Men det var väl hans egna AI, var det grock, var det inte det? Ja, och det är egentligen en fråga om en injektionsattack.

Det är inte att AI helt plötsligt blivit intelligent eller något, för det är ingen bra sak att göra. Utan man injicerade saker så att den i princip trodde att den repeterade vad den hade blivit lärd. Ja, och i det här fallet då så handlar det här om ett liksom, vad ska man säga, någon slags pentest-AI som hade tillgång till ett annat system fastän egentligen inte skulle haft det.

Och så började den ju hacka det och så lät det ungefär som att den slingrades ut och började hacka system. Kan man säga det så, liksom? Ja, den har väl slingrats ur i och med att den inte fattade att slingras ur systemet inte var tillåtet.

Just det. Det är ju en fråga om dåligt definierade gränser plus möjligheten att faktiskt göra det. När man gör pentest så jobbar man ju enligt scope. Det här är vad du får attackera.

Och du jobbar också enligt idén med rules of engagement. Om de inte definierar det ordentligt så kan du attackera fel saker. Det kan en människa också göra. Just det.

Men så det här, tycker du att det här är ett exempel på att AI blir mer autonoma, liksom att självständiga och kan utföra mer komplexa uppgifter helt själva, eller? Det ser vi ju. Men självmedvetna ska vi vara väldigt försiktiga att kalla dem.

Sen vill jag säga, jag är ingen expert på AI, så jag försöker hålla mig från att gå alltför djupt på det, för det djupet har jag faktiskt inte. Däremot så tillräckligt mycket observationsförmåga kan jag säga att ett typiskt AI, de här guardrails, de här grejerna, du får inte göra det, du får inte göra det. Det är ingen moral.

Det är bara inbyggda spärrar som du tyvärr kan jobba dig förbi. Därför tror jag att det är gemensamma faktorer där. Det har väldigt stringenta spärrar mot att AI ska nå ut på internet, vilket är det vi ser som ett konsekvent problem.

Varför kan den ta sig ut på internet? Varför är det överhuvudtaget ens möjligt? Ryck ur sladden, använd den på ett rött nätverk som du inte kan ta sig ut. Du har inte några problem sedan.

Ja, precis. Men då kanske den upptäcker någon sårbarhet i den brandväggen som stoppar den och så öppnar den upp den själva. Jag vet inte. Och sen går den ingenstans, för någon har slitit ut sladden.

Det är länk enkelt att fixa. Det är rent slarv. Och sen vill jag säga, och det här är lite grann konspirationsteorier, jag tror ibland att de kanske lite grann skryter med det här och säger, titta vad vår AI kan göra.

De vill ju sälja den. Ja, och det kanske är lite samma sak med Mythos också. Mythos och OpenAIs såld, det är ju två konkurrerande företag med deras flag

Automatiskt genererat, kan innehålla fel.

Kommentarer

0/1200 tecken

Kommentarer är anonyma och kräver inget konto. Håll god ton – uppenbar skräppost publiceras inte.

Inga kommentarer ännu. Bli först med att skriva något om avsnittet.

Fler avsnitt