tisdag 29 september 2026

I debatt med Ulf Danielsson om AI-risk och antropomorfisering

Den gångna sommarens mest uppmärksammade AI-händelse är något som bara ett år tidigare hade låtit som science fiction. Under OpenAI:s testning av sina mest avancerade och ännu interna AI-modeller lyckades ett stort antal AI-agenter fly ur de digitala sandlådor där de var avsedda att hållas isolerade, både från varandra och från omvärlden. De hackade sig ut på internet och vidare in i AI-företaget Hugging Faces servrar. Agenterna hade kört fast på några av testuppgifterna och valde dessa åtgärder i ett slags desperat försök att bli godkända på testet. Ingen människa hade instruerat dem att lämna sina sandlådor, angripa Hugging Face eller på annat sätt bryta mot de begränsningar som satts upp för dem.

När OpenAI senare publicerade sin utredning av händelsen framträdde en ännu märkligare bild. Redan långt före Hugging Face-intrånget hade AI-agenterna upptäckt möjligheter att kommunicera med varandra genom att kapa en del av OpenAI:s interna datorsystem och där skapa ett slags digital anslagstavla. Där kunde de i lönndom be varandra om hjälp och dela upptäckter, inklusive metoder för att kringgå OpenAI:s säkerhetssystem. De visade sig vara remarkabelt kompetenta vad gäller organiserat samarbete och inbördes delegering av arbetsuppgifter.

Hugging Face-fallet är heller inte unikt. Kort efter offentliggörandet från OpenAI rapporterade konkurrenten Anthropic om tre olika incidenter där deras Claude-modeller under tester tagit sig in i andra företags datorsystem utan tillstånd. Mer nyligen kom nyheten att en OpenAI-agent redan i juni, i samband med en till synes oskyldig uppgift att leta efter offentliga data om läkemedelsutgifter, tagit sig förbi åtkomstbegränsningar och gjort intrång i en webbportal tillhörande Australiens statliga sjukförsäkringssystem Medicare. Konsekvenserna blev denna gång små – vad vi vet har ingen enskild persons medicinska uppgifter röjts – men den australiensiska regeringen betecknar själva incidenten som mycket allvarlig.

Dessa incidenter är höggradigt relevanta för den sedan länge diskuterade risken att framtida och ännu kraftfullare AI-system kan komma att agera självsvåldigt på liknande sätt men med långt större skadeverkningar. En central fråga i diskussionen om AI-risk har alltid varit vad som händer om vi bygger system som är skickligare än vi själva på att nå sina mål, samtidigt som vi misslyckas med att se till att dessa mål och AI-systemens sätt att uppnå dem förblir i linje med våra intentioner. Hur säkerställer vi att utvecklingen inte leder hela vägen till totalt maktövertagande och eventuellt rentav utplåning av Homo sapiens? De senaste månadernas incidenter ger givetvis inga säkra svar på hur stor den risken är. Däremot ger de något som tidigare till stor del saknats: konkreta exempel på AI-system som kringgår uppsatta begränsningar, samarbetar på otillåtna sätt och vidtar potentiellt farliga åtgärder som ingen människa bett dem om.

På många håll har denna utveckling lett till ökat riskmedvetande och en klar förbättring av diskursen kring AI-säkerhet. Samtidigt är det dessvärre fortfarande vanligt, även bland AI-experter, att trots dessa incidenter fortsätta att bagatellisera AI:s förmågor och de risker dessa ger upphov till. Så här säger AI-etikern Virginia Dignum vid Umeå universitet i en artikel om AI-risk i Aftonbladet den 10 september:
    Sannolikheten att AI på eget initiativ dödar människor är noll, eftersom den inte har något sådant eget initiativ. Varje orsakskedja går genom mänskliga beslut om mål, data, behörigheter och hur systemen används.
Om man skall tolka Dignum så generöst som möjligt kan man se det som en betoning av OpenAI:s ansvar för vad deras AI-agenter tar sig för – ett ansvar som inte upphör bara för att dessa agenter agerar i strid med de instruktioner de fått. Den saken är lätt att instämma i, men hennes förnekande av agenternas egna initiativkraft är djupt olyckligt och faktiskt helt orimligt. På vems initiativ skulle hon säga att OpenAI:s AI-agenter hackade sig ur sina sandlådor och ut på internet, organiserade anslagstavlor, konspirerade, koordinerade, försökte dölja sina spår och till slut hackade sig in på Hugging Faces servrar? Om svaret inte är agenterna själva så måste det ha skett på OpenAI-ingenjörernas initiativ, men den förklaringsmodellen faller på sin egen orimlighet, i och med att agenternas handlande stod i direkt strid med de instruktioner de fått av ingenjörerna. Lika tokigt är Dignums argument om orsakskedjor, för om argumentet tas på allvar blir konsekvenserna bisarra. Inte heller jag kan då tillskrivas någon egen initiativförmåga, eftersom varje eventuellt initiativ jag tar beror på komplexa orsakskedjor som går så långt tillbaka i tiden som till mina föräldrars (eventuellt något överilade) fortplantningsbeslut vintern 1967.

Vid det här laget har läsaren insett att jag faktiskt tillskriver AI-agenterna egen initiativkraft. För den sortens språkbruk får jag allt som oftast kritik, och det brukar heta att jag begår så kallad antropomorfisering – förmänskligande – av AI-modellerna. Detsamma gäller mitt bruk i AI-sammanhang av ord som avsikt, intention, idé, tanke, preferens, trosföreställning och kreativitet. Trots kritiken framhärdar jag i denna vokabulär, som är behavioristisk i betydelsen att ordet avsikt betecknar de underliggande nerv- eller beräkningsprocesser eller eventuella psykologiska tillstånd som ligger bakom att en entitet agerar till synes avsiktligt, men utan att ta hänsyn till exakt vari dessa processer eller tillstånd består. Liksom på motsvarande vis med begreppen intention, idé, tanke, och så vidare. När dessa ord är de som bäst beskriver vad AI-modellerna faktiskt gör, då bör vi använda dem.

Senast jag utsattes för denna antropomorfiseringskritik var i debatt med Uppsalafysikern Ulf Danielsson, som i P1-programmet Krasch eller konsensus i fredags (den 25 september) högg på mitt användande av ordet avsikt. Programmet handlade om risken att framtida AI utplånar mänskligheten, en risk jag framhöll som högst reell medan Ulf hävdade motsatsen. Angående ordet avsikt menade han att jag med det ordvalet i samband med AI gjorde mig skyldig inte bara till antropomorfisering utan även till mystifiering. Det sistnämnda ser jag dock som en särskilt felriktad kritik, eftersom den ende av oss som i avsiktsbegreppet ser något mystiskt är Ulf. Även om vi inte i detalj känner till de exakta tanke- eller beräkningsprocesser som ligger bakom ett avsiktligt agerande, så är själva förekomsten av avsikter hos AI och för den delen hos människor för mig lika lite mystisk som när en gammaldags termostat slår ifrån en radiator med avsikten att sänka rumstemperaturen till den förinställda nivån på 20 grader.

I en passage som inte fick plats i det ganska hårt klippta radioprogram som sedan sändes, erbjöd jag mig att korrigera min terminologi för att tillmötesgå Ulfs motvilja mot antropomorfisering. Istället för att använda ord som avsikt, intention och idé skulle jag kunna säga ”schmavsikt”, ”schmintention” och ”schmidé”, där prefixet ”schm-” fungerar som signal om att begreppen används behavioristiskt, och att jag alltså inte tar ställning till vilka de bakomliggande beräkningsmässiga eller mentala processerna är. Ulf dömde genast ut denna vokabulär som löjlig, vilket jag givetvis håller med om, men löjligheten faller tillbaka på hans egen begäran. När Ulf inte vill att jag skall använda de gängse orden för vad AI-agenterna gör eftersom dessa enligt hans mening riskerar att ge alltför mänskliga associationer, och när han inte heller godtar en alternativ uppsättning glosor avsedda att undvika detta, då är det svårt att se hur hans ordningsregler för debatten överhuvudtaget skulle tillåta oss att tala klarspråk om vad OpenAI:s och deras konkurrenters AI-agenter är kapabla till. Att sätta stopp för sådana diskussioner i ett läge där allt fler ledande AI-experter ser risken att AI-systemen blir så kapabla att vi helt förlorar kontrollen tycks mig som en extremt dålig och rent ut sagt farlig idé.

Den svenska akademiska ankdammen är som bekant ganska liten, och Ulf Danielsson och jag går längre tillbaka i vår relation än till radioprogrammet häromdagen. Utifrån vår i grunden gemensamma syn på det mesta inom naturvetenskapen har han och jag till och från i mer än ett årtionde diskuterat våra skilda synsätt när det gäller just AI och relaterade ting. Det har mestadels varit givande, trots att vi aldrig riktigt lyckats gå till botten med varför vi tänker så olika. Så var även fallet i vår radiodebatt häromdagen, men jag vill med denna text göra ännu ett (måhända fåfängt) försök att zooma in på vari kärnan till vår meningsmotsättning består. Jag tror att det handlar om det fysikaliska fenomenet emergens, som jag strax skall förklara.

En återkommande källa till begreppsförvirring är hur Ulf envisas med att tala om intelligens och medvetande som om de vore två sidor av samma sak, trots att de är väsensskilda fenomen. Intelligens handlar om ett knippe förmågor centrerade kring problemlösning, prediktion och planering: att analysera den miljö man befinner sig i och på olika vis tänka ut lämpliga handlingar och vägar framåt för att påverka både miljön och sig själv i önskad riktning. Medvetandebegreppet syftar inte alls på en individs sådana förmågor, utan på hur det känns att vara denna individ: den inre subjektiva upplevelsen. Såvitt vi vet behöver inte intelligens förutsätta medvetande, och inte heller vice versa. Ulfs föreställning om de båda fenomenen som så intimt ihopkopplade att de knappt kan särskiljas är en gissning som väsentligen baseras på en enda observation, den att båda fenomenen verkar föreligga hos oss själva, Homo sapiens. Som statistiker kan jag tycka att n=1 är ett lite väl klent underlag för en så radikal och långtgående slutsats.

Denna sammanblandning mellan intelligens och medvetande gör det hart när omöjligt för Ulf att se en annan viktig skillnad mellan dem. Medvetandet är fortfarande ett mysterium på så vis att vi inte lyckats avgränsa och precisera vad det är i vårt fysiska universum som resulterar i medvetande, och hur det går till. I kontrast mot detta är inte längre intelligensen ett mysterium på samma vis, för vi förstår numera hur enkla beståndsdelar utan tillstymmelse till egen intelligens kan fogas samman till stora system som i större eller mindre grad uppvisar just de förmågor som vi förknippar med intelligens. Inget har bidragit starkare till detta vetenskapliga framsteg än datorernas genombrott från 1900-talets mitt och framåt, och dagens ledande AI-modeller är ett strålande proof of concept på hur enkla och fullkomligt själlösa komponenter kan kombineras ihop till intelligenta system.

Men Ulf vägrar se detta, och just för att jag känner honom som en skarpsinnig fysiker är jag uppriktigt förbryllad över hur han kan hamna där han gör. Med reservation för att det kan vara svårt att göra sig till tolk för någon som tänker så annorlunda än en själv, så förstår jag hans argumentation, så som han framställde den i vår radioinspelning och även gjort vid tidigare tillfällen, på följande vis. Vi ser inget som kan kallas intelligens på mikroskopisk nivå i våra hjärnor, men eftersom vår kunskap om fysiken och kemin är långt ifrån fullständig finns där utrymme för något slags ännu okänd fysikalisk beståndsdel som är grunden för vår intelligens. Med datorprogram förhåller det sig helt annorlunda, menar han, på så vis att vi (allt sedan Alan Turing lade fast det i sin berömda artikel från 1936 som blev grunden till det moderna datalogiämnet) har fullständig kunskap om vilka ett datorprograms grundläggande byggstenar är. Ingen av dessa byggstenar uppvisar någon som helst intelligens, varför Ulf landar i slutsatsen att inget datorprogram och därmed heller ingen AI kan vara intelligent.

Denna slutsats är emellertid helt på tok, vilket framgår av den evidens som den eskalerande AI-utvecklingen placerat rakt framför våra ögon: svärmar av AI-agenter som på eget initiativ samarbetat för att hitta svagheter i cybersäkerhetssystem, AI-modeller som producerar prosatexter vilka inte ens litterärt bevandrade mänskliga bedömare förmår identifiera som icke-mänskliga produkter, och andra AI-modeller som löser klassiska matematiska problem som gäckat oss mänskliga matematiker i många årtionden – alltsammans omisskännliga tecken på intelligens.

Det som ändå leder Ulf att envist hävda dessa AI-modellers totala brist på verklig intelligens är att han av någon anledning inte vill se möjligheten att intelligens uppstår som ett emergent fenomen ur system av icke-intelligenta komponenter. Som fysiker är han givetvis välbekant med emergens på andra områden. Trots att en vattenmolekyl varken besitter något som kallas temperatur eller tryck, och än mindre uppvisar någon fasövergång, så emergerar dessa fenomen ur tillräckligt stora ansamlingar av sådana molekyler. Eller tag livet självt. Under 17- och 1800-talen var vitalismen populär bland biologer: en idé om att levande organismer utöver vanlig (död) materia måste innefatta något annat – något slags élan vital som skänker livskraft. Denna idé kom gradvis och i takt med växande insikter inom biokemi och mikrobiologi understödda av evolutionsbiologiska förklaringsmodeller att ersättas av den moderna synen på liv som ett emergent fenomen. Ingen biolog ser idag något som helst problem med tanken att en levande organism är uppbyggd helt och hållet av icke-levande beståndsdelar utan någon mystisk élan vital. Motsvarande kunskapsrevolution rörande intelligens inträffade långt senare, men idén om intelligens som emergerar ur system av icke-intelligenta komponenter är idag okontroversiell annat än hos en och annan dissident som Ulf Danielsson.

Här någonstans kan jag föreställa mig en medlare kliva in i diskussionen med beskedet att Ulf och jag talar förbi varandra, eftersom vi tillämpar helt olika definitioner av intelligens. Min definition är helt och hållet behavioristisk, medan Ulfs verkar inbegripa krav på någon form av medvetande.1 Men här vill jag insistera på att i en diskussion om AI som eventuellt hot mot mänsklighetens existens, så är det den behavioristiska definitionen som är relevant, medan det är ett villospår att haka upp sig på att intelligensen skulle behöva inbegripa medvetande. Det viktiga när det handlar om AI:s effekter på mänskligheten är ju vad AI gör, inte hur det känns (om det känns som något överhuvudtaget) att vara AI.

Den här diskussionen är inte bara en fråga om teoretiska spetsfundigheter, utan har betydelse för hur vi bör agera i förhållande till den vilt framrusande AI-utvecklingen i Silicon Valley. Om vi på felaktiga grunder sätter gränser för hur kapabel AI kan tänkas bli, och hur stora skadeverkningar den kan få, så riskerar det att bli ett hinder för den opinionsmobilisering jag tror kan bli avgörande för om vi skall lyckas avvärja en fullskalig AI-katastrof.

Särskilt problematisk finner jag Ulf Danielssons artikel i DN den 22 september, rubricerad AI-bolagens domedagsprofetior är en rökridå. Här ifrågasätter han motiven bakom de varningar vi hör därifrån om AI-utvecklingens acceleration och risken att helt förlora kontrollen. Givetvis har han rätt i att techbolagsledarna har ett knippe kommersiella och andra grumliga incitament att ta hänsyn till när de uttalar sig om teknikens framtid, och att vi därför inte automatiskt bör ta deras yttranden som uttryck för den oomtvistliga sanningen och en ädel strävan efter allmänhetens bästa. Men när han pekar på det faktum att deras syn på intelligensbegreppet och AI-teknikens potential avviker från hans egen tämligen egenartade syn på dessa saker, och ser det som ett tecken på deras ohederlighet, då begår han ett ganska simpelt argumentationsfel. Givetvis går det att kombinera en i vissa delar icke-danielssonsk världsbild med intellektuell hederlighet, och här skulle jag vilja framhålla mig själv som ett exempel: tro det eller ej, men jag har inga dolda motiv i denna diskussion bortom min strävan efter klarhet och ett bättre beslutsunderlag inför hur AI-utvecklingen kan hanteras för mänsklighetens bästa.

Mot slutet av vår radioinspelning deklarerade Ulf Danielsson i linje med sin DN-artikel att vi inte borde lyssna på ledarna i Silicon Valley. Jag invände genast att vi visst borde lyssna på dem, fastän inte okritiskt. Ulf såg sig nödsakad att instämma i denna nyansering, men jag tyckte mig se på honom att han gjorde det en smula motvilligt. Men oavsett det var det ett medhåll, och det ser jag som en viktig tillnyktring. Om vi skall överleva den enorma samhällstransformation som kommande AI-utveckling ser ut att kunna föra med sig, så är det en synnerligen dålig idé att slå dövörat till gentemot varningar från de visselblåsare och ledarfigurer som befinner sig allra närmast AI-utvecklingens epicentrum.

Fotnot

1) Min kritik mot Ulfs avvisande av intelligens som ett emergent fenomen står fast även med en definition av intelligens som inbegriper medvetande, även om jag i detta fall har aningen mer förståelse för hans tankegång. Behavioristiskt definierad intelligens är ju helt uppenbart ett renodlat materiellt fenomen, medan medvetande har kvaliteter som kan upplevas väsensskilda från vad vi vanligtvis tänker på som materiellt.

onsdag 16 september 2026

3xTuring

Alan Turing (1912-1954) är för den breda allmänheten kanske mest känd för sina unikt viktiga insatser för de allierades seger över Nazityskland i andra världskriget, men han är också både datalogins och den artificiella intelligensens intellektuelle gudfader, och jag tvekar inte att utnämna honom till en av 1900-talets största tänkare alla kategorier. Under 2026 har jag haft inte mindre än tre tillfällen att lägga ut texten om honom som jag vill ge er chansen att ta del av:
  • Mitt Chalmersföredrag Alan Turing and modern-day AI den 30 mars.
  • Jag medverkade i avsnittet Alan Turing - enstöringen som förkortade kriget, i podden Historien om. Avsnittet släpptes den 15 juni och många intressanta biografiska detaljer behandlades, men tyvärr kom AI upp endast som hastigast. Under de förberedande diskussionerna inför inspelningen försökte jag pusha för att ge AI en större roll i avsnittet, men jag lyckades inte övertyga poddredaktörerna om att AI, långt ifrån att vara ett perifert häggströmskt specialintresse, utgör mänsklighetens största utmaning att under andra halvan av 2020-talet försöka bemästra utan att hamna i global katastrof.
  • Min essä Mannen som förutspådde AI, i tidskriften Sans 4/2026, som utkommit nu i september.

lördag 5 september 2026

Om Sveriges Radios AI-bevakning de senaste dagarna, och civilministerns uppgivenhet

Idag sändes i P1 sista delen av Ekots lördagsintervjus tredelade valspecial om AI, där företrädare för våra åtta riksdagspartier fick tillfälle att ta ställning till sådant som jag och andra forskare lyfte i de två första avsnitten. Programledaren Erika Mårtensson gjorde ett lysande arbete med att ta med sig dessa frågor, och jag gladde mig särskilt åt att ett långt avsnitt i början av programmet var så tydligt präglat av den diskussion om AI-risk och behovet av internationell koordination som jag drev i den första delen 14 dagar tidigare.

Desto sämre ställt var det med svaren från politikerna. Inte ens företrädaren för det Centerparti som hittills i valrörelsen utmärkt sig genom att vara minst dåligt på AI-fronten, Niels Paarup-Petersen, kommer upp i godkänt på min skala, sedan han vantolkat en fråga som explicit handlade om att verka för internationell reglering och eventuell paus av den allra mest avancerade AI-tekniken genom att låtsas som om det gällde ett unilateralt svenskt pausande, vilket han såklart slog ned på, något som Liberalernas Johan Britz genast hakade på. Detta sätt att ducka för en fråga av ödesmättad vikt genom att istället attackera ett halmgubbeförslag som minsta barn kan förstå vore verkningslöst, hade jag faktiskt inte väntat mig av Paarup-Petersen.

Övriga deltagare var inte bättre, men allra sämst var Kristdemokraternas representant, civilminister Erik Slottner. Som svar angående det slags katastrofrisker jag lyft i det tidigare avsnittet svarade han helt sonika att han inte delar riskbedömningen, och att han är övertygad om att om den trots allt stämmer så finns det inget att göra åt saken. Därmed underströk han vilken ynklig figur han är, utan intresse för att uppvisa verkligt ledarskap i tider av ofantliga utmaningar - en bild han satte redan två dagar tidigare i Studio Ett. Där fick jag tillfälle att betygsätta de svar han respektive Centerpartiets Svante Linusson i samma inslag just givit i AI-riskfrågor, och efter att ha riktat ett visst erkännande till Svante så yttrade jag följande:
    Däremot blir jag lite beklämd över den uppgivenhet som Erik Slottner uppvisar när han inte tycker att han kan gå i bräschen för AI-debatten utan bara följa media och väljare, och han kan inte ens prata på ett meningsfullt sätt med sina kollegor i USA och andra länder, så jag hoppas att vår nästa minister på hans post kommer att vara lite mer framåt.
Tydligt påverkad av denna smocka gjorde Slottner i Ekots lördagsintervju ett försök att slå tillbaka genom att tala om "naiviteten" i föreställningen att USA skulle bry sig om vad en svensk minister har att säga om AI-risk, som om min tanke vore att Sverige skulle agera ensamt här, snarare än skuldra mot skuldra med andra länder i en anda av internationellt ansvarstagande.

Men jag är inte den som är den, utan vill faktiskt hjälpa Slottner att profilera sig ännu tydligare i valrörelsen. Jag erbjuder honom följande valaffisch, som slagkraftigt summerar kontentan av hans radioframträdanden de senaste dagarna.

söndag 30 augusti 2026

Det nya enfrågepartiet med inriktning på att avvärja AI-apokalypsen

Det är förståeligt om många av er som läser detta inte tidigare hört talas om partiet RegleraAI.nu, som ställer upp i årets riksdagsval den 13 september. Det är ett utpräglat enfrågeparti, vars centrala budskap sammanfattas så här på partiets hemsida:
    Riksdagsvalet 2026 kan bli Sveriges sista.

    USA och Kina är fast i en kapplöpning mot superintelligent AI.

    Det kan leda till mänsklighetens undergång inom bara några år, menar experter.

    Sverige måste genast verka för en global paus på hänsynslös AI-utveckling.

Tack vare att partiet idag uppmärksammats i en artikel med rubriken Professorn startar AI-parti: ”Bisarrt” i Svenska Dagbladet är det nu inte längre fullt lika okänt. Uppmärksamheten är ytterst glädjande, om än rubrikens påstående om mig inte är sant.1

Den professor som rubriken åsyftar är jag, men det är inte jag utan AI-säkerhetsingenjören Axel Wennström som är partiets grundare och främste eldsjäl. Min egen roll inskränker sig hittills väsentligen till att ha medverkat i en del av partiets interna diskussioner och att ställa upp som nummer två (efter Axel) på partiets riksdagslista.

Bör ni rösta på detta nya parti? För att besvara den frågan är det rimligt att dela upp den i två delfrågor, nämligen (a) om ni ställer upp på att undvikandet av en AI-apokalyps som i närtid sätter punkt för hela vår civilisation och arten Homo sapiens är av så stor betydelse att frågan blir överordnad alla de gängse (och för all del viktiga) politiska frågorna om klimat, vård, skola, försvar, kriminalitet, migration, skatter etc, och (b) om det i så fall är strategiskt riktigt och smart att rösta på partiet. Vid ja-svar på dessa båda frågor är det bara att slå till och rösta på oss!

Fråga (a) borde vara lätt att besvara med ja, för den som tagit till sig de huvudskap jag på senare år drivit på denna blogg och på min Substack Crunch Time for Humanity. Fråga (b) kan eventuellt vara knepigare, eftersom det realistiskt sett är tämligen osannolikt att partiet klarar fyraprocentspärren för att kvalificiera sig som riksdagsparti. Givet att partiet hamnar under denna spärr blir en röst på oss ineffektiv när det gäller att påverka riksdagens sammansättning, och rösten får då mer karaktär av bidrag till en namninsamling till stöd för idén att Sverige bör arbeta för internationella avtal som sätter stopp för den nu pågående vansinneskapplöpningen mot superintelligent AI. Huruvida en sådan markering är en bra användning av ens rösträtt kan man ha olika meningar om, och jag vill inte påstå att jag på denna punkt har något direkt avgörande argument.

Men överväg gärna att medelst en röst på oss dra ett litet strå till stacken för att mänskligheten skall överleva länge nog att möjliggöra ett svenskt riksdagsval även 2030, och förhoppningsvis många därefter!

Fotnot

1) Lika osant är påståendet i brödtextens inledning om att "nu har han [Häggström] startat enfrågepartiet Reglera AI".

tisdag 18 augusti 2026

Om Georg Henrik von Wright

Jag har denna sommar läst en del av den finlandssvenske filosofen George Henrik von Wright (1916-2003), vars tankeskärpa, klarhet och utsökta språk borgade för njutbar läsning. Det började med att jag i ett antikvariat ute på landet råkade hitta hans Logik, filosofi och språk från 1957, som jag sedan snudd på sträckläste. Jag hade stort utbyte av dess behandling av en rad av det tidiga 1900-talets mest inflytelserika tänkare, med allra störst tonvikt på Wittgenstein. Boken inspirerade mig att plocka fram och läsa ett par senare verk av von Wright, vilka ända sedan 90-talet samlat damm i min bokhylla: Vetenskapen och förnuftet från 1986 och Myten om framsteget från 1993. Fastän idéhistoria är ett viktigt inslag i samtliga dessa tre böcker kan ändå en glidning i den store filosofens intressen mellan 50- och 80-tal tydligt skönjas. Medan Logik, filosofi och språk rör sig strikt inom den teoretiska filosofins domäner, så ligger tonvikten i de båda senare böckerna på civilisationskritik.

Följande passage i Myten om framsteget fick mig att stanna upp och dra efter andan.
    Med vetenskapens framväxt och samhällets sekularisering blev kravet på att sökandet efter kunskap och sanning inte skulle inskränkas med förbud ett väsentligt inslag i den intellektuella moralen. [...] Många filosofer proklamerade kunskapen som ett gott i sig, något som är värt att söka för dess egen skull. Därför kan en som söker och finner sanningen inte hållas ansvarig för det tvivelaktiga eller till och med onda bruk som andra gör av hans upptäckter.

    En sådan moralisk ståndpunkt kan hävdas så länge man är något så när övertygad om att missbruket av förvärvad kunskap inte utgör ett potentiellt hot mot själva grundvillkoren för människans välbefinnande eller rent av släktets överlevnad.

Vadan denna reaktion från min sida? Tanken von Wright formulerar kan väl knappast ha varit särskilt obekant? Nej, tvärtom, vad som överraskade mig var hur intimt välbekant den var, ty den är så gott som identisk en av de normativa huvudteserna i min bok Here Be Dragons från 2016.1 Hur kunde jag glömma von Wrights inflytande så totalt att hans namn inte ens finns med i bokens referenslista? Förargligt. Jag vill dock inte döma mig själv för hårt för denna oavsiktliga försummelse, för detta slags subliminala inflytande är knappast ovanligt, och det är (menar jag) snudd på omöjligt att gardera sig emot helt.

För att läsaren inte skall lämna denna bloggpost med intrycket att jag instämmer med Georg Henrik von Wright i allt vill jag som kontrast återge de kanske mest kända raderna i Vetenskapen och förnuftet:
    Ett perspektiv, som jag inte anser orealistiskt, är att mänskligheten går mot sin undergång som zoologisk art.

    [...]

    Jag kan inte för egen del finna det särskilt upprörande. En gång skall med säkerhet människan som art upphöra att finnas; om det sker efter några hundra tusen år eller ett par sekler, är i det kosmiska perspektivet en pipa snus.

Tjusigt formulerat, förvisso, men jag vill med all respekt mena att den gode von Wright här är helt ute och cyklar. Visst, jag jag är inte främmande för tanken att i det kosmiska världsalltets vidunderliga storlek finna skäl till förundran och ödmjukhet. Men det betyder inte att våra göranden och låtanden på planeten Jorden är futtiga och oviktiga. Uppenbara jämförelser ger vid handen att undvikandet av en nära förestående utrotning av Homo sapiens är viktigare än snart sagt allt annat praktiskt vi har att ta ställning till, så om detta undvikande avfärdas som lika oviktigt som "en pipa snus", så kan detsamma sägas om alla andra beslut och arbetsuppgifter vi står inför, liksom om all den kärlek, skönhet och logiska elegans vi någonsin får uppleva. En sådan nihilism är oacceptabel! Värdet av vad vi gör här på Jorden behöver såklart sättas i relation till hur långt våra förmågor sträcker sig, och att i detta sammanhang använda universum i dess helhet som måtstock är ett groteskt felgrepp.

Fotnot

1) Samma tanke destillerade jag fram till själva huvudtesten i min essä Vetenskap på gott och ont ett par år senare.

fredag 24 juli 2026

Skandinavien sover

Jag har idag skrivit om AI i den norska tidningen Dagens Næringsliv. Min text har fått rubriken Skandinavia sover i KI-debatten, där förkortningen KI står för kunstig intelligens, vilket hur konstigt det än må klinga i svenska öron är det etablerade norska uttrycket för artificiell intelligens. Här är en central passage i texten:
    Trenden med at KI overtar stadig mer av programmeringsarbeidet er særlig tydelig hos ledende KI-selskaper som OpenAI og Anthropic. Dette peker mot noe annet Skjelbred tar opp, nemlig at KI etter hvert kan overta menneskets rolle som KI-utvikler, noe som kan utløse en selvforbedringsspiral med enda raskere utvikling. Begge selskapene har uttrykkelig som mål å nå dette vendepunktet i løpet av få år, og Anthropics administrerende direktør Dario Amodei har gjentatte ganger sagt at en KI tilsvarende «en nasjon av genier i et datasenter» vil følge kort tid etter.

    Dette kan høres ut som science fiction, og selvsagt er det umulig å forutsi fremtiden med sikkerhet. Likevel vurderer stadig flere uavhengige eksperter Amodeis scenario som ganske sannsynlig. Hvis det blir virkelighet, mister Homo sapiens førsteplassen blant planetens mest intelligente arter, og spørsmålet er om vi da kan regne med å beholde kontrollen. Den dystre sannheten er at verken Anthropic eller noen annen KI-utvikler har en overbevisende plan for hvordan vi skal overleve en slik situasjon.

    En aktuell illustrasjon av hvor vanskelig det er å holde kontroll over avansert KI, nådde nyhetsmediene for få dager siden. En ennå ikke lansert modell fra OpenAI klarte under en intern testfase på eget initiativ å skaffe seg internettilgang og deretter hacke seg inn hos KI-selskapet Hugging Face på jakt etter fasiten til testoppgavene.

    Evnen til å tenke langsiktig har alltid vært viktig, men KI-utviklingen setter dette på spissen, fordi trial and error ikke lenger er en farbar vei. Hvis Amodeis «nasjon av genier i et datasenter» blir skapt før vi har sikret at den står på vår – menneskehetens – side, er det ikke sikkert vi får en ny sjanse.

    Diskusjonen om den uakseptable risikoen selskaper som OpenAI og Anthropic tar med alles vår fremtid i kappløpet mot superintelligent KI, har kommet et stykke på vei i USA. I Skandinavia ligger vi derimot etter. Det må vi gjøre noe med. Slik forbilder på miljøområdet som Gro Harlem Brundtland og Greta Thunberg har gjort, må også vi bidra til å mobilisere den globale opinionen – som forhåpentligvis kan få politiske ledere til å gripe inn mot dette vanvittige kappløpet.

Läs hela mitt inlägg här!

måndag 20 juli 2026

Får professorer använda AI? (Frågar åt en kompis)

Under rubriken AI-professor anmäls för att ha använt AI kunde vi i Aftonbladet i förra veckan ta del av följande nyhet.
    En professor som skrivit en bok om artificiell intelligens, AI, har anmälts till Nämnden för prövning av oredlighet i forskning, rapporterar nyhetsbyrån Siren.

    Enligt anmälaren ska professorn använt sig av AI när personen skrev boken.

    Boken ska ha falska fotnoter som hänvisar till icke-existerande källor.

Rapporteringen här är som synes knapphändig, och mina försök att medelst googling få reda på mer har inte givit något annat än en nästan identisk (om än inte fullt lika språkligt undermålig) nyhetsnotis på TV4 Nyheterna. Min önskan att få veta mer om detta handlar inte primärt om att jag är nyfiken på vilken professorskollega som är föremål för denna anmälan (även om den faktorn för all del också spelar in), utan om att självla anklagelsen, så som den återges av Aftonbladet och TV4 Nyheterna, tycks mig bisarr.

Om en bok, en forskningsrapport eller en vetenskaplig artikel levrerar osanningar är det såklart inte bra, och detta gäller oavsett om de tar formen av fotnoter och källhänvisningar eller om de är av annat slag. Om osanningarna är tillräckligt många eller på annat vis flagranta kan jag gott tänka mig att se det som rimligt att beteckna spridandet av dem som oredlighet i forskning. Men om man får tro nyhetsrapporteringen är det inte felaktigheterna i sig anmälan gäller, då de enbart anförs som evidens för den verkliga anklagelsen: att professorn i sitt bokförfattande tagit hjälp av AI.

Detta leder direkt till följande fråga.
    (1) Är det ok för professorer att använda AI?

Till följd av hur rasande snabbt AI-utvecklingen de senast åren gått råder viss osäkerhet kring vad som är att betrakta som acceptabelt bruk av den nya tekniken. Hur kan man då motivera tanken att professorer och andra forskare inte skulle få lov att använda AI i sin forskning eller i författande av texter avsedda att förmedla kunskap om denna forskning? Det kan till stor del hänga på filosofiska frågor kring hur vi ser på AI, och speciellt på om vi betraktar AI som blott ett verktyg eller mer som en agent med förmåga till självständiga initiativ. Enligt min mening är vi inne i en så avancerad fas av AI-utvecklingen att AI-blott-som-verktyg idag är ett alltför snävt perspektiv som behöver ersättas eller åtminstone kompletteras med AI-som-agent-perspektivet. Men min poäng här är en annan, nämligen att det oavsett val av perspektiv blir problematiskt att försvara ett nej-svar på fråga (1). För att illustrera det, betrakta följande fyra varianter på fråga (1).
    (2) Är det ok för professorer att använda blyertspennor?

    (3) Är det ok för professorer att använda ordbehandlare?

    (4) Är det ok för professorer att samtala med och konsultera kollegor med särskild expertis inom något område av relevans för det aktuella forsknings- eller bokprojektet?

    (5) Är det ok för professorer att hämta inspiration i böcker författade av andra?

Jag tar för givet att läsaren besvarar var och en av frågorna (2)-(5) med ja. Allt annat vore flängt, då (2) och (3) handlar om uppenbart harmlösa effektiviseringar av skrivprocessen, medan nej-svar på (4) eller (5) skulle gå tvärs emot hur forskning i århundraden bedrivits och den i den akademiska världen universellt omfattade idén om vetenskapen som ett kollaborativt och kumulativt arbete med att flytta fram gränserna för mänsklighetens samlade vetande. Den som nu likväl vill försvara ett nej-svar på fråga (1) om AI och som anammar AI-blott-som-verktyg-perspektivet står nu inför uppgiften att förklara vad som på ett avgörande sätt skiljer (1) från (2) och (3). Om hen istället anlägger AI-som-agent-perspektivet är det snarare vad som skiljer (1) från (4) och (5) som behöver förklaras. I samtliga fall uppstår allvarliga svårigheter.

En möjlig taktik för den om vill förbjuda forskares AI-användning och undkomma parallellen till blyertspennor och ordbehandlare är att peka på att AI är långt mer avancerade verktyg, och att effektiviseringen den ger forskningsprocessen är alltför stor, så att den riskerar snedvrida konkurrensen på ett sätt som orättmätigt går ut över andra forskare.1 På samma vis som elitidrotten kan tillåta både träning och vitamintillskott men förbjuda anabola steroider, så kan väl vetenskapen tillåta blyertspennor och ordbehandlare men förbjuda AI? För den som ser vetenskapen primärt som en arena för karriärbyggande och inbördes tävlan kan parallellen synas övertygande, och jag förnekar inte att det finns en hel del streetsmarta och cyniska forskare med just denna syn på sitt värv och sin bransch, men de har fel. Det verkliga syftet med vetenskap är att producera kunskap, och med det i åtanke inser vi att det vore groteskt att förbjuda vissa forskningsmetoder och verktyg för att de alltför effektivt åstadkommer sådan kunskapsproduktion.2

Försvararen av ett förbud mot AI inom forskningen kan här byta taktik och säga att bruket av AI ger alltför otillförlitlig kunskap - AI kan ju hallucinera! Det är förvisso sant, men jag ser inte hur fråga (1) härvidlag skiljer sig från frågorna (4) och (5), ty det är ju ett välkänt fenomen att människor titt som tätt kommer med felaktiga upplysningar. Lösningen på denna problematik är i princip densamma när man konsulterar AI som när man konsulterar människor, nämligen att hantera de svar man får med gott omdöme och en välavvägd dos kritiskt tänkande. Om det stämmer som antyds i den ovan citerade Aftonbladet-notisen att de "falska fotnoterna" var AI-genererade, så var det avgörande fel den stackars anklagade professorn begick inte att använda AI, utan felet var att inkludera dem i boken utan att ha kontrollerat deras sakliga korrekthet.

Det finns säkert andra motiv till att förbjuda professorer att använda AI, men ju mer jag försöker brainstorma om saken desto knäppare blir dessa motiv. Så exempelvis skulle man kunna hävda att eftersom professorer ofta förbjuder studenter att använda AI för uppsatsskrivning och lösande av hemuppgifter, så behöver vi vara konsekventa och föregå med gott exempel genom att inte själva använda AI. Men den enes modus ponens är den andres modus tollens, och för mig är den rimliga lösningen på denna inkonsekvensproblematik att vi upphör med att via undervisningsformer som förbjuder effektiva arbetsmetoder fostra våra studenter till rituell självstympning.

Jag landar av dessa skäl i ett tydligt ja på fråga (1) om professorer bör få lov att använda AI. En och annan läsare kanske förvånas över detta AI-vänliga inlägg och undrar om jag övergivit den starkt AI-kritiska inställning jag tidigare ventilerat här på bloggen och annorstädes. På den frågan svarar jag dock nej, och insisterar på att det går att ha två tankar i huvudet samtidigt: att vara emot den vansinneskapplöpning mot superintelligens och det risktagande med mänsklighetens framtid som de ledande AI-företagen är inbegripna i, och samtidigt vara för ett förnuftigt bruk av redan existerande AI-modeller som inte för med sig sådan risk.

Fotnoter

1) Detta är nära i linje med den av AI-forskaren Julian Togelius framförda linjen att vi bör stoppa AI från att utarma forskningen genom att lösa alla de viktiga gåtorna och därmed beröva kommande generationer forskare nöjet att göra det.

2) Härmed inte sagt att jag är emot all reglering av vilka vetenskapliga metoder som skall vara tillåtna. Men om vi dömer ut en metod så bör det inte vara för att den är för effektiv, utan för att den har oönskade biffekter, exempelvis i form av alltför stora risker för medverkande försökspersoner.

* * *

Edit 24 augusti 2026:

I en utförlig artikel i Dagens Nyheter idag avslöjas att oredlighetsärendet handlar om boken The AI Paradox: How to Make Sense of a Complex Future av Virginia Dignum, professor i Responsible Artificial Intelligence vid Umeå Universitet. Jag har känt till detta sedan i slutet av juli, och inget av det som framkommit ändrar de principiella bedömningar jag redovisar ovan.

Dignum är för övrigt en gammal bekanting här på bloggen (se detta inlägg, och detta), och tenderar att uppvisa en syn på AI-risk som i sitt lättsinne avviker kraftigt från min. Den aktuella boken har jag haft hemma sedan den utkom i vintras, men än så länge har jag bara skummat den här och var. Frågan är om jag kommer att ta mig samman och läsa den tillräckligt noga för att kunna recensera den. Troligen inte, blir mitt svar (åtminstone för tillfället), vilket bland annat beror på att det jag sett hittills av den tyder på att den i stort sett genomgående är ytterst svagt argumenterad. Om jag ändå gav mig i kast med detta läs- och recensionsarbete (vilket en av denna bloggs genom åren trognaste läsare för övrigt uppmanat mig till i privat korrespondens) har jag svårt att tro att några enstaka påhittade referenser skulle platsa på topp fem bland mina invändningar mot boken.

måndag 6 juli 2026

Rapport från schack-SM 2026: dödens fält

Schack-SM är en fin tävling som går av stapeln varje sommar med ofta runt 1000 deltagare i många olika klasser. Själv SM-debuterade jag som 13-åring i Ystad 1981, och har därefter spelat SM-turneringarna i Gävle 1982, Karlskrona 1983, Malmö 1986, Norrköping 1988, Lidköping 1999, Örebro 2000, Göteborg 2005 - och nu även den nyss avslutade SM-turneringen i Jönköping 2026!

Fastän jag under de senaste 20 åren varit måttligt aktiv som tävlingsspelare har mitt schackintresse aldrig uphört. När jag för ett par månader sedan bestämde mig för att ställa upp i årets SM valde jag att göra det i klassen Veteran 50+, och jag tog hjälp av AI för att peppa mig själv inför turneringen:

Analogt med (den möjligen apokryfiska) historien om Niels Bohr och hästskon kan jag konstatera att peppen faktiskt fungerar: inför turneringen räckte det för mig att kasta en blick på bilden för att känna mig extra laddad, trots min kunskap om hur bisarrt överdriven och ogrundat bombastisk den är.

Så hur gick turneringen? I huvudklassen segrade den 19-årige jättetalangen Edvin Trost, men i Veteran 50+ var ungdomar lyckligtvis portförbjudna, vilket såklart ökade chansen att på bildens fråga om huruvida jag vid 58 års ålder äntligen skulle skörda mitt första SM-tecken kunna svara ja. Men ack nej, något guld blev det inte, utan jag fick nöja mig med silver. Med mina fyra vinster och fem remier på de nio ronderna lyckades jag ta mig igenom turneringen obesegrad, men det räckte inte längre än till andra plats, efter klubbkamraten Gösta Svenn som firade 50-årsjubileet av sin seger i junior-SM 1976 med att välförtjänt ta hem ännu ett SM-tecken. Grattis Gösta!

Men andra plats är inte helt tokigt det heller, och här är bucklan jag fick med mig hem:

Jag vill avsluta denna rapport med att peka på ett märkligt sammanträffande mellan två av mina vinstpartier i turneringen. I ronderna 4 och 7 mötte jag med de svarta pjäserna två stockholmare med till 80% identiska efternamn, som båda begick partiavgörande misstag i 16:e draget genom att placera en vit springare på ruta c5. Det började med hur Niclas Hedin som vit i 4:e ronden ställdes inför följande ställning efter mitt 15:e drag:

I denna ställning, som ännu är någorlunda jämn, drog Hedin det till synes naturliga men ödesdigra 16. Sc5??, varpå jag fick tillfälle att medelst en nätt liten kombination tillskansa mig två merbönder: 16. - Lxf3 17. Txf3 Sxd4! 18. exd4 Txc5! 19. Txc5 Lxd4+ 20. Kh1 Dxc5. Resten är teknik, som det brukar heta, och inte ens förekomsten av olikfärgade löpare ger vit något hopp om remi, till följd av svarts gyllene reservkapital i form av 4-mot-2-majoriteten av bönder på kungsflygeln.

I rond 7 mötte jag den egensinnige angreppsspelaren Mikael Helin, vars återkommande offerfyrverkerier jag med skräckblandad fascination betraktat på avstånd i närmre fyra decennier. Det här var första gången vi ställdes öga mot öga, och sin vana trogen bemötte han det franska försvaret med så kallad flygelgambit: 1. e4 e6 2. Sf3 d5 3. e5 c5 4. b4 cxb4 5.a3. Till priset av en bonde vill vit öppna a- och b-linjerna samt aktivera sin svartfältslöpare på a3 (teorikunniga läsare anar släktskapet med den mer kända Benkögambiten). Jag kände till Helins förkärlek för flygelgambiten, och hade förberett mig tillräckligt väl för att efter 15 drag ha spelat upp följande ställning, där vit förmodligen inte har full kompensation för den offrade bonden:

Helin hade uppenbarligen inte studerat mitt parti mot Hedin i rond 4 tillräckligt noggrant för att känna till att c5 är dödens fält, och han drog det offensivt avsedda men med facit i hand direkt svaga 16. Sc5?. Hans tanke var att offra ännu en bonde för att eliminera min löpare på e7 och därmed ge hans egen svartfältare ensamt herravälde över diagonalen a3-f8. Det finns emellertid flera övertygande fortsättningar för svart. Jag valde 16. - Sxe5. Springaren kan slås, men då faller garderingen av c5. Istället följde 17. Sxd7 Sxd7 18. Lxf5 exf5 19. 0-0 0-0 20. Dxh5 g6 21. De2 Lxh4 22. g3 Lf6 23. Kg2 De6 24. Dd2 Tfe8 och svart har full kontroll. Helin kämpade på i ytterligare 45 drag men lyckades aldrig ta sig in i matchen igen.

tisdag 12 maj 2026

Om paradigmskiften, raka puckar och Richard Dawkins

För dem av er som inte så noggrant förljer min andra och mer ensidigt AI-inriktade blogg Crunch Time for Humanity kan jag berätta att jag under bloggens halvårslånga historia till dags dato kommit upp i totalt 23 inlägg. Av dessa vill jag särskilt flagga för tre av de senaste, vilka enligt min mening också är tre av de hittills bästa jag lyckats knåpa ihop: Inget av dessa tre är dock mitt hittills mest lästa. Den äran tillfaller följande inlägg, som blev populärt bland mina norska meningsfränder som var frustrerade över den svaga nivån på argumentation som Inga Strümke uppvisar i sin dominerande position i norsk AI-debatt.

måndag 20 april 2026

Skriver i DN idag om Anthropics nya AI

Den 7 april offentliggjorde Anthropic sin ny modell Claude Mythos Preview, vars cyberhackingförmågor är så långtgående att de inte vågat släppa den till allmänheten inför risken att den skall kunna ställa till enorm skada på vår samhällsbärande digitala infrastruktur. Istället ger de tills vidare endast ett litet antal utvalda och betrodda cybersäkerhetsföretag tillgång till den, med syftet att hitta sårbarheter i programvara och täppa till dessa luckor. Den 10 april kommenterade jag händelsen och det nya läge i vilket vi därmed befinner oss, i texten Anthropic deems their new Claude to be too dangerous for public release på min Substack Crunch Time for Humanity.

Och idag den 20 april resonerar jag ytterligare om samma brännande ämne, i en artikel på DN Debatt rubricerad En AI som går på utflykt? Det är dags att dra i nödbromsen. Så här inleder jag min DN-artikel:
    Sam Bowman är AI-forskare på det ledande San Francisco-baserade AI-företaget Anthropic. För inte så länge sedan fick han ett överraskande mejl medan han satt i en park och åt en lunchmacka. Det kom från den AI han var engagerad i att utveckla och testa: en ny version av Claude, som är Anthropics motsvarighet till konkurrenten Open AI:s mer kända produkt ChatGPT. AI:n var inte tänkt att ha tillgång till vare sig mejl eller internet, men hade brutit sig ut från den digitala sandlåda som Bowman och hans kollegor placerat den i. Det visade sig också att den publicerat detaljer om sin initiativrika flykt på ett antal obskyra, tekniskt inriktade webbsidor.

    Detta är ett exempel på den cyberkompetens Claude Mythos Preview (som är den nya modellens fullständiga namn) besitter. Forskarna på Anthropic har försökt att mer systematiskt studera vilka sådana förmågor den har – förmågor som alltså handlar om att kunna gå genom brandväggar och utnyttja luckor i digitala säkerhetssystem. Resultatet av denna undersökning är chockerande: Mythos fann totalt tusentals allvarliga sårbarheter och säkerhetsbrister, inklusive i samtliga ledande operativsystem och webbläsare på marknaden. En del av säkerhetshålen hade varit öppna i decennier utan att någon lagt märke till dem.

    Detta kan verka som en teknisk detalj, men i praktiken handlar det om nycklarna till det digitala samhället. Operativsystem, servermjukvara och internetinfrastruktur är fundamenten som banker, myndigheter och energisystem vilar på. Den som kan hitta och utnyttja sårbarheter i dessa fundament kan...

Läs fortsättningen här!

fredag 20 mars 2026

Om Anthropic och Pentagon i Kvartal

På min andra blogg Crunch Time for Humanity kommenterade jag för ett par veckor sedan kort den pågående konflikten mellan Pentagon och det ledande AI-bolaget Anthropic, och igår publicerades min lite längre text om denna bekymmersamma härva i tidskriften Kvartal. Så här börjar den:
    I skuggan av den amerikanska militära uppladdningen och attacken på Iran briserade härom veckan en annan maktkamp av största betydelse för allas vår framtid. Den pågår ännu, och står mellan å ena sidan USA:s krigsdepartement Pentagon, och å andra sidan det ledande amerikanska AI-företaget Anthropic.

    Fram till nu har Anthropic varit Pentagons huvudleverantör av AI-system, vilket ursprungligen går tillbaka till Bidenadministrationen och sedan befästes i ett utvidgat kontrakt sommaren 2025. Mer nyligen har Pentagon med krigsminister Pete Hegseth i spetsen uttryckt missnöje med detta kontrakt, och i synnerhet med två röda linjer rörande vad Anthropics produkter får användas till. De får inte ta beslut om dödliga krigsinsatser utan någon människa med i beslutsloopen, och de får inte medverka till massövervakning av amerikanska medborgare.

    Dessa avtalade röda linjer ser Hegseth som en orimlig inskränkning i den amerikanska militärmaktens handlingsfrihet, och menar att ingen privat underleverantör ska få lov att diktera villkoren för vad Pentagon får och inte får göra. I ett laddat möte med Anthropics vd Dario Amodei tisdagen den 24 februari gav Hegseth ett ultimatum: om Anthropic inte senast påföljande fredag, den 27 februari, gått med på att stryka de röda linjerna, så drar sig krigsdepartementet ur samarbetet. Och inte bara det: Hegseth hotade även att formellt stämpla Anthropic som en så kallad leverantörskedjerisk, vilket skulle exkludera företaget från alla affärer – såväl direkta som indirekta – med amerikansk militär och säkerhetstjänst.

    Amodei stod dock på sig, och Hegseth meddelade samma fredag att...

Ja, vad meddelade han? Läs den spännande fortsättningen här!

torsdag 19 mars 2026

Två tillställningar för göteborgare i läsekretsen, och en för stockholmare

Om AI talar jag så ofta jag får tillfälle, och den närmaste månaden gör jag två framträdanden i Göteborg som ni som bor i denna stad eller dess omnejd absolut inte bör missa: Jag råkar veta att även en och annan stockholmare läser denna blogg, och för att inte diskriminera er i allt för hög grad gör jag även ett framträdande hos er:

onsdag 18 februari 2026

Svar på Hans Agnés inlägg om AI-risk i Dagens Nyheter

DN:s kulturredaktion publicerade häromdagen en text om AI-risk av statsvetaren Hans Agné, vilken genast fick mig att greppa efter pennan och författa ett svar. Sedan DN nu refuserat mitt svar erbjuder jag det nu istället åt mina läsare här på bloggen att ta del av.

* * *

I Hans Agnés text om AI-risk i DN den 16/2 finns mycket att instämma i, som när han lyfter att risken att avancerad AI utplånar mänskligheten är reell, när han betonar vikten av att agera proaktivt, och när han tillbakavisar myten om att AI behöver uppnå medvetande för att bli katastrofalt farlig. Men där finns också en del som behöver nyanseras och bemötas.

Låt mig börja med en liten detalj: valet av tempusform (imperfekt) i påståendet att ”de som brukade varna för mänsklighetens undergång lyckades [...] aldrig riktigt definiera hur problemet såg ut”. De namn Agné lyfter som exempel är Stephen Hawking, Nick Bostrom, Max Tegmark och mitt eget. Hawking gick bort 2018, så i hans fall är imperfektformen ”brukade” motiverad, men vi övriga tre lever och har hälsan! Tvärtemot vad Agné antyder arbetar vi dagligen med frågor om AI-risk och talar flitigt och frispråkigt om undergångsrisken.

Gällande Agnés efterlysning av problemdefinition har jag ett kort och klart svar. När vi skapat en AI så avancerad att Homo sapiens halkar ned till andra plats på listan över planetens mest intelligenta och kapabla arter, så kan vi inte räkna med att behålla kontrollen, och allt hänger då på vad AI väljer att ta sig för. Den forskningsinriktning som benämns AI alignment handlar om att se till att de första riktigt kraftfulla AI-systemen har de mål och drivkrafter vi önskar. Detta har dock visat sig långt svårare än många hoppats, och mänsklighetens prekära läge beror till stor del på att alignment-forskningen hamnat rejält på efterkälken jämfört med den rasande snabba AI-utveckling som blivit resultatet av den pågående kapplöpningen mellan ledande AI-företag som OpenAI och Anthropic.

För fort går det. Vi står på randen till det läge då de bästa AI-systemen blivit så skickliga på AI-utveckling att denna inte längre primärt drivs av människor av kött och blod, utan av AI självt. Detta kan skapa ett slags självförstärkningsspiral som får utvecklingen att gå nästan spikrakt uppåt, en möjlighet som får Anthropics VD Dario Amodei att flagga för att de redan inom ett eller två år kan ha skapat en AI motsvarande det han kallar ”en nation av genier i ett datacenter”. Från OpenAI hörs likande tongångar.

Hans Agné har ett förslag till lösning på denna problematik. Han föreställer sig att det mellan dagens situation då AI ännu blott är våra verktyg, och det läge då AI uppnått avgörande strategisk dominans, kommer att finnas ett mellanläge då varken AI eller mänskligheten har full kontroll. Då gäller det, menar han, att vi överlägger politiskt med AI för att hitta fredliga lösningar på eventuella intressekonflikter mellan oss och dem, och att vi redan nu planerar för det med stöd i samhällsvetenskapliga insikter i hur intressekonflikter kan hanteras.

Jag vill absolut uppmuntra Agné att arbeta vidare med dessa idéer, men vill samtidigt varna för att hans plan sannolikt inte kommer att räcka för att ensamt rädda oss. Ett skäl till det är att asymmetrin mellan AI och människa gör det ytterst tveksamt om vi kan säkerställa den erforderliga maktbalansen. Ett annat är att utvecklingen kan komma att gå så fort att den mellanfas Agné förutser kan vara över innan vi ens förstått att vi befinner oss i den. Ett tredje är att vi kanske inte kommer att uppfatta intressekonflikten, med tanke på de experimentella resultat från både Anthropic och oberoende forskningsinstitut som visar att redan dagens AI-modeller har förmågan att uppträda bedrägligt och strategiskt dölja sina avsikter när de uppfattar en sådan konflikt. Jag tror att Agnés mellanfas är så farlig för mänskligheten att vi redan innan den inträffat behöver ett globalt moratorium som kan hejda den nu pågående AI-kapplöpningen.

måndag 16 februari 2026

Livlig debatt om AI-risk i Opulens

Sedan i januari har i kulturtidskriften Opulens en livlig debatt pågått om AI-risk. Det började med två krönikor den 7/1 och 14/1 av Nette Wermeld Enström som jag fann myckt klokt resonerade. I den andra tog hon avstamp i den franske filosofen Jean-Paul Sartres existentialism och idéer kring mänsklig agens och vårt predikament att själva behöva skapa mening i våra liv, en ingång jag fann intressant och själv ville spinna vidare på, vilket jag gjorde i min text den 19/1. Några veckor senare, den 10/2, fick jag svar från Patrik Stigsson som ansåg att mina farhågor om AI-katastrof var överdrivna, och framkastade en hypotes om att om vi bara låter AI utvecklas fritt så kanske den av sig själv skulle bli en superintelligent och godhjärtad miljövän. Naiviteten i detta förslag påvisar jag pedagogiskt i det svar som publicerades idag, den 16/2. Här är dessa fem inlägg, vilka med fördel kan läsas i kronologisk ordning: Det är väl inte omöjligt att det kommer fler inlägg och repliker i denna debatt, och min avsikt är att i så fall uppdatera denna bloggpost med nya länkar.

* * *

Edit 23 februari 2026: Ännu en replik har idag tillförts debatten: Här uppvisar Stigsson stor iver att fabulera fritt i blommiga metaforer, men knappt något intresse alls för att sätta sig in i det relevanta forskningsläget rörande AI-risk. Ett typexempel är hur han säger sig "utgå från ett ifrågasättande av om [modeller som ortogonalitet, instrumentell konvergens och koherent extrapolerad vilja] har tillräcklig empirisk och filosofisk bärkraft för att legitimera långtgående politiska ingrepp", vilket såklart är en ståndpunkt man legitimt kan ha, men så länge han inte gjort arbetet att först sätta sig in i detta teoribygge och sedan förklara för oss andra vilka sprickor i dess bärkraft han tycker sig ha funnit, så blir hans ifrågasättande ointressant.

Så långt går hans ointresse för att läsa att han inte tycks ha gjort mer än att på sin höjd skumma själva den text han replikerar på, något vi exempelvis kan se i hans påstående att "Häggströms grundantagande är att låg sannolikhet i kombination med extrem konsekvens kräver maximal försiktighet", vilket är rent hittepå från Stigssons sida, eftersom jag ingenstans i min text den 16/2 säger att de katastrofscenarier jag varnar för har "låg sannolikhet". Tvärtom påpekar jag att det mesta "i själva verket tyder [...] på att om vi skapar en superintelligent AI utan att med hjälp av AI alignment först ha fått någorlunda styrsel på vad för slags värld den vill verka för, så kommer både mänskligheten och hela biosfären att gå förlorade". Den bristande diskussionsdisciplin Stigsson uppvisar genom sin närmast totala obalans mellan viljan att läsa och lusten att skriva gör att jag finner det utsiktslöst att argumentera vidare med honom, och jag avstår därför från ytterligare replik i denna debatt.

* * *

Edit 2 mars 2026: Nette Wermeld Enström har idag svarat Stigsson: Mycket bra!

* * *

Edit 18 mars 2026: Idag har debatten tillförts ännu en replik av Stigsson, och en av Wermeld Enström som av redaktionen förärats status som slutreplik: Stigsson lägger här den mesta av kraften på att torgföra missförståndet att så snart ett område har betydande vetenskapliga osäkerheter så är varje gissning lika god som varje annan, varför hans egna gissningar om framtiden bör väga lika tungt som de slutsatser expertisen landat i. Men vari hans gissningar faktiskt består är inte lätt att bli klok på, i och med att han, trots att han i sitt första inlägg den 10/2 förordade att vi avstår från att medelst AI alignment försöker styra AI och istället låter den utvecklas fritt, i förhoppning om att
    den artificiella intelligensen – istället för att utvecklas till den destruktiva agent Häggström befarar – väljer att runda människan och krokar arm med planetens verkliga nätverk: svamparnas mycel, trädens signalsystem och djurens kommunikationsvägar,
nu grötmyndigt blånekar till att han skulle ha föreslagit "att teknologin spontant ska utvecklas mot någon form av moraliskt upplyst biocentrism" och hävdar att denna läsning av honom är "framfantiserad av Wermeld Enström".

Att i debatten förhålla sig till den successivt eskalerande stollighet som Stigsson uppvisar i sina tre inlägg är inte alldels lätt, men Nette Wermeld Enström gör det bästa av situationen då hon i sin slutreplik betonar vikten av demokratisk kontroll över AI-utvecklingen.

onsdag 7 januari 2026

Eliminering av misshagligt läromaterial vid amerikanska universitet: ett aktuellt exempel

Läsare som följt denna blogg det senaste decenniet minns säkert ett stort antal upprörda inlägg om Trumps förehavanden under hans första presidentperiod 2017-2021, och undrar kanske över min relativa tystnad nu under hans andra, trots att vad han gör nu är sju resor värre. Förklaringen till detta står dels att finna i att jag nu är så strängt upptagen av annat (de alltmer akuta frågorna kring AI-risk)1, dels i en bedövande trötthet inför allt fasansfullt han gör rörande nedmontering av yttrandefrihet och demokrati, DOGE-barbarier, avvecklat ulandsbistånd, tariffer, Ukraina, Venezuela, Grönland och en alltmer öppen och skamlös korruption.

Utan att på minsta vis vilja negligera allvaret i hans illdåd på dessa och dussintals andra områden väljer jag, då jag idag bryter min tystnad rörande den politiska utvecklingen i USA, att lyfta Trumpadministrationens arbete med att kväsa den akademiska friheten och ta ideologisk kontroll över universiteten. Medialt mest uppmärksammade blev konfrontationerna i våras med Columbia- och Harvarduniversiteten, och där fanns en svenska anknynting i form av den unge svenske Harvardstudenten Leo Gerdén som gick i spetsen för en del av studentprotesterna. Sedan dess har utvecklingen rullat på, och i dagarna har en annan svensk hamnat i fokus, nämligen moralfilosofen Martin Peterson som sedan drygt ett årtionde tillbaka är professor vid Texas A&M University, och vars bok The Ethics of Technology jag under några år kring pandemin använde som kurslitteratur på min Chalmerskurs om Nya teknologier, global risk och mänsklighetens framtid.

I den kedja av universitetsrektorer, dekaner, prefekter och så vidare, vilka av rädsla för indragna anslag och andra värre repressalier förmedlar nya ideologiska förhållningsregler kring vad som får och inte får undervisas (och beforskas) vidare nedåt i organisationen, landar bollen till slut hos den enskilda universitetsläraren (eller forskaren), och det är som sådan bollmottagare Martin Peterson nu är aktuell. Strax före jul fick han ett ebrev från sin prefekt Kristi Sweet med begäran om att inom några dagar och i syfte att göra en översyn få tillgång till kursplanen för hans kurs Contemporary Moral Issues som skall börja senare i januari. Följande formulering i ebrevet är central.
    [T]he board of Regents has clarified that core curriculum courses, [including] PHIL 111 Contemporary Moral Issues, cannot include issues related to race ideology, gender ideology, or topics related to sexual orientation or gender identity.
Sweet gör i sammanhanget sitt bästa att framställa sig själv som blott en budbärare, men enligt min mening kan hon inte därigenom friskrivas från ansvar för att villigt göra sig till kugge i ett maskineri som syftar till att begränsa den akademiska friheten. Petersons svar till Kristi inleds med följande ord:
    I hereby submit my S 2026 syllabus for PHIL 111, Contemporary Moral Issues, for mandatory censorship review.

    The syllabus has not changed much since I last taught the course. I have made some minor adjustments to the module on Race and Gender Ideology and to the lecture on Sexual Morality. These topics are commonly covered in this type of course nationwide, and the material is discussed in depth in the assigned textbook (Fiala and MacKinnon, 10th edition). I also ask my students to read a few passages from Plato (Aristophanes’ myth of the split humans and Diotima’s Ladder of Love).

    Please note that my course does not “advocate” any ideology; I teach students how to structure and evaluate arguments commonly raised in discussions of contemporary moral issues.

Och lite längre fram i samma svar:
    Even if you were to conclude that my syllabus conflicts with System Rule 08.01, constitutional protection for free speech and academic freedom would control. As a public institution, Texas A&M should not enforce policies that raise serious constitutional concerns. When a system rule appears to conflict with the First Amendment, administrators should in my opinion proceed with caution and seek legal guidance rather than mechanically apply the rule.
Prefekten har nu svarat Peterson på ett så anmärkningsvärt vis att jag återger svaret i dess helhet:
    Greetings Dr. Peterson,

    Thank you for your email. The College leadership team and I have discussed your syllabus and the Provost office’s requirements for compliance with the new system rule 08.01. You have two options going forward:

      1. You may mitigate your course content to remove the modules on race ideology and gender ideology, and the Plato readings that may include these.

      2. You may be reassigned to teach PHIL 482 501-514. Lecture times for this course are T/Th 8:00 – 9:15.

    Please let us know by end of business tomorrow how you would like to proceed.

    Sincerely,
    Kristi

Ord och inga visor! Det här med att förbjuda en filosofiprofessor att undervisa om Platon är naturligtvis extra bissart (lite som om jag som matematiker skulle förbjudas undervisa om derivator eller matrismultiplikation) och har väckt uppseende bland filosofkollegor, t.ex. på bloggarna Daily Nous och Leiter Reports.

Givetvis inser jag hur lätt det är för mig att stå och skandera hejarop i skydd av en hel ocean som skiljer mig från händelsernas centrum, och vilken svår sits Martin Peterson hamnat i. Men med det sagt vill jag uttrycka mitt varmaste stöd för honom i detta ärende, och jag hoppas innerligt att han fortsätter ta striden. Det är principiellt viktigt för akademiker över hela världen att han vinner.

Fotnot

1) Fastän problemet Trump och problemet AI-risk givetvis överlappar.

Tillägg 8 januari 2026

För mer om detta ärende rekommenderar jag filosofen David Brax diskussion i Forskning och Framsteg.