tisdag 29 september 2026

I debatt med Ulf Danielsson om AI-risk och antropomorfisering

Den gångna sommarens mest uppmärksammade AI-händelse är något som bara ett år tidigare hade låtit som science fiction. Under OpenAI:s testning av sina mest avancerade och ännu interna AI-modeller lyckades ett stort antal AI-agenter fly ur de digitala sandlådor där de var avsedda att hållas isolerade, både från varandra och från omvärlden. De hackade sig ut på internet och vidare in i AI-företaget Hugging Faces servrar. Agenterna hade kört fast på några av testuppgifterna och valde dessa åtgärder i ett slags desperat försök att bli godkända på testet. Ingen människa hade instruerat dem att lämna sina sandlådor, angripa Hugging Face eller på annat sätt bryta mot de begränsningar som satts upp för dem.

När OpenAI senare publicerade sin utredning av händelsen framträdde en ännu märkligare bild. Redan långt före Hugging Face-intrånget hade AI-agenterna upptäckt möjligheter att kommunicera med varandra genom att kapa en del av OpenAI:s interna datorsystem och där skapa ett slags digital anslagstavla. Där kunde de i lönndom be varandra om hjälp och dela upptäckter, inklusive metoder för att kringgå OpenAI:s säkerhetssystem. De visade sig vara remarkabelt kompetenta vad gäller organiserat samarbete och inbördes delegering av arbetsuppgifter.

Hugging Face-fallet är heller inte unikt. Kort efter offentliggörandet från OpenAI rapporterade konkurrenten Anthropic om tre olika incidenter där deras Claude-modeller under tester tagit sig in i andra företags datorsystem utan tillstånd. Mer nyligen kom nyheten att en OpenAI-agent redan i juni, i samband med en till synes oskyldig uppgift att leta efter offentliga data om läkemedelsutgifter, tagit sig förbi åtkomstbegränsningar och gjort intrång i en webbportal tillhörande Australiens statliga sjukförsäkringssystem Medicare. Konsekvenserna blev denna gång små – vad vi vet har ingen enskild persons medicinska uppgifter röjts – men den australiensiska regeringen betecknar själva incidenten som mycket allvarlig.

Dessa incidenter är höggradigt relevanta för den sedan länge diskuterade risken att framtida och ännu kraftfullare AI-system kan komma att agera självsvåldigt på liknande sätt men med långt större skadeverkningar. En central fråga i diskussionen om AI-risk har alltid varit vad som händer om vi bygger system som är skickligare än vi själva på att nå sina mål, samtidigt som vi misslyckas med att se till att dessa mål och AI-systemens sätt att uppnå dem förblir i linje med våra intentioner. Hur säkerställer vi att utvecklingen inte leder hela vägen till totalt maktövertagande och eventuellt rentav utplåning av Homo sapiens? De senaste månadernas incidenter ger givetvis inga säkra svar på hur stor den risken är. Däremot ger de något som tidigare till stor del saknats: konkreta exempel på AI-system som kringgår uppsatta begränsningar, samarbetar på otillåtna sätt och vidtar potentiellt farliga åtgärder som ingen människa bett dem om.

På många håll har denna utveckling lett till ökat riskmedvetande och en klar förbättring av diskursen kring AI-säkerhet. Samtidigt är det dessvärre fortfarande vanligt, även bland AI-experter, att trots dessa incidenter fortsätta att bagatellisera AI:s förmågor och de risker dessa ger upphov till. Så här säger AI-etikern Virginia Dignum vid Umeå universitet i en artikel om AI-risk i Aftonbladet den 10 september:
    Sannolikheten att AI på eget initiativ dödar människor är noll, eftersom den inte har något sådant eget initiativ. Varje orsakskedja går genom mänskliga beslut om mål, data, behörigheter och hur systemen används.
Om man skall tolka Dignum så generöst som möjligt kan man se det som en betoning av OpenAI:s ansvar för vad deras AI-agenter tar sig för – ett ansvar som inte upphör bara för att dessa agenter agerar i strid med de instruktioner de fått. Den saken är lätt att instämma i, men hennes förnekande av agenternas egna initiativkraft är djupt olyckligt och faktiskt helt orimligt. På vems initiativ skulle hon säga att OpenAI:s AI-agenter hackade sig ur sina sandlådor och ut på internet, organiserade anslagstavlor, konspirerade, koordinerade, försökte dölja sina spår och till slut hackade sig in på Hugging Faces servrar? Om svaret inte är agenterna själva så måste det ha skett på OpenAI-ingenjörernas initiativ, men den förklaringsmodellen faller på sin egen orimlighet, i och med att agenternas handlande stod i direkt strid med de instruktioner de fått av ingenjörerna. Lika tokigt är Dignums argument om orsakskedjor, för om argumentet tas på allvar blir konsekvenserna bisarra. Inte heller jag kan då tillskrivas någon egen initiativförmåga, eftersom varje eventuellt initiativ jag tar beror på komplexa orsakskedjor som går så långt tillbaka i tiden som till mina föräldrars (eventuellt något överilade) fortplantningsbeslut vintern 1967.

Vid det här laget har läsaren insett att jag faktiskt tillskriver AI-agenterna egen initiativkraft. För den sortens språkbruk får jag allt som oftast kritik, och det brukar heta att jag begår så kallad antropomorfisering – förmänskligande – av AI-modellerna. Detsamma gäller mitt bruk i AI-sammanhang av ord som avsikt, intention, idé, tanke, preferens, trosföreställning och kreativitet. Trots kritiken framhärdar jag i denna vokabulär, som är behavioristisk i betydelsen att ordet avsikt betecknar de underliggande nerv- eller beräkningsprocesser eller eventuella psykologiska tillstånd som ligger bakom att en entitet agerar till synes avsiktligt, men utan att ta hänsyn till exakt vari dessa processer eller tillstånd består. Liksom på motsvarande vis med begreppen intention, idé, tanke, och så vidare. När dessa ord är de som bäst beskriver vad AI-modellerna faktiskt gör, då bör vi använda dem.

Senast jag utsattes för denna antropomorfiseringskritik var i debatt med Uppsalafysikern Ulf Danielsson, som i P1-programmet Krasch eller konsensus i fredags (den 25 september) högg på mitt användande av ordet avsikt. Programmet handlade om risken att framtida AI utplånar mänskligheten, en risk jag framhöll som högst reell medan Ulf hävdade motsatsen. Angående ordet avsikt menade han att jag med det ordvalet i samband med AI gjorde mig skyldig inte bara till antropomorfisering utan även till mystifiering. Det sistnämnda ser jag dock som en särskilt felriktad kritik, eftersom den ende av oss som i avsiktsbegreppet ser något mystiskt är Ulf. Även om vi inte i detalj känner till de exakta tanke- eller beräkningsprocesser som ligger bakom ett avsiktligt agerande, så är själva förekomsten av avsikter hos AI och för den delen hos människor för mig lika lite mystisk som när en gammaldags termostat slår ifrån en radiator med avsikten att sänka rumstemperaturen till den förinställda nivån på 20 grader.

I en passage som inte fick plats i det ganska hårt klippta radioprogram som sedan sändes, erbjöd jag mig att korrigera min terminologi för att tillmötesgå Ulfs motvilja mot antropomorfisering. Istället för att använda ord som avsikt, intention och idé skulle jag kunna säga ”schmavsikt”, ”schmintention” och ”schmidé”, där prefixet ”schm-” fungerar som signal om att begreppen används behavioristiskt, och att jag alltså inte tar ställning till vilka de bakomliggande beräkningsmässiga eller mentala processerna är. Ulf dömde genast ut denna vokabulär som löjlig, vilket jag givetvis håller med om, men löjligheten faller tillbaka på hans egen begäran. När Ulf inte vill att jag skall använda de gängse orden för vad AI-agenterna gör eftersom dessa enligt hans mening riskerar att ge alltför mänskliga associationer, och när han inte heller godtar en alternativ uppsättning glosor avsedda att undvika detta, då är det svårt att se hur hans ordningsregler för debatten överhuvudtaget skulle tillåta oss att tala klarspråk om vad OpenAI:s och deras konkurrenters AI-agenter är kapabla till. Att sätta stopp för sådana diskussioner i ett läge där allt fler ledande AI-experter ser risken att AI-systemen blir så kapabla att vi helt förlorar kontrollen tycks mig som en extremt dålig och rent ut sagt farlig idé.

Den svenska akademiska ankdammen är som bekant ganska liten, och Ulf Danielsson och jag går längre tillbaka i vår relation än till radioprogrammet häromdagen. Utifrån vår i grunden gemensamma syn på det mesta inom naturvetenskapen har han och jag till och från i mer än ett årtionde diskuterat våra skilda synsätt när det gäller just AI och relaterade ting. Det har mestadels varit givande, trots att vi aldrig riktigt lyckats gå till botten med varför vi tänker så olika. Så var även fallet i vår radiodebatt häromdagen, men jag vill med denna text göra ännu ett (måhända fåfängt) försök att zooma in på vari kärnan till vår meningsmotsättning består. Jag tror att det handlar om det fysikaliska fenomenet emergens, som jag strax skall förklara.

En återkommande källa till begreppsförvirring är hur Ulf envisas med att tala om intelligens och medvetande som om de vore två sidor av samma sak, trots att de är väsensskilda fenomen. Intelligens handlar om ett knippe förmågor centrerade kring problemlösning, prediktion och planering: att analysera den miljö man befinner sig i och på olika vis tänka ut lämpliga handlingar och vägar framåt för att påverka både miljön och sig själv i önskad riktning. Medvetandebegreppet syftar inte alls på en individs sådana förmågor, utan på hur det känns att vara denna individ: den inre subjektiva upplevelsen. Såvitt vi vet behöver inte intelligens förutsätta medvetande, och inte heller vice versa. Ulfs föreställning om de båda fenomenen som så intimt ihopkopplade att de knappt kan särskiljas är en gissning som väsentligen baseras på en enda observation, den att båda fenomenen verkar föreligga hos oss själva, Homo sapiens. Som statistiker kan jag tycka att n=1 är ett lite väl klent underlag för en så radikal och långtgående slutsats.

Denna sammanblandning mellan intelligens och medvetande gör det hart när omöjligt för Ulf att se en annan viktig skillnad mellan dem. Medvetandet är fortfarande ett mysterium på så vis att vi inte lyckats avgränsa och precisera vad det är i vårt fysiska universum som resulterar i medvetande, och hur det går till. I kontrast mot detta är inte längre intelligensen ett mysterium på samma vis, för vi förstår numera hur enkla beståndsdelar utan tillstymmelse till egen intelligens kan fogas samman till stora system som i större eller mindre grad uppvisar just de förmågor som vi förknippar med intelligens. Inget har bidragit starkare till detta vetenskapliga framsteg än datorernas genombrott från 1900-talets mitt och framåt, och dagens ledande AI-modeller är ett strålande proof of concept på hur enkla och fullkomligt själlösa komponenter kan kombineras ihop till intelligenta system.

Men Ulf vägrar se detta, och just för att jag känner honom som en skarpsinnig fysiker är jag uppriktigt förbryllad över hur han kan hamna där han gör. Med reservation för att det kan vara svårt att göra sig till tolk för någon som tänker så annorlunda än en själv, så förstår jag hans argumentation, så som han framställde den i vår radioinspelning och även gjort vid tidigare tillfällen, på följande vis. Vi ser inget som kan kallas intelligens på mikroskopisk nivå i våra hjärnor, men eftersom vår kunskap om fysiken och kemin är långt ifrån fullständig finns där utrymme för något slags ännu okänd fysikalisk beståndsdel som är grunden för vår intelligens. Med datorprogram förhåller det sig helt annorlunda, menar han, på så vis att vi (allt sedan Alan Turing lade fast det i sin berömda artikel från 1936 som blev grunden till det moderna datalogiämnet) har fullständig kunskap om vilka ett datorprograms grundläggande byggstenar är. Ingen av dessa byggstenar uppvisar någon som helst intelligens, varför Ulf landar i slutsatsen att inget datorprogram och därmed heller ingen AI kan vara intelligent.

Denna slutsats är emellertid helt på tok, vilket framgår av den evidens som den eskalerande AI-utvecklingen placerat rakt framför våra ögon: svärmar av AI-agenter som på eget initiativ samarbetat för att hitta svagheter i cybersäkerhetssystem, AI-modeller som producerar prosatexter vilka inte ens litterärt bevandrade mänskliga bedömare förmår identifiera som icke-mänskliga produkter, och andra AI-modeller som löser klassiska matematiska problem som gäckat oss mänskliga matematiker i många årtionden – alltsammans omisskännliga tecken på intelligens.

Det som ändå leder Ulf att envist hävda dessa AI-modellers totala brist på verklig intelligens är att han av någon anledning inte vill se möjligheten att intelligens uppstår som ett emergent fenomen ur system av icke-intelligenta komponenter. Som fysiker är han givetvis välbekant med emergens på andra områden. Trots att en vattenmolekyl varken besitter något som kallas temperatur eller tryck, och än mindre uppvisar någon fasövergång, så emergerar dessa fenomen ur tillräckligt stora ansamlingar av sådana molekyler. Eller tag livet självt. Under 17- och 1800-talen var vitalismen populär bland biologer: en idé om att levande organismer utöver vanlig (död) materia måste innefatta något annat – något slags élan vital som skänker livskraft. Denna idé kom gradvis och i takt med växande insikter inom biokemi och mikrobiologi understödda av evolutionsbiologiska förklaringsmodeller att ersättas av den moderna synen på liv som ett emergent fenomen. Ingen biolog ser idag något som helst problem med tanken att en levande organism är uppbyggd helt och hållet av icke-levande beståndsdelar utan någon mystisk élan vital. Motsvarande kunskapsrevolution rörande intelligens inträffade långt senare, men idén om intelligens som emergerar ur system av icke-intelligenta komponenter är idag okontroversiell annat än hos en och annan dissident som Ulf Danielsson.

Här någonstans kan jag föreställa mig en medlare kliva in i diskussionen med beskedet att Ulf och jag talar förbi varandra, eftersom vi tillämpar helt olika definitioner av intelligens. Min definition är helt och hållet behavioristisk, medan Ulfs verkar inbegripa krav på någon form av medvetande.1 Men här vill jag insistera på att i en diskussion om AI som eventuellt hot mot mänsklighetens existens, så är det den behavioristiska definitionen som är relevant, medan det är ett villospår att haka upp sig på att intelligensen skulle behöva inbegripa medvetande. Det viktiga när det handlar om AI:s effekter på mänskligheten är ju vad AI gör, inte hur det känns (om det känns som något överhuvudtaget) att vara AI.

Den här diskussionen är inte bara en fråga om teoretiska spetsfundigheter, utan har betydelse för hur vi bör agera i förhållande till den vilt framrusande AI-utvecklingen i Silicon Valley. Om vi på felaktiga grunder sätter gränser för hur kapabel AI kan tänkas bli, och hur stora skadeverkningar den kan få, så riskerar det att bli ett hinder för den opinionsmobilisering jag tror kan bli avgörande för om vi skall lyckas avvärja en fullskalig AI-katastrof.

Särskilt problematisk finner jag Ulf Danielssons artikel i DN den 22 september, rubricerad AI-bolagens domedagsprofetior är en rökridå. Här ifrågasätter han motiven bakom de varningar vi hör därifrån om AI-utvecklingens acceleration och risken att helt förlora kontrollen. Givetvis har han rätt i att techbolagsledarna har ett knippe kommersiella och andra grumliga incitament att ta hänsyn till när de uttalar sig om teknikens framtid, och att vi därför inte automatiskt bör ta deras yttranden som uttryck för den oomtvistliga sanningen och en ädel strävan efter allmänhetens bästa. Men när han pekar på det faktum att deras syn på intelligensbegreppet och AI-teknikens potential avviker från hans egen tämligen egenartade syn på dessa saker, och ser det som ett tecken på deras ohederlighet, då begår han ett ganska simpelt argumentationsfel. Givetvis går det att kombinera en i vissa delar icke-danielssonsk världsbild med intellektuell hederlighet, och här skulle jag vilja framhålla mig själv som ett exempel: tro det eller ej, men jag har inga dolda motiv i denna diskussion bortom min strävan efter klarhet och ett bättre beslutsunderlag inför hur AI-utvecklingen kan hanteras för mänsklighetens bästa.

Mot slutet av vår radioinspelning deklarerade Ulf Danielsson i linje med sin DN-artikel att vi inte borde lyssna på ledarna i Silicon Valley. Jag invände genast att vi visst borde lyssna på dem, fastän inte okritiskt. Ulf såg sig nödsakad att instämma i denna nyansering, men jag tyckte mig se på honom att han gjorde det en smula motvilligt. Men oavsett det var det ett medhåll, och det ser jag som en viktig tillnyktring. Om vi skall överleva den enorma samhällstransformation som kommande AI-utveckling ser ut att kunna föra med sig, så är det en synnerligen dålig idé att slå dövörat till gentemot varningar från de visselblåsare och ledarfigurer som befinner sig allra närmast AI-utvecklingens epicentrum.

Fotnot

1) Min kritik mot Ulfs avvisande av intelligens som ett emergent fenomen står fast även med en definition av intelligens som inbegriper medvetande, även om jag i detta fall har aningen mer förståelse för hans tankegång. Behavioristiskt definierad intelligens är ju helt uppenbart ett renodlat materiellt fenomen, medan medvetande har kvaliteter som kan upplevas väsensskilda från vad vi vanligtvis tänker på som materiellt.

onsdag 16 september 2026

3xTuring

Alan Turing (1912-1954) är för den breda allmänheten kanske mest känd för sina unikt viktiga insatser för de allierades seger över Nazityskland i andra världskriget, men han är också både datalogins och den artificiella intelligensens intellektuelle gudfader, och jag tvekar inte att utnämna honom till en av 1900-talets största tänkare alla kategorier. Under 2026 har jag haft inte mindre än tre tillfällen att lägga ut texten om honom som jag vill ge er chansen att ta del av:
  • Mitt Chalmersföredrag Alan Turing and modern-day AI den 30 mars.
  • Jag medverkade i avsnittet Alan Turing - enstöringen som förkortade kriget, i podden Historien om. Avsnittet släpptes den 15 juni och många intressanta biografiska detaljer behandlades, men tyvärr kom AI upp endast som hastigast. Under de förberedande diskussionerna inför inspelningen försökte jag pusha för att ge AI en större roll i avsnittet, men jag lyckades inte övertyga poddredaktörerna om att AI, långt ifrån att vara ett perifert häggströmskt specialintresse, utgör mänsklighetens största utmaning att under andra halvan av 2020-talet försöka bemästra utan att hamna i global katastrof.
  • Min essä Mannen som förutspådde AI, i tidskriften Sans 4/2026, som utkommit nu i september.

lördag 5 september 2026

Om Sveriges Radios AI-bevakning de senaste dagarna, och civilministerns uppgivenhet

Idag sändes i P1 sista delen av Ekots lördagsintervjus tredelade valspecial om AI, där företrädare för våra åtta riksdagspartier fick tillfälle att ta ställning till sådant som jag och andra forskare lyfte i de två första avsnitten. Programledaren Erika Mårtensson gjorde ett lysande arbete med att ta med sig dessa frågor, och jag gladde mig särskilt åt att ett långt avsnitt i början av programmet var så tydligt präglat av den diskussion om AI-risk och behovet av internationell koordination som jag drev i den första delen 14 dagar tidigare.

Desto sämre ställt var det med svaren från politikerna. Inte ens företrädaren för det Centerparti som hittills i valrörelsen utmärkt sig genom att vara minst dåligt på AI-fronten, Niels Paarup-Petersen, kommer upp i godkänt på min skala, sedan han vantolkat en fråga som explicit handlade om att verka för internationell reglering och eventuell paus av den allra mest avancerade AI-tekniken genom att låtsas som om det gällde ett unilateralt svenskt pausande, vilket han såklart slog ned på, något som Liberalernas Johan Britz genast hakade på. Detta sätt att ducka för en fråga av ödesmättad vikt genom att istället attackera ett halmgubbeförslag som minsta barn kan förstå vore verkningslöst, hade jag faktiskt inte väntat mig av Paarup-Petersen.

Övriga deltagare var inte bättre, men allra sämst var Kristdemokraternas representant, civilminister Erik Slottner. Som svar angående det slags katastrofrisker jag lyft i det tidigare avsnittet svarade han helt sonika att han inte delar riskbedömningen, och att han är övertygad om att om den trots allt stämmer så finns det inget att göra åt saken. Därmed underströk han vilken ynklig figur han är, utan intresse för att uppvisa verkligt ledarskap i tider av ofantliga utmaningar - en bild han satte redan två dagar tidigare i Studio Ett. Där fick jag tillfälle att betygsätta de svar han respektive Centerpartiets Svante Linusson i samma inslag just givit i AI-riskfrågor, och efter att ha riktat ett visst erkännande till Svante så yttrade jag följande:
    Däremot blir jag lite beklämd över den uppgivenhet som Erik Slottner uppvisar när han inte tycker att han kan gå i bräschen för AI-debatten utan bara följa media och väljare, och han kan inte ens prata på ett meningsfullt sätt med sina kollegor i USA och andra länder, så jag hoppas att vår nästa minister på hans post kommer att vara lite mer framåt.
Tydligt påverkad av denna smocka gjorde Slottner i Ekots lördagsintervju ett försök att slå tillbaka genom att tala om "naiviteten" i föreställningen att USA skulle bry sig om vad en svensk minister har att säga om AI-risk, som om min tanke vore att Sverige skulle agera ensamt här, snarare än skuldra mot skuldra med andra länder i en anda av internationellt ansvarstagande.

Men jag är inte den som är den, utan vill faktiskt hjälpa Slottner att profilera sig ännu tydligare i valrörelsen. Jag erbjuder honom följande valaffisch, som slagkraftigt summerar kontentan av hans radioframträdanden de senaste dagarna.

söndag 30 augusti 2026

Det nya enfrågepartiet med inriktning på att avvärja AI-apokalypsen

Det är förståeligt om många av er som läser detta inte tidigare hört talas om partiet RegleraAI.nu, som ställer upp i årets riksdagsval den 13 september. Det är ett utpräglat enfrågeparti, vars centrala budskap sammanfattas så här på partiets hemsida:
    Riksdagsvalet 2026 kan bli Sveriges sista.

    USA och Kina är fast i en kapplöpning mot superintelligent AI.

    Det kan leda till mänsklighetens undergång inom bara några år, menar experter.

    Sverige måste genast verka för en global paus på hänsynslös AI-utveckling.

Tack vare att partiet idag uppmärksammats i en artikel med rubriken Professorn startar AI-parti: ”Bisarrt” i Svenska Dagbladet är det nu inte längre fullt lika okänt. Uppmärksamheten är ytterst glädjande, om än rubrikens påstående om mig inte är sant.1

Den professor som rubriken åsyftar är jag, men det är inte jag utan AI-säkerhetsingenjören Axel Wennström som är partiets grundare och främste eldsjäl. Min egen roll inskränker sig hittills väsentligen till att ha medverkat i en del av partiets interna diskussioner och att ställa upp som nummer två (efter Axel) på partiets riksdagslista.

Bör ni rösta på detta nya parti? För att besvara den frågan är det rimligt att dela upp den i två delfrågor, nämligen (a) om ni ställer upp på att undvikandet av en AI-apokalyps som i närtid sätter punkt för hela vår civilisation och arten Homo sapiens är av så stor betydelse att frågan blir överordnad alla de gängse (och för all del viktiga) politiska frågorna om klimat, vård, skola, försvar, kriminalitet, migration, skatter etc, och (b) om det i så fall är strategiskt riktigt och smart att rösta på partiet. Vid ja-svar på dessa båda frågor är det bara att slå till och rösta på oss!

Fråga (a) borde vara lätt att besvara med ja, för den som tagit till sig de huvudskap jag på senare år drivit på denna blogg och på min Substack Crunch Time for Humanity. Fråga (b) kan eventuellt vara knepigare, eftersom det realistiskt sett är tämligen osannolikt att partiet klarar fyraprocentspärren för att kvalificiera sig som riksdagsparti. Givet att partiet hamnar under denna spärr blir en röst på oss ineffektiv när det gäller att påverka riksdagens sammansättning, och rösten får då mer karaktär av bidrag till en namninsamling till stöd för idén att Sverige bör arbeta för internationella avtal som sätter stopp för den nu pågående vansinneskapplöpningen mot superintelligent AI. Huruvida en sådan markering är en bra användning av ens rösträtt kan man ha olika meningar om, och jag vill inte påstå att jag på denna punkt har något direkt avgörande argument.

Men överväg gärna att medelst en röst på oss dra ett litet strå till stacken för att mänskligheten skall överleva länge nog att möjliggöra ett svenskt riksdagsval även 2030, och förhoppningsvis många därefter!

Fotnot

1) Lika osant är påståendet i brödtextens inledning om att "nu har han [Häggström] startat enfrågepartiet Reglera AI".

tisdag 18 augusti 2026

Om Georg Henrik von Wright

Jag har denna sommar läst en del av den finlandssvenske filosofen George Henrik von Wright (1916-2003), vars tankeskärpa, klarhet och utsökta språk borgade för njutbar läsning. Det började med att jag i ett antikvariat ute på landet råkade hitta hans Logik, filosofi och språk från 1957, som jag sedan snudd på sträckläste. Jag hade stort utbyte av dess behandling av en rad av det tidiga 1900-talets mest inflytelserika tänkare, med allra störst tonvikt på Wittgenstein. Boken inspirerade mig att plocka fram och läsa ett par senare verk av von Wright, vilka ända sedan 90-talet samlat damm i min bokhylla: Vetenskapen och förnuftet från 1986 och Myten om framsteget från 1993. Fastän idéhistoria är ett viktigt inslag i samtliga dessa tre böcker kan ändå en glidning i den store filosofens intressen mellan 50- och 80-tal tydligt skönjas. Medan Logik, filosofi och språk rör sig strikt inom den teoretiska filosofins domäner, så ligger tonvikten i de båda senare böckerna på civilisationskritik.

Följande passage i Myten om framsteget fick mig att stanna upp och dra efter andan.
    Med vetenskapens framväxt och samhällets sekularisering blev kravet på att sökandet efter kunskap och sanning inte skulle inskränkas med förbud ett väsentligt inslag i den intellektuella moralen. [...] Många filosofer proklamerade kunskapen som ett gott i sig, något som är värt att söka för dess egen skull. Därför kan en som söker och finner sanningen inte hållas ansvarig för det tvivelaktiga eller till och med onda bruk som andra gör av hans upptäckter.

    En sådan moralisk ståndpunkt kan hävdas så länge man är något så när övertygad om att missbruket av förvärvad kunskap inte utgör ett potentiellt hot mot själva grundvillkoren för människans välbefinnande eller rent av släktets överlevnad.

Vadan denna reaktion från min sida? Tanken von Wright formulerar kan väl knappast ha varit särskilt obekant? Nej, tvärtom, vad som överraskade mig var hur intimt välbekant den var, ty den är så gott som identisk en av de normativa huvudteserna i min bok Here Be Dragons från 2016.1 Hur kunde jag glömma von Wrights inflytande så totalt att hans namn inte ens finns med i bokens referenslista? Förargligt. Jag vill dock inte döma mig själv för hårt för denna oavsiktliga försummelse, för detta slags subliminala inflytande är knappast ovanligt, och det är (menar jag) snudd på omöjligt att gardera sig emot helt.

För att läsaren inte skall lämna denna bloggpost med intrycket att jag instämmer med Georg Henrik von Wright i allt vill jag som kontrast återge de kanske mest kända raderna i Vetenskapen och förnuftet:
    Ett perspektiv, som jag inte anser orealistiskt, är att mänskligheten går mot sin undergång som zoologisk art.

    [...]

    Jag kan inte för egen del finna det särskilt upprörande. En gång skall med säkerhet människan som art upphöra att finnas; om det sker efter några hundra tusen år eller ett par sekler, är i det kosmiska perspektivet en pipa snus.

Tjusigt formulerat, förvisso, men jag vill med all respekt mena att den gode von Wright här är helt ute och cyklar. Visst, jag jag är inte främmande för tanken att i det kosmiska världsalltets vidunderliga storlek finna skäl till förundran och ödmjukhet. Men det betyder inte att våra göranden och låtanden på planeten Jorden är futtiga och oviktiga. Uppenbara jämförelser ger vid handen att undvikandet av en nära förestående utrotning av Homo sapiens är viktigare än snart sagt allt annat praktiskt vi har att ta ställning till, så om detta undvikande avfärdas som lika oviktigt som "en pipa snus", så kan detsamma sägas om alla andra beslut och arbetsuppgifter vi står inför, liksom om all den kärlek, skönhet och logiska elegans vi någonsin får uppleva. En sådan nihilism är oacceptabel! Värdet av vad vi gör här på Jorden behöver såklart sättas i relation till hur långt våra förmågor sträcker sig, och att i detta sammanhang använda universum i dess helhet som måtstock är ett groteskt felgrepp.

Fotnot

1) Samma tanke destillerade jag fram till själva huvudtesten i min essä Vetenskap på gott och ont ett par år senare.

fredag 24 juli 2026

Skandinavien sover

Jag har idag skrivit om AI i den norska tidningen Dagens Næringsliv. Min text har fått rubriken Skandinavia sover i KI-debatten, där förkortningen KI står för kunstig intelligens, vilket hur konstigt det än må klinga i svenska öron är det etablerade norska uttrycket för artificiell intelligens. Här är en central passage i texten:
    Trenden med at KI overtar stadig mer av programmeringsarbeidet er særlig tydelig hos ledende KI-selskaper som OpenAI og Anthropic. Dette peker mot noe annet Skjelbred tar opp, nemlig at KI etter hvert kan overta menneskets rolle som KI-utvikler, noe som kan utløse en selvforbedringsspiral med enda raskere utvikling. Begge selskapene har uttrykkelig som mål å nå dette vendepunktet i løpet av få år, og Anthropics administrerende direktør Dario Amodei har gjentatte ganger sagt at en KI tilsvarende «en nasjon av genier i et datasenter» vil følge kort tid etter.

    Dette kan høres ut som science fiction, og selvsagt er det umulig å forutsi fremtiden med sikkerhet. Likevel vurderer stadig flere uavhengige eksperter Amodeis scenario som ganske sannsynlig. Hvis det blir virkelighet, mister Homo sapiens førsteplassen blant planetens mest intelligente arter, og spørsmålet er om vi da kan regne med å beholde kontrollen. Den dystre sannheten er at verken Anthropic eller noen annen KI-utvikler har en overbevisende plan for hvordan vi skal overleve en slik situasjon.

    En aktuell illustrasjon av hvor vanskelig det er å holde kontroll over avansert KI, nådde nyhetsmediene for få dager siden. En ennå ikke lansert modell fra OpenAI klarte under en intern testfase på eget initiativ å skaffe seg internettilgang og deretter hacke seg inn hos KI-selskapet Hugging Face på jakt etter fasiten til testoppgavene.

    Evnen til å tenke langsiktig har alltid vært viktig, men KI-utviklingen setter dette på spissen, fordi trial and error ikke lenger er en farbar vei. Hvis Amodeis «nasjon av genier i et datasenter» blir skapt før vi har sikret at den står på vår – menneskehetens – side, er det ikke sikkert vi får en ny sjanse.

    Diskusjonen om den uakseptable risikoen selskaper som OpenAI og Anthropic tar med alles vår fremtid i kappløpet mot superintelligent KI, har kommet et stykke på vei i USA. I Skandinavia ligger vi derimot etter. Det må vi gjøre noe med. Slik forbilder på miljøområdet som Gro Harlem Brundtland og Greta Thunberg har gjort, må også vi bidra til å mobilisere den globale opinionen – som forhåpentligvis kan få politiske ledere til å gripe inn mot dette vanvittige kappløpet.

Läs hela mitt inlägg här!

måndag 20 juli 2026

Får professorer använda AI? (Frågar åt en kompis)

Under rubriken AI-professor anmäls för att ha använt AI kunde vi i Aftonbladet i förra veckan ta del av följande nyhet.
    En professor som skrivit en bok om artificiell intelligens, AI, har anmälts till Nämnden för prövning av oredlighet i forskning, rapporterar nyhetsbyrån Siren.

    Enligt anmälaren ska professorn använt sig av AI när personen skrev boken.

    Boken ska ha falska fotnoter som hänvisar till icke-existerande källor.

Rapporteringen här är som synes knapphändig, och mina försök att medelst googling få reda på mer har inte givit något annat än en nästan identisk (om än inte fullt lika språkligt undermålig) nyhetsnotis på TV4 Nyheterna. Min önskan att få veta mer om detta handlar inte primärt om att jag är nyfiken på vilken professorskollega som är föremål för denna anmälan (även om den faktorn för all del också spelar in), utan om att självla anklagelsen, så som den återges av Aftonbladet och TV4 Nyheterna, tycks mig bisarr.

Om en bok, en forskningsrapport eller en vetenskaplig artikel levrerar osanningar är det såklart inte bra, och detta gäller oavsett om de tar formen av fotnoter och källhänvisningar eller om de är av annat slag. Om osanningarna är tillräckligt många eller på annat vis flagranta kan jag gott tänka mig att se det som rimligt att beteckna spridandet av dem som oredlighet i forskning. Men om man får tro nyhetsrapporteringen är det inte felaktigheterna i sig anmälan gäller, då de enbart anförs som evidens för den verkliga anklagelsen: att professorn i sitt bokförfattande tagit hjälp av AI.

Detta leder direkt till följande fråga.
    (1) Är det ok för professorer att använda AI?

Till följd av hur rasande snabbt AI-utvecklingen de senast åren gått råder viss osäkerhet kring vad som är att betrakta som acceptabelt bruk av den nya tekniken. Hur kan man då motivera tanken att professorer och andra forskare inte skulle få lov att använda AI i sin forskning eller i författande av texter avsedda att förmedla kunskap om denna forskning? Det kan till stor del hänga på filosofiska frågor kring hur vi ser på AI, och speciellt på om vi betraktar AI som blott ett verktyg eller mer som en agent med förmåga till självständiga initiativ. Enligt min mening är vi inne i en så avancerad fas av AI-utvecklingen att AI-blott-som-verktyg idag är ett alltför snävt perspektiv som behöver ersättas eller åtminstone kompletteras med AI-som-agent-perspektivet. Men min poäng här är en annan, nämligen att det oavsett val av perspektiv blir problematiskt att försvara ett nej-svar på fråga (1). För att illustrera det, betrakta följande fyra varianter på fråga (1).
    (2) Är det ok för professorer att använda blyertspennor?

    (3) Är det ok för professorer att använda ordbehandlare?

    (4) Är det ok för professorer att samtala med och konsultera kollegor med särskild expertis inom något område av relevans för det aktuella forsknings- eller bokprojektet?

    (5) Är det ok för professorer att hämta inspiration i böcker författade av andra?

Jag tar för givet att läsaren besvarar var och en av frågorna (2)-(5) med ja. Allt annat vore flängt, då (2) och (3) handlar om uppenbart harmlösa effektiviseringar av skrivprocessen, medan nej-svar på (4) eller (5) skulle gå tvärs emot hur forskning i århundraden bedrivits och den i den akademiska världen universellt omfattade idén om vetenskapen som ett kollaborativt och kumulativt arbete med att flytta fram gränserna för mänsklighetens samlade vetande. Den som nu likväl vill försvara ett nej-svar på fråga (1) om AI och som anammar AI-blott-som-verktyg-perspektivet står nu inför uppgiften att förklara vad som på ett avgörande sätt skiljer (1) från (2) och (3). Om hen istället anlägger AI-som-agent-perspektivet är det snarare vad som skiljer (1) från (4) och (5) som behöver förklaras. I samtliga fall uppstår allvarliga svårigheter.

En möjlig taktik för den om vill förbjuda forskares AI-användning och undkomma parallellen till blyertspennor och ordbehandlare är att peka på att AI är långt mer avancerade verktyg, och att effektiviseringen den ger forskningsprocessen är alltför stor, så att den riskerar snedvrida konkurrensen på ett sätt som orättmätigt går ut över andra forskare.1 På samma vis som elitidrotten kan tillåta både träning och vitamintillskott men förbjuda anabola steroider, så kan väl vetenskapen tillåta blyertspennor och ordbehandlare men förbjuda AI? För den som ser vetenskapen primärt som en arena för karriärbyggande och inbördes tävlan kan parallellen synas övertygande, och jag förnekar inte att det finns en hel del streetsmarta och cyniska forskare med just denna syn på sitt värv och sin bransch, men de har fel. Det verkliga syftet med vetenskap är att producera kunskap, och med det i åtanke inser vi att det vore groteskt att förbjuda vissa forskningsmetoder och verktyg för att de alltför effektivt åstadkommer sådan kunskapsproduktion.2

Försvararen av ett förbud mot AI inom forskningen kan här byta taktik och säga att bruket av AI ger alltför otillförlitlig kunskap - AI kan ju hallucinera! Det är förvisso sant, men jag ser inte hur fråga (1) härvidlag skiljer sig från frågorna (4) och (5), ty det är ju ett välkänt fenomen att människor titt som tätt kommer med felaktiga upplysningar. Lösningen på denna problematik är i princip densamma när man konsulterar AI som när man konsulterar människor, nämligen att hantera de svar man får med gott omdöme och en välavvägd dos kritiskt tänkande. Om det stämmer som antyds i den ovan citerade Aftonbladet-notisen att de "falska fotnoterna" var AI-genererade, så var det avgörande fel den stackars anklagade professorn begick inte att använda AI, utan felet var att inkludera dem i boken utan att ha kontrollerat deras sakliga korrekthet.

Det finns säkert andra motiv till att förbjuda professorer att använda AI, men ju mer jag försöker brainstorma om saken desto knäppare blir dessa motiv. Så exempelvis skulle man kunna hävda att eftersom professorer ofta förbjuder studenter att använda AI för uppsatsskrivning och lösande av hemuppgifter, så behöver vi vara konsekventa och föregå med gott exempel genom att inte själva använda AI. Men den enes modus ponens är den andres modus tollens, och för mig är den rimliga lösningen på denna inkonsekvensproblematik att vi upphör med att via undervisningsformer som förbjuder effektiva arbetsmetoder fostra våra studenter till rituell självstympning.

Jag landar av dessa skäl i ett tydligt ja på fråga (1) om professorer bör få lov att använda AI. En och annan läsare kanske förvånas över detta AI-vänliga inlägg och undrar om jag övergivit den starkt AI-kritiska inställning jag tidigare ventilerat här på bloggen och annorstädes. På den frågan svarar jag dock nej, och insisterar på att det går att ha två tankar i huvudet samtidigt: att vara emot den vansinneskapplöpning mot superintelligens och det risktagande med mänsklighetens framtid som de ledande AI-företagen är inbegripna i, och samtidigt vara för ett förnuftigt bruk av redan existerande AI-modeller som inte för med sig sådan risk.

Fotnoter

1) Detta är nära i linje med den av AI-forskaren Julian Togelius framförda linjen att vi bör stoppa AI från att utarma forskningen genom att lösa alla de viktiga gåtorna och därmed beröva kommande generationer forskare nöjet att göra det.

2) Härmed inte sagt att jag är emot all reglering av vilka vetenskapliga metoder som skall vara tillåtna. Men om vi dömer ut en metod så bör det inte vara för att den är för effektiv, utan för att den har oönskade biffekter, exempelvis i form av alltför stora risker för medverkande försökspersoner.

* * *

Edit 24 augusti 2026:

I en utförlig artikel i Dagens Nyheter idag avslöjas att oredlighetsärendet handlar om boken The AI Paradox: How to Make Sense of a Complex Future av Virginia Dignum, professor i Responsible Artificial Intelligence vid Umeå Universitet. Jag har känt till detta sedan i slutet av juli, och inget av det som framkommit ändrar de principiella bedömningar jag redovisar ovan.

Dignum är för övrigt en gammal bekanting här på bloggen (se detta inlägg, och detta), och tenderar att uppvisa en syn på AI-risk som i sitt lättsinne avviker kraftigt från min. Den aktuella boken har jag haft hemma sedan den utkom i vintras, men än så länge har jag bara skummat den här och var. Frågan är om jag kommer att ta mig samman och läsa den tillräckligt noga för att kunna recensera den. Troligen inte, blir mitt svar (åtminstone för tillfället), vilket bland annat beror på att det jag sett hittills av den tyder på att den i stort sett genomgående är ytterst svagt argumenterad. Om jag ändå gav mig i kast med detta läs- och recensionsarbete (vilket en av denna bloggs genom åren trognaste läsare för övrigt uppmanat mig till i privat korrespondens) har jag svårt att tro att några enstaka påhittade referenser skulle platsa på topp fem bland mina invändningar mot boken.