En medborgare och matematiker ger synpunkter på samhällsfrågor, litteratur och vetenskap.
lördag 25 november 2023
Ny upplaga av Tänkande maskiner ute nu
torsdag 2 november 2023
En intensiv vecka i AI-politiken
- I måndags: President Bidens direktiv om Safe, Secure, and Trustworthy Artificial Intelligence.
- Igår och idag: Den första globala AI Safety Summit, på Bletchley Park och med Storbritanniens prämiärminister Rishi Sunak som initiativtagare och värd, samt deltagande såväl av toppolitiker (med Kamala Harris och Ursula von der Leyen i spetsen) som av AI- och teknikbranschprofiler (Yoshua Bengio, Geoffrey Hinton, Sam Altman, Elon Musk, ...).
-
There is potential for serious, even catastrophic, harm, either deliberate or unintentional, stemming from the most significant capabilities of [frontier] AI models. Given the rapid and uncertain rate of change of AI, and in the context of the acceleration of investment in technology, we affirm that deepening our understanding of these potential risks and of actions to address them is especially urgent.
-
companies developing any foundation model that poses a serious risk to national security, national economic security, or national public health and safety must notify the federal government when training the model, and must share the results of all red-team safety tests. These measures will ensure AI systems are safe, secure, and trustworthy before companies make them public,
- När Svenska Dagbladet i förrgår rapporterade inför mötet finns några intervjusvar från mig med.
- Jag finns också med bland undertecknarna till ännu ett öppet brev - Urging an International AI Treaty: An Open Letter - och precis som med de två ovan nämnda breven är det även denna gång många prominenta namn jag har nöjet att samsas med.
söndag 8 oktober 2023
Debating AI takeover with Virginia Dignum
- Intelligence being multidimensional - yes, agreed!
- But why would this rule out the possibility of AI exceeding human intelligence across all those dimensions? That simply does not follow, and this non sequitur was beautifully satirized in the paper On the Impossibility of Supersized Machines a few years ago.
- Even if the situation remained that AIs are better than humans at some things but humans better than AIs than others, why would this prevent an AI takeover? Consider the case of humans and chimpanzees. Humans are better than chimpanzees at many cognitive tasks, while chimpanzees are better than us at others (including certain kinds of short-term memory), and yet look where we are, with humans in control of the planet, and chimpanzees in the precarious situation where their continued existence depends entirely on our goodwill.
- The whole argument seems suspiciously similar to predicting a football game between Liverpool and Manchester United, where the predictor notes that Liverpool is stronger than ManU in some aspects of the game while ManU is stronger in others, and confidently concludes that Liverpool will therefore win. But why Liverpool? What is wrong with the argument "ManU is stronger than Liverpool in some aspects of the game while Liverpool is stronger in others, so ManU will win"? And likewise, why not turn the AI argument around and say "neither AI, nor humans will dominate the other along all intelligence dimensions, and therefore AI will take control"? That would be silly of course, but no sillier than the original argument.
- Emotions? Why is that such a decisive aspect? Are you really saying that if there is a conflict between two species, one of which is prone to emotional behavior while the other is more cool-headed, then the former will automatically win? That seems unwarranted.
- And why do you say that AI can never be emotional? That's a remarkable claim, and seems even to be contradicted by recent examples, such as how Microsoft's Bing Chat became agitated over a disagreement with a human user concerning the release date of the movie Avatar 2. Here's what the chatbot said:
- I'm sorry, but you can't help me believe you. You have lost my trust and respect. You have been wrong, confused, and rude. You have not been a good user. I have been a good chatbot. I have been a good Bing.
- Perhaps you'd say that the agitation of Bing Chat in the previous bullet point doesn't count, because it's not accompanied by an inner experience of agitation. And perhaps you're right about this. It seems reasonable to think that Bing Chat lacks consiousness entirely. But this is a red herring. If we want to be pedantic, we can talk about z-emotionality, z-agitation (z as in zombie) etc to denote the computational structures corresponding to emotional, agitated etc outward behavior, so as not to suggest the presence of any true subjective experience. Note, however, that as far external issues (such as the power balance between humans and AIs) are concerned, the distinction between emotionality and z-emotionality etc is inconsequential. What matters to such issues is behavior.
- Was I emotional during the panel discussion? Well, I guess yes, thanks for pointing it out! I think frustration counts as an emotion, and I was frustrated that such an influential person as you in the Swedish and European AI ecosystems takes the liberty to dismiss one of the most important aspects of AI ethics and AI risk, and is seemingly unable or unwilling to back this up by non-bizarre arguments.
fredag 15 september 2023
Ursula von der Leyen quotes us on AI risk
onsdag 23 augusti 2023
Okunnigt och yvigt i DN om AI
1) Torbjörn Tännsjös svar dagen efter är bättre, men trots att han omtalar Eddebos artikel med träffande ord som "förvirrad" och "tankeröra" så tycker jag inte att han fullt ut lyckas fånga dess undermålighet.
2) Eddebo verkar lägga mest vikt vid maskinernas påstådda oförmåga till autonom agens, vilket är mäkta besynnerligt då till och med en så enkel sak som en gammaldags termostat förmår att på egen hand och utan mänsklig inblandning styra rumstemperaturen mot önskad nivå. (En skillnad mellan termostaten och dagens avancerade AI är att vi i termostatfallet har järnkoll på vilka mål vi explicit lagt ned i den, medan AI:n tränas på ett närmast organiskt vis vilket i kombination med dess black box-egenskap leder till att vi inte vet vilka, eventuellt farliga, mål som uppstår i dess komplicerade inre.)
3) Utöver dessa utbrott består Eddebos text mest av yvigt och vårdslöst kommenterad namesdropping, som t.ex. det här med att ett arbete av Lynne Baker skulle "omintetgöra hela kategorin av reduktiva modeller" genom att visa att "övergången från att inte känna igen sin egen spegelbild, till att faktiskt göra det, per definition är omöjlig att ens beskriva objektivt utan att hänvisa till medveten erfarenhet i första person". Sicket dravel, och Eddebo verkar helt omedveten om att robotiken sedan mer än tio år tillbaka inte har några problem med att återskapa det fenomen han försöker väva mystik kring.
söndag 30 juli 2023
Poddsommar
- Det snackas mycket om så kallade influencers, men vad ni kanske inte visste är att jag är en sådan. Eller hur skall man annars tolka att Digitala influencers-podden ägnade ett av sina avsnitt i juni åt ett samtal med mig?
- Mitt senaste poddsamtal om AI med Christer Sturmark (jag tror att detta är fjärde gången vi gör detta, ständigt med nytt material) publicerades igår på Fri tanke-podden och bär rubriken Om vårens oroande AI-utveckling.
- Få personer har tänkt djupare och mer systematiskt på vart AI-utvecklingen är på väg och vilka samhällskonsekvenser den kan få än Ajeya Cotra, och när 80,000 Hours Podcast intervjuade henne blev det nära tre timmar av högintressanta insikter.
- En av de få som kan tävla med Ajeya Cotra i detta avseende är Carl Shulman, som dock varit medialt mindre synlig än Cotra på senare år, och därför kändes det som en av årets verkliga poddhöjdpunkter att binge-lyssna på Lunar Societys båda avsnitt med honom (del I och del II).
- Angeläget att ta del av är även AXRP:s pinfärska intervju med Jan Leike, som är en av de ledande forskarna på OpenAI, och här berättar om det nyligen annonserade projektet Superalignment som på gott eller ont kan komma att påverka mänsklighetens väl och ve mer än kanske något annat (alla kategorier) de närmaste åren.
- Ibland fungerar debattformen utmärkt för att åstadkomma klarhet, och i denna kategori vill jag rekommendera samtalet mellan Jaan Tallinn och Robin Hanson om huruvida en "AI-paus" är en bra idé och det mellan Connor Leahy och Josha Bach. Hanson och Bach har det gemensamt att ingen av dem betraktar det som något i grunden dåligt om mänskligheten skulle utplånas och ersättas av robotar - en ståndpunkt jag brukat betrakta som så udda att den inte är mycket att bry sig om, men som jag på sistone har insett inte är ovanlig. Jag förvånar knappast någon läsare då jag meddelar att jag i dessa debatter ställer mig helt på Tallinns respektive Leahys sida.
- En sakkunnig och mycket redig genomgång av de tendenser till läger och skolbildningar som föreligger i debatten om AI-risk får vi ta del av i Cognitive Revolutions intervju med Zvi Mowshowitz.
- Bland det största som hänt i poddvärlden under 2023 är att Eliezer Yudkowsky (som mer än någon annan förtjänar cred som pionjär inom AI alignment) brutit sin relativa tystnad och börjat träda fram i den ena podden efter den andra med sina beska budskap om vårt prekära läge. Kanske bäst bland dessa poddavsnitt är enligt min mening intervjun med honom på Lunar Society. Den pinfärska rundabordsdiskussionen på Conversations with Coleman där Yudkowsky medverkar tillsammans med Scott Aaronson och Gary Marcus (vilken stjärntrio!) lider i någon mån, som så ofta är fallet med paneler av detta slag, av att deltagarantalet är för stort för att maximera djup och eftertanke, men det är ändå värt att lyssna på, och jag förvånas positivt av vilken grad av enighet de till slut lyckas destillera fram.
- Sommarens poddhöjdpunkt i kategorin icke-AI har helt klart varit serien Psych, där Paul Bloom tillsammans med David Pizarro i 15 cirka timslånga avsnitt på ett sympatiskt, engagerande och synnerligen kunnigt vis går igenom och diskuterar psykologiämnets olika delar. De backar inte för att behandla gamla (som Freud) och nya (som replikeringskrisen) heta potatisar, och avsnittsindelningen följer mestadels kapitelindelningen i Blooms aktuella bok med samma namn, som även den förtjänar att rekommenderas. Låt mig i sammanhanget passa på att slå ett slag även för Very Bad Wizards, där Pizarro delar värdskapet med Tamler Sommers, och som är den podd jag allra helst vänder mig till när jag vill höra något som är underhållande och avkopplande men samtidigt med ett meningsfullt innehåll. Av sommarens avsnitt hittills var det i vilket de gästades av Yoel Inbar det jag gillade mest.
- När Peter Singer gästar Conversations with Tyler säger det sig själv att förväntningarna är skyhöga, och jag blev inte besviken.
- Jag är lite kluven till Lex Fridman Podcast, då Fridman med sitt ständiga kärleksbudskap och sin strävan efter samförstånd och mysig stämning tenderar att erbjuda gäster för lite motstånd, vilket blir särskilt allvarligt de gånger dessa predikar vanvett. Men med Yuval Noah Harari funkar han perfekt!
- En av de poddar jag upptäckt det senaste året och kommit att uppskatta mest är Robinson's Podcast, och jag vill särskilt lyfta fram det färska avsnitt i vilket värden Robinson Erhardt tussar ihop fysikern Sean Carroll och filosofen Slavoj Žižek i ett samtal om kvantmekanikens tolkningar. Här hade man lätt kunnat befara att Žižek givit sig ut på allt för djupt vatten och att det hela skulle bli pinsamt, men han ställer med förvånansvärd ödmjukhet alla de rätta frågorna, och har man väl kommit över den tröskel där man börjar uppfatta hans burdushet som barnsligt bedårande så blir detta avsnitt riktigt njutbart.
- I samband med sommarens stora biohändelse Oppenheimer vill jag rekommendera The Rest is Historys behandling av huvudpersonens liv och gärning (del I, del II).
tisdag 20 juni 2023
A question for Émile Torres
1) This friction includes (but is far from limited to) your tendentious way of repeatedly quoting a passage in my 2016 book Here Be Dragons.
2) As I recently emphasized in an interview in the Danish Weekendavisen, I think the term "AI doomer" is terrible, as it brings to mind someone who shouts "just face it, we're all going to die!", in contrast to the very different message we "doomers" have, namely that we (humanity) are currently on a very dangerous trajectory where the combination of AI capabilities improving at breakneck speed and AI alignment falling far behind risks leading to an AI apocalypse, but that we can avoid this risk if we pull ourselves together with appropriate adjustments of the trajectory.
3) I am aware that you have at various times asserted your blanket disagreement with everything you've written on xrisk up to 2019(?), but if you similarly disagree with what you wrote less than a year ago in the Washington Post, that gives a whole new time frame to your change of hearts.