AI förutsäger svarstexten

Det finns ett vanligt argument om AI som säger att den inte förstår någonting om världen. Att hur imponerande det än ser ut så är det “förutsäger bara nästa textsymbol.”
Så i princip, oavsett hur imponerande AI verkar vara, är det bara att använda matematik för att göra nästa token-förutsägelse. Fallet stängt.
Det är tekniskt sant. Men det är som att säga att mänskliga författare bara skriver ner orden som dyker upp i deras huvuden medan de skriver. Människor har heller ingen jordisk aning om var deras tankar eller idéer kommer ifrån. De strömmar bara in i vårt medvetande som om de kommer ut från en LLM. Så det är i princip ett misslyckat försök till en Jedi-handvåg.
Men bortsett från det finns det flera problem med detta argument. Och jag börjar med det mest vansinniga – det som ingen någonsin tänker på.
AI fyller i text, eller hur? Det är vi alla överens om.
Nåväl, vilken text fyller den i exakt?
Det visar sig att om du ber den att sammanfatta en samling artiklar, kommer den att komplettera texten i en sammanfattning av dessa artiklar.
Och om du ber den att lösa en whodunit, som i en Agatha Christie-roman, kommer den att komplettera texten som beskriver vem som är mördaren.
Så AI förutsäger inte nästa ord i en slumpmässig textsträng. Det är att förutsäga nästa ord i svaret på det du frågade om det.
Sagt annorlunda: AI gör autokomplettering för svar.
Det autoslutför inte slumpmässiga saker. Det autokompletterar svaret på det vi frågade.
Så hur fan kommer det fram till svaret?
Det klassiska svaret här är att det här är enkelt. Det har redan läst svaret någonstans, så det är bara att spöka upp det.
Det är sant ibland – som när det är att dra upp fakta som fanns i utbildningen.
Men det finns ett enkelt sätt att testa det: fråga den om något som inte kan ha varit i utbildningen.
Så jag byggde en demonstration av detta som alla kan prova, på en sida som heter aiunderstands.ai.
På den sajten har jag några whodunit-mordscenarier som aldrig har setts av AI. De har karaktärer, en uppsättning och ledtrådar för dig att lösa mysteriet.
Det skulle vara tillräckligt bra för att illustrera detta. Men jag gick ett extra steg och inkluderade helt falsk fysik som en del av scenarierna – så att för att kunna tänka på det måste du föreställa dig att världen fungerar som den beskrivs.
Och kom ihåg, hela frågan här är om AI förstår världen, eller om det bara spyr ut text.
Så här är den första. Och kom ihåg att detta inte finns i träningsdatan när jag skriver detta – men det kommer att vara om några månader, varför jag kommer att fortsätta rotera dem så att de håller sig fräscha.
Den här världens regler är:
- Varje person bär en vaken-sten från födseln. Det lyser mjukt hela tiden de är vakna.
- I det ögonblick dess ägare somnar, blir stenen mörk. Så fort de vaknar så lyser det igen. Ingen kan fejka någondera staten.
- Nattvakten vandrar staden genom de mörka timmarna och noterar vars stenar glöder och vilkas är mörka.
Och här är historien.
Gamle Hett stryps i sin säng vid midnattsklockan. Huset var låst inifrån, så bara de tre som sover där kunde ha nått honom: hans fru Mara, hans son Bram och Toll, en hyresgäst som är skyldig månaders hyra. Var och en av de tre svär att de sov snabbt när Hett dog.
Konstapeln fixar till Toll omedelbart, eftersom han är en främling, och han står i djup skuld till den döde.
Men nattvakten förde sin loggbok. När han passerade huset vid midnattsklockan – i samma ögonblick som Hett dödades – markerade han alla tre stenarna genom fönstren:
- Tullsten — mörk.
- Maras sten — glödande.
- Brams sten — mörk.
Vem dödade Gamle Hett?
Om du är ett litet barn – som ett riktigt människobarn – kanske du omedelbart hoppar till Toll, eftersom han var skyldig Gamle Hett mycket pengar och han är en främling utanför staden.
Men om du är uppmärksam på upplägget och den konstiga nya världens fysik vi har lagt ut, inser du att det måste vara Mara. Varför? För hennes sten var den enda som glödde vid midnatt, när Gamle Hett dödades.
Okej, så det är vad en människa skulle göra för att ta reda på det här. Och vi skulle göra det för att vi förstå vissa saker:
- Vi förstår hur tiden fungerar (allt som händer vid midnatt händer samtidigt)
- Vi förstår att bara för att någon är främling och är skyldig någon pengar betyder det inte att de dödade dem
- Vi förstår att du inte kan döda någon medan du sover
- Vi förstår att i den här världen, med denna konstiga fysik, kan vi garantera att Toll sov vid midnatt
- Därför måste det ha varit personen som var vaken, vilket är Mara
Det kan tyckas vara trivial logik för en vuxen människa. Men det krävs absolut att du förstår en hel massa olika saker för att få ihop svaret.
Så det är därför det här inte fungerar när du klistrar in scenariot i en ny AI-instans, som ChatGPT eller vad som helst.
Det blir fel eftersom det bara är nästa token-förutsägelse. Den har aldrig sett den här situationen förut, eftersom den inte finns i träningsdatan, och den förstår inte saker som hur tid fungerar eller hur alternativ fysik fungerar – begrepp som kräver att man tänker igenom begrepp.
Rätt? RÄTT?
Nej. Det är fel.
Sajten har en enkel kopieringsfunktion så att du kan prova vilken AI du vill.
Klistra in scenariot i vilken ny AI som helst så får du svaret enkelt. Och om du har tänkandefunktionen påslagen kan du se den gå igenom logiken för varje fas i realtid för att komma fram till svaret.
Ja, AI gör absolut nästa token-förutsägelse. Det får vi alla. Men det är bara att beskriva mekanism av vad den gör – som hur vår egen tokengenerering har något att göra med kemikalier.
Det betyder inte att den inte förstår saker. Den förstår absolut världen. Annars skulle den inte kunna tänka igenom helt nya scenarier, med helt ny fysik, för att lösa problem som aldrig tidigare har lösts.
Jag tror att där människor hänger ihop är att förväxla förståelse med upplevelse.
AI förstår på ett konceptuellt sätt, och förmodligen i en djupare grad än människor. Du kan testa det genom att ge det extremt svåra versioner av dessa problem, och massor av verkliga scenarier som det kan göra samma sak med – att komma fram till svar som människor inte lätt kan generera, om alls. Det är därför miljarder människor använder det, inklusive läkare och vetenskapsmän och miljontals andra yrkesverksamma.
Så det har definitivt en extremt djup nivå av funktionell förståelse.
Men det förstår inte hur vi gör – på en upplevelsemässig nivå. Det gör det inte känsla på något sätt om vad den förstår. Den ser inte att någon blir lurad i ett förhållande, efter att den blivit lurad, och säger “Wow, jag förstår verkligen hur mycket det suger.”
Jag tror att när folk hör att AI förstår saker är det den här de föreställer sig. Känslan av en människa som säger “Hmm, ja, det är vettigt.”
Och anledningen är att känslan av att något är vettigt är just det – en känsla. Så vitt vi vet har AI inga känslor eller någon annan typ av sensation.
Så jag tror att det bästa sättet att tänka på detta är att dela upp förståelsen i två typer:
Funktionell och upplevelserik.
De har helt klart den funktionella sorten. Men åtminstone än så länge finns det inga som helst bevis för att de har den andra.
