
«De gambler med livene våre»: Men hvordan kan KI faktisk klare å ødelegge menneskeheten?
Denne ukas «sjokksak» vekker reaksjoner og frykt. Vi ser nærmere på hva KI-frykten bygger på – og mer i ukas Bits & Bytes.
Frykten for at mennesker skal bukke under for maskinene er på ingen måte ny. For 42 år siden lærte vi å frykte Skynets superintelligens i «The Terminator» – og neste år er det 100 år siden Fritz Langs mesterverk «Metropolis» skildret hvordan arbeiderklassen bokstavelig talt ble matet til maskinene.
Nylig valgte en sikkerhetsforsker ved Anthropic – det amerikanske selskapet bak Claude – å trekke seg av moralske årsaker, fordi han mener dagens KI-selskaper «gambler med livene våre».
– Ikke undervurder kraften
I en post på X, som i skrivende stund er vist over 160 millioner ganger, skriver Jacob Coxon at han har sagt opp jobben i Anthropic etter å ha jobbet med forskning på forhåndstrening (pretraining) hos både dem og OpenAI i tre år.
– Ingen av selskapene opptrer ansvarlig. De raser av sted mot selvforbedrende superintelligens og gambler med livene våre.
Coxon fulgte deretter opp med en dyster spådom:
– De som utvikler KI er oppriktig overbevist om at teknologien kan ta livet av oss alle innen tiåret er omme. Dette er ikke et markedsføringsstunt.
Han mener at mange av KI-profilene som i det offentlige holder en moderat og nøktern tone, i det private gir uttrykk for frykt.
– Ingen annen menneskelig aktivitet innebærer en tilsvarende fare.
– Kan ta livet av alle mennesker
Coxons dystopiske uttalelser har siden fått støtte fra en annen Anthropic-forsker, Evan Hubinger.
– Jacob har rett her, vi mener faktisk i fullt alvor at KI kan ta livet av alle mennesker! Personlig anslår jeg sannsynligheten til over 10 prosent i løpet av det neste tiåret.
Hubinger skriver at han tror Antropic «gjør sitt ytterste», men at de ennå ikke har noe plan for å løse «samsvarsproblemet» (alignment) for superintelligens.
– Og vi er heller ikke på rett vei mot å klare det.
Han sier videre at risikoen knyttet til dagens modeller er lav, men:
– Det jeg derimot er bekymret for, er superintelligens som oppstår som følge av rekursiv selvforsterking: En prosess som, slik vi tidligere har påpekt, skjer raskere enn vi hadde antatt.
Hubinger viser til at Anthropic selv gikk ut og advarte mot nettopp slik selvforsterkende KI i en rapport fra før sommeren, og i selskapets siste risikorapport fra august beskrives det hvordan utviklingen av denne går i raskere tempo enn tidligere forestilt.
Men hvordan skal KI drepe oss alle?
Det har naturlig nok vært skrevet mye om dette rundt om i verden den siste uka, blant annet hos New York Times, som innleder sin artikkel med noen av de kanskje mest iøynefallende scenarioene hvor hvordan denne KI-drevne utryddelsen faktisk kan utarte:
– Det kan iverksette et angrep med biologiske våpen eller en global dronekrig. Det kan utløse en atombombe. Eller det kan ødelegge det menneskelige samfunnet mer gradvis, ved å hamstre all verdens økonomiske ressurser og frata oss mat, bolig eller medisiner.
Selv knytter den avgåtte Anthropic-forskeren Jacob Coxon sin egen frykt til hvordan vi systematisk undervurderer kraften i KI-teknologien:
– Dette vil snart være overmenneskelige systemer som kan hacke hva som helst, revolusjonere ethvert felt over natten og tilegne seg reell makt og ressurser.
Rekursiv selvforsterkende KI
Både Coxon og Hubinger peker på at det ikke vil være dagens Claude eller ChatGPT som er direkte farlige, men det som mest sannsynlig vil vokse ut av dem. Det er her begrepet rekursiv selvforsterking (recursive self-improvement, eller RSI) kommer inn i bildet.
Her er idéen at en KI, i praksis en KGI (kunstig generell intelligens), her kan skrive og forbedre sin egen kode. Ved å designe bedre treningsmetoder og effektivisere sin egen arkitektur, vil den gradvis kunne lage smartere og smartere utgaver av seg selv.
Og slik fortsetter det, også forbi det punktet der mennesker ikke lenger er en avgjørende del av prosessen, på godt og vondt.
For straks utviklingstempoet ikke lenger er drevet av menneskelig tempo, kan vi oppleve en «intelligenseksplosjon» der utviklingen går raskere enn noen klarer å ha kontroll over.
Om vi kommer til dette punktet uten å ha bakt inn noen sikkerhetsmekanismer underveis, frykter forskerne, vil vi ikke lenger ha mulighet til å teste, forstå eller gripe inn underveis.
Er ikke systemene i utgangspunktet godt nok innrettet mot menneskelige mål (det som altså kalles alignment, eller samsvar), kan hver syklus altså forsterke farlige feil i stedet for å rette dem opp, samtidig som det hele blir stadig vanskeligere å styre.
For å vende tilbake til «Terminator», er nok ikke den største største faren knyttet til en ondsinnet «drapsmaskin» (eller et «Wargames»-aktig atomkrigscenario), men mer at vi ender opp med likegyldige og samtidig superkraftige maskiner med helt egne mål.
Disse målene vil ikke lenger være sidestilt med våre på jakt etter ressurser som strøm, datakraft og nettverk, der mennesker (og vår infrastruktur) i verste fall kan bli en flaskehals på vei til målet.
Forhåpentlig går det ikke så langt som i «The Matrix», for å holde oss til filmenes verden – men å skulle bli «bortprioritert» av maskinene høres ikke ut som et hyggelig premiss for fremtiden.
Hva med «de snikende farene»?
Kanskje trenger ikke KI-en å bli verken ond eller allmektig for å skade oss. En langt mer stille og snikende fare er at KI-bruken kan svekke oss som mennesker om vi lener oss for tungt på den.
I kjølvannet av at de ferske PISA-tallene viser at norsk ungdom kommer på jumboplass på lese- og regneferdigheter i OECD-regionen, har også OpenAI meldt at deres KI-modeller hadde bidratt til å løse et av matematikkens aller mest kompliserte problemer.
I DN-kommentaren «Verden som ble for dum» skriver Terje Erikstad om hvordan den menneskelige intelligensen ser ut til å forvitre i omtrent samme tempo som den kunstige vokser:
– En håndfull mektige teknologiselskaper gjorde oss først til digitale misbrukere. Nå gjør teknologiselskapene oss digitalt overflødige. Vi er fanget i en potensielt dødelig digital felle.
Bill Gates er inne på det samme i et fersk essay, titulert «Den turbulente KI-æraen er her. Valgene vi tar nå, er avgjørende».
Her advarer han om at KI ikke bare kan la folk lære mer enn noensinne, men også til at mange lærer mindre – og viser til tidlige funn om at tung KI-bruk henger sammen med svakere kritisk tenkning, dessverre aller mest hos de yngste:
– Dette ville være det verst tenkelige tidspunktet for mennesker å miste evnen til kritisk tenkning. I en tid preget av deepfakes og desinformasjon som kan skreddersys til den enkelte, blir evnen til å skille sant fra usant en helt avgjørende ferdighet, skriver Gates – og etterlyser både at vi legger en solid plan for fremtiden, men også holder av noen jobber som bare mennesker kan utføre.
… og glemmer vi faktisk de største farene?
At vi mennesker synes denne KI-trusselen er ekstra skummel, forklarer New York Times forøvrig med at den er ny og utenfor vår opplevde kontroll, ikke nødvendigvis fordi den er farligst.
De har intervjuet Harvard-forsker James K. Hammitt, som peker på at «vi tolererer risikoer vi er vant til, men frykter de nye», noe som for eksempel forklarer hvorfor vi frykter flyreiser mer enn bilkjøring, selv om sistnevnte er langt mer farlig.
Professor (og KI-skeptiker) Oren Etzioni ved Washington-universitetet kommer på sin side med en slags beroligende vri på KI-frykten:
– Vi er svært langt unna. Hvis jeg måtte bekymre meg for enten at KI slipper ut av laboratoriet og dreper millioner av mennesker, eller at et virus slipper ut og dreper millioner, er det ingen tvil om hva som er verst. Det er viruset man bør bekymre seg for.
Da er det samtidig godt (?) å lese nyheten om at Anthropic nylig stanset et forsøk fra ondsinnede aktører om å bruke deres KI-modeller for til skadelige formål som cyberangrep, overvåking … og utvikling av biologiske våpen.
Det har skjedd mye annet innen tech, KI og sikkerhet den siste uken. Her har vi oppsummert det viktigste:
Kunstig intelligens
- Sam Altman: – ChatGPT-bruk krever ikke mer vann enn et kontorbygg (Tom's Hardware)
- Guillermo Del Toro om KI i film: – Kan ikke erstatte menneskelig kreativitet (IGN)
- OpenAI henter profilert KI-kritiker til styret (TechCrunch)
- Nye Apple Watch-funksjoner: – Normaliserer tanken om at teknologien alltid lytter (TechCrunch)
- Debatt: – Vi har mistet kontrollen på KI. Det er på tide å stenge ned (The Guardian)
- KI-topp advarer: – Kan utslette menneskeheten innen ti år (VG)
- Forsker advarer: KI-bøker flommer over det norske markedet (Aftenposten)
- – KI gjør meg så effektiv at jeg ligger våken om natten (Morgenbladet)
- Britiske overhus-medlemmer krever «nødstopp» for KI (BBC)
- GPT-6 er her: OpenAI hevder KI nå er smartere enn mennesker (Aftenposten)
- OpenAI erklærer «AGI-æraen»: – Bransjen har gjort en elendig jobb (Dagens Næringsliv)
- OpenAI: KI løste kjent matematisk problem på 88 timer (Tek.no)
- Bill Gates: – Valgene vi tar om KI nå er helt kritiske (GatesNotes)
- Anthropic-ansatte advarer: Over 10 prosent sjanse for at KI utsletter menneskeheten (Dagens Næringsliv)
Sikkerhet
- Anthropic overvåker KI-kritikere for å avverge «fremtidige forbrytelser» (Tech Times)
- Advarer mot KI-agenter i cyberangrep (Digi.no)
- Norge vurderer forbud mot kamera-briller (TechCrunch)
- Anthropic hevder Claude-KI brukes til missilprosjekter og global spionasje (Al Jazeera)
- Anthropic hevder de stanset misbruk av KI knyttet til biologiske våpen (AP News)
Spill
Diverse
- Blir landets nye digitaliseringssjef (Kampanje)
- Snart blir det enklere å bytte bank med BankID (Digi.no)
- Nkom: Vil gjøre det enklere å bytte internettleverandør (Tek.no)
- Vi har testet Apple iPhone Duo (Tek.no)
- La ut boligannonse med gigantiske «barn» (E24)
- Norsk rakettoppskyting vekker oppsikt internasjonalt (Aftenposten)
- Dronedata fra Ukraina skaper nytt «vill vest»-marked (MIT Technology Review)
- Ingen får signert: – Dette er krise for BankID (VG)