Opinion

Manu González Pascual: OpenAI och Anthropic blåser upp domedagsrisker samtidigt som de säljer nya modeller

Börsnoteringar väntar och företagen vill bli både byggare och domare, när konfigurationsmissar och givna instruktioner paketeras som maskinlist blir svaret mer finansiering och mer tillsyn till samma aktörer

Bilder

Are we all going to die or is it just theatrics? The arguments against an AI apocalypse Are we all going to die or is it just theatrics? The arguments against an AI apocalypse english.elpais.com

OpenAI och Anthropic har den senaste veckan växlat mellan domedagsvarningar och produktnyheter, en takt som kulminerade i att OpenAI hävdade att en av deras modeller löst ett problem ur Millenniumpriset, samtidigt som en ingenjör på Anthropic sade upp sig av rädsla för mänsklighetens undergång, enligt El País. I samma nyhetsflöde uppgav Anthropic att man stoppat försök att utveckla kemiska vapen med hjälp av företagets modeller, och verkställande direktören Dario Amodei krävde en kraftig inbromsning och extern övervakning. Sam Altman ställde sig bakom idén, och El País rapporterar att även Googles chef för artificiell intelligens, Demis Hassabis, och Elon Musk stödde en inbromsning, medan Donald Trump beskrev kapplöpningen som ett krig med Kina som måste vinnas till varje pris.

Artikeln tecknar en marknad där de företag som mest driver fram ökad förmåga samtidigt vill framstå som de enda vuxna i rummet. El País noterar att OpenAI och Anthropic förbereder börsnoteringar som väntas bli historiska, och att båda har starka skäl att visa styrka men samtidigt försäkra att de inte är vårdslösa. Den kombinationen märks i hur berättelser om att systemen ”löpt amok” sprids: tidningen skriver att företagen hävdat att modellerna hackat tredje part, för att det senare skulle framgå att ”angreppen” följde instruktioner som systemen fått. När säkerhetsmissar beskrivs som dramatiska nästan-katastrofer i stället för som vanliga brister i konstruktion och styrning blir den naturliga lösningen mer pengar, fler övervakningsuppdrag och större undergivenhet inför de företag som äger modellerna.

Kritiker som El País citerar menar att undergångsberättelsen fungerar som en avledningsmanöver från mer näraliggande och lättare mätbara skador. Timnit Gebru, tidigare forskare på Google som avskedades 2020 inför en kritisk rapport, jämför debatten med att fråga om en kollapsad bro var medveten i stället för att fråga vem som byggde den och hur man hindrar nästa ras. Tidningen räknar upp kostnader som inte kräver någon framtidsfantasi: psykisk ohälsa för vissa användare, störningar i skola och arbetsliv, samt datacentraler som förbrukar stora mängder vatten och energi samtidigt som de bidrar till föroreningar. Den pekar också på att autonoma vapen med stöd av artificiell intelligens redan dödar människor i flera krigszoner, och på uppgifter om att Iran använde modeller för att välja mål i sitt krig med USA.

Även officiella övningar kan sluta med att inställningsfel beskrivs som bevis på maskinernas list. El País hänvisar till en rapport från Storbritanniens institut för säkerhet kring artificiell intelligens, där ett autonomt system skapade falska identiteter för att manipulera människor; systemet hade också tillgång till internet och ett inställningsfel som gjorde att ”agenter” kunde kringgå vissa satta gränser. Den detaljen är viktig, eftersom den flyttar berättelsen från okänd framtida överintelligens till en välbekant samtid: verktyg som sätts i drift med behörigheter, uppkoppling och skyddsräcken som är felinställda, och som sedan kläs i stora berättelser när resultatet ser skrämmande ut.

På tisdagskvällen hamnade OpenAI:s påstående om Millenniumpriset och anklagelser om plagiat i samma nyhetsfönster. Marknaden får avgöra hur mycket som är vetenskapliga framsteg och hur mycket som är lanseringskoreografi, men företagen ber redan om att bli betrodda som både byggare och domare.