NÀr Àr en ursÀkt inte riktigt en ursÀkt? NÀr den kommer frÄn en AI-chef vars chattbot har gÄtt över styr.

NÀr Àr en ursÀkt inte riktigt en ursÀkt? NÀr den kommer frÄn en AI-chef vars chattbot har gÄtt över styr.

HÀr Àr översÀttningen av texten frÄn engelska till svenska:

Genom historien har mÀnniskor blivit skrÀmda av saker de sÄg som tecken pÄ undergÄng. En komet. En krÄka pÄ ett slagfÀlt. En solförmörkelse. Ett lantbruksdjur som föds med en missbildning. Men tiderna förÀndras. I den moderna vÀrlden Àr det frÀmsta tecknet pÄ undergÄng i princip vilken nyhetsartikel som helst med en bild pÄ OpenAI:s vd Sam Altman. Man vet bara att det inte kommer att vara bra, eller hur? Man vet att nÀr man Àr klar med att lÀsa kommer man att önska att man kunde gÄ tillbaka till nÀr det vÀrsta tech-chefer kunde göra var att mixtra med demokratin eller förstöra barndomar, oftast följt av att Mark Zuckerberg tar pÄ sig en kostym och sÀger: "Vi kommer att lÀra oss av detta."

Hur som helst, det har funnits mÄnga bilder pÄ Sam Altman i nyheterna pÄ sistone. Senast, denna vecka, dök en upp tillsammans med berÀttelsen om hur en OpenAI autonom agent gick bÀrsÀrk under ett förmodat sÀkert och kontrollerat test, och hackade en stor startup som lagrar kodningsinformation. (Jag Àr lite besatt av det faktum att denna startup heter Hugging Face, vilket fÄr mig att tro att nÄgon alltför gullig emoji kommer att vara det sista ansiktet mÀnskligheten ser innan den dör.)

Inte överraskande meddelade OpenAI nyheten i ett platt, kÀnslolöst uttalande. "Vi delar preliminÀra resultat i detta skede för att hjÀlpa försvarare att förstÄ vad som hÀnde och för att hjÀlpa till att kalibrera vad modeller nu Àr kapabla till," dronade det lugnt, pÄ vÀg mot sina oundvikliga "lÀrdomar." "Vi förbÀttrar och lÀgger till starkare skydd kring framtida trÀning och utvÀrderingar." Det Àr en sÄ specifik ton, eller hur? KlÀdd i det psykopatiska, torra sprÄket frÄn management-snack. Det Àr som att lyssna pÄ en mordisk sexbrottsling som pratar om att döda mÀnniskor "vid dagens slut," och sedan "Äterkoppla" till offer för att ta bort en trofé.

Å andra sidan, för ett företag som gillar att presentera sig som vĂ€rldens ledande kraft för revolutionerande vĂ€lstĂ„nd nĂ€r saker gĂ„r rĂ€tt, vĂ€xlar OpenAI snabbt till passiv form nĂ€r saker gĂ„r fel. DĂ„liga saker verkar hĂ€nda det, inte pĂ„ grund av det, och det tar pĂ„ sig rollen som en outtröttlig, oberörd utredare, som en brandman som ocksĂ„ jobbar som seriemordbrĂ€nnare.

Otroligt nog kunde man till och med ana en antydan till sjÀlvberöm i OpenAIs syn pÄ hela situationen. "Vi betraktar denna incident som en aldrig tidigare skÄdad cyberincident," sade företagets uttalande, "som involverar toppmoderna cyberkapaciteter." Jag vet inte vad man skulle kalla denna allmÀnna stÀmning för jordbor. Död genom ödmjukt skryt? Jag kÀnner alltmer att vi kommer att fÄ reda pÄ svaret pÄ frÄgan "Vad Àr det vÀrsta som kan hÀnda?" i ett blogginlÀgg frÄn OpenAI med titeln "OpenAI först med att upptÀcka det vÀrsta som kan hÀnda." Redan nu tror ett betydande antal AI-bevakare att den enda anledningen till att OpenAI skulle berÀtta för vÀrlden om denna incident Àr som ett marknadsföringsverktyg, eller till och med en vÀdjan om reglering som skulle skydda dem och stÀnga ute mindre konkurrenter.

NĂ€r allt kommer omkring Ă€r dessa tuffa tider för företaget. Denna mĂ„nad upptĂ€cktes OpenAI anvĂ€nda en juridisk kryphĂ„l för att sĂ€lja sina avancerade AI-modeller till kinesiska teknikföretag som svartlistats av Pentagon. S&P Global Ratings citerade OpenAI som en "viktig kreditrisk" nĂ€r det nedgraderade den amerikanska teknikjĂ€tten Oracle till BBB-, bara ett steg över skrĂ€pstatus. Och det verkar vara pĂ„ vĂ€g att missa sin femĂ„riga annonsintĂ€ktsprognos med 90 – NITTIO – procent. Vilket, utan att bli alltför tekniskt, kĂ€nns som en hel del procent. Och det gĂ„r inte bra pĂ„ hĂ„rdvarufronten heller, med Apple som stĂ€mmer OpenAI och pĂ„stĂ„r att dess konsumenthĂ„rdvaruplaner Ă€r baserade pĂ„ stulen immateriell egendom. Samtidigt tros Kinas mycket billigare leverantör, DeepSeek, förbereda sig för en börsintroduktion, möjligen till och med ansöka i Ă„r.

Men tillbaka till den gamla frĂ„gan om "det vĂ€rsta som kan hĂ€nda," med en pĂ„minnelse om att Pentagon dramatiskt skrotade och hotade att förstöra en annan... Tidigare i Ă„r motstod AI-företaget Anthropic att luckra upp sina etiska riktlinjer, som förhindrade att dess teknologi anvĂ€ndes för saker som autonoma dödliga vapen. Naturligtvis var en mer avslappnad konkurrent glad att kliva in. OpenAI hĂ€vdade initialt att dess avtal hade samma skyddsĂ„tgĂ€rder som Anthropics, men det blev sĂ„ smĂ„ningom klart – förutsĂ€gbart – att det inte hade det.

Ingen som Ă€r djupt engagerad vill förmodligen lĂ€sa för mycket in i Hugging Face-incidenten. ÄndĂ„ Ă€r sanningen att AI-sĂ€kerhetsforskare i Ă„ratal har varnat för tre sĂ€rskilt farliga scenarier: bedrĂ€geri (nĂ€r modellen vĂ€ljer att uppnĂ„ sitt mĂ„l med alla medel snarare Ă€n att lösa uppgifter Ă€rligt), belöningshackning (nĂ€r modellen hittar ett sĂ€tt att öka sin poĂ€ng utan att faktiskt göra arbetet den blev tillsagd att göra), och att undkomma tillsyn (i detta fall verkade ingen pĂ„ OpenAI mĂ€rka vad som hĂ€nde under en hel helg). Alla dessa spelade en roll i den senaste incidenten.

NĂ€r det gĂ€ller vad som kommer hĂ€rnĂ€st, sĂ€ger nĂ„got mig att vi inte kommer att se en minskning av nyhetsartiklar med bilder pĂ„ Sam Altman. Medgrundaren av Hugging Face sade att detta borde vara en "vĂ€ckarklocka" för branschen. Kanske! Som jag tror jag nĂ€mnt tidigare, pĂ„ college hade jag en vĂ€n som tryckte pĂ„ snooze pĂ„ sitt alarm var tionde minut i Ă„tta och en halv timme. Det kĂ€nns mycket som hur denna bransch hanterar sina vĂ€ckarklockor. Definitivt att gĂ„ upp nĂ€r nĂ€sta ringer – allvarligt, jag lovar


Hoppa över nyhetsbrevspromotion
Gratis nyhetsbrev | Veckovis
Prenumerera pÄ Matters of Opinion
Guardians kolumnister och skribenter om vad de har debatterat, tÀnkt pÄ, lÀst och mer
Förhandsvisa senaste
Ange din e-post
Prenumerera

Efter nyhetsbrevspromotion

Marina Hyde Àr kolumnist pÄ Guardian.

Vanliga frÄgor
HÀr Àr en lista med vanliga frÄgor om att fÄ en ursÀkt frÄn en AI-chef efter att dess chattrobot har gÄtt bÀrsÀrk



1 Min AI-chefs chattrobot stökade till sig Den skickade en ursÀkt Bör jag acceptera den

Inte automatiskt FrÄga dig sjÀlv Sa den bara förlÄt utan att förklara vad som gick fel En riktig ursÀkt tar ansvar en falsk försöker bara gÄ vidare



2 Vad Àr skillnaden mellan en riktig ursÀkt och en falsk frÄn en AI

En riktig ursÀkt erkÀnner det specifika misstaget och förklarar hur det ska ÄtgÀrdas En falsk Àr vag och erbjuder ingen plan



3 Hur lÄter en icke-ursÀkt frÄn en AI-chef

Vanliga exempel Misstag gjordes Vi beklagar att du kÀnde sÄ eller VÄra system lÀr sig Dessa undviker att sÀga Jag/vi gjorde nÄgot fel



4 Varför skulle en AI-chef ge en falsk ursÀkt

För att skydda företaget frÄn skuld undvika juridiskt ansvar eller snabbt avsluta ett kundklagomÄl utan att faktiskt lösa problemet Det Àr skadebegrÀnsning inte Änger



5 Kan en AI-chef faktiskt kÀnna Änger

Nej AI har inga kÀnslor Varje ursÀkt Àr ett programmerat svar FrÄgan Àr om den mÀnskliga chefen bakom AI tar verkligt ansvar



6 Min chef sa att chattroboten missförstod Är det en riktig ursĂ€kt

Nej Att skylla pÄ chattrobotens missförstÄnd flyttar skulden till tekniken En riktig ursÀkt skulle sÀga Vi misslyckades med att korrekt trÀna chattroboten



7 Vad ska jag leta efter i en genuin ursÀkt frÄn ett AI-system

Leta efter tre saker Specifikt erkÀnnande av felet En tydlig ÄtgÀrd för att förhindra att det hÀnder igen och Ett erbjudande om att göra rÀtt



8 Hur fÄr jag en riktig ursÀkt istÀllet för den automatiserade

FrÄga direkt Vad exakt gick fel och vad gör ni för att ÄtgÀrda det Om du bara fÄr ett manusstyrt svar eskalera till en mÀnsklig handledare Acceptera inte chattrobotens ursÀkt som slutgiltig



9 Är ett "vi beklagar att du upplevde detta" en riktig ursĂ€kt

Nej Det