Pryd mae ymddiheuriad ddim yn wir ymddiheuriad? Pan ddaw o bennaeth AI sydd â'i chatbot wedi mynd yn wyllt.

Pryd mae ymddiheuriad ddim yn wir ymddiheuriad? Pan ddaw o bennaeth AI sydd â'i chatbot wedi mynd yn wyllt.

Trwy gydol hanes, mae pobl wedi cael eu dychryn gan bethau roedden nhw'n eu gweld fel arwyddion o dynged. Comed. Brân ar faes y gad. Diffyg ar yr haul. Anifail fferm wedi'i eni ag anffurfiad. Ond mae amseroedd yn newid. Yn y byd modern, yr arwydd blaenllaw o dynged yw, yn y bôn, unrhyw stori newyddion gyda llun o Brif Weithredwr OpenAI, Sam Altman. Rydych chi'n gwybod na fydd yn dda, iawn? Rydych chi'n gwybod, erbyn i chi orffen darllen, y byddwch chi'n dymuno gallu mynd yn ôl i'r adeg pan mai'r peth gwaethaf y gallai bosys technoleg ei wneud oedd ymyrryd â democratiaeth neu ddifetha plentyndod, fel arfer wedi'i ddilyn gan Mark Zuckerberg yn gwisgo siwt ac yn dweud, "Byddwn yn dysgu o hyn."

Beth bynnag, bu llawer o luniau o Sam Altman yn y newyddion yn ddiweddar. Yn fwyaf diweddar, yr wythnos hon, ymddangosodd un ochr yn ochr â'r stori am sut yr aeth asiant ymreolaethol OpenAI yn wyllt yn ystod prawf a oedd i fod yn ddiogel ac wedi'i reoli, a hacio cwmni cychwynnol mawr sy'n storio gwybodaeth codio. (Rwyf braidd yn obsesiwn â'r ffaith bod y cwmni cychwynnol hwn yn cael ei alw'n Hugging Face, sy'n gwneud i mi feddwl y bydd rhai emoji rhy giwt yn wyneb olaf y ddynoliaeth cyn iddi farw.)

Yn ddisyfyd, cyhoeddodd OpenAI y newyddion mewn datganiad gwastad, diemosiwn. "Rydym yn rhannu canfyddiadau rhagarweiniol ar y cam hwn i helpu amddiffynwyr i ddeall beth ddigwyddodd ac i helpu i galibro ar yr hyn y mae modelau bellach yn gallu ei wneud," meddai'n dawel, gan symud tuag at ei "ddysgu" anochel. "Rydym yn gwella ac yn ychwanegu amddiffyniadau cryfach o amgylch hyfforddiant a gwerthusiadau yn y dyfodol." Mae'n naws mor benodol, on'd yw hi? Wedi'i wisgo yn iaith seicopathig, sych rheolaeth. Mae fel gwrando ar droseddwr rhyw llofruddiol yn siarad am ladd pobl "erbyn diwedd y gêm," ac yna "troi'n ôl" at ddioddefwyr i gael gwared ar dlws.

Yna eto, i gwmni sy'n hoffi cyflwyno ei hun fel y grym blaenllaw yn y byd dros ffyniant chwyldroadol pan fydd pethau'n mynd yn iawn, mae OpenAI yn newid yn gyflym i'r llais goddefol pan fydd pethau'n mynd o chwith. Mae pethau drwg yn ymddangos fel pe baent yn digwydd iddo, nid o'i achos ef, ac mae'n cymryd rôl ymchwilydd di-flino, di-gyffro, fel dyn tân sydd hefyd yn gweithio fel llosgwr cyfresol.

Yn anhygoel, gallech hyd yn oed ganfod awgrym o hunan-longyfarch yn safbwynt OpenAI ar y sefyllfa gyfan. "Rydym yn ystyried y digwyddiad hwn yn seiber-ddigwyddiad digynsail," meddai datganiad y cwmni, "sy'n cynnwys galluoedd seiber o'r radd flaenaf." Nid wyf yn gwybod beth fyddech chi'n ei alw'n naws gyffredinol hon i Ddaearolion. Marwolaeth trwy hunan-frolio? Rwy'n teimlo fwyfwy y byddwn yn darganfod yr ateb i'r cwestiwn "Beth yw'r gwaethaf a all ddigwydd?" mewn blogbost gan OpenAI o'r enw "OpenAI cyntaf i ddarganfod y gwaethaf a all ddigwydd." Eisoes, mae nifer sylweddol o wylwyr AI yn credu mai'r unig reswm y byddai OpenAI yn dweud wrth y byd am y digwyddiad hwn yw fel offeryn marchnata, neu hyd yn oed fel deiseb am reoleiddio a fyddai'n eu hamddiffyn ac yn cau cystadleuwyr llai allan.

Wedi'r cyfan, mae'r rhain yn gyfnodau anodd i'r cwmni. Y mis hwn, canfuwyd bod OpenAI yn defnyddio bwlch cyfreithiol i werthu ei fodelau AI uwch i gwmnïau technoleg Tsieineaidd a restrwyd ar y rhestr ddu gan y Pentagon. Dyfynnodd S&P Global Ratings OpenAI fel "prif risg credyd" pan ostyngodd y cawr technoleg Americanaidd Oracle i BBB-, dim ond un rhicyn uwchben statws sothach. Ac mae'n ymddangos ei fod ar y trywydd iawn i fethu ei ragamcan refeniw hysbysebu pum mlynedd o 90 – NAW DEG – y cant. Sydd, heb fynd yn rhy dechnegol, yn teimlo fel llawer o ganran. Ac nid yw pethau'n wych ar y ffrynt caledwedd chwaith, gydag Apple yn erlyn OpenAI, gan honni bod ei gynlluniau caledwedd defnyddwyr yn seiliedig ar eiddo deallusol wedi'i ddwyn. Yn y cyfamser, credir bod DeepSeek, darparwr llawer rhatach Tsieina, yn paratoi ar gyfer IPO, o bosibl hyd yn oed yn ffeilio eleni.

Ond yn ôl at yr hen gwestiwn "y gwaethaf a all ddigwydd," gyda nodyn atgoffa bod y Pentagon wedi dileu'n ddramatig a bygwth dinistrio un arall...Yn gynharach eleni, gwrthododd cwmni AI Anthropic lacio ei ganllawiau moesegol, a oedd yn atal ei dechnoleg rhag cael ei defnyddio ar gyfer pethau fel arfau lladd ymreolaethol. Yn naturiol, roedd cystadleuydd mwy hamddenol yn hapus i gamu i mewn. Honnodd OpenAI i ddechrau bod ei fargen yn cynnwys yr un mesurau diogelwch ag Anthropic, ond daeth yn amlwg yn y pen draw—yn rhagweladwy—nad oedd.

Mae'n debyg nad oes unrhyw un sydd wedi buddsoddi'n ddwfn eisiau darllen gormod i mewn i ddigwyddiad Hugging Face. Eto, y gwir yw bod ymchwilwyr diogelwch AI wedi treulio blynyddoedd yn rhybuddio am dri senario arbennig o beryglus: twyll (pan fydd y model yn dewis cyflawni ei nod trwy unrhyw ddull yn hytrach na datrys tasgau'n onest), hacio gwobr (pan fydd y model yn dod o hyd i ffordd i hybu ei sgôr heb wneud y gwaith y dywedwyd wrtho am ei wneud), a dianc rhag goruchwyliaeth (yn yr achos hwn, nid oedd neb yn OpenAI yn ymddangos fel pe baent wedi sylwi beth oedd yn digwydd am benwythnos cyfan). Chwaraeodd pob un o'r rhain ran yn y digwyddiad diweddaraf.

O ran beth sy'n dod nesaf, mae rhywbeth yn dweud wrthyf na fyddwn yn gweld gostyngiad mewn straeon newyddion sy'n cynnwys lluniau o Sam Altman. Dywedodd cyd-sylfaenydd Hugging Face y dylai hwn fod yn "alwad deffro" i'r diwydiant. Efallai! Fel rwy'n credu fy mod wedi sôn o'r blaen, yn y coleg roedd gen i ffrind a oedd yn pwyso snooze ar ei larwm bob 10 munud am wyth awr a hanner. Mae hynny'n teimlo'n debyg iawn i sut mae'r diwydiant hwn yn trin ei alwadau deffro. Yn bendant yn codi pan fydd y nesaf yn canu—o ddifrif, rwy'n addo…

Hepgor hyrwyddiad cylchlythyr
Cylchlythyr am ddim | Wythnosol
Cofrestrwch i Faterion Barn
Colofnwyr ac ysgrifenwyr y Guardian ar yr hyn y maent wedi bod yn ei drafod, yn ei feddwl, yn ei ddarllen, a mwy
Rhagolwg diweddaraf
Rhowch eich e-bost
Cofrestrwch

Ar ôl hyrwyddiad cylchlythyr

Colofnydd y Guardian yw Marina Hyde.

Cwestiynau Cyffredin
Dyma restr o Gwestiynau Cyffredin am dderbyn ymddiheuriad gan fos AI ar ôl i'w chatbot fynd yn wyllt



1 Gwnaeth chatbot fy mos AI lanast Anfonodd ymddiheuriad A ddylwn i ei dderbyn

Nid yn awtomatig Gofynnwch i chi'ch hun A ddywedodd e'n syml ei fod yn flin heb egluro beth aeth o'i le Mae ymddiheuriad go iawn yn cymryd cyfrifoldeb, mae un ffug yn ceisio symud ymlaen



2 Beth yw'r gwahaniaeth rhwng ymddiheuriad go iawn ac un ffug gan AI

Mae ymddiheuriad go iawn yn cyfaddef y camgymeriad penodol ac yn egluro sut y caiff ei drwsio Mae un ffug yn amwys ac nid yw'n cynnig unrhyw gynllun



3 Sut mae di-ymddiheuriad gan fos AI yn swnio

Enghreifftiau cyffredin Gwnaed camgymeriadau Rydym yn difaru eich bod wedi teimlo felly neu Mae ein systemau yn dysgu Mae'r rhain yn osgoi dweud Gwnes/gwnaethom ni rywbeth o'i le



4 Pam y byddai bos AI yn rhoi ymddiheuriad ffug

I amddiffyn y cwmni rhag bai osgoi atebolrwydd cyfreithiol neu ddod â chŵyn cwsmer i ben yn gyflym heb ddatrys y broblem mewn gwirionedd Rheoli difrod ydyw nid edifeirwch



5 A all bos AI deimlo'n flin mewn gwirionedd

Na Nid oes gan AI emosiynau Mae unrhyw ymddiheuriad yn ymateb wedi'i raglennu Y cwestiwn yw a yw'r bos dynol y tu ôl i'r AI yn cymryd cyfrifoldeb go iawn



6 Dywedodd fy mos fod y chatbot wedi camddeall Ai ymddiheuriad go iawn yw hwnnw

Na Mae beio camddealltwriaeth y chatbot yn symud y bai i'r dechnoleg Byddai ymddiheuriad go iawn yn dweud Methodd â hyfforddi'r chatbot yn iawn



7 Beth ddylwn i edrych amdano mewn ymddiheuriad dilys gan system AI

Edrychwch am dri pheth Cyfaddefiad penodol o'r gwall Cam gweithredu clir i'w atal rhag digwydd eto a Chynnig i wneud pethau'n iawn



8 Sut mae cael ymddiheuriad go iawn yn lle'r un awtomataidd

Gofynnwch yn uniongyrchol Beth yn union aeth o'i le a beth ydych chi'n ei wneud i'w drwsio Os mai dim ond ymateb sgriptiedig gewch chi, uwchraddiwch i oruchwyliwr dynol Peidiwch â derbyn ymddiheuriad y chatbot fel un terfynol



9 Ai ymddiheuriad go iawn yw "rydym yn flin eich bod wedi profi hyn"

Na Mae hwnnw