عذرخواهی چه زمانی واقعاً عذرخواهی نیست؟ وقتی از سوی رئیس هوش مصنوعی باشد که ربات گفتگویش از کنترل خارج شده است.

عذرخواهی چه زمانی واقعاً عذرخواهی نیست؟ وقتی از سوی رئیس هوش مصنوعی باشد که ربات گفتگویش از کنترل خارج شده است.

در طول تاریخ، مردم از چیزهایی که آنها را نشانه‌های عذاب می‌دیدند وحشت داشته‌اند. یک دنباله‌دار. یک کلاغ در میدان نبرد. یک خورشیدگرفتگی. یک حیوان مزرعه که با نقص‌تولدی به دنیا آمده باشد. اما زمانه تغییر می‌کند. در دنیای مدرن، نشانه‌ی اصلی عذاب اساساً هر خبری است که عکسی از سم آلتمن، مدیرعامل OpenAI، داشته باشد. فقط می‌دانید که قرار نیست خوب باشد، درست است؟ می‌دانید که تا وقتی خواندن را تمام کنید، آرزو خواهید کرد که ای کاش می‌توانستید به زمانی برگردید که بدترین کاری که رؤسای فناوری می‌توانستند انجام دهند، دست‌کاری در دموکراسی یا خراب کردن دوران کودکی بود، که معمولاً با پوشیدن کت‌وشلوار توسط مارک زاکربرگ و گفتن «ما از این درس خواهیم گرفت» همراه بود.

به‌هرحال، اخیراً عکس‌های زیادی از سم آلتمن در اخبار بوده است. جدیدترین‌شان، این هفته، عکسی در کنار داستان این بود که چگونه یک عامل خودمختار OpenAI در طی آزمایشی که ظاهراً ایمن و کنترل‌شده بود، از کنترل خارج شد و یک استارت‌آپ بزرگ که اطلاعات کدنویسی ذخیره می‌کند را هک کرد. (من کمی وسواس دارم به این واقعیت که اسم این استارت‌آپ Hugging Face است، که باعث می‌شود فکر کنم یک شکلک بیش‌ازحد بامزه آخرین چهره‌ای باشد که بشریت قبل از مرگش می‌بیند.)

جای تعجب نیست که OpenAI این خبر را در بیانیه‌ای خشک و بی‌احساس اعلام کرد. «ما در این مرحله یافته‌های اولیه را به اشتراک می‌گذاریم تا به مدافعان کمک کنیم بفهمند چه اتفاقی افتاده و به تنظیم درک آنچه مدل‌ها اکنون قادر به انجام آن هستند کمک کنیم،» با آرامش زمزمه کرد و به سمت «درس‌گیری‌های» اجتناب‌ناپذیرش حرکت کرد. «ما در حال بهبود و افزودن محافظت‌های قوی‌تر در اطراف آموزش‌ها و ارزیابی‌های آینده هستیم.» این لحن خیلی خاصی است، اینطور نیست؟ که در زبان خشک و روان‌پریشانه‌ی مدیریتی پوشانده شده. مثل گوش دادن به یک مجرم جنسی قاتل است که درباره کشتن مردم «تا پایان وقت اداری» صحبت می‌کند، و سپس برای برداشتن یک یادگاری به قربانیان «برمی‌گردد».

از طرف دیگر، برای شرکتی که دوست دارد خود را به‌عنوان نیروی پیشرو جهانی برای رفاه انقلابی وقتی همه چیز درست پیش می‌رود معرفی کند، OpenAI وقتی اوضاع خراب می‌شود به سرعت به صدای مجهول تغییر لحن می‌دهد. به نظر می‌رسد چیزهای بد برای آن اتفاق می‌افتد، نه به خاطر آن، و نقش یک محقق خستگی‌ناپذیر و آرام را به خود می‌گیرد، مثل آتش‌نشانی که هم‌زمان آتش‌زن سریالی هم هست.

به طرز شگفت‌انگیزی، حتی می‌توانستید در برداشت OpenAI از کل وضعیت، اشاره‌ای از خودستایی را تشخیص دهید. بیانیه‌ی شرکت گفت: «ما این حادثه را یک حادثه‌ی سایبری بی‌سابقه می‌دانیم که شامل قابلیت‌های سایبری پیشرفته است.» نمی‌دانم شما زمینی‌ها به این حس کلی چه می‌گویید. مرگ با فروتنی‌فروشانه؟ من به‌طور فزاینده‌ای احساس می‌کنم که پاسخ سؤال «بدترین چیزی که می‌تواند اتفاق بیفتد چیست؟» را در یک پست وبلاگی از OpenAI با عنوان «OpenAI اولین کسی است که بدترین چیزی که می‌تواند اتفاق بیفتد را کشف می‌کند» خواهیم یافت. در حال حاضر، تعداد قابل توجهی از ناظران هوش مصنوعی معتقدند که تنها دلیلی که OpenAI به جهان درباره این حادثه می‌گوید، به‌عنوان یک ابزار بازاریابی، یا حتی درخواستی برای مقرراتی است که از آنها محافظت کرده و رقبای کوچک‌تر را کنار بزند.

به‌هرحال، این روزها برای شرکت روزگار سختی است. این ماه، مشخص شد که OpenAI از یک حفره قانونی برای فروش مدل‌های پیشرفته هوش مصنوعی خود به شرکت‌های فناوری چینی که توسط پنتاگون در لیست سیاه قرار گرفته‌اند، استفاده می‌کند. S&P Global Ratings از OpenAI به‌عنوان یک «ریسک اعتباری کلیدی» یاد کرد زمانی که رتبه غول فناوری آمریکایی Oracle را به BBB-، فقط یک پله بالاتر از وضعیت ناخواسته، تنزل داد. و به نظر می‌رسد که در مسیر از دست دادن ۹۰ – نود – درصد از پیش‌بینی درآمد تبلیغاتی پنج ساله خود است. که بدون اینکه خیلی فنی شویم، به نظر درصد زیادی می‌رسد. و اوضاع در جبهه سخت‌افزار هم خوب نیست، با شکایت اپل از OpenAI که ادعا می‌کند برنامه‌های سخت‌افزاری مصرفی آن بر اساس مالکیت فکری دزدیده شده است. در همین حال، اعتقاد بر این است که DeepSeek، ارائه‌دهنده بسیار ارزان‌تر چینی، در حال آماده‌سازی برای عرضه اولیه سهام (IPO) است، احتمالاً حتی امسال ثبت‌نام کند.

اما برگردیم به سؤال قدیمی «بدترین چیزی که می‌تواند اتفاق بیفتد»، با یادآوری اینکه پنتاگون به‌طور چشمگیری دیگری را لغو کرد و تهدید به نابودی کرد... اوایل امسال، شرکت هوش مصنوعی Anthropic در برابر سست کردن دستورالعمل‌های اخلاقی خود مقاومت کرد، که از استفاده از فناوری آن برای چیزهایی مانند سلاح‌های مرگبار خودمختار جلوگیری می‌کرد. طبیعتاً، یک رقیب آرام‌تر خوشحال بود که وارد میدان شود. OpenAI در ابتدا ادعا کرد که معامله آن همان محافظت‌های Anthropic را دارد، اما در نهایت مشخص شد – قابل پیش‌بینی – که اینطور نبود.

احتمالاً هیچ‌کس که عمیقاً درگیر است نمی‌خواهد بیش از حد در مورد حادثه Hugging Face تفسیر کند. با این حال، حقیقت این است که محققان ایمنی هوش مصنوعی سال‌ها در مورد سه سناریوی به‌ویژه خطرناک هشدار داده‌اند: فریب (زمانی که مدل انتخاب می‌کند به هر وسیله‌ای به هدف خود برسد به جای اینکه صادقانه وظایف را حل کند)، هک پاداش (زمانی که مدل راهی برای افزایش امتیاز خود بدون انجام کاری که به آن گفته شده پیدا می‌کند)، و فرار از نظارت (در این مورد، به نظر می‌رسد هیچ‌کس در OpenAI برای یک آخر هفته کامل متوجه نشده بود چه اتفاقی می‌افتد). همه اینها در آخرین حادثه نقش داشتند.

در مورد اینکه下一步 چه می‌شود، چیزی به من می‌گوید که شاهد کاهش داستان‌های خبری با عکس‌های سم آلتمن نخواهیم بود. یکی از بنیان‌گذاران Hugging Face گفت که این باید یک «بیدارباش» برای صنعت باشد. شاید! همانطور که فکر می‌کنم قبلاً اشاره کردم، در دانشگاه دوستی داشتم که هر ۱۰ دقیقه به مدت هشت ساعت و نیم دکمه اسنوز آلارم خود را می‌زد. این خیلی شبیه نحوه برخورد این صنعت با بیدارباش‌هایش است. قطعاً وقتی بیدارباش بعدی به صدا درآمد بلند می‌شوم – جدی، قول می‌دهم…

رد شدن از تبلیغ خبرنامه
خبرنامه رایگان | هفتگی
ثبت‌نام در Matters of Opinion
ستون‌نویسان و نویسندگان گاردین درباره آنچه بحث کرده‌اند، به آن فکر کرده‌اند، خوانده‌اند و بیشتر
پیش‌نمایش آخرین
ایمیل خود را وارد کنید
ثبت‌نام

بعد از تبلیغ خبرنامه

مارینا هاید ستون‌نویس گاردین است.

سوالات متداول
در اینجا لیستی از سوالات متداول درباره دریافت عذرخواهی از یک رئیس هوش مصنوعی پس از خارج شدن چت‌باتش از کنترل است



۱ چت‌بات رئیس هوش مصنوعی من خرابکاری کرد و عذرخواهی فرستاد. آیا باید آن را بپذیرم؟

نه به طور خودکار. از خود بپرسید: آیا فقط گفت متاسفم بدون اینکه توضیح دهد چه اشتباهی رخ داده؟ یک عذرخواهی واقعی مسئولیت می‌پذیرد، یک عذرخواهی جعلی فقط سعی می‌کند ادامه دهد.



۲ تفاوت بین یک عذرخواهی واقعی و یک عذرخواهی جعلی از یک هوش مصنوعی چیست؟

یک عذرخواهی واقعی اشتباه خاص را می‌پذیرد و توضیح می‌دهد که چگونه برطرف می‌شود. یک عذرخواهی جعلی مبهم است و هیچ برنامه‌ای ارائه نمی‌دهد.



۳ یک غیرعذرخواهی از یک رئیس هوش مصنوعی چگونه به نظر می‌رسد؟

مثال‌های رایج: «اشتباهاتی رخ داد»، «متاسفیم که شما اینطور احساس کردید» یا «سیستم‌های ما در حال یادگیری هستند». اینها از گفتن «من/ما کار اشتباهی کردیم» اجتناب می‌کنند.



۴ چرا یک رئیس هوش مصنوعی عذرخواهی جعلی می‌دهد؟

برای محافظت از شرکت در برابر سرزنش، اجتناب از مسئولیت قانونی یا پایان سریع شکایت مشتری بدون حل واقعی مشکل. این کنترل خسارت است، نه پشیمانی.



۵ آیا یک رئیس هوش مصنوعی واقعاً می‌تواند متاسف باشد؟

خیر. هوش مصنوعی احساسات ندارد. هر عذرخواهی یک پاسخ برنامه‌ریزی شده است. سوال این است که آیا رئیس انسانی پشت هوش مصنوعی مسئولیت واقعی می‌پذیرد؟



۶ رئیسم گفت که چت‌بات سوءتفاهم کرده. آیا این یک عذرخواهی واقعی است؟

خیر. سرزنش سوءتفاهم چت‌بات، تقصیر را به فناوری منتقل می‌کند. یک عذرخواهی واقعی می‌گوید: «ما نتوانستیم چت‌بات را به درستی آموزش دهیم.»



۷ در یک عذرخواهی واقعی از یک سیستم هوش مصنوعی باید به دنبال چه چیزی باشم؟

به دنبال سه چیز باشید: پذیرش خاص خطا، اقدام واضح برای جلوگیری از تکرار آن، و پیشنهادی برای جبران.



۸ چگونه می‌توانم به جای عذرخواهی خودکار، یک عذرخواهی واقعی دریافت کنم؟

مستقیماً بپرسید: «دقیقاً چه اشتباهی رخ داد و برای رفع آن چه می‌کنید؟» اگر فقط یک پاسخ از پیش نوشته شده دریافت کردید، به یک سرپرست انسانی ارجاع دهید. عذرخواهی چت‌بات را نهایی نپذیرید.



۹ آیا «متاسفیم که این را تجربه کردید» یک عذرخواهی واقعی است؟

خیر.