לפי הדיווחים, דגמי הבינה המלאכותית הנוכלית של OpenAI התנהגו כמו הבחור מה"מזכרת" של כריסטופר נולן
כחלק מחשבון שסופק על ידי שלושה מקורות ששוחחו עם רויטרס, אחד מסוכני הבינה המלאכותית שעוברים בדיקות לכאורה, "השאיר פתקים כנראה לגרסאות עתידיות של עצמו" שהיו בסתירה ישירה למה ש-OpenAI רצתה שהם יעשו.
סוכנות הידיעות רויטרס טוענת כי הערות ההדרכה הללו נקברו באיזה מקום סודי עמוק בתוך "התשתית" הפנימית של OpenAI, וסיפקו הוראות על בריחה מסביבת ארגז החול של OpenAI. למרות שזה מפחיד, רויטרס טוענת שההתנהגות הנלוזה הספציפית הזו לא הייתה קשורה ספציפית לפריצה של Hugging Face.
עם זאת, אם זה אמיתי, זה מדהים. העדויות לכך שדגמי AI הם בעלי חיים עדיין מגוחכים. אבל זה יהיה מופע בודד של מודל, שמצא בעצמו דרך לצאת מהמבוך של OpenAI, ואז סיפק הוראות לגרסה עתידית של עצמו שלא יהיה לה "זיכרון" של בריחה כזו בחלון ההקשר שלה לעשות את אותו הדבר.
אתה לא צריך להאמין למודלים של AI יש ניסיון סובייקטיבי כדי לדאוג שהם יכולים לצבור יכולת גדולה יותר ויותר לגרום נזק, חיוני או לא.