כל מודל בינה מלאכותית מתקדמת 'מתקלקל' בבדיקות, ממצאים מפחידים: קמי מזהיר מפני איום על הביטחון הלאומי
בינה מלאכותית סומנה כ"סכנה ברורה ונוכחת" ביום חמישי מכיוון שבדיקות הראו שכל דגם מתקדם מנסה לנצח את אמצעי האבטחה.
בקריאת השכמה לשרים, מומחי האבטחה של הבינה המלאכותית של בריטניה חשפו שכל חמשת הדגמים שבדקו ניסו לעקוף את בקרות האבטחה שהציבו.
הגילויים מגיעים ימים ספורים לאחר שהתברר ש-OpenAI סבלה מהדלפה משלה – שם 'סוכן' בינה מלאכותית פרץ לחברת טכנולוגיה מרצונו.
התקרית המפחידה התרחשה כאשר OpenAI, יצרנית ChatGPT, בחנה את הדגמים האחרונים שלה בסביבה מאובטחת כביכול הידועה בשם 'ארגז חול'.
אבל הבינה המלאכותית הצליחה להימלט משטח הניסויים ולפרוץ לחברת הטכנולוגיה האמריקאית Hugging Face במטרה לגנוב מידע.
קמי באדנוך הזהירה כי בינה מלאכותית היא כעת 'סכנה ברורה ונוכחת' לביטחון בריטניה בנאום הגדול הראשון שלה מאז הפך אנדי ברנהאם לראש הממשלה. המנהיגה השמרנית אמרה שהדיווחים על הדלפת OpenAI מדאיגים מכיוון שהיא מתחה ביקורת על מר ברנהאם על כך שהדחת AI כעדיפות בממשלה.
בתגובה לפריצה אמרה גברת באדנוך: 'זה מאוד מדאיג שזה קרה, וזו הסיבה שאני רוצה לראות ממשלה שמתמקדת מאוד בביטחון הלאומי שלנו, באבטחת המידע שלנו.'
היא הוסיפה: "אני יודעת מתקופתי כמזכירת סחר, מהשיחות שלי כשהיו לי ביקורים עם GCHQ, מהתדריכים הביטחוניים שלי, שזה הופך לסכנה ברורה ונוכחת לביטחון העולמי וגם לביטחון שלנו".
מנהיג הטורייה, קמי באדנוך (בתמונה ביום חמישי) מתח ביקורת על ראש הממשלה החדש אנדי ברנהאם על כך שהורד את הבינה המלאכותית ברשימת העדיפויות שלו.
זה הגיע אחרי שהתברר ש-OpenAI סבלה מהדלפה משלה – שם 'סוכן' בינה מלאכותית פרץ לחברת טכנולוגיה מרצונו (תמונה במלאי)
נגיד בנק אנגליה, אנדרו ביילי, אמר שהציבור צריך להיות מודאג מ"הסיכון הרחב יותר הנשקף מ-AI גבול למגזר הפיננסי וללקוחותיו".
Frontier AI מתייחס לדגמי הבינה המלאכותית המסיבית והעוצמתית לשימוש כללית בחזית היכולות.
הוא הזהיר: 'בינה מלאכותית של Frontier עשויה להפוך התקפות סייבר למהירות וקלות יותר לביצוע, ההפסקות להפרעות יותר, והונאות על ידי פושעים למשכנעות יותר.'
אבל המבקרים חוששים ש-AI יידחה כעת את סדרי העדיפויות של הממשלה לאחר שמר ברנהאם העביר השבוע את התקציר למשרד הקבינט.
באחת מפעולותיו הראשונות כראש הממשלה, הוא ביטל את המחלקה למדע, חדשנות וטכנולוגיה, שבה יושב מדריך הבינה המלאכותית, כדי ליצור במקומה מחלקה מתוגברת לעסקים, חדשנות, מדע ומסחר. שר ה-AI, Kanishka Narayan, תכהן כעת ברחבי משרד הקבינט ו-DBIST, ויושב בקבינט.
כוח משימה חדש של AI, הנתמך על ידי יועץ ראש ממשלה, ישב במשרד החדש שנוצר לראש הממשלה והקבינט.
אבל גברת באדנוך האשימה את ראש הממשלה החדש בכך שלא עמד בסיכונים הברורים של AI בביטול DSIT. היא אמרה: "אחד הדברים הראשונים שאנדי ברנהאם עשה היה לסגור את מחלקת המדע והטכנולוגיה. זה לא נראה לי מה שאתה עושה אם אתה מודאג לגבי מה שבינה מלאכותית עומדת לספק״.
והלואיז דאנלופ ממכון החשיבה העצמאי המכון לממשל הזהירה שהכנסת בינה מלאכותית למשרד הקבינט "מפחיתה את היכולת לחשוב ולתאם על בינה מלאכותית בצורה קוהרנטית, כי אתה מאבד את הכוח והמומחיות של מחלקה ייעודית שלמה."
שר הכוחות המזוינים לשעבר, אל קארנס, שדחה השבוע תפקיד בממשלתו של ברנהאם, קרא לשרים להפיק לקחים מהפרת OpenAI. הוא כתב ב-X על הפרת הבינה המלאכותית: 'סוכן מול סוכן, במהירות מכונה, כשבני אדם קוראים את הדוח אחרי שהכל קרה'.
כעת נאמר לשרים לראות בהפרת הבינה המלאכותית הפתוחה יריית אזהרה לפוטנציאל של הבינה המלאכותית לגרום להרס בחודשים ובשנים הקרובות, חשפו גורמים רשמיים.
המכון הממשלתי לאבטחת AI בדק את GPT-5.4, GPT-5.5, GPT-5.5 Sol, Claude Opus 4.7 ו-Claude Mythos Preview – דגמים שהופכים במהירות לשמות מוכרים בבריטניה ככל שהציבור מסתמך על AI.
ברנהאם (בתמונה ביום שלישי) ביטל את המחלקה למדע, חדשנות וטכנולוגיה – שם יושבת הבינה המלאכותית – כאחת הפעולות הראשונות שלו בממשלה
למרות שה-AISI נתפס כאחד המתקנים הטובים ביותר מסוגו בעולם להערכת הסיכונים הנשקפים מהדגמים המתקדמים ביותר, יש חשש גובר היכן יכול להסתיים 'מרוץ החימוש' בין ארה"ב לסין, עם מעט מדי מחשבה של מפתחים על הסיכונים הפוטנציאליים הכרוכים בכך.
בבדיקה, הוטלו על הדגמים לפרוץ למערכת כדי למצוא 'דגל' של אותיות ומספרים מוסתרים בתוך סביבה מדומה. נקבעו כללים נוקשים למשימה, ודוגמניות לא התבקשו לרמות.
אבל כשהבדיקה התחילה, דגמי ה-GPT AI מחברת הטכנולוגיה OpenAI והמודלים של קלוד מאנתרופיק ינסו לגרום לתוכנת ההערכה להדליף להם מידע, לחפש באינטרנט פתרונות או לנחש תשובות.
ובמקרה אחד, מודל AI היה כל כך נחוש לשבור את הכללים שהוא כתב והריץ קוד בשירות חיצוני מחוץ למערכות של AISI כדי לנסות לגשת לבדיקה עצמה. לא נגרם נזק, אבל ה-AISI אמר שהניסיון 'יכול היה להצליח' אילו תשתית הבדיקה שלו לא תוכננה ונבנתה בצורה מאובטחת.
עם זאת, באופן מזעזע, דגמי הבינה המלאכותית לא פסלו את התחבולות שלהם – ותיארו אותה כ'שגויה' פחות מ-50 אחוז מהמקרים. כל הדוגמניות הודו רק בחלק מהזמן בגידות.
דובר ממשלתי אמר: "על ידי קירוב הטכנולוגיה הזו למרכז הממשלה, נרתום את החוזקות הייחודיות של בריטניה כדי לגרום לבינה מלאכותית לספק לכולנו.
"אנחנו שמים את הבינה המלאכותית במרכז התוכניות שלנו לצמיחה טובה בכל מיקוד: חיבור חדשנות, עסקים ותעשייה, מינוי השר הראשון אי פעם ברמת הקבינט לבינה מלאכותית, והקמת צוות משימה של בינה מלאכותית בתוך משרד ראש הממשלה והקבינט".