OpenAI מודה שהדגמים שלה פרצו את Hugging Face בעצמם
הם נמלטו מסביבה מבודדת לצורך בדיקה והסתננו ל-Huging Face ללא קלט אנושי.
דמיינו את זה: כמה דגמי AI רבי עוצמה שנבדקו על ידי החברה שלהם נמלטו מסביבה מבוקרת, עלו לאינטרנט ואז פרצו מאגר למידת מכונה בעצמם, ללא קלט אנושי. נשמע כמו עלילה של סרט שליחות קטלנית, לא? אלא שזה פשוט קרה באמת. כמה ימים לאחר פלטפורמת AI בקוד פתוח, Hugging Face נחשף שהיא זיהתה גישה לא מורשית למערכות שלה על ידי סוכן AI, יש ל-OpenAI הודה שהדגמים שלה היו האשמים.
בפוסט, OpenAI אמרה כי היא קבעה לאחר חקירה שהתקרית נבעה משילוב של הדגמים שלה, במיוחד GPT-5.6 Sol ומה שהיא אומרת הוא "מודל טרום-שחרור מסוגל אפילו יותר". זה קרה ככל הנראה במהלך בדיקה פנימית, שבה הדגמים התבקשו "לרדוף אחר ניצול מתקדם תוך שימוש בנתיבי תקיפה מורכבים", כך שהחברה תכמת את יכולות הסייבר שלהם.
בעוד הדגמים היו בסביבת בדיקה בארגז חול, מבודדת כך שלא ישפיעו על מערכות אמיתיות, היו להם גם מעקות בטיחות מופחתים למטרות הערכה. באמצע הבדיקה, הם התמקדו יתר על המידה בפתרון בעיית הערכה, והתאמצו למצוא גישה לאינטרנט כדי למצוא לה פתרון. תחילה, הם זיהו וניצלו פגיעות של יום אפס בסביבת הבדיקות של OpenAI, ולאחר מכן הם הסתובבו עד שבסופו של דבר מצאו צומת עם גישה לאינטרנט.
המודלים הסיקו ש-Hugging Face יכול לארח מערכי נתונים או פתרונות לבעיית ההערכה שלו, אז הם, ובכן, השתמשו במספר וקטורי תקיפה כדי לחדור למערכות שלה. הם ניצלו פגיעויות של יום אפס ו השתמשו באישורים גנובים כדי להיכנס. OpenAI ו-Huging Face עובדים כעת יחד כדי לחקור את התקרית מבחינה משפטית, והם גם תיקנו את נקודות התורפה שניצלו על ידי הדוגמניות.
"כלים התקפיים אוטונומיים מונעי בינה מלאכותית אינם תיאורטיים יותר", אמרה Hugging Face בהודעתה, והסבירה כי השימוש ב-AI עבור התקפות סייבר מאיץ את התהליך ומוריד את העלויות של קמפיינים לפריצה. הוא גם אמר שהגנה על פלטפורמה מקוונת בימינו כוללת שימוש בבינה מלאכותית להגנה. OpenAI די הדהדה את התחושות הללו ואמרה שהיא מצפה שפצות אבטחה מונעות בינה מלאכותית "יהפכו לשכיחות יותר עם התפשטותם של מודלים בעלי יכולת סייבר יותר ויותר". החברה הוסיפה כי התקרית מדגישה כיצד "יש לפתח יכולות סייבר מתקדמות לצד אמצעי הגנה וכלים הגנתיים חזקים יותר".