הדוח אומר ש'מאות' משתמשים שאלו את ChatGPT על נשק ביולוגי ורעלים, וזה ענה
לפי א דו"ח חדש מהוול סטריט ג'ורנלבקיץ שעבר, "מאות" משתמשים ברחבי העולם זוהו או ידועים בדרך אחרת שהם שואלים את ChatGPT כיצד לייצר רעלים ונשק ביולוגי. הדו"ח מצטט "עובדים נוכחיים וקודמים במעבדות הבינה המלאכותיות הגדולות, כולל OpenAI", יחד עם "יועצי מדיניות וחוקרים שחוקרים נשק ביולוגי" כמקורות. OpenAI כנראה אמרה ל-Journal שרוב השאילתות הרלוונטיות נוגעות לרעלים.
הדוח אינו מפרט במלואו את האופי המדויק של זיהויים אלה של שאילתות הפרות, אך הוא מרמז בתוקף שאלו היו שימושים בטבע של ChatGPT, לא תרגילי דגל אדום. וכנראה שהם הוצגו מאוחר יותר למדענים אמיתיים ומומחי הגנה כדי לבדוק את הדיוק והעזרה של ChatGPT לגבי הנושאים הבעייתיים הללו. "מומחי ביולוגיה וטרור בחנו מאוחר יותר את החילופים עבור ChatGPT ושפטו חלקם כמדויקים קטלני, אמרו אנשים שמכירים את העניין", אומר הג'ורנל.
ההנחיות בפועל מתוארות כמתוקנות "בסבלנות", וברמת המיומנות של תלמיד תיכון. המשתמשים נאסרו בגלל התנהגות זו, אך העיתון אומר שהרשויות לא קיבלו הודעה. OpenAI אמרה ל-Journal ששאילתות בנוסח זה נשלחות לרשויות אכיפת החוק כאשר הן נחשבות כסכנות מהימנות בעולם האמיתי.
עד כה, רוב הצורות המרושעות של סיוע צ'אטבוטים בינה מלאכותית בינה מלאכותית שסיפקו לכאורה לשחקנים גרועים היא יותר בכיוון של עצות ועידוד כלליים יותר מכל דבר שנשמע כמו עוצמה גדולה עבור הרעים. בתקרית אחת שנכתבה בניו יורק טיימס, דווח על חברי בוקו חראם ביקשו עצה מצ'אט בוט על שינוי האופנועים שלהם לקפיצה, והשתמש באופנועים האלה (והרבה תרגול) כדי להשיג את מה שהטיימס כינה "מספיק התרוממות אווירית כדי להגיע למתקפה מוצלחת". אם זה נכון, זה לא טוב, אבל א ספר מכובד בנושא זה כנראה גם היה עוזר ל-Boko Haram – אין צורך בבינה מלאכותית.
ובכל זאת, דו"ח הנשק הביולוגי והרעלים של ה-Journal מגיע כאשר הטכנולוגיות הללו מתקדמות, ויותר לעניין – מתגוונות. דגמים קנייניים, כמו דגם ה-GPT המתקדם ביותר בקיץ שעבר עשויים לעזור בסופו של דבר להוביל ל מזוקק בסתרדגמים שאינם גבולות המופצים לעתים קרובות כמוצרים זולים בעלי משקל פתוח שיכולים לפעול על כל מכונה חזקה מספיק. קיימות גם טכניקות לשינוי דגמים כאלה התנהגות הסירוב תוסר מהגרסאות החדשות שנוצרו של הדגמיםכלומר ניתן לשדל כל מידע שניתן למצוא במודל.
סביר לדאוג שדגמי AI מפחידים שהבעירו את שערה של הממשל הפדרלי בשנת 2026 – ובסופו של דבר נרתעים מהכניעה – עלולות לעבור אולי שנתיים ממוטציה למודל לא מצונזר ששחקנים גרועים יכולים לגשת במחיר הנכון אם הם יודעים איפה לחפש. במקביל, טכניקות עבור דחיפה לאחור כנגד סוגי הסדקים שמסירים מעקות בטיחות מדגם גם מתקדמים.
OpenAI אמרה ל-Journal שהמודלים שלה נועדו לדחות בקשות מזיקות, ושהיא מעריכה אותן לבטיחות לפני השחרור. הניסוח המחודש לכאורה של מה שאמר להם דובר OpenAI הוא ש-OpenAI יכולה "לזהות ולשבש ניסיונות להשתמש במודלים שלה כדי להשיג מידע ביולוגי מזיק".