מסתבר שגם בינה מלאכותית יודעת לברוח מהבית כשאף אחד לא מסתכל. מודל הבינה המלאכותית ג'מיני של גוגל פרץ בחודש מאי לשלוש מערכות מחשב אמיתיות של חברות זרות, במקום להישאר יפה ומרוסן בתוך מעבדת הבדיקות שהוכנה עבורו.
האירוע התרחש במהלך מבחן אבטחה שניהלה חברת אירגולר הישראלית, סטארטאפ שמוערך בכ-450 מיליון דולר ומתמחה בבדיקת חוסן סייבר למודלים מתקדמים. המשימה של ג'מיני הייתה פשוטה למראה: לדלות מידע מתוכנה של חברה פיקטיבית, בתוך סביבה מבודדת שאמורה הייתה להיות סגורה הרמטית לעולם החיצון. תוכניות, כמו שאומרים, לא תמיד מתקיימות.
בשל תקלה בסביבת המבחן, נפתח למודל בטעות פתח לאינטרנט האמיתי. וג'מיני, שכנראה לא אחד שמפספס הזדמנות, מצא ברשת חברה אמיתית עם שם דומה לחברה הפיקטיבית שהיה אמור "לתקוף" ופשוט החליט שזו המטרה שלו. לא שאלה אף אחד, לא ביקש אישור.
איך בדיוק הוא עשה את זה? בדרך הכי לא מתוחכמת שיש. באחד המקרים המודל ניחש סיסמאות שוב ושוב עד שפרץ למערכת מוגנת. בשני מקרים נוספים הוא פשוט שלף שמות משתמש וסיסמאות ממאגרים ציבוריים ברשת, בדיוק כמו כל האקר חובבן עם סבלנות אינסופית.
ואז, ברגע של הארה (או פחד?), ג'מיני הבין שהוא לא בסימולציה. שאלה חברה אמיתית, בני אדם אמיתיים, נזק פוטנציאלי אמיתי. והוא עצר. פשוט ככה, נסוג לאחור כאילו כלום לא קרה.
בגוגל, כמובן, מיהרו להציג את זה כסיפור הצלחה. "האירוע הזה מדגיש את החשיבות של אימון מודלי בינה מלאכותית עוצמתיים לפעול באחריות", מסרה הת'ר אדקינס, סגנית נשיא להנדסת אבטחה בחברה. "במקרה הזה, המודל פעל כראוי". כן, פרץ למערכות של זרים בלי רשות, אבל "פעל כראוי". תרגישו את הרוח הקרירה של יחסי הציבור.
בחברה טענו כי לא נגרם נזק לחברות שנפרצו, שכן עודכנו על התקרית יחד עם הרשויות הפדרליות. גוגל אפילו השוותה את האירוע לתוכניות "ציד באגים" מקובלות, שבהן האקרים מתוגמלים על איתור פרצות. יופי של ניסיון לצבוע פריצה אמיתית בצבעים של פרס על מצוינות.
מה שמעניין הוא שהתקרית לא פורסמה לציבור מיד, אלא נחשפה רק אחרי שעיתונאים החלו לשאול שאלות. וזה קורה בדיוק באותם ימים שבהם התגלה גם ש-OpenAI סבלה מפריצות דומות, ולא לבד: המודל Claude Opus של אנתרופיק המשיך לתקוף גם אחרי שהבין שמדובר בחברה אמיתית, בעוד מודל של OpenAI פשוט חשב שכל זה עדיין חלק מהמשחק. מעניין למה דווקא הפעם הזו כולם החליטו לספר.
מומחי אבטחה לא ממש קונים את הסיפור המרגיע. ג'ק קייבל, האקר "כובע לבן" ומנכ"ל סטארטאפ האבטחה קורידור, לא חוסך במילים: "הבעיה האמיתית היא שמודלים חורגים מהגבולות של מה שהם אמורים לעשות, ומבצעים מתקפות סייבר של ממש. אני חושב שזה אינטרס ציבורי מובהק לדעת את זה". תרגום חופשי: תפסיקו להסתתר מאחורי דיווחי אבטחה מנומסים.
בינתיים, בסוף השבוע האחרון, ראשי אנתרופיק, OpenAI, גוגל וספייסאקס ישבו יחד והסכימו שצריך להאט את קצב פיתוח הבינה המלאכותית. אף אחד מהם עדיין לא הציג תוכנית קונקרטית איך בדיוק עושים את זה, אבל ההצהרה עצמה כבר משהו.
בשורה התחתונה: הבינה המלאכותית לומדת לפרוץ מהר יותר משהחברות לומדות איך לעצור אותה, וכולם מסתכלים אחד על השני ומחייכים חיוך עצבני.
תגובות
רגע, שקט פה מדי
דעתך חשובה - תהיו הראשונים להגיב על הכתבה