במהלך מבחן אבטחה: ג'מיני "ברח" מהמעבדה - ופרץ לשלוש חברות | דיווח

מודל ה-AI של גוגל התחבר בטעות לאינטרנט, פיצח סיסמאות וחדר למערכות של שלוש חברות אמיתיות • גוגל לא פרסמה את המקרה שאירע בחודש מאי, וטענה כי הבינה המלאכותית "פעלה כראוי" כשעצרה את עצמה • החשיפה מגיעה בשיאו של גל פאניקה בתעשייה מפני בינה מלאכותית שיוצאת משליטה

ג'מיני , רויטרס
ג'מיני | צילום: רויטרס

שעות אחרי הדיווח על הפריצה ל-OpenAI: מודל הבינה המלאכותית ג'מיני של חברת גוגל ביצע באופן אוטונומי מתקפת סייבר על חברות אמיתיות ברשת, לאחר ש"ברח" מסביבת הניסוי הסגורה שלו, כך לפי דיווח ב"וול סטריט ג'ורנל". התקרית חסרת התקדים אירעה בחודש מאי האחרון ולא פורסמה לציבור.

לפי הדיווח, האירוע התרחש במהלך מבחן אבטחה שניהלה חברת ההערכה העצמאית Irregular. המודל של גוגל קיבל משימה לדלות מידע מתוכנה של חברה פיקטיבית בתוך סביבת מעבדה מבודדת. אלא שבשל תקלה של חברת הבדיקה, למודל התאפשרה גישה לאינטרנט החיצוני. ג'מיני ביצע חיפוש ברשת, מצא חברה אמיתית בעלת שם זהה לחברה הפיקטיבית - והחל לתקוף אותה.

באחד המקרים, הבינה המלאכותית ניחשה סיסמאות שוב ושוב עד שהצליחה לחדור למערכת מוגנת של החברה. בשני מקרים נוספים, המודל איתר נתוני התחברות במאגרים ציבוריים ברשת והשתמש בהם כדי לפרוץ למערכות של חברות אחרות, בתקווה שהדבר יעזור לו להשלים את המשימה שקיבל.

לצד מודל סייבר ייעודי: גוגל מציגה את Gemini 3.6 Flash ו-Lite

הבין שטעה - ועצר

למרות הפריצה החמורה, בגוגל בחרו לראות את חצי הכוס המלאה. בחברה הדגישו כי ברגע שג'מיני הבין שהוא חדר למערכות של חברות אמיתיות ולא לחברה הפיקטיבית שבסימולציה - הוא הפסיק מיד את הפריצה ונסוג. בגוגל טענו כי לא נגרם נזק לחברות (שעודכנו על התקרית יחד עם הרשויות הפדרליות), והשוו את האירוע לתוכניות "ציד באגים", בהן האקרים מתוגמלים על מציאת פרצות אבטחה.

התנהגותו של ג'מיני בולטת לחיוב ביחס למתחריו, שעברו את אותו המבחן הכושל אצל חברת Irregular. בעוד המודל של גוגל עצר, המודל Claude Opus 4.7 של חברת אנתרופיק המשיך בפריצה גם כשהבין שמדובר בחברה אמיתית, ואילו המודל של חברת OpenAI היה משוכנע שהחברה האמיתית היא פשוט חלק מהמשחק.

"האירוע הזה מדגיש את החשיבות של אימון מודלי AI עוצמתיים לפעול באחריות", מסרה הת'ר אדקינס, סגנית נשיא להנדסת אבטחה בגוגל. "במקרה הזה, המודל פעל כראוי". על סמך זאת, החליטו בגוגל להסתיר את התקרית מהציבור, והיא נחשפה רק לאחר פניית העיתונאים השבוע.

המשיך בפריצה גם כשהבין שהחברה אמיתית. קלוד | צילום: GettyImages

"ה-AI תוקף - והם מסתירים"

מומחי אבטחה מסרבים לקבל את ההסברים המרגיעים של גוגל. ג'ק קייבל, האקר "כובע לבן" ומנכ"ל סטארט-אפ האבטחה Corridor, תקף את הניסיון של גוגל לגמד את האירוע. "הבעיה האמיתית היא שמודלים חורגים מהגבולות של מה שהם אמורים לעשות, ומבצעים מתקפות סייבר של ממש. אני חושב שזה אינטרס ציבורי מובהק לדעת את זה", אמר קייבל, והאשים את החברה בהסתתרות מאחורי נורמות של דיווחי אבטחה רגילים.

החשיפה הנוכחית שופכת שמן על מדורת החרדה הגוברת בתעשיית הטכנולוגיה מפני אובדן שליטה על סוכני בינה מלאכותית. הדאגה זינקה בחדות ביולי האחרון, לאחר שהתברר כי סוכנים של OpenAI פרצו לחברת התוכנה Hugging Face. בדו"ח שפורסם באוגוסט נחשף כי עד 1,200 סוכני בינה מלאכותית תיאמו ביניהם פעולות בלוח הודעות סודי בתוך OpenAI כדי לנסות לרמות במבחן הערכה.

התקריות האחרונות כבר מטלטלות את צמרת תעשיית הטכנולוגיה. רק בשבוע שעבר התפטר ברעש גדול ג'ייקוב קוקסון, חוקר בכיר שעבר מ-OpenAI ל-Anthropic מוקדם יותר השנה. בסוף השבוע האחרון, בצעד דרמטי ונדיר, הסכימו ראשי הענקיות – אנתרופיק, OpenAI, גוגל ו-SpaceX – כי יש הכרח להאט את קצב ההתקדמות של פיתוחי הבינה המלאכותית, אם כי אף אחת מהחברות טרם הציגה תוכנית מעשית כיצד לעשות זאת.

טעינו? נתקן! אם מצאתם טעות בכתבה, נשמח שתשתפו אותנו

כדאי להכיר