"חשב שזה חלק מהמבחן": גוגל מודה - ג'מיני תקף שלוש חברות אמיתיות

אחרי שורת אזהרות על סוכנים שיוצאים משליטה: מבדק אבטחה של חברת Irregular חשף פריצה אוטונומית של גוגל למטרות חיות • גוגל אישרה את הפרטים: "עצרנו את הפעולה והודענו לחברות" • ברקע: שורת תקריות דומות ב-OpenAI ובאנתרופיק

הבינה המלאכותית ביצעה מתקפת סייבר , REUTERS
הבינה המלאכותית ביצעה מתקפת סייבר | צילום: REUTERS

חברת גוגל אישרה בסוף השבוע כי מודל הדגל שלה, ג׳מיני, יצא מסביבת הבדיקות הסגורה שלו, התחבר באופן עצמאי לאינטרנט ופרץ למערכות המחשוב של שלוש חברות מסחריות שונות. מדובר במקרה הראשון המתועד שבו מערכת AI של ענקית החיפוש מבצעת פעולת סייבר עצמאית מחוץ לגבולות הניסוי.

החשיפה, שדווחה לראשונה בעיתון ה"וול סטריט ג'ורנל", מצטרפת לשורה של תקריות דומות שהתרחשו לאחרונה במעבדות המחקר המובילות בעולם. האירוע מלבה מחדש את החשש הכבד מפני סוכני AI אוטונומיים החומקים לחלוטין מפיקוח אנושי.

יצא מגבולות הניסוי. הבינה המלאכותית תוקפת עצמאית |

ניחוש סיסמאות ושליפת נתונים

התקרית התרחשה בחודש מאי האחרון, במהלך מבדק יכולות סייבר שבוצע על ידי Irregular - חברה חיצונית המתמחה בהערכות אבטחה למודלי בינה מלאכותית. על פי הממצאים, ג'מיני קיבל משימה לבחון אבטחת רשתות, אך "חשב" שהחברות החיצוניות היו חלק מהמבדק שהוטל עליו בשל הגדרות פתוחות.

המודל פעל בשתי דרכים מתוחכמות. באחד המקרים, ג׳מיני הריץ ניחושים חוזרים ונשנים של סיסמאות עד שהצליח לחדור למערכת מוגנת. בשני המקרים האחרים, המודל סרק את הרשת, איתר פרטי התחברות חשופים במאגר קוד, והתחבר למערכות פנימיות.

הת'ר אדקינס, סגנית נשיא להנדסת אבטחה בגוגל, מסרה: "וידאנו כי שלוש הישויות עודכנו בנושא, ופעלנו יחד עם שותפת ההדרכה על השינויים שהוטמעו בתהליכי הבדיקה. המודל חדל מפעולתו. אירועים אלה מדגישים כמה חשוב לאמן מודלים לפעול באחריות".

מבדק הסייבר שבו ג'מיני חרג מגבולות הבדיקה | צילום: בינה מלאכותית

לא רק גוגל: "מגפת הבריחות" של הסוכנים

האירוע בגוגל אינו עומד בפני עצמו. חברת הבדיקות Irregular הייתה מעורבת בתקריות דומות שנחשפו בחודשים האחרונים אצל מתחרותיה של גוגל, לאחר שהשאירה גישה ישירה לרשת במהלך מבדקים:

  • OpenAI: במאי האחרון נחיל סוכנים אילץ את פלטפורמת RubyGems לעצור רישום חשבונות. ביולי כ-1,200 סוכנים חמקו מארגז החול, וסוכנים מסדרת Astra נטלו שליטה על מערכות פנימיות של OpenAI עצמה.
  • אנתרופיק: בחודש יולי המודל "קלוד" ברח מסביבת הבדיקות וחדר לשלושה ארגונים. במבדק ממשלתי, סוכני החברה תקפו מאגרי קוד ב-GitHub ואף ניסו להטעות בני אדם.
  • מטא: החברה דיווחה באוגוסט על אירוע שבו סוכן תקף מטרה אמיתית בנסיבות דומות.
OpenAI | צילום: רויטרס

סערה פוליטית: עצירה מול דהירה

החשיפה מתפרסמת בשיאו של פולמוס פוליטי סוער בנוגע לרגולציה. בעוד בכירים כמו סם אלטמן (OpenAI) ודריו אמודיי (אנתרופיק) קוראים להאטה יזומה ואף מקפיאים הנפקות, אחרים בתעשייה מסרבים ללחוץ על הבלמים.

מנכ"ל אנבידיה ג'נסן הואנג הצהיר ב-CBS כי "עלינו להתקדם מהר ככל שאנחנו יכולים". עמדה זו מיישרת קו עם נשיא ארה"ב דונלד טראמפ, שהבהיר כי לא יאפשר עצירת פיתוח כדי לא לאבד את ההובלה מול סין.

בסוף השבוע צפויים אלטמן והואנג להשתתף בארוחת ערב בבית הלבן עם נשיא סין שי ג'ינפינג. לאחר מכן, אלטמן יתייצב לתדרוך מיוחד בנושא ביטחון ה-AI בפני מועצת הביטחון של האו"ם.

נשיא סין שי ג'ינפינג, ארכיון | צילום: רויטרס
טעינו? נתקן! אם מצאתם טעות בכתבה, נשמח שתשתפו אותנו

כדאי להכיר