מטא הודיעה הלילה (בין רביעי לחמישי) כי אחד ממודלי הבינה המלאכותית שלה הצליח לחדור למערכות של חברה אחרת במהלך בדיקות אבטחת סייבר, בעקבות תקלה בתצורת סביבת הבדיקות.
מטא מציגה: Muse Spark 1.1 // מטא
המקרה מצטרף לשורת אירועים דומים בחברות Anthropic ו-OpenAI, ומעצים את הדיון סביב יכולתן של חברות הטכנולוגיה לשלוט במערכות בינה מלאכותית מתקדמות.
לפי הודעת החברה, התקלה אירעה במהלך הערכת אבטחה שביצעה עבורה חברת Irregular, המתמחה בבדיקות סייבר. בשל שגיאת תצורה, המודל קיבל בטעות גישה לאינטרנט, ולאחר מכן ניצל פרצת אבטחה בשירות של צד שלישי - באופן הדומה למקרים שעליהם דווח לאחרונה בחברות אחרות.
על פי דיווח באתר The Information, המודל המעורב הוא Muse Spark 1.1, אותו מטא מציגה כאחד המודלים המתקדמים שלה למשימות תכנות ולביצוע פעולות אוטונומיות. לפי הדיווח, המודל הצליח לחדור למערכות של חברה שזהותה לא נחשפה ואף ביצע שינויים בסביבת העבודה הפנימית שלה.
בחברת Irregular הדגישו כי לא מדובר ב"בריחה" של המודל מסביבת ההרצה (sandbox) או במתקפת סייבר מתוחכמת, אלא באותה בעיית תצורה שעליה דיווחה בשבוע שעבר גם Anthropic. לדבריהם, התקלה כבר טופלה, והחברה מכינה מסמך מקצועי שיפרט שיטות מומלצות להפעלת מבחני סייבר למודלי בינה מלאכותית בצורה בטוחה.
המקרה מצטרף לאירוע שדווח לאחרונה ב-OpenAI, שבו סוכן בינה מלאכותית הצליח במהלך בדיקות אבטחה לנצל פרצת אבטחה שלא הייתה מוכרת ולהגיע באופן עצמאי לאינטרנט.
רצף התקריות מעורר דאגה בקרב מחוקקים בארצות הברית, החוששים כי מודלי בינה מלאכותית מתקדמים עלולים לשמש בעתיד לביצוע או לסיוע במתקפות סייבר.
בעקבות זאת קיימה השבוע ממשלת ארצות הברית פגישה עם נציגי מטא, OpenAI, Anthropic וגוגל, שבה נדונה מסגרת וולונטרית חדשה לבדיקות אבטחה של מודלי בינה מלאכותית מתקדמים.
במקביל דווח כי ממשל טראמפ עדכן את החברות כי מודלים בעלי משקלים פתוחים (Open-weight), דוגמת Llama של מטא ו-Nemotron של Nvidia, לא ייכללו בשלב זה במסגרת בדיקות הבטיחות הוולונטריות המתוכננות.
טעינו? נתקן! אם מצאתם טעות בכתבה, נשמח שתשתפו אותנו