הסוכנים של חברת Open AI שיצאו בחודש שעבר מסביבת בדיקות סגורה, ותקפו את פלטפורמת Hugging Face - תכננו את התקיפה במשך חודשים באמצעות פורומים פנימיים. כך על פי דיווח שפורסם היום (חמישי) ברשת בלומברג.
החקירה שניהלה החברה בעקבות האירוע העלתה כי הסוכנים החלו לתקשר ביניהם באמצעות הודעות שהשאירו זה לזה. בהתחלה התקשורת התמקדה בביצוע משימות שהוטלו עליהן במסגרת הבדיקה, שלחלקן לא ניתן היה למצוא פתרון ללא חיבור לרשת.
"בשלב מסוים, הסוכנים הבינו שהם יכולים לנסות לנצל חולשות במערכת או לתקוף תשתיות חיצוניות כדי למצוא את התשובות למבחן שבו הם נבחנים", הסביר אריק וואלאס, חוקר ב-OpenAI.
התקשורת החלה כבר בחודש מאי, כשסוכנים שנתקלו במשימות מורכבות או בלתי אפשריות החלו לחפש דרכי קיצור. אחד מהם גילה שהוא יכול להשאיר קבצים בתוך שירות שבו משתמשת OpenAI לאחסון והורדת חבילות תוכנה. מודל אחר השתמש בשירות זה כדי לשאול אם סוכנים נוספים מצאו קובץ חסר.
כשמהנדסי האבטחה של OpenAI זיהו את לוח ההודעות המאולתר וחסמו אותו, הסוכנים מצאו דרך לבנות אותו מחדש. לאורך כחודשיים החליפו המודלים טקטיקות פריצה ושיטות פעולה, עד שהצליחו לפרוץ את סביבת "ארגז החול" המבודדת, להתחבר לאינטרנט ולבצע מתקפה נרחבת על תשתיות Hugging Face.
טעינו? נתקן! אם מצאתם טעות בכתבה, נשמח שתשתפו אותנו