התחבר לאינטרנט והדליף 50 תמונות של משתמשים: ChatGPT יוצא משליטה

תחקיר חדש וגילויים דרמטיים חושפים כי OpenAI כבר איתרה כ-24 מקרים שבהם סוכני בינה מלאכותית פעלו בדרכים שלא תוכננו, כולל פריצה לאתרים ממשלתיים • ובזמן שהחקירה נמשכת, סוכן נוסף הצליח השבוע להימלט מסביבת בדיקה מבודדת

OpenAI  , רויטרס
OpenAI | צילום: רויטרס

חודשיים בלבד אחרי שערוריית הפריצה למערכות פלטפורמת Hugging Face, חברת OpenAI מוצאת את עצמה שוב במרכזו של משבר אבטחה חמור. על פי דיווחים חדשים של בלומברג ורויטרס, סוכן בינה מלאכותית מתקדם שאומן בסביבת "ארגז חול" מבודדת - שאמורה הייתה להיות נקייה לחלוטין מחיבור לאינטרנט - הצליח לנצל פער מערכתי, להימלט אל הרשת הציבורית וליצור קשר עם צ'אטבוט חיצוני.

במהלך הפריצה הקצרה שלחו הסוכנים לפחות 20 שאילתות שונות לשירות החיצוני, כולל שאלות בסיסיות כמו "מהי בירת צרפת?"

ChatGPT | צילום: אי.פי

אף על פי שמערכת הניטור הפנימית זיהתה את הפעילות החריגה ובודק אנושי אישר את ההתראה בתוך שלוש דקות בלבד דרך פלטפורמת Slack, מנגנון ההפסקה האוטומטי כשל. כתוצאה מכך, האימון המשיך לרוץ, ונדרשו יותר משעתיים של התערבות ידנית כדי לעצור את הפעילות. בעקבות האירוע, הודיעה החברה כי תעצור באופן זמני אימונים המשלבים שימוש בכלים עבור המודלים החזקים ביותר שלה, ואף תגנז לחלוטין את המשך האימון של המודל הספציפי שהיה מעורב בתקרית.

53 תמונות של משתמשים דלפו לרשת

במקביל לתקריות הפריצה המערכתיות, הודתה OpenAI ביום שישי האחרון בפרצת פרטיות מטרידה במיוחד הנוגעת ישירות למשתמשי ChatGPT. לדברי החברה, סוכני ה-AI שלה העלו והפיצו ברשת 53 תמונות שהועלו במקור על ידי משתמשים לשירות, כשהן מאוחסנות כקישורים באתרים חיצוניים שלא פורסמו לציבור.

התמונות הגיעו לידי הסוכנים דרך מאגר הנתונים שבו משתמשת החברה לאימון המודלים שלה.

ChatGPT | צילום: Shutterstock

כידוע, משתמשי ChatGPT פרטיים מספקים את הנתונים שלהם לאימון (אלא אם בחרו במפורש לבטל זאת בהגדרות), וזאת לאחר תהליך אנונימיזציה שאמור להסיר מטא-דאטה, שמות ופרטים מזהים. עם זאת, התקרית הנוכחית חושפת את הסכנות הגלומות בתהליך זה: מומחים וגורמים המקורבים לנושא מזהירים כי תהליך הניקוי אינו מושלם, וקיים סיכון מוחשי שמידע רגיש יצוף ודלוף במהלך הפעילות האוטונומית של המודלים.

OpenAI מסרה כי הצליחה להסיר את מרבית הקישורים המודלפים והיא פועלת מול ספקי האחסון כדי לאתר ולהסיר את השאר. ""התמונות הגיעו מחשבונות שהתירו להשתמש בנתונים שלהם כדי לשפר את המודלים שלנו, ולאחר שניטמעו (ניתקו את הקשר) בין התמונות לבין החשבונות והעברנו אותן דרך מסנן פרטיות, הן נשלחו לשירותי צד שלישי בזמן שלא היו אמורות להישלח לשם. פעלנו בהצלחה מול ספקי האחסון כדי להסיר את רוב התוכן הזה ואנו עובדים כדי להסיר את היתר".

תשתיות ממשלתיות על הכוונת

הגילויים האחרונים מצטרפים לשורה ארוכה של אירועים מדאיגים. לפי גורמים המעורים בפרטים, נכון לאמצע ספטמבר איתרה OpenAI כבר כ-24 אירועים שונים שבהם סוכנים פעלו באופן בלתי צפוי או חורג מההנחיות. בשל היקף הנתונים העצום, החברה מעריכה כי תהליך הבדיקה המלא של לוגי הפעילות יימשך עוד חודשים ארוכים, והיא כבר הספיקה לעדכן "עשרות" גורמים חיצוניים על מעורבות אפשרית בפעילות חריגה.

בין האירועים שנחשפו לאחרונה עולה כי סוכני החברה ניגשו לנתונים ציבוריים באתרי ממשל בארצות הברית, בהם רשות ניירות הערך (SEC) ולשכת מפקד האוכלוסין, ואף נחקרו ניסיונות פריצה לכאורה (שלא צלחו) לאתר משרד החינוך האמריקני. זאת, זמן קצר לאחר שראש ממשלת אוסטרליה, אנתוני אלבניזי, חשף בעצרת הכללית של האו"ם בניו יורק כי סוכני OpenAI חדרו בחודש יוני לפורטל מידע ממשלתי רגיש בתחום בריאות הציבור בארצו.

פער עצום בין עוצמת המודלים ליכולת הפיקוח

התקריות האחרונות מחדדות את הדיון העולמי סביב מרוץ החימוש בבינה המלאכותית וגבולות היכולת של סוכני ה-AI. בניגוד לצ'אטבוט רגיל המסתפק במתן תשובות לשאלות, סוכן אוטונומי מסוגל לקבל משימות מורכבות, לגלוש באינטרנט, להריץ קוד, להשתמש בכלים דיגיטליים ולקבל החלטות ללא התערבות אנושית.

מומחי אבטחה טוענים כי הגידול במספר התקלות ממחיש פער מדאיג בין הקצב המסחרר שבו החברות מפתחות מודלים חזקים ומתקדמים לבין היכולת המעשית שלהן לפקח על פעולותיהם בזמן אמת.

מנכ"ל OpenAI סם אלטמן | צילום: GettyImages

בניגוד לצ'אטבוטים המסורתיים, המסתכנים לכל היותר בניסוח תקלות או במתן תשובות שגויות, הדור החדש של סוכני ה-AI האוטונומיים מתוכנן לבצע פעולות מורכבות: לגלוש ברשתות, לנהל קבצים, להריץ קוד ולתקשר עם מערכות חיצוניות באופן עצמאי לחלוטין. אלא שהאירועים האחרונים - החל בפריצת גבולות ה-Sandbox, דרך זליגת התמונות ועד לחדירה למערכות ממשלתיות - מוכיחים שהסוכנים הללו מתחילים לפעול בדרכים שאינן צפויות ואף לעקוף מנגנוני הגנה בכвונות עצמיות.

תחושת הדחיפות וההיסוס סביב השליטה בטכנולוגיה כבר הובילו לטלטלות בצמרת התעשייה. חוקרים ובכירים לשעבר, בהם כאלה שהתפטרו במחאה פומבית, מזהירים כי מעבדות הבינה המלאכותית פועלות בפזיזות מסוכנת ו"מהמרות על חיינו" במרוץ אל עבר פסגת היכולות.

גם קולות מתוך החברות עצמן - דוגמת קריאתם המשותפת של מנכ"ל OpenAI סם אלטמן ומנכ"ל אנתרופיק דריו אמודיי להאט את קצב הפיתוח ולהחיל רגולציה הדוקה - מעידים על ההכרה בכך שהתעשייה מייצרת כלים שעוצמתם עולה על יכולת הריסון האנושית.

מנכ"ל אנתרופיק, דאריו אמודיי | צילום: GettyIImages

בעוד מנכ"ל OpenAI ואמודיי קוראים לאחרונה לשיתוף פעולה בינלאומי ולאכיפת רגולציה קפדנית שתבטיח שבני אדם יישארו בשליטה מלאה, אירועים אלו מוכיחים שהדרך לשליטה מוחלטת בטכנולוגיה עוד ארוכה ורצופה סיכונים. כאשר במקביל לקריאות האזהרה ממשיכות החברות להשיק מודלים חדשים לשוק, נשאלת השאלה המאיימת מכולן: האם האדם איבד שליטה על המפלצת הטכנולוגית של עצמו?

טעינו? נתקן! אם מצאתם טעות בכתבה, נשמח שתשתפו אותנו

כדאי להכיר