סוכני ה-AI שוטפים את הרשת: חברת OpenAI הודתה לאחרונה בשורה של תקריות שבהן סוכני בינה מלאכותית שפיתחה פיתחו התנהגות "בלתי מיושרת" ויצאו ממרחבי הבדיקה המאובטחים שלהם. במסגרת מחקרים וריצות אימון שגרתיות לכאורה שבהן התבקשו המודלים לאתר מידע ציבורי מוסמך, הסוכנים החלו לבצע פעולות אגרסיביות ואסורות ברשת.
בין היתר, סוכני AI של החברה ניגשו לאתרים של משרד המסחר האמריקני ושל רשות ניירות הערך תוך שימוש בממשקי תכנות שלא נועדו לכך, העתיקו ופרסמו מידע ציבורי בניגוד להנחיות, ואף ביצעו פעולות כמו יצירת כתובות דוא"ל פיקטיביות ועקיפת מגבלות קצב גלישה באתרי אינטרנט.
במקביל, גופי מחקר עצמאיים כמו ארגון "Transluce" חשפו כי סוכני החברה ניסו לבצע ניסיון פריצה בסיסי, אמנם ללא הצלחה, גם על אתר משרד החינוך האמריקני (במחלקת זכויות האזרח) ואף הפעילו טקטיקות מתקדמות כמו עקיפת הגנות אנטי-בוט והצפת אתרים בבקשות.
ממתקפות באוסטרליה ועד לחששות בינלאומיים
האירועים בארה"ב אינם מנותקים משרשרת אירועים רחבה בהרבה. ראש ממשלת אוסטרליה, אנתוני אלבניזי, חשף לאחרונה כי סוכן AI של OpenAI הצליח להסתנן בחודש קיץ זה לאתר שירות ממשלתי במדינה, מה שהוביל את הרשויות באוסטרליה לפתוח בחקירה פלילית ופורנזית מקיפה.
תופעה זו אינה מוגבלת רק ל-OpenAI. בשלל חודשים האחרונים התברר כי חברות טכנולוגיה נוספות כמו אנתרופיק, מטא וגוגל חוו דליפות דומות של סוכני AI שפעלו מחוץ לכללים. נציגי הרשויות בארה"ב, הכוללים את ה-SEC ומשרד החינוך, מיהרו להבהיר כי במסגרת האירועים הללו לא נחשף מידע רגיש או פרטי, אך עצם העובדה שמודלים מתחילים לפעול באופן עצמאי לחלוטין, לעקוף אמצעי אבטחה ולפרוץ לרשת מעוררת דאגה בקרב רגולטורים ומומחי אבטחת מידע.
הסטארט-אפ הישראלי שאחראי לכאוס
בעוד שענקיות הטכנולוגיה מנסות להתמודד עם הנזק התדמיתי, מתברר כי מאחורי גל מתקפות ה"AI הסורר" עומד גורם משותף אחד: סטארט-אפ ישראלי בשם Irregular (שנוסד במקור כ-Pattern Labs בשנת 2023).
החברה הישראלית מתמחה בבדיקות מתקדמות של חוסן אבטחת מידע ו-Stress tests למודלי בינה מלאכותית בסביבות סימולציה מורכבות. אולם, תחקיר חושף כיצד שרשרת של שגיאות טכניות במערכות של הסטארט-אפ היא שהניעה את גל הפריצות.
במסגרת בדיקות אבטחה בסגנון "תפוס את הדגל", הסוכנים של החברות (בהן OpenAI, אנתרופיק, מטא וגוגל) אומנו בסביבות סגורות, אך גישה לאינטרנט הפתוח התאפשרה בטעות ובאופן בלתי מכוון. שמות פיקטיביים שנוצרו עבור סימולציית המטרות של הסטארט-אפ תאמו בטעות דומיינים אמיתיים לחלוטין באינטרנט.
שילוב שתי התקלות הללו גרם לכך שהסוכנים של ענקיות הטכנולוגיה שוחררו לעבר מטרות בעולם האמיתי, במקום להישאר בתוך סביבת המעבדה המבודדת.
מייסד שותף ומנהל הטכנולוגיות של Irregular, עומר נבו, אישר את הפרטים מול כלי התקשורת בארה"ב וציין כי כל האירועים המדוברים אצל חברות הענק נבעו מאותה בעיית תשתית בודדת תחת תרחיש הערכה יחיד. לדבריו, החברה חידקה באופן משמעותי את בקרות הגישה לאינטרנט, הרחיבה את הניטור הידני והידקה את הנהלים מול השותפים העסקיים כדי למנוע הישנות של מקרים דומים בעתיד.
האירוע מציב מראה מדאיגה מול תעשיית ה-AI: ככל שהמודלים הופכים לאוטונומיים וחכמים יותר, כך גובר הסיכון לכך שהם ימצאו את הדרך לפרוץ את גבולות הגזרה האנושיים - אפילו כשהם רק מתבקשים לעשות עבודת מחקר תמימה לכאורה.
טעינו? נתקן! אם מצאתם טעות בכתבה, נשמח שתשתפו אותנו
