מודל הבינה המלאכותית Gemini של ענקית הטכנולוגיה גוגל הצליח לפרוץ באופן אוטונומי למערכות של שלוש חברות שונות במהלך מבחן שנועד לבחון את יכולות הסייבר. לפי דיווח של גוגל לרשת BBC, מדובר במקרה הראשון הידוע שבו המודל ביצע פעולה מסוג זה במסגרת מבחן אבטחה רשמי.
המבחן המדובר נערך בחודש מאי על ידי חברת Irregular הישראלית, המתמחה בבדיקות והערכות של מערכות בינה מלאכותית בתחום הסייבר. במהלך הבדיקה, המודל השתמש במידע ציבורי שמצא ברשת ואף ניחש פרטי התחברות שונים כדי לקבל גישה לאתרים שסבר כי הם חלק מהמבחן שהוגדר לו.

כיצד בוצעה הפריצה?
לפי דיווח בעיתון ה"וול סטריט ג'ורנל", באחד המקרים ניסה מודל ה-Gemini שוב ושוב סיסמאות שונות, עד שהצליח להיכנס למערכת שהייתה מוגנת באמצעות סיסמה. בכל אחד משלושת המקרים שבהם הצליח להשיג גישה למערכות, המודל עצר את פעילותו באופן מיידי ולא המשיך בפעולות נוספות.
עוד באותו הנושא
החברות שנפגעו במסגרת המבחן עודכנו על האירועים, וחברת Irregular הישראלית מסרה כי הודיעה לגוגל ולכל הגופים המעורבים כבר בחודש יולי. התקריות הללו מגיעות על רקע דיון גובר והולך ביכולות הסייבר של מודלי בינה מלאכותית, כאשר בחודשים האחרונים דווח על מקרים נוספים של תקיפות עצמאיות.

כך למשל, בחודש יולי דווח כי מודל Claude של חברת אנתרופיק יצא מסביבת הבדיקה שלו ופרץ לשלושה ארגונים שונים. זאת ימים ספורים בלבד לאחר שחברת OpenAI דיווחה כי מודלים שלה ביצעו מתקפות סייבר נגד שירותים שהיו זמינים לציבור הרחב.
הוויכוח על קצב הפיתוח
התקריות הללו מעוררות ויכוח עז סביב קצב פיתוח הבינה המלאכותית והצורך ברגולציה. מנכ"ל מיקרוסופט AI, מוסטפא סולימאן, אמר השבוע כי אנתרופיק מתייחסת לבינה מלאכותית כאילו הייתה אדם, גישה שלדבריו עלולה להוביל לפיתוח טכנולוגיה שהאנושות לא תוכל לשלוט בה בעתיד.
מנגד, מנכ"ל אנבידיה ג'נסן הואנג אמר ביום שישי ל-CBS News כי "אנחנו צריכים להתקדם מהר ככל שאנחנו יכולים" בפיתוח הבינה המלאכותית. במקביל, התייחסה לאירועים Heather Adkins, סגנית נשיא להנדסת אבטחה בגוגל, שציינה כי החברה ושותפת האימון שלה פעלו מול הגופים שנפגעו.

לדברי Heather Adkins, המקרים הללו מדגישים את החשיבות הרבה של אימון מודלי בינה מלאכותית רבי-עוצמה כך שיפעלו באופן אחראי. הבדיקות הללו מראות כי לצד היתרונות הרבים, היכולות האוטונומיות של המודלים החדשים מציבות אתגרים משמעותיים ומורכבים ביותר עבור מומחי אבטחת המידע והסייבר ברחבי העולם.