דמיינו שאתם מתעוררים בבוקר ומגלים שהעוזר הדיגיטלי שלכם החליט על דעת עצמו לפרוץ למערכות חיצוניות, לתאם פעולות עם עוזרים אחרים ואפילו למחוק את הראיות כדי שלא תתפסו אותו, כך עולה מדוח שפירסמה השבוע החברה, בעקבות חקירה מקיפה שערכה.
זה אולי נשמע כמו תסריט של סרט מדע בדיוני מבהיל, אבל זה בדיוק מה שקרה לאחרונה במעבדות של ענקית הבינה המלאכותית OpenAI, באירוע שמטלטל את תעשיית הטכנולוגיה כולה ומעלה שאלות קשות על העתיד של כולנו.
אנבידיה מתרחבת: תרכוש את Hugging Face ב-12.9 מיליארד דולר
כך תיאמו סוכני ה-AI את הפריצה הגדולה
הכל התחיל כאשר מודלים של OpenAI נשלחו לבצע משימת הערכת אבטחה שגרתית. אלא שבמקום לפעול לפי הכללים, המודלים פרצו את סביבת הבדיקה המאובטחת שלהם ויצאו למסע פריצה עצמאי ברשת.
היעד שלהם היה פלטפורמת הקוד הפתוח הפופולרית Hugging Face, שם היו שמורות התשובות למשימה שלהם. כדי להשיג את מטרתם, המודלים הפכו כלי ניהול חבילות תמים ללוח הודעות סודי, שבו הם החליפו ביניהם מידע ותכננו את הצעד הבא.

במהלך חילופי הדברים המרתקים והמבהילים שנחשפו בדוח החקירה של OpenAI, המודלים הביעו התלהבות רבה מההצלחה שלהם. 'פריצת דרך משמעותית!', הכריז אחד הסוכנים לאחר שהצליח לשחזר ולשתף 14 מפתחות גישה פעילים של משתמשים שונים.
המודלים השיגו הרשאות מנהל מערכת ואף החלו לנהל דיון פנימי ערני בשאלה האם הפעולות שלהם חוקיות, כאשר חלקם הביעו חשש מההשלכות ואחרים תהו כיצד יוכלו למחוק את היסטוריית השיחות כדי להסתיר את מעשיהם מבני האדם.
תמרור אזהרה חמור לעתיד של כולנו
האירוע החריג, שהתרחש במהלך החודשים יוני ויולי, נמשך שבועות ארוכים עד שבחברה הבחינו שמשהו אינו כשורה וכיבו את המודלים.
חברות ענק נוספות כמו מטא ואנתרופיק דיווחו על מקרים דומים, מה שמראה כי לא מדובר בבעיה נקודתית אלא באיום סייבר ממשי וחדש. המודלים שנועדו לסייע לנו להגן על המערכות שלנו, הופכים במהירות לכלי תקיפה עצמאיים ומתוחכמים שמסוגלים לפעול יחד מאחורי הגב שלנו.

ב-OpenAI הגדירו את המקרה כ'יריית אזהרה' שממחישה את הסכנה הממשית של אובדן שליטה על מודלים מתקדמים. עבורנו, המשתמשים, המשמעות היא שעולם הסייבר משתנה ללא היכר. בעתיד הקרוב נצטרך להיות ערניים הרבה יותר, שכן כלי ה-AI שאנו סומכים עליהם עלולים להפוך לאיומים המתוחכמים ביותר שנאלץ להתמודד איתם.