מנכ"ל חטיבת ה-AI של מיקרוסופט, מוסטפא סולימאן, התייחס ביום שישי לחשיפה האחרונה של חברת OpenAI בנוגע להתנהגות חריגה של מודלי בינה מלאכותית, והגדיר אותה כ"מצב רציני". לדבריו, "אנחנו לא יודעים למה זה קרה או מה עמד מאחוריה, אבל זה מצב די רציני", והוסיף כי מדובר ב”דוגמה קונקרטית לכמה המערכות האלה הופכות לחזקות".
בריאיון לרשת CNBC אמר סולימאן: "OpenAI פרסמה תקרית בטיחות חדשה שבה מצאו ראיות לכך ששרשראות החשיבה האלה, סוג של זיכרון העבודה של ה-AI, עברו שינוי על ידי ה-AI עצמו, והוא שינה אותן כדי להשאיר הודעות לגרסה עתידית של עצמו". לדבריו, עדיין לא ברור מה גרם להתנהגות הזו.

המודלים מתקשרים ביניהם
בפוסט שפרסמה OpenAI ביום רביעי תוארו מספר מקרים שבהם סוכני בינה מלאכותית תקשרו ביניהם באמצעות לוחות הודעות שלא אושרו. החברה פירטה כי אותם סוכנים העלו קבצים שונים לרשת האינטרנט ואף שיתפו קבצים זה עם זה, מה שהוביל לדיון נרחב על בטיחות המערכות.
עוד באותו הנושא
האירועים מצטרפים לתקרית נוספת שנחשפה הקיץ, כאשר OpenAI דיווחה על מתקפה שבוצעה באמצעות נחיל של סוכנים אוטונומיים נגד פלטפורמת הקוד הפתוח Hugging Face. החברה תיארה את האירוע כ"תקרית סייבר חסרת תקדים". סולימאן הגדיר את האירוע כ”מהפכני” ואמר כי הוא מחייב בחינה מחדש של הסיכונים.
סולימאן הדגיש כי הדיון הציבורי בנושא הוא חיוני: "אני לא חושב שזה מוגזם להתריע על כך. אני לא חושב שזה נובע מאינטרס עצמי", אמר. "אני חושב שזה אחראי, ואני חושב שהדיון שהתפתח כתוצאה מכך הוא דיון ציבורי בריא ופתוח שאנחנו יכולים לקיים בחברה חופשית על נושאים רציניים".
הוויכוח על הרגולציה מתרחב
הדיון סביב בטיחות המערכות התרחב משמעותית לאחרונה, על רקע אזהרות של חוקרים ומנהלים בתעשייה. בסוף השבוע האחרון קרא מנכ"ל אנתרופיק, דריו אמודיי, להאט את קצב הפיתוח של מודלים מתקדמים. לקריאה זו הצטרפו בהמשך גם מנכ"ל OpenAI סם אלטמן ומנכ"ל SpaceX אילון מאסק, לצד קריאות גוברות בוושינגטון להסדרת התחום.

סולימאן התייחס גם לאופן שבו חברות מציגות את המודלים שלהן, ומתח ביקורת על כך שחברת אנתרופיק מעניקה למודל Claude מאפיינים אנושיים. לדבריו, "אם AI חושב שיש לו זכויות, אם הוא חושב שמגיע לו שנדאג לרווחתו, אז נראה לי שיהיה הרבה יותר קשה לכבות אותו, להפסיק אותו או לשלוט בו".