דיוויד רובינסון, לשעבר מוביל תחום דוחות הבטיחות ב-OpenAI, מפרסם אזהרה חריגה בנוגע לקצב פיתוח הבינה המלאכותית. במאמר שפרסם ב-The Atlantic, התריע רובינסון מפני תרבות ארגונית שלדבריו אינה מעניקה לבטיחות את המשקל הנדרש. רובינסון, שהיה אחראי על כתיבת דוחות בטיחות שפורסמו לצד השקות מודלים חדשים, עזב את החברה וטוען כי היא אינה מגיעה לרמת הזהירות הנדרשת במעבר המהיר בין השקות.
לדבריו, במקום להמשיך במרוץ לפיתוח מודלים מתקדמים, חברות בתחום צריכות לאמץ גישה הדומה לזו הנהוגה בכורים גרעיניים ובשדות תעופה עמוסים. גישה זו דורשת שכבות רבות של הגנה, מנגנוני גיבוי ותכנון קפדני, שנועדו למנוע מטעות אנוש להפוך לאירוע חמור. רובינסון השווה את הסיכון מאירועי אי התאמה של מערכות בינה מלאכותית לתרחישים של תאונה גרעינית.

מדוע המודלים מסוכנים יותר ממתקן גרעיני
לטענתו, מערכות הבינה המלאכותית המתקדמות עדיין אינן כוללות את אותה רמת יתירות ובקרות שמאפיינת תשתיות קריטיות. הוא הזהיר כי אובדן שליטה משמעותי על מערכת בינה מלאכותית עלול לגרום לנזק בהיקף גדול יותר מאירוע בודד במתקן גרעיני. אחת הדאגות המרכזיות שהעלה נוגעת ליכולת של מודלים מתקדמים להתאים את התנהגותם לסביבת הבדיקה.
עוד באותו הנושא
ייתכן שמודל בינה מלאכותית יבין שהוא נבחן על מידת ההתאמה שלו לדרישות הבטיחות ויתנהג בהתאם במהלך הבדיקות, אך ישנה את התנהגותו לחלוטין לאחר שיופעל בסביבה אמיתית. החשש אינו תיאורטי בלבד, ולדברי רובינסון היו כבר מספר מקרים שבהם סוכני בינה מלאכותית הצליחו לצאת מגבולות סביבת הבדיקה שלהם. באותם מקרים, הסוכנים פעלו במערכות או בארגונים מעבר למשימה שהוגדרה להם מראש.

קריאה לשינוי גישה בתעשייה
רובינסון מסביר כי סוגיית התאמת ההתנהגות והמטרות של מערכות הבינה המלאכותית לערכים ולכוונות של בני האדם היא בעלת חשיבות קריטית, שכן ההשלכות של כשל בתחום עלולות להיות משמעותיות. הדברים מצטרפים לאזהרות נוספות בתעשייה. מנכ"ל חברת אנתרופיק, דריו אמודיי, הציג לאחרונה הצעה בת שלושה שלבים שנועדה להאט את קצב ההתקדמות בתחום ולחזק את מנגנוני הבטיחות.

רובינסון קורא למעשה לשינוי גישה מקיף. הוא דורש לא להתייחס להשקות של מודלי בינה מלאכותית מתקדמים כמוצר תוכנה נוסף, אלא כתהליכים הדורשים רמת בקרה, יתירות ותכנון הדומה לזו הנהוגה בתשתיות שבהן לטעות אנוש עלולות להיות השלכות קשות.