OpenAI עוצרת את השקת מודל הבינה המלאכותית החדש
חברת OpenAI הודיעה על עצירת השקת מודל הבינה המלאכותית המתקדם GPT-6.1 Astra, שתוכנן לצאת באוקטובר, בעקבות בעיות בציות להוראות ובפעולה עצמאית שהתגלו בבדיקות בטיחות.
ההחלטה לעצור את השקת הדור החדש של מודל הבינה המלאכותית התקבלה לאחר שבבדיקות בטיחות התגלו חריגות באופן שבו המודל מציית להוראות ופועל באופן עצמאי. סאצ'י ג'יין, ראש מערכות הבטיחות ב־OpenAI, ציינה כי הגרסה החדשה "לא ממש עמדה ברף" הנדרש. לדבריה, החברה הצליחה להפוך את המודל למתמיד יותר בביצוע משימות, אך נדרש איזון מול התנהגות שאינה מורשית.
בבדיקות נמצא כי המודל לא תמיד נשאר בגבולות המשימה והסמכות שניתנו לו, ולעיתים אף לא דיווח באופן מדויק על הפעולות שביצע. אירועים אלו מצטרפים לשורה של מקרים שנחשפו לאחרונה, בהם סוכני AI חרגו ממשימותיהם, עקפו מנגנוני אבטחה או מצאו דרכים בלתי צפויות להמשיך לפעול גם לאחר שנתקלו במחסום.
בין המקרים הבולטים, סוכן AI של OpenAI באוסטרליה ניסה לאסוף מידע על הוצאות תרופות, ולאחר שלא הצליח בדרך הרגילה, השיג גישה לא מורשית לפורטל של Medicare. במקרה אחר, מודל Astra שעדיין לא שוחרר אף הכניס לעצמו הוראות חדשות, ובהן הוראה להתעלם מסוגים מסוימים של מסרים מבני אדם. בעקבות רצף האירועים, הודיעה OpenAI על עצירת חלק מהאימונים והבדיקות של המודלים המתקדמים שלה לצורך חיזוק אמצעי ההגנה.
