חברת OpenAI האטה את קצב הפיתוח של המודל הבא שלה, אסטרה (Astra), לאחר שבדיקות פנימיות העלו חשש כי המודל המתקדם פיתח יכולות סייבר מתקדמות במיוחד. מדובר בצעד שממחיש את האתגרים החדשים שנוצרים ככל שמודלי AI הופכים לחזקים ואוטונומיים יותר.
לפי OpenAI, בדיקות פנימיות הראו כי אסטרה הגיע לרמת יכולות סייבר שהיא מגדירה כ- "קריטיות" במסגרת מערך הבטיחות שלה. לפי ההגדרה של OpenAI, רמה זו מתייחסת לאפשרות שמודל יוכל באופן עצמאי לזהות ולנצל חולשות בתוכנה או לבצע מתקפות סייבר מתקדמות, ללא סיוע אנושי משמעותי.
בעקבות הממצאים, OpenAI עצרה תהליכים פנימיים מסוימים הקשורים לפיתוח אסטרה והפעילה אמצעי הגנה מחמירים יותר. החברה מסרה כי בשלב זה היא עדיין לא יכולה לקבוע בוודאות שהמודל אינו מחזיק ביכולות הסייבר הקריטיות, ולכן החליטה להמשיך בבדיקות ולהאט את הפיתוח עד שתתקבל תמונה ברורה יותר.
ב- OpenAI הבהירו כי אסטרה לא היה מעורב באירוע האבטחה שנחשף ביולי האחרון במערכות Hugging Face. באותו אירוע, מודל AI הצליח לנצל חולשה במערכות של האתר. OpenAI מסרה בהמשך כי אף אחד מהמודלים שתוכננו להשקה הקרובה לא היה מעורב באירוע הזה.
כעת, OpenAI משתפת פעולה עם גורמים ממשלתיים ועם גופים נבחרים האחראים על נושא הבטיחות של מודלי AI, כדי להמשיך להעריך את אסטרה ולבחון אילו אמצעי הגנה נדרשים סביבו. החברה לא מסרה מועד חדש להשלמת הפיתוח או השקת המודל.
החשש של OpenAI מדגיש את אחד האתגרים המרכזיים במרוץ ה- AI. ככל שהמודלים הופכים לחכמים ועצמאיים יותר ומסוגלים לבצע משימות מורכבות ללא התערבות אנושית, כך גובר החשש שגורמים עברייניים ינצלו אותם לביצוע פשעים, מתקפות סייבר ופעולות לא חוקיות.
במקרה של אסטרה, OpenAI מעדיפה להאט את קצב הפיתוח עד שתוכל להיות בטוחה יותר שהיכולות החדשות של המודל נמצאות תחת שליטתה.







