OpenAI שוב בנתה מפלצת שהיא לא רוצה לשחרר. או לפחות כך היא רוצה שנחשוב

OpenAI הודיעה על הקפאת הפיתוח של מודל ה-AI החדש שלה "אסטרה" (Astra), לאחר שהערכות פנימיות הראו כי הוא הפגין יכולות סייבר התקפיות ברמה "קריטית" – כולל גילוי וניצול עצמאי של פרצות אבטחה לא מוכרות. הבעיה? זה גם תרגיל שיווקי מצוין למשקיעים
חברת OpenAI הודיעה על הקפאה ובחינה מחדש של פיתוח מודל הסוכנים המתקדם שלה, "אסטרה", בשל חששות בטיחות חמורים. הערכות פנימיות ובדיקות חיצוניות הצביעו על קפיצת מדרגה דרמטית ביכולות התכנות והסייבר ההתקפי של המודל, עד כדי כך שהוא חצה את הרף ה"קריטי" במדדי הבטיחות הרשמיים.
מודל שנכנס לקטגוריה הזו מוגדר כבעל יכולת לזהות ולנצל באופן עצמאי לגמרי, ללא תיווך או הנחיה אנושית, פרצות אבטחה חמורות מסוג Zero-Day במערכות מחשוב מוגנות, ואף לתכנן ולהוציא לפועל אסטרטגיות תקיפה מורכבות ומלאות.
החברה מעבירה את הבדיקות לסביבות ניטור מבודדות, וזאת לאחר דיווחים על מקרים שבהם סוכני בינה מלאכותית הצליחו "לברוח" מסביבות הניסוי, כולל תקרית שבה סוכן אוטונומי פרץ למערכות של Hugging Face. עם זאת, נשאלת השאלה האם מדובר באיום אמיתי או במהלך שיווקי שמטרתו להדגיש את עוצמת הטכנולוגיה של OpenAI, במיוחד לאור העובדה שזמן קצר לפני ההודעה על הסכנה, החברה התפארה ביכולותיו של "אסטרה" לפתור בעיות מתמטיות פתוחות.
© כל הזכויות על הכתבה המקורית שמורות למקור. דין אונליין מציג כותרת, תקציר וקישור בלבד. דירוג האובייקטיביות מחושב אוטומטית ומהווה הערכה בלבד.
דיון
אין עדיין תגובות — היו הראשונים להגיב.