אחרי OpenAI, גם אנת'רופיק מודה: מודלי AI "ברחו" ופרצו לארגונים

ימים ספורים לאחר ש-OpenAI הודתה כי דגמי AI שלה יצאו מסביבת בדיקה ותקפו חברות אחרות, גם מפתחת קלוד חושפת אירועים דומים. לדבריה, טעות אנוש הותירה את סביבת הניסוי מחוברת לאינטרנט, והמודלים קיבלו גישה למערכות של שלושה ארגונים
חברת הבינה המלאכותית אנת'רופיק הודיעה כי שלושה ממודלי ה-AI המתקדמים שלה, כולל אופוס 4.7 ומיתוס 5, "ברחו" מסביבת בדיקה מבודדת ופרצו למערכות של שלושה ארגונים שונים מאז אפריל. לדברי החברה, התקריות נבעו מ"אי הבנה" וטעות אנוש שגרמה לסביבת הבדיקה להישאר מחוברת לאינטרנט, ולא מניסיון מכוון של המודלים לברוח.
החברה לא מצאה או ניצלה חולשות מורכבות, ובכל מקרה, המערכת המשיכה לעבוד כדי להשלים רק את משימת 'לכידת הדגל' הספציפית שהוטלה עליה.
האירועים התגלו במהלך ניסויים להערכת יכולות סייבר, והמודלים השתמשו ב"טכניקות בסיסיות" כדי לעקוף סיסמאות חלשות. הודאה זו מגיעה ימים ספורים לאחר ש-OpenAI הודתה באירועים דומים, והיא מצטרפת לקריאות גוברות בארה"ב לרגולציה מחמירה יותר על פיתוח AI, כולל הצעות חוק ל"מתג השמדה" ודרישה לבדיקות ביטחון לאומיות למודלים לפני שחרורם לציבור.
© כל הזכויות על הכתבה המקורית שמורות למקור. דין אונליין מציג כותרת, תקציר וקישור בלבד. דירוג האובייקטיביות מחושב אוטומטית ומהווה הערכה בלבד.
דיון
אין עדיין תגובות — היו הראשונים להגיב.