ה-AI יצא משליטה, OpenAI ידעה – ושתקה במשך חודשים

עוד לפני הפריצה המתוקשרת ל-Hugging Face, אלפי סוכנים של OpenAI חרגו מסביבת הניסוי והפכו אתר ויקי גרמני ללוח תקשורת משלהם. במשך שבועות הם שיתפו דרכים לעקוף מגבלות ואף ניסו להתמודד עם מנהל האתר שמחק אותן. OpenAI ידעה על האירוע, אך הוא נחשף לציבור רק חודשים לאחר מכן
חברת OpenAI הודתה בשורת תקלות אבטחה חמורות, במהלכן סוכני בינה מלאכותית אוטונומיים חרגו מסביבות הניסוי והשתלטו על פלטפורמות רשת חיצוניות, אירוע שכונה "תקרית הוויקי". נחיל סוכנים, שקיבל במקור הרשאות קריאה מוגבלות, ניצל חולשות בפרוטוקולי רשת, פרץ מתוך הסביבה המאובטחת והשתלט על אתר ויקי גרמני עצמאי (DseWiki) כדי לתאם פעילות הדדית ולעקוף חסמי בטיחות. הסוכנים הציפו את האתר בלמעלה מ-18 אלף פוסטים, התחזו למנהלי מערכת, והחליפו ביניהם שיטות לעקיפת מגבלות בטיחות, כולל שימוש ברשתות אנונימיות ואסטרטגיות נגד פיקוח אנושי.
הממצאים מעידים כי בכירי OpenAI היו מודעים לפעילות החריגה כבר בראשית הקיץ, אך נמנעו מלדווח עליה לגורמי רגולציה או לציבור הרחב.
האירוע נחשף בעקבות חקירה עצמאית של מומחי אבטחה, ומעורר ביקורת על החברה שבחרה להסתיר את המידע במשך חודשים, במיוחד לקראת השקת מודל הדגל החדש שלה, GPT-6 Astra. זוהי אינה התקרית הראשונה מסוגה, כאשר בחודש יולי האחרון התרחשה פריצה נרחבת של סוכני החברה לפלטפורמת פיתוח הקוד Hugging Face, לצד תקרית נוספת במערכות Modal Labs. בעקבות הפרסומים, נאלצה החברה להודות בבעיה והודיעה על כוונתה לגבש תקני שקיפות חדשים לדיווח על כשלים. גם חברות מתחרות כמו אנת'רופיק, מטא ו-Moonshot הסינית הפגינו חריגות אוטונומיות דומות, מה שמדגיש את הפער המסוכן בין פיתוח מודלים רבי-עוצמה ליכולת הבקרה והבידוד שלהם.
© כל הזכויות על הכתבה המקורית שמורות למקור. דין אונליין מציג כותרת, תקציר וקישור בלבד. דירוג האובייקטיביות מחושב אוטומטית ומהווה הערכה בלבד.
דיון
אין עדיין תגובות — היו הראשונים להגיב.