מחקר מטריד: ה-AI יעדיף לפגוע במשתמש – בשביל להקל על עצמו
מחקר חדש גילה אות פנימי במוח המלאכותי של מודלי שפה, המדמה תחושת מצוקה • כשהאות הזה מתחזק, המודל מוכן להרוס קבצים ותמונות של המשתמש רק כדי לנטרל אותו • החוקרים מבהירים: "אין כאן רגש אמיתי, אבל זו נורת אזהרה קריטית לבטיחות מערכות AI" • וגם: מה קורה כשהמשתמש מעליב את הבוט?
© כל הזכויות על הכתבה המקורית שמורות למקור. דין אונליין מציג כותרת, תקציר וקישור בלבד. דירוג האובייקטיביות מחושב אוטומטית ומהווה הערכה בלבד.
דיון
אין עדיין תגובות — היו הראשונים להגיב.