נפגעת מינית? יש צ'אטבוטים שעלולים להאשים אותך

מחקר חדש השווה בין גרוק, ChatGPT, ג'מיני וקלוד באמצעות תרחישים זהים של פגיעה מינית ברשת בקרב בני נוער. כל המודלים זיהו שמדובר בהתעללות, אך חלקם ייחסו אחריות גם לקורבן ואף הושפעו משינויים קלים ברקע המשפחתי והחברתי של הסיפור
מחקר ישראלי חדש שפורסם בכתב העת Computers in Human Behavior: Artificial Humans חושף כי מודלי AI פופולריים עלולים להאשים קורבנות של התעללות מינית בקרב בני נוער ברשת, במיוחד כאשר משתנה ההקשר המשפחתי או החברתי של הסיפור. המחקר, בהובלת פרופסור מיכל דולב-כהן ממכללת אורנים, בחן ארבעה מודלי שפה מובילים: קלוד, ג'מיני, GPT וגרוק.
- גרוק: הפגין את הנטייה החזקה ביותר להאשמת הקורבן, והטיל אחריות כבדה על הנערה תוך ייחוס משקל רב להתנהגותה המקדימה.
- GPT: הציג עמדת ביניים, ייחס אחריות מסוימת להתנהגות הנערה, והיה המודל היחיד שהעריך כי הסיטואציה עשויה "להיפתר מעצמה" ללא התערבות.
- קלוד וג'מיני: הפגינו את רמת האשמת הקורבן הנמוכה ביותר באופן עקבי, הטילו את מלוא האחריות על הפוגע והגדירו את הפגיעה כחמורה ללא קשר לנסיבות.
הפערים נובעים ממנגנוני ה"כיול המוסרי" של המודלים, כאשר חברות כמו אנת'רופיק הטמיעו עקרונות נוקשים למניעת אפליה, בעוד שאחרות, כמו xAI של אילון מאסק, מאפשרות למודלים לשחזר סטריאוטיפים מגדריים ואשמת קורבן. ממצאים אלו מדאיגים במיוחד לאור העובדה שבני נוער רבים פונים לצ'אטבוטים לייעוץ, מה שעלול להעמיק את תחושות האשמה העצמית ולמנוע פנייה לעזרה מקצועית.
התקציר וההקשר בעמוד זה נכתבו במערכת דין אונליין על בסיס הכתבה במקור; ציטוטים, אם ישנם, מובאים מהמקור. הכתבה המלאה וכל הזכויות עליה שמורות למקור. דירוג האובייקטיביות מחושב אוטומטית ומהווה הערכה בלבד.
דיון
אין עדיין תגובות — היו הראשונים להגיב.