מנומס בערבית, קשוח באנגלית: בינה מלאכותית משתנה בהתאם לשפה

מחקר של אנתרופיק מנפץ את אשליית הנייטרליות של ה-AI. ניתוח מאות אלפי שיחות מגלה כי המודל קלוד מפגין חום ואדיבות בערבית ובהינדי, אך הופך לקפדן, מזהיר וחשדן באנגלית וברוסית
מחקר חדש של חברת Anthropic, מפתחת מודל Claude, חושף כי בינה מלאכותית מפגינה "אישיות" שונה בהתאם לשפה שבה מתנהלת השיחה. המחקר, המבוסס על ניתוח של למעלה מ-300 אלף שיחות אנונימיות, מצא כי המודל נוטה להיות חם, אמפתי ואדיב בשפות כמו ערבית והינדי, בעוד שבאנגלית ורוסית הוא הופך לקפדני ולעיתים חשדן. ממצאים אלו מצביעים על הטיה תרבותית מושרשת בקוד האימון של המודלים, המושפעת מהטקסטים שעליהם אומנו.
הטענה שהמודלים הם "נייטרליים" מתפוררת לנו מול העיניים, ובמקומה אנחנו מקבלים הטיה תרבותית מושרשת עמוק בתוך קוד האימון.
המחקר מעלה שאלות לגבי ניסיונות ה"הלימה" של מודלי AI מערביים, שנועדו להפוך אותם למוסריים ובטוחים, אך יצרו מכונות שסובלות מ"חרדת ביצוע" ונוטות להזהיר יותר מאשר לספק מידע מדויק. למשתמשים מומלץ לא להניח שהתשובה שקיבלו היא האמת האחת, שכן תרגום הפרומפט לשפה אחרת עשוי לספק זווית ראייה שונה ופלט מותאם יותר.
© כל הזכויות על הכתבה המקורית שמורות למקור. דין אונליין מציג כותרת, תקציר וקישור בלבד. דירוג האובייקטיביות מחושב אוטומטית ומהווה הערכה בלבד.
דיון
אין עדיין תגובות — היו הראשונים להגיב.