נמאס לכם ש-ChatGPT חוזר על עצמו? כך תוציאו ממנו תשובות יצירתיות יותר

מתברר שמודלי AI מתקדמים נוטים יותר ויותר לחזור על אותן תשובות, דווקא בגלל הניסיונות להפוך אותם לאמינים ובטוחים יותר. חוקרים מכנים את התופעה "קריסת מצבים", אבל מציעים גם שיטה פשוטה שיכולה לחלץ מהצ'אט תשובות מגוונות ויצירתיות יותר
הכתבה דנה בתופעה של חוסר יצירתיות וחזרתיות בתשובות של מודלי בינה מלאכותית יוצרת, כמו ChatGPT, למרות שדרוגים שנועדו לשפר את איכותם ובטיחותם. חוקרים מכנים זאת "קריסת מצבים" (Mode collapse), וטוענים שהיא נובעת מתהליכי אימון המבוססים על משוב אנושי (RLHF), שבהם המודלים מתכנסים לתכנים מצומצמים ואחידים. הסיבה לכך היא נטייתם של בני אדם להעדיף תכנים מוכרים, מה שמוביל לדירוג גבוה יותר של תשובות נפוצות ופחות יצירתיות.
חוקרים כינו את התופעה הזאת של התלכדות למספר מצומצם מאוד של תשובות "קריסת מצבים" (Mode collapse).
כדי להתמודד עם הבעיה, מציעים החוקרים שיטה פשוטה בשם "דגימת הסתברות מילולית" (Verbalized Sampling), המבקשת מהמודל במפורש להפיק מספר תשובות אפשריות ולצרף לכל אחת את אומדן ההסתברות שלה. שיטה זו, המכונה "פרומפט הקסם", מגבירה את היצירתיות והגיוון של התשובות מבלי לפגוע בדיוק או בבטיחות. למרות שהשיטה יעילה כיום, קצב ההתפתחות המהיר של התחום עשוי להביא לפתרונות חדשים בעתיד.
© כל הזכויות על הכתבה המקורית שמורות למקור. דין אונליין מציג כותרת, תקציר וקישור בלבד. דירוג האובייקטיביות מחושב אוטומטית ומהווה הערכה בלבד.
דיון
אין עדיין תגובות — היו הראשונים להגיב.