OpenAI recrute des centaines d’évaluateurs externalisés pour lire et annoter de véritables conversations d’utilisateurs avec ChatGPT, dans le cadre de ses efforts visant à améliorer la qualité des réponses du modèle. Les évaluations portent sur des conversations complètes entre les utilisateurs et ChatGPT, dont certaines peuvent contenir des informations personnelles sensibles. Des documents internes montrent que ces évaluateurs contribuent à entraîner ChatGPT afin de réduire l’auto-anthropomorphisme et les réponses « flagorneuses ». OpenAI a déclaré tenter de supprimer les informations personnelles avant que les conversations ne soient examinées, mais a reconnu que du contenu sensible pouvait néanmoins subsister. Anthropic a également confirmé utiliser un processus similaire de révision manuelle pour entraîner ses modèles.