OpenAI đang thuê hàng trăm nhân viên đánh giá thuê ngoài để đọc và gắn nhãn các cuộc trò chuyện ChatGPT của người dùng thật, như một phần trong nỗ lực cải thiện chất lượng phản hồi của mô hình. Các đánh giá này bao gồm toàn bộ cuộc trò chuyện giữa người dùng và ChatGPT, trong đó một số có thể chứa thông tin cá nhân nhạy cảm. Các tài liệu nội bộ cho thấy những nhân viên đánh giá này giúp huấn luyện ChatGPT nhằm giảm xu hướng tự nhân cách hóa và các phản hồi mang tính “xu nịnh”. OpenAI cho biết họ cố gắng loại bỏ thông tin cá nhân trước khi các cuộc trò chuyện được đưa ra đánh giá, nhưng thừa nhận rằng nội dung nhạy cảm vẫn có thể còn sót lại. Anthropic cũng xác nhận họ sử dụng một quy trình đánh giá thủ công tương tự để huấn luyện các mô hình của mình.