OpenAI stellt Hunderte ausgelagerte Prüfer ein, die im Rahmen der Bemühungen zur Verbesserung der Antwortqualität des Modells echte ChatGPT-Unterhaltungen von Nutzern lesen und kennzeichnen. Die Überprüfungen umfassen vollständige Unterhaltungen zwischen Nutzern und ChatGPT, von denen einige sensible personenbezogene Informationen enthalten können. Interne Dokumente zeigen, dass die Prüfer dabei helfen, ChatGPT darauf zu trainieren, Selbstanthropomorphisierung und „sykophantische“ Antworten zu reduzieren. OpenAI erklärte, dass es versucht, personenbezogene Informationen zu entfernen, bevor Unterhaltungen überprüft werden, räumte jedoch ein, dass sensible Inhalte dennoch verbleiben können. Anthropic bestätigte ebenfalls, dass es ein ähnliches manuelles Prüfverfahren nutzt, um seine Modelle zu trainieren.