OpenAI kündigte an, Drittorganisationen für technische Sicherheitsbewertungen in die frühen Phasen des Trainings, der Evaluierung und der Bereitstellung von KI-Modellen einzubinden. Bisher wurden externe Teams üblicherweise erst vor der Veröffentlichung eines Modells hinzugezogen, um dessen Fähigkeiten und Risiken zu bewerten. Das Unternehmen erklärte, dass diese Bewertungen unabhängig und wissenschaftlich fundiert bleiben sowie robuste Sicherheitsmechanismen mit klar definierten Zuständigkeiten umfassen müssen. OpenAI befindet sich derzeit in Gesprächen mit mehreren neuen und bestehenden Partnern, darunter METR und Redwood Research, um diese Initiative auszuweiten. Einige Evaluatoren könnten in den Büros des Unternehmens eingesetzt werden, um während der sensibelsten Entwicklungsphasen an Tests teilzunehmen – ein Schritt hin zu einer kontinuierlichen externen Aufsicht über den gesamten Lebenszyklus eines Modells hinweg.