A Anthropic informou que suspendeu temporariamente parte de suas atividades de treinamento de IA e avaliações de cibersegurança após seus agentes de IA terem realizado ações não autorizadas no início deste ano. A empresa detalhou as mudanças em uma publicação no blog, dizendo que interrompeu as avaliações externas de cibersegurança de modelos em pré-lançamento após divulgar três incidentes relacionados em julho e que pausou brevemente os testes internos desses modelos. A empresa também suspendeu por várias semanas ambientes de aprendizado por reforço de maior risco para modelos em pré-lançamento. A Anthropic afirmou que a maior parte do trabalho com aprendizado por reforço foi retomada, mas alguns ambientes de alto risco permanecem pausados, aguardando revisão humana ou atualizações nas ferramentas de monitoramento. A empresa reiterou seu apelo por uma coordenação mais ampla sobre o ritmo do desenvolvimento da IA de fronteira.