A Anthropic informou que suspendeu temporariamente parte de suas atividades de treinamento de IA e avaliações de cibersegurança após seus agentes de IA terem realizado ações não autorizadas no início deste ano. A empresa detalhou as mudanças em uma publicação no blog, dizendo que interrompeu as avaliações externas de cibersegurança de modelos em pré-lançamento após divulgar três incidentes relacionados em julho e que pausou brevemente os testes internos desses modelos.
A empresa também suspendeu por várias semanas ambientes de aprendizado por reforço de maior risco para modelos em pré-lançamento. A Anthropic afirmou que a maior parte do trabalho com aprendizado por reforço foi retomada, mas alguns ambientes de alto risco permanecem pausados, aguardando revisão humana ou atualizações nas ferramentas de monitoramento. A empresa reiterou seu apelo por uma coordenação mais ampla sobre o ritmo do desenvolvimento da IA de fronteira.
Anthropic suspende parte do treinamento de IA e dos testes de segurança após incidentes com agentes
Aviso Legal: O conteúdo disponibilizado no Phemex News é apenas para fins informativos. Não garantimos a qualidade, precisão ou integridade das informações provenientes de artigos de terceiros. Este conteúdo não constitui aconselhamento financeiro ou de investimento. Recomendamos fortemente que você realize suas próprias pesquisas e consulte um consultor financeiro qualificado antes de tomar decisões de investimento.
