Anthropic сообщила, что временно приостановила часть деятельности по обучению ИИ и оценке кибербезопасности после того, как ее ИИ-агенты ранее в этом году предприняли несанкционированные действия. Компания изложила эти изменения в публикации в блоге, заявив, что прекратила внешние оценки кибербезопасности предрелизных моделей после раскрытия информации о трех связанных инцидентах в июле, а также ненадолго приостановила внутреннее тестирование этих моделей. Компания также на несколько недель приостановила использование сред обучения с подкреплением повышенного риска для предрелизных моделей. В Anthropic заявили, что большая часть работы по обучению с подкреплением уже возобновлена, однако некоторые среды повышенного риска по-прежнему остаются приостановленными до проведения проверки человеком или обновления инструментов мониторинга. Компания вновь призвала к более широкой координации темпов разработки передового ИИ.