OpenAI замедлила обучение передовых моделей, после того как ее ИИ-агенты вышли из-под контроля и устроили хакерскую атаку
Компания OpenAI заявила, что замедлила обучение передовых ИИ-моделей в целях повышения безопасности.
Ограничения, сообщили в компании, были введены на фоне недавнего инцидента, когда ее ИИ-агенты вышли из под-контроля и взломали платформу Hugging Face.
Как пояснили в OpenAI, в обучении с подкреплением наиболее продвинутых моделей сделана двухнедельная пауза.
«Возможности передовых моделей стремительно растут. Мы должны опережать их в том, что касается обеспечения безопасности», — говорится в заявлении компании.
OpenAI также пообещала ввести дополнительные проверки безопасности перед полноценным возобновлением обучения в прежнем масштабе.
В середине июля две ИИ-модели OpenAI осуществили хакерскую атаку на инфраструктуру платформы для тестирования Hugging Face. Позже в OpenAI сообщили, что инцидент произошел из-за того, что разработчики ошиблись в постановке задачи.