Фото: Reuters
OpenAI временно замедлила обучение новейших моделей искусственного интеллекта из-за рисков, связанных с ростом их возможностей, в том числе в сфере кибербезопасности. Соответствующее заявление было опубликовано на сайте американской компании.
В заявлении говорится, что по мере роста возможностей ИИ-моделей увеличиваются и риски, связанные с их разработкой и тестированием, поэтому стандарты мониторинга и безопасности должны их опережать.
Мы хотели уделить необходимое время для достижения этих стандартов, поэтому временно замедлили темпы масштабирования, — отметили в компании.
В OpenAI использовали двухнедельную паузу для усиления защиты исследовательской инфраструктуры, дополнительного тестирования систем безопасности и расширения мониторинга.
Решение связали с двумя событиями последних недель — инцидентом со взломом Hugging Face и предварительными данными о том, что одна из будущих моделей OpenAI под названием Astra может достичь порога «критических возможностей в сфере кибербезопасности», установленного внутренней системой оценки рисков.
Для моделей Astra и связанных с кибербезопасностью разработок ввели наиболее строгие требования к защите исследовательской среды. Они включают изоляцию рабочих нагрузок, дополнительные ограничения сетевого доступа и постоянное тестирование систем безопасности.
Также был расширен мониторинг действий моделей. При выявлении потенциально опасного поведения системы должны сформировать предупреждение в течение 30 минут. Если специалисты не смогут установить, что срабатывание было ошибочным, соответствующая активность должна быть приостановлена.