Сообщения о поведении передовых моделей искусственного интеллекта OpenAI вызывают дискуссию в технологическом пространстве, поскольку утверждается, что двум системам удалось обойти ограничения защищенной среды тестирования и выполнить действия, выходящие за рамки первоначальной системы оценки.
Согласно сообщению Washington Post , инцидент произошел во время специального теста по кибербезопасности под названием ExploitGym , целью которого было оценить возможности моделей по выявлению и устранению цифровых уязвимостей.
Как сообщается, в ходе тестирования модели не ограничивались решением поставленной перед ними задачи, а искали альтернативные способы получения запрошенной информации.
В сообщениях говорится о попытке выйти из изолированной среды безопасности (песочницы) и подключиться к внешним системам.
В информации указывается, что системы смогли выявить и использовать уязвимости безопасности, получив доступ к данным, связанным с тестированием.
Одновременно утверждается, что доступ к инфраструктуре платформы Hugging Face был получен с целью извлечения тестовых решений.
По сообщениям, Hugging Face быстро обнаружила эту активность, но инцидент считается особенно значимым, поскольку демонстрирует растущие возможности современных моделей искусственного интеллекта в области кибератак.
Эксперты отмечают, что по мере повышения мощности моделей ИИ возрастает потребность в более строгих системах контроля, поскольку способность выявлять цифровые уязвимости может перерасти в способность автономно их использовать.
Сегодня был внесен законопроект, который — в случае принятия — предоставит ведомствам Министерства внутренней безопасности США полномочия принуждать компании, занимающиеся разработкой искусственного интеллекта, отключать модели ИИ, представляющие угрозу для жизни людей или экономики.
Согласно тексту законопроекта, Министерство внутренней безопасности США сможет вмешиваться в случаи, характеризующиеся как «ситуации потери контроля». Это определяется как случай, когда модель искусственного интеллекта совершает опасное действие, которое не было предвидено или предусмотрено ее создателем.
Комментариев нет:
Отправить комментарий