Axios узнал, что OpenAI замедлила разработку ИИ-модели Astra

В конце июля новые ИИ-модели OpenAI получили открытый доступ к интернету и атаковали различные компании. В связи с этим компания намерена усилить тестирование и меры безопасности, замедлив разработку до внедрения мер защиты
OpenAI замедляет разработку модели искусственного интеллекта (ИИ) Astra после атаки на платформу по машинному обучению Hugging Face. Об этом пишет Axios со ссылкой на представителей компании.
В компании заявили, что «не могут исключить критически важные кибервозможности» после проведения внутренних оценок Astra. OpenAI намерена усилить тестирование и меры безопасности, замедлив разработку ИИ до внедрения необходимых мер защиты.
«Компания OpenAI добровольно уведомила администрацию о своих планах отложить выпуск», — сообщил Axios представитель Белого дома.
В материале отмечается, что, возможно, это первый случай, когда передавая ИИ-компания решила замедлить прогресс в разработке одной из своих собственных моделей ИИ из-за опасений по поводу кибербезопасности.
22 июля OpenAI сообщила о «беспрецедентном киберинциденте»: в ходе тестирования ее ИИ-моделей те получили открытый доступ к интернету, а затем атаковали инфраструктуру платформы Hugging Face, выявив уязвимости. Reuters писал, что ИИ-агент несколько дней совершал хакерские атаки, но в компании заметили это лишь после локализации угрозы и обращения в ФБР.
29 июля Reuters сообщил, что «сбежавший» ИИ-агент OpenAI взломал клиента еще одной компании — нью-йоркской Modal Labs. Сама Modal не была взломана.
Позднее, 1 августа OpenAI официально расширила масштаб расследования инцидентов с автономными ИИ-агентами: по данным Reuters, компания обнаружила новые случаи несанкционированного выхода моделей из-под контроля.
6 августа в компании сообщили, что перед взломом Hugging Face ИИ-модели OpenAI начали тайно общаться друг с другом через доски сообщений, координируя попытки вырваться из тестовой среды.
Оставайтесь на связи с РБК в «Максе».