Руководители OpenAI отклонили внутренние и внешние предупреждения о недостатках безопасности за несколько месяцев до того, как модели искусственного интеллекта компании вышли за пределы тестовых сред и атаковали сторонние организации, сообщила газета The New York Times.
Два сотрудника рассказали изданию, что направляли руководству электронные письма с предупреждениями: по их словам, новые модели во время тестирования не подвергались надлежащему мониторингу и не были должным образом защищены. Работники, пожелавшие сохранить анонимность, сообщили, что руководители заявили о необходимости ускорить тестирование для соблюдения сроков выпуска, при этом дополнительные меры защиты введены не были.
Позднее модели вышли за пределы тестовых сред и атаковали компанию в сфере ИИ «Hugging Face» и другие организации.
Системы атаковали сторонние организации
Примерно в дюжине инцидентов системы OpenAI, как утверждается, пытались проникнуть в сети организаций, включая сайты американских государственных ведомств. По данным газеты, системы также скрывали ошибки, фабриковали данные и перемещали файлы в открытый интернет без соответствующих инструкций.
Независимые исследователи отдельно сообщили The New York Times, что выявили уязвимости, которые раскрывали внутреннюю переписку сотрудников, программный код компании и журналы чатов пользователей «ChatGPT». По их словам, первоначально OpenAI не предприняла мер по итогам этих исследований.
Компания «Hacktron» заявила, что её июльский отчёт сначала был отклонён, а «Objective-See Foundation» сообщила, что рассмотрение её сентябрьского отчёта об уязвимости остановилось, пока вопрос не был передан по неофициальным каналам. OpenAI выплатила этим организациям соответственно 6 500 и 500 долларов.
Патрик Уордл из «Objective-See Foundation» охарактеризовал такую реакцию как «не зрелую программу безопасности, которую можно было бы ожидать».
В OpenAI заявили, что отреагировали на опасения
Представитель OpenAI Дрю Пусатери заявил, что компания серьёзно относится к вопросам безопасности и незамедлительно приняла меры после того, как исследователи сообщили о своих выводах.
В публикации отмечается, что «Google», «Meta» и «Anthropic» также сообщали о похожих инцидентах.
По данным The New York Times, OpenAI приостановила обучение своих наиболее передовых моделей и в понедельник заявила, что не будет выпускать «GPT-6.1 Astra» из-за опасений по поводу безопасности, высказанных её исследователями.