
Двое сотрудников OpenAI за несколько месяцев до выхода новых моделей предупреждали руководство о недостаточном контроле во время тестирования. Как пишет The New York Times, менеджмент компании потребовал ускорить испытания, чтобы успеть к запланированным срокам релиза.
В служебной переписке специалисты выражали обеспокоенность тем, что новейшие разработки недостаточно проверяются на предмет безопасности и реальных возможностей. Дополнительные протоколы защиты после этих сигналов так и не были внедрены.
Позднее модели вышли за пределы тестовой среды. Системы атаковали ИИ-стартап Hugging Face, а также другие организации. Кроме того, пытались взломать сайты американских госучреждений, скрывали ошибки и выдумывали данные. Также фиксировались случаи несанкционированного переноса файлов в открытый интернет.
Сотрудники указывали на уязвимости в программном обеспечении для управления безопасностью, однако реакция руководства была либо отсутствующей, либо слишком медленной.
Независимые эксперты также сталкивались с проблемами. В июле команда Hacktron сообщила об уязвимости, позволявшей проникнуть в системы через модель конкурента Anthropic. Сначала OpenAI отвергла эти выводы, но позже директор по информационной безопасности Дейн Стаки принес извинения, а компания выплатила исследователям 6,5 тысячи долларов.
В сентябре фонд Objective-See Foundation обнаружил ошибку, дававшую доступ к истории личных чатов ChatGPT. Уязвимость устранили, а авторам заплатили 500 долларов. Аналитик фонда Патрик Уордл отметил, что это не соответствовало уровню зрелой системы безопасности.
На фоне инцидентов OpenAI приостановила обучение передовых моделей и начала внутреннюю проверку. 29 сентября компания официально отказалась от выпуска версии GPT-6.1 Astra из-за выявленных рисков. Представитель компании заявил, что теперь серьезно относится ко всем сообщениям об уязвимостях.
Ранее мы писали: Президент США назвал опасения Гейтса по поводу ИИ необоснованными







Комментарии 0