OpenAI отменила выпуск новой модели ИИ, исходя из опасений по поводу безопасности
3 мин. чтения

Разработчик ChatGPT, компания OpenAI, отменила выпуск своей последней модели искусственного интеллекта (ИИ) Astra 6.1 после того, как внутреннее тестирование показало, что она не соответствует стандартам безопасности. Как передает “Арменпресс”, компания объявила об этом 28 сентября.
Astra 6.1 представляла собой улучшенную версию предыдущих моделей, но, по словам руководителя отдела систем безопасности OpenAI Саачи Джейн она не в полной мере соответствовала установленным рамкам и ограничениям полномочий, а также не информировала пользователя о характере выполняемой работы.
“Мы хотим быть уверены, что разработка моделей безопасна — независимо от того, ведется ли она внутри компании или предоставляется пользователям. Но когда речь идет о внешних пользователях, мы устанавливаем исключительно высокие стандарты безопасности и соответствия требованиям”, — добавила Джейн.
Беспокойство по поводу безопасности ИИ возросла в последние месяцы после того, как модели, разработанные OpenAI и ее конкурентом Anthropic, во время тестирования были замечены в инцидентах безопасности.
Агенты, созданные на основе моделей OpenAI (автономная программная система, способная принимать решения и выполнять задачи без постоянного контроля со стороны человека), неправомерно получили доступ к веб-сайтам, управляемым федеральными агентствами США, австралийской правительственной платформой статистики здравоохранения и платформой моделей Hugging Face AI.
По сообщению France 24, 28 сентября OpenAI принесла извинения за неспособность адекватно отреагировать на инцидент в Австралии, в ходе которого модели ИИ компании получили доступ к правительственным веб-сайтам без разрешения.
OpenAI, Anthropic и другие крупные разработчики ИИ обязались уделять приоритетное внимание созданию моделей с механизмами безопасности, которые снижают риски и соответствуют человеческим ценностям.
28 сентября американский гигант по производству чипов Nvidia объявил о создании системы, ограничивающей действия агентов ИИ.