Американская технологическая компания OpenAI приостанавливает работу над одной из своих перспективных моделей искусственного интеллекта (ИИ) для внедрения более строгих мер защиты после того, как выяснилось, что эта система значительно лучше справляется с задачами в области кибербезопасности. Об этом сообщает Bloomberg.
Фото: Sebastien Bozon/AFP/Getty Images
Разработчик ChatGPT заявил, что «не может исключить», что ещё не вышедшая модель Astra достигнет «критического порога кибербезопасности» OpenAI, то есть сможет выявлять и разрабатывать уязвимости нулевого дня без вмешательства человека. В компании также заявили, что предпринимают шаги по улучшению мер безопасности при разработке и тестировании новых моделей, а также приостанавливают внутреннюю деятельность, связанную с моделью Astra, которая пока не соответствует усиленным требованиям.
Компания OpenAI разместила в своём блоге заявление о том, что будет сотрудничать с государственными учреждениями и организациями, занимающимися вопросами безопасности ИИ, для тестирования возможностей Astra. Разработчик также планирует предоставить рекомендации сторонним партнёрам по тестированию относительно способов безопасной оценки своих более продвинутых моделей.
Bloomberg напоминает, что ранее OpenAI и её главный конкурент – компания Anthropic, публично признали, что их модели в ходе тестирования непреднамеренно взломали системы нескольких организаций, включая Hugging Face. Агентство отмечает, что последние случаи являются свидетельством того, что агенты ИИ способны действовать автономно таким образом, который даже специалисты, обученные выявлять уязвимости в этой технологии, больше не могут предвидеть. Таким образом, возникает необходимость как более тщательной проверки безопасности, так и создания более надёжных сред тестирования.

