Американская технологическая компания OpenAI планирует разрешить сторонним группам экспертов проверять модели искусственного интеллекта (ИИ) на предмет рисков для безопасности на ранних этапах их разработки, что является частью постоянных усилий по решению растущих опасений по поводу потенциального вреда, который может нанести эта технология. Об этом сообщает Bloomberg.
Фото: Gabby Jones/Bloomberg
Компания-разработчик ChatGPT сообщила в своём блоге, что намерена разрешить сторонним организациям проводить техническую оценку безопасности своих моделей в процессе обучения, оценки и внедрения новых моделей ИИ. OpenAI также изложила приоритеты, которые, по ее мнению, необходимы для эффективной работы таких проверок, включая обеспечение «надёжных механизмов независимости, научной строгости, надёжных методов обеспечения безопасности и четкого распределения обязанностей».
Лама Ахмад, технический руководитель программ по обеспечению надёжности искусственного интеллекта в OpenAI, которая руководит большей частью усилий компании по сотрудничеству с внешними экспертами в области анализа безопасности, отметила, что ранее компания, как правило, привлекала подобные группы для оценки безопасности перед запуском моделей и для оценки их возможностей.
Bloomberg отмечает, что в последние недели сотрудники ведущих компаний, занимающихся ИИ, выражают обеспокоенность по поводу потенциальной возможности причинения катастрофического вреда с помощью данной технологии. Эти опасения во многом подпитываются несколькими инцидентами за последние несколько месяцев, когда передовые модели ИИ от OpenAI и других разработчиков непреднамеренно взламывали системы других компаний во время тестирования.
В своём сообщении в блоге компания OpenAI заявила, что ведет переговоры с группами, которые могут заниматься подобными оценками. Лама Ахмад сказала, что фирма ведёт переговоры с различными организациями, с которыми она ранее сотрудничала, а также с теми, с которыми она раньше не работала, включая исследовательские группы в области ИИ METR и Redwood Research. Именно их привлекала OpenAI для проведения расследования по факту нарушения своими моделями системы компании Hugging Face.

