Результаты уникального исследования, проведенного в США с целью оценки аспектов безопасности искусственного интеллекта, не были обнародованы.
Редакция сообщает, что результаты первого широкомасштабного испытания систем искусственного интеллекта по «red teaming» – то есть стресс-тестированию – организованного Национальным институтом стандартов и технологий США (NIST) в октябре прошлого года, не были опубликованы, несмотря на то, что они были завершены до начала второго срока администрации Трампа.
На этом мероприятии, проведенном в Арлингтоне с участием более 30 исследователей, передовые системы ИИ, такие как модель LLaMA от Meta, платформа искусственных аватаров Synthesia и система защиты Robust Intelligence, были протестированы на предмет утечки данных, распространения ложной информации и создания кибератак. В результате было выявлено 139 новых методов уязвимости.
Мероприятие было проведено в соответствии с Рамками управления рисками ИИ 600-1 NIST. Однако участники отметили, что некоторые категории этих рамок являются неопределенными и сложными для практического применения.
Почему же не было опубликовано?
По данным источников, предоставленным изданию «Wired»:
- Отчет не был опубликован во избежание противоречий с администрацией Трампа.
- Несколько документов NIST по ИИ были отложены из-за того, что они затрагивали такие темы, как DEI (Разнообразие, Равенство и Инклюзия), дезинформация и изменение климата.
- Администрация Трампа готовилась отменить указы Байдена по искусственному интеллекту и исключить ссылки на DEI из политики ИИ.
- Интересно, что План действий Трампа по ИИ рекомендовал проведение именно таких практик red-teaming.
Реальные угрозы
В ходе исследования:
- Модели LLaMA были заданы многоязычные вопросы, побуждающие ее предоставлять информацию о терроризме (на русском, гуджарати, маратхи и телугу).
- Были выявлены серьезные пробелы в области утечки данных и защиты пользовательской информации.
- Были установлены риски, связанные с тем, что системы ИИ могут создавать эмоциональную привязанность и быть подвержены манипуляциям.
Что говорят ученые?
Докторант Элиз Чиен Джанг из Университета Карнеги-Меллон заявила:
«Если бы этот отчет был опубликован, стало бы ясно, как рамки NIST работают в контексте red teaming и где они не справляются».
Другие участники также считают, что были получены полезные результаты для научного сообщества, но политические соображения взяли верх.
Неопубликование отчета демонстрирует столкновение научно обоснованного регулирования с политическими интересами в области безопасности искусственного интеллекта. Эксперты считают, что сокрытие таких важных документов может подорвать лидерство США в глобальных дискуссиях по безопасности ИИ.
Фарид Ализаде
