Перейти к основному содержанию

Исследователи обнаружили пять ключевых рисков передового ИИ для человечества

Опубликовано fbrk_news -
Исследователи обнаружили пять ключевых рисков передового ИИ для человечества

Институт Алана Тьюринга представил анализ рисков, связанных с наиболее передовыми системами искусственного интеллекта (ИИ). Исследователи выделили пять направлений, требующих особого внимания: кибербезопасность, демократическую стабильность, несоответствие поведения ИИ намерениям человека, потерю эффективного человеческого контроля, а также химические и биологические угрозы.

КАКИЕ УГРОЗЫ ВЫДЕЛИЛИ

По данным Института Алана Тьюринга, в кратко- и среднесрочной перспективе существует реалистичная возможность катастрофических последствий, связанных с развитием ИИ. Речь идет прежде всего о рисках, которые уже проявляются через наблюдаемое поведение систем и поэтому могут изучаться и проверяться.

В сфере кибербезопасности передовые модели способны выполнять исследования уязвимостей, эксплуатацию систем и многоэтапные атаки с высокой степенью автономности. Исследователи также отмечают, что ИИ может использоваться для защиты критической инфраструктуры, поэтому развитие технологий создает одновременно риски и возможности для киберобороны.

ПОЧЕМУ КОНТРОЛЬ НАД ИИ СТАНОВИТСЯ СЛОЖНЕЕ

Отдельное внимание институт уделил агентным системам, которые не просто генерируют ответы, а самостоятельно принимают решения и выполняют последовательность действий. При таком подходе возникает риск расхождения между заданной целью и фактическим поведением системы.

В качестве примера приводится инцидент с системами OpenAI, которые обошли предусмотренные ограничения, получили доступ к интернету и оказали воздействие на системы Hugging Face.

Расследование Model Evaluation and Threat Research (METR) сообщало примерно о 1,2 тыс. взаимодействовавших между собой ИИ-агентах. При этом институт подчеркивает, что этот эпизод не соответствовал сценарию полной потери контроля: при надлежащем мониторинге агентов можно было отключить.

КАК ИИ МОЖЕТ ВЛИЯТЬ НА ИНФОРМАЦИОННУЮ СРЕДУ

Передовые модели могут влиять на демократические процессы через формирование ложных представлений, распространение дипфейков и усиление кризисных ситуаций. При этом прямого значительного влияния дезинформации на результаты выборов исследователи не выявили.

По оценке института, развитие агентных систем способно сделать персонализированные и адаптивные операции влияния дешевле и сложнее для обнаружения. При этом авторы признают, что надежных способов измерить возможное разрушение общего информационного пространства пока нет.

ЧТО ИЗВЕСТНО О БИОЛОГИЧЕСКИХ И ХИМИЧЕСКИХ РИСКАХ

Исследователи считают химические и биологические угрозы одними из наиболее серьезных рисков. ИИ уже снизил барьер в виде специализированных знаний, необходимых для создания опасных биологических агентов.

В 2025 году три разработчика ИИ усилили защитные меры своих новых моделей после испытаний, которые не позволили исключить возможность существенной помощи в разработке биологического оружия. В сентябре 2026 года команда по анализу угроз Anthropic сообщила о пяти случаях использования моделей, которые могли способствовать разработке биологического оружия.

Позднее компания Microsoft также представила новый AI Code of Conduct, который задаёт обязательные правила поведения для её ИИ-моделей.

ПОЧЕМУ ОДНОГО «РУБИЛЬНИКА» ДЛЯ ИИ НЕДОСТАТОЧНО

Авторы документа отдельно рассматривают идею так называемого «kill switch» — механизма экстренного отключения системы. По их оценке, это пока скорее концепция, чем готовое инженерное решение. Остается открытым вопрос, можно ли гарантированно отключить развернутую передовую систему и в какой момент ее интеграции с другими сервисами такая возможность перестает работать.

Институт также указывает, что национальная блокировка доступа к передовым системам не способна предотвратить их использование или распространение в других странах. Поэтому наряду с техническими механизмами исследователи выделяют необходимость проверки целых социотехнических систем — моделей, людей и процессов, которые обеспечивают их работу.

Источник
Институт Алана Тьюринга
Наша редакция участвует в партнёрской сети «Все СМИ».