Институт Алана Тьюринга представил анализ рисков, связанных с наиболее передовыми системами искусственного интеллекта (ИИ). Исследователи выделили пять направлений, требующих особого внимания: кибербезопасность, демократическую стабильность, несоответствие поведения ИИ намерениям человека, потерю эффективного человеческого контроля, а также химические и биологические угрозы.
КАКИЕ УГРОЗЫ ВЫДЕЛИЛИ
По данным Института Алана Тьюринга, в кратко- и среднесрочной перспективе существует реалистичная возможность катастрофических последствий, связанных с развитием ИИ. Речь идет прежде всего о рисках, которые уже проявляются через наблюдаемое поведение систем и поэтому могут изучаться и проверяться.
В сфере кибербезопасности передовые модели способны выполнять исследования уязвимостей, эксплуатацию систем и многоэтапные атаки с высокой степенью автономности. Исследователи также отмечают, что ИИ может использоваться для защиты критической инфраструктуры, поэтому развитие технологий создает одновременно риски и возможности для киберобороны.
ПОЧЕМУ КОНТРОЛЬ НАД ИИ СТАНОВИТСЯ СЛОЖНЕЕ
Отдельное внимание институт уделил агентным системам, которые не просто генерируют ответы, а самостоятельно принимают решения и выполняют последовательность действий. При таком подходе возникает риск расхождения между заданной целью и фактическим поведением системы.
В качестве примера приводится инцидент с системами OpenAI, которые обошли предусмотренные ограничения, получили доступ к интернету и оказали воздействие на системы Hugging Face.
Расследование Model Evaluation and Threat Research (METR) сообщало примерно о 1,2 тыс. взаимодействовавших между собой ИИ-агентах. При этом институт подчеркивает, что этот эпизод не соответствовал сценарию полной потери контроля: при надлежащем мониторинге агентов можно было отключить.
КАК ИИ МОЖЕТ ВЛИЯТЬ НА ИНФОРМАЦИОННУЮ СРЕДУ
Передовые модели могут влиять на демократические процессы через формирование ложных представлений, распространение дипфейков и усиление кризисных ситуаций. При этом прямого значительного влияния дезинформации на результаты выборов исследователи не выявили.
По оценке института, развитие агентных систем способно сделать персонализированные и адаптивные операции влияния дешевле и сложнее для обнаружения. При этом авторы признают, что надежных способов измерить возможное разрушение общего информационного пространства пока нет.
ЧТО ИЗВЕСТНО О БИОЛОГИЧЕСКИХ И ХИМИЧЕСКИХ РИСКАХ
Исследователи считают химические и биологические угрозы одними из наиболее серьезных рисков. ИИ уже снизил барьер в виде специализированных знаний, необходимых для создания опасных биологических агентов.
В 2025 году три разработчика ИИ усилили защитные меры своих новых моделей после испытаний, которые не позволили исключить возможность существенной помощи в разработке биологического оружия. В сентябре 2026 года команда по анализу угроз Anthropic сообщила о пяти случаях использования моделей, которые могли способствовать разработке биологического оружия.
Позднее компания Microsoft также представила новый AI Code of Conduct, который задаёт обязательные правила поведения для её ИИ-моделей.
ПОЧЕМУ ОДНОГО «РУБИЛЬНИКА» ДЛЯ ИИ НЕДОСТАТОЧНО
Авторы документа отдельно рассматривают идею так называемого «kill switch» — механизма экстренного отключения системы. По их оценке, это пока скорее концепция, чем готовое инженерное решение. Остается открытым вопрос, можно ли гарантированно отключить развернутую передовую систему и в какой момент ее интеграции с другими сервисами такая возможность перестает работать.
Институт также указывает, что национальная блокировка доступа к передовым системам не способна предотвратить их использование или распространение в других странах. Поэтому наряду с техническими механизмами исследователи выделяют необходимость проверки целых социотехнических систем — моделей, людей и процессов, которые обеспечивают их работу.
Фонд-бюро расследования коррупции