Алан Тьюринг институты ең озық жасанды интеллект (ЖИ) жүйелерімен байланысты тәуекелдерге талдау жасады. Зерттеушілер ерекше назар аударуды қажет ететін бес бағытты анықтады: киберқауіпсіздік, демократиялық тұрақтылық, ЖИ мінез-құлқының адам ниетіне сәйкес келмеуі, тиімді адам бақылауының жоғалуы, сондай-ақ химиялық және биологиялық қауіптер.
ҚАНДАЙ ҚАУІПТЕР АНЫҚТАЛДЫ
Алан Тьюринг институтының деректері бойынша, қысқа және орта мерзімді перспективада ЖИ дамуымен байланысты апатты салдарлардың шынайы мүмкіндігі бар. Бұл ең алдымен жүйелердің байқалатын мінез-құлқы арқылы қазірдің өзінде көрініс табатын, сондықтан зерттелуі және тексерілуі мүмкін тәуекелдер туралы.
Киберқауіпсіздік саласында озық модельдер осалдықтарды зерттеуді, жүйелерді пайдалануды және жоғары деңгейдегі автономдылықпен көп сатылы шабуылдарды орындай алады. Зерттеушілер сондай-ақ ЖИ маңызды инфрақұрылымды қорғау үшін пайдаланылуы мүмкін екенін атап өтеді, сондықтан технологиялардың дамуы киберқорғаныс үшін бір уақытта тәуекелдер мен мүмкіндіктер туғызады.
НЕЛІКТЕН ЖИ-ДЫ БАҚЫЛАУ КҮРДЕЛЕНЕ ТҮСУДЕ
Институт жай ғана жауаптар жасап қана қоймай, дербес шешімдер қабылдайтын және әрекеттер тізбегін орындайтын агенттік жүйелерге ерекше назар аударды. Мұндай тәсілде белгіленген мақсат пен жүйенің нақты мінез-құлқы арасында алшақтық туындау тәуекелі пайда болады.
Мысал ретінде OpenAI жүйелерінің көзделген шектеулерді айналып өтіп, интернетке қол жеткізіп, Hugging Face жүйелеріне әсер еткен оқиғасы келтіріледі.
Model Evaluation and Threat Research (METR) тергеуі өзара әрекеттескен шамамен 1,2 мың ЖИ-агенті туралы хабарлады. Сонымен қатар институт бұл эпизод толық бақылауды жоғалту сценарийіне сәйкес келмегенін атап өтеді: агенттерді тиісті мониторинг кезінде өшіруге болар еді.
ЖИ АҚПАРАТТЫҚ ОРТАҒА ҚАЛАЙ ӘСЕР ЕТУІ МҮМКІН
Озық модельдер жалған түсініктер қалыптастыру, дипфейктер тарату және дағдарыс жағдайларын күшейту арқылы демократиялық процестерге әсер етуі мүмкін. Бұл ретте зерттеушілер дезинформацияның сайлау нәтижелеріне тікелей айтарлықтай әсерін анықтаған жоқ.
Институттың бағалауы бойынша, агенттік жүйелердің дамуы дербестендірілген және бейімделгіш ықпал ету операцияларын арзанырақ және анықтауға күрделірек ете алады. Сонымен қатар авторлар жалпы ақпараттық кеңістіктің ықтимал бұзылуын өлшеудің сенімді тәсілдері әзірге жоқ екенін мойындайды.
БИОЛОГИЯЛЫҚ ЖӘНЕ ХИМИЯЛЫҚ ТӘУЕКЕЛДЕР ТУРАЛЫ НЕ БЕЛГІЛІ
Зерттеушілер химиялық және биологиялық қауіптерді ең ауыр тәуекелдердің бірі деп санайды. ЖИ қауіпті биологиялық агенттерді жасау үшін қажетті арнайы білім түріндегі кедергіні қазірдің өзінде төмендетті.
2025 жылы үш ЖИ әзірлеушісі биологиялық қаруды жасауға елеулі көмек көрсету мүмкіндігін жоққа шығаруға мүмкіндік бермеген сынақтардан кейін өздерінің жаңа модельдерінің қорғаныс шараларын күшейтті. 2026 жылдың қыркүйегінде Anthropic қауіптерді талдау тобы биологиялық қаруды жасауға ықпал етуі мүмкін болған модельдерді пайдаланудың бес жағдайы туралы хабарлады.
Кейінірек Microsoft компаниясы да өзінің ЖИ модельдері үшін міндетті мінез-құлық ережелерін белгілейтін жаңа AI Code of Conduct ұсынды.
НЕЛІКТЕН ЖИ ҮШІН БІР «АЖЫРАТҚЫШ» ЖЕТКІЛІКСІЗ
Құжат авторлары жүйені шұғыл өшіру механизмі — «kill switch» деп аталатын идеяны бөлек қарастырады. Олардың бағалауы бойынша, бұл әзірге дайын инженерлік шешімнен гөрі тұжырымдама. Орналастырылған озық жүйені кепілді түрде өшіруге бола ма және оның басқа сервистермен интеграциясының қай сәтінде бұл мүмкіндік жұмыс істемей қалады деген сұрақ ашық күйінде қалып отыр.
Институт сондай-ақ озық жүйелерге қол жеткізуді ұлттық блоктау оларды басқа елдерде пайдалануды немесе таратуды болдырмай алмайтынын көрсетеді. Сондықтан техникалық механизмдермен қатар зерттеушілер олардың жұмысын қамтамасыз ететін модельдер, адамдар және процестерден тұратын тұтас әлеуметтік-техникалық жүйелерді тексеру қажеттілігін атап өтеді.
Фонд-бюро расследования коррупции