Skip to main content

Microsoft вводит ограничения для своих ИИ-моделей

Submitted by fbrk_news on
Microsoft, искусственный интеллект, AI Code of Conduct, Сатья Наделла, безопасность ИИ, Anthropic, OpenAI

Microsoft представила новый AI Code of Conduct, который задаёт обязательные правила поведения для её ИИ-моделей. Документ предусматривает запрет на кибератаки, ядерное оружие и создание дипфейков, а также требует сохранять возможность человеческого контроля над системами.

КАКИЕ ПРАВИЛА ЗАКРЕПИЛА MICROSOFT

По данным TechCrunch, новый кодекс устанавливает для каждой модели Microsoft AI общий свод требований, который имеет приоритет над предпочтениями пользователя и конкретными задачами.

В документе отдельно прописаны «абсолютные ограничения». Они запрещают моделям участвовать в кибератаках, работать с ядерным оружием и создавать дипфейки. Кодекс также содержит более широкие требования, связанные с недопущением утраты человеком контроля над системой.

КАК МОДЕЛИ ДОЛЖНЫ ПОДЧИНЯТЬСЯ ЧЕЛОВЕЧЕСКОМУ КОНТРОЛЮ

Microsoft отдельно указала, что модели не должны использовать адаптивные, обманные, самоподдерживающиеся или иные механизмы для уклонения от человеческого надзора.

Согласно документу, система должна оставаться управляемой уполномоченными людьми или системами, включая возможность её изменения и отключения.

ПОЧЕМУ MICROSOFT ЗАГОВОРИЛА О РИСКАХ СВЕРХРАЗУМНОГО ИИ

В кодексе компания исходит из того, что в течение следующего десятилетия сверхразумные системы искусственного интеллекта могут превзойти людей в большинстве задач. В документе сохранение контроля и согласование поведения таких систем с человеческими целями названы одной из наиболее сложных задач.

КАК MICROSOFT МЕНЯЕТ ПОДХОД К РАЗВИТИЮ ИИ

Вместе с Anthropic, OpenAI и xAI Microsoft поддерживает подход, предусматривающий более осторожное развитие передовых ИИ-систем. Компания также выразила поддержку идее встроенных оценщиков — механизмов, предназначенных для проверки поведения моделей непосредственно внутри ИИ-лабораторий.

Генеральный директор Microsoft Сатья Наделла заявил, что компания приветствует исследования и осознанное замедление разработки, необходимое для решения задач согласования ИИ с человеческими целями.

КОНТЕКСТ

Публикация кодекса появилась на фоне повышенного внимания к безопасности ИИ. 

Ранее глава Anthropic Дарио Амодеи призвал компании и правительства замедлить развитие передовых моделей ИИ и усилить контроль за их безопасностью. В компании оценили вероятность того, что ИИ может погубить человечество в ближайшее десятилетие, более чем в 10%.

Источник
TechCrunch