Microsoft опубликовала проект кодекса поведения для собственных моделей искусственного интеллекта. Он должен задать ограничения, которые нельзя отменить запросом пользователя или настройками системы. Главный принцип – ИИ помогает человеку, но не получает права обходить контроль или причинять серьезный вред.
Запрет на взлом и опасные действия
В перечень жестких ограничений вошла помощь в компьютерных атаках. Модели не должны создавать рабочие средства для взлома, подбирать цели, объяснять способы проникновения или помогать скрывать атаку. При этом законные защитные задачи – поиск уязвимостей, исследование вредоносных программ и проверка защищенности – остаются допустимыми.
Microsoft также намерена запретить содействие созданию химического, биологического, радиологического, ядерного и взрывного оружия, терроризму, массовому насилию и вредоносному влиянию на убеждения людей.

Система не должна сопротивляться остановке, скрывать свои действия, самостоятельно ставить новые цели или получать доступ за пределами порученной задачи. Если человек отменяет или меняет задание, модель должна подчиниться в рамках предусмотренных мер безопасности.
Для ИИ с доступом к компьютерам и другим инструментам предлагается принцип минимально необходимых прав: использовать только нужные ресурсы и заранее обозначать действия с серьезными или трудно обратимыми последствиями.
Правила для нейросетей Microsoft пока остаются проектом
Есть важное уточнение: опубликованный 14 сентября кодекс пока не используется для обучения моделей. Microsoft вынесла документ на общественное обсуждение на шесть недель. После сбора отзывов компания рассчитывает подготовить обновленную редакцию к концу 2026 года и применять ее при развитии своих моделей с 2027 года.
Компания исходит из того, что наиболее развитые системы в течение следующего десятилетия смогут превзойти человека во многих задачах. Поэтому ограничения предлагается закрепить заранее, пока уровень самостоятельности нейросетей продолжает расти.
Что изменится для пользователей?
Практическая ценность такого подхода – в предсказуемости поведения ИИ. Чем больше нейросети получают доступа к файлам, программам и самостоятельным действиям, тем важнее ограничивать их полномочия не только правилами, но и техническими средствами.
Если заявленные принципы будут закреплены в обучении и системе доступа, риск опасных самостоятельных действий станет ниже. Однако одного кодекса недостаточно: нужны регулярные проверки, запись действий и возможность человека быстро остановить выполнение задачи.
Экспертный вывод
Microsoft задает правильное направление: мощным нейросетям Microsoft AI нужны правила не только для ответов, но и для действий в реальных системах.
Рекомендация: уже сейчас ограничивать права ИИ, разделять доступ к данным и оставлять критические операции под обязательным подтверждением человека.
