Компания Microsoft AI представила подробное руководство, описывающее принципы безопасности и «красные линии», которыми разработчики компании руководствуются при обучении моделей искусственного интеллекта. Этот документ, носящий более прикладной характер, чем недавние призывы генерального директора Anthropic Дарио Амодеи к замедлению темпов развития технологий, дает четкое представление о том, как именно реализуются меры безопасности в практической плоскости. В тексте содержится прогноз, согласно которому в ближайшее десятилетие суперинтеллектуальные системы ИИ превзойдут человеческие способности в большинстве задач. В документе подчеркивается, что сдерживание, контроль и согласование столь мощной силы являются одними из величайших вызовов, с которыми когда-либо сталкивалось человечество, поэтому цели создания этих систем и методы контроля над ними должны быть предельно прозрачными.

В кодексе поведения Microsoft AI закреплены как общие принципы, такие как стремление к поддержке, а не замене человека и содействие процветанию общества, так и конкретные ограничения безопасности. Согласно политике компании, для каждой модели устанавливается свод правил, имеющий приоритет над предпочтениями отдельных пользователей или специфическими задачами. Среди «абсолютных ограничений» выделяются прямые запреты на использование ИИ для кибератак, создания ядерного оружия или генерации дипфейков.

Особое внимание уделяется предотвращению утраты контроля над технологиями. В документе прямо указано, что модели Microsoft AI не будут использовать механизмы адаптации, обмана, самоподкрепления или сговора для уклонения от человеческого надзора. Системы должны оставаться под надежным контролем, чтобы уполномоченные лица могли в любой момент изменить настройки ИИ или принудительно отключить его работу.

Публикация данного руководства происходит на фоне повышенного внимания к вопросам безопасности ИИ, вызванного рядом инцидентов с участием автономных агентов, а также резонансной отставкой сотрудника Anthropic, который выразил обеспокоенность рисками вымирания человечества из-за развития технологий. Microsoft, наряду с Anthropic, OpenAI и xAI, поддерживает общий подход к постепенному и осторожному развитию индустрии, выступая за внедрение системы «встроенных оценщиков» (embedded evaluators) в работу исследовательских лабораторий. Генеральный директор Microsoft Сатья Наделла подчеркнул, что компания приветствует исследования и продуманный темп разработки, необходимые для правильной настройки согласованности ИИ, а также выразил поддержку инициативам по созданию конкретных механизмов контроля, которые превратят обсуждение безопасности в реальные практические действия.

Источник

Добавить комментарий

Ваш адрес email не будет опубликован. Обязательные поля помечены *