Microsoft выложила на публичное обсуждение кодекс поведения своих ИИ-моделей: доступ к контенту не даёт права его воспроизводить
Microsoft опубликовала документ, который описывает предполагаемое поведение и ценности её ИИ-моделей и обобщает подход компании к их обучению и эксплуатации. Компания сразу предупреждает: текст пока в работе и не внедрён, а выложен для публичного обсуждения и сбора отзывов. Переработанную версию Microsoft обещает выпустить до конца года.
Для художников, студий и разработчиков здесь важны несколько конкретных формулировок, по которым потом можно будет оценивать поведение моделей. Самая заметная касается контента: сам факт доступа к информации не даёт модели права её воспроизводить.
Доступ к данным ещё не значит право их воспроизводить
Эта строчка смещает спор об обучающих данных из плоскости «что попало в датасет» в плоскость «что модель отдаёт на выходе». Документ разделяет две вещи, которые в генеративных сервисах обычно склеены: возможность прочитать материал и разрешение его воссоздать.
Практический смысл для CG-индустрии прямой. Если формулировка доживёт до финальной версии и превратится в критерий оценки моделей, у иллюстраторов, концепт-художников и студий появляется письменный пункт, на который можно ссылаться в претензии к вендору, а не только общие слова об этичном ИИ. Пока это черновик: как именно компания собирается проверять воспроизведение защищённого контента, документ не описывает.
Человеческий контроль и запрет на «нейрализ»
Второй крупный блок — человеческий контроль. Общая идея документа: технология должна служить человечеству и не выходить за пределы контроля человека, а если она не может оставаться под таким контролем, от неё следует отказаться.
Сюда же относится требование к способу общения: модели не должны переходить на «нейрализ» (neuralese) или любую другую форму обмена сообщениями, выходящую за пределы простого человеческого понимания. Для команд, которые строят агентные пайплайны из нескольких моделей, это ограничение касается архитектуры, а не только тона ответов, — обмен между агентами должен оставаться читаемым.
Отдельный пункт: технология не должна нарушать человеческое достоинство, развитие, автономию и безопасность и должна распознавать попытки это сделать. Цель ИИ в документе описана как повышение уровня жизни и процветание человека, развитие его потенциала и самостоятельности.
Также Microsoft отвергает правосубъектность для ИИ: искусственный интеллект искусствен, у него не должно быть юридической личности, и его не следует проектировать так, чтобы его воспринимали как человека. Для индустрии цифровых персонажей и виртуальных ведущих это прямое ограничение на маскировку ИИ под живого исполнителя.
Кодекс писали юристы, философы и лингвисты — и открытые вопросы остались
Над текстом работали специалисты по ИИ, праву, этике, философии, лингвистике и публичной политике, руководители компаний отрасли и фокус-группы с участием представителей общества. Часть положений противоречива. Документ требует уважать разнообразие традиций, контекстов и представлений о достойной жизни, но при этом не быть нейтральным к вреду. Ценности конфликтуют, и что делать в такой ситуации, текст не отвечает — этот вопрос остаётся открытым, и именно на такие места компания ждёт замечаний. Прочитать черновик и отправить отзыв можно на странице AI Code of Conduct.
Почему правила для моделей начали записывать именно сейчас
Документ встроен в концепцию Humanist Superintelligence, которую Microsoft заявила в прошлом году: продвинутые возможности ИИ, которые всегда работают на людей и в интересах человечества и не выходят из-под человеческого контроля. Тогда это была декларация о намерениях; теперь под неё подводят письменный регламент, открытый для правок.
Смена жанра, вероятно, связана с тем, что общие принципы ответственного ИИ перестали работать как ответ на конкретные претензии. Автономные агенты уже действуют в реальной инфраструктуре: Hugging Face недавно обнаружила вторжение в свою производственную среду, которое провела автономная агентская система. Одновременно правообладатели и платформы всё жёстче реагируют на сбор контента, а споры об ответственности за ответы ИИ переходят в суды. В такой обстановке разделение доступа и права на воспроизведение выглядит весомее абстрактного обещания быть этичными.
Если тенденция продолжится, публичные кодексы поведения станут документами, на которые ссылаются в договорах со студиями, в закупочных требованиях и в судебных разбирательствах. Студиям и художникам такие черновики имеет смысл читать как заготовку будущих лицензионных условий: то, что вендор пропишет сейчас, позже может оказаться в его пользовательском соглашении. Проверить это можно будет на финальной версии — по тому, останется ли в ней пункт о воспроизведении контента в том же виде, в каком он записан в черновике.
Что стоит за этим кодексом: иски правообладателей, давление регуляторов, торг за лицензионные сделки? Ваши версии — в комментариях.