Духовный контроль для ИИ: в России вводят обязательную проверку моделей на «традиционные ценности»
Российский рынок искусственного интеллекта стоит на пороге тектонических изменений. Разработчики, претендующие на статус «суверенной» или «национальной» модели, вскоре будут обязаны подтверждать не только техническое соответствие законодательству, но и приверженность традиционным духовно-нравственным ценностям. Эта процедура будет проходить в аккредитованных испытательных лабораториях, а дискуссии о её параметрах велись на площадке АНО «Цифровая экономика» в конце июля — начале августа.
Как устроена новая система проверки
С 26 июля вступил в силу рамочный закон об ИИ, но ключевые правила игры ещё предстоит прописать в подзаконных актах. Сейчас обсуждается введение двух официальных статусов для крупных фундаментальных моделей — суверенной и национальной. Чтобы получить один из них, разработчик обязан пройти экспертизу на соответствие законодательству и ценностным ориентирам.
Примечательно, что отдельный акт с чётким перечнем ценностей пока создавать не планируют — список уже закреплён в указе президента № 809. Вместо этого совместно с бизнесом будут разработаны специальные бенчмарки: наборы тестов для проверки моделей. Процедура будет выглядеть так: разработчик подаёт заявку с описанием архитектуры и механизмов фильтрации запросов, после чего лаборатория проверяет ответы модели по бенчмаркам и тестирует её на устойчивость к промпт-инъекциям — так называемому «взлому ИИ», когда вредоносные инструкции прячутся во входных данных.
Положительное заключение направляется в комиссию по цифровизации, и именно оно открывает доступ к государственной поддержке и преференциям в госзакупках. При этом проверять все модели рынка никто не собирается — речь идёт только о тех, кто претендует на высокий статус. Первыми сферами внедрения станут образование и госуслуги.
Кто будет выносить вердикт
Вместо одной уполномоченной организации решено создать сеть из нескольких аккредитованных лабораторий. Схема выстраивается в два этапа: сначала разработчик самостоятельно тестирует модель по общей риск-ориентированной методике, а затем аккредитованная лаборатория оценивает выводы и может выборочно проверить устойчивость системы. Финальное слово останется за Минцифрой, а требования безопасности для госссистем будут согласовываться с ФСБ и ФСТЭК.
Однако эксперты уже указывают на серьёзные риски. Бизнес-архитектор ИИ-экосистемы «Авандо» Алексей Борщов справедливо отмечает: такие категории, как гражданственность, справедливость и историческая память, невозможно напрямую транслировать в техническое задание. Единственный рабочий вариант — процедурный подход: единый формат отчёта, набор провокационных запросов и воспроизводимость результатов. Управляющий партнёр бюро «Пропозитум» Дмитрий Галанцев предупреждает об «оценочности» критериев, которая может привести к избирательному применению, и предлагает ввести сроки действия сертификатов и публичный реестр заключений.
Мой взгляд: это знаковый прецедент для всей индустрии. Формализация «духовности» в виде бенчмарков — крайне сложная задача, и рынок ждёт не столько сам закон, сколько его правоприменительную практику. Если критерии будут размытыми, мы рискуем получить инструмент не столько регулирования, сколько административного давления. Прозрачность процедуры и чёткая методология — единственный способ избежать хаоса в этой новой реальности.