Новости

«Духовные алгоритмы»: ФСБ будет проверять нейросети на нравственность

Алексей Алоисов
«Духовные алгоритмы»: ФСБ будет проверять нейросети на нравственность

Для крупных ИИ-моделей в России разработают критерии соответствия законодательству и традиционным духовно-нравственным ценностям — требования к моделям будут устанавливать Минцифры, ФСБ и ФСТЭК. Проверять модели на соответствие этим критериям будет независимая испытательная лаборатория, куда IT-компании обязаны будут передавать свои разработки, если рассчитывают на статус суверенной или национальной модели.

Обсуждение механизма проверки проходило в конце июля — начале августа на площадке АНО «Цифровая экономика» — там готовили подзаконные акты к принятому 26 июля Федеральному закону № 243-ФЗ «О поддержке развития технологий искусственного интеллекта в Российской Федерации».

Что даёт статус суверенной модели

Закон вводит два новых статуса — суверенная и национальная большая фундаментальная модель искусственного интеллекта. Чтобы получить любой из них, разработчику придётся подтвердить, что модель соответствует не только российскому законодательству, но и традиционным духовно-нравственным ценностям — порядок такого подтверждения установит правительство.

Разработкой соответствующих норм сейчас занимаются сразу три ведомства — Минцифры, ФСБ и ФСТЭК. Первый проект архитектуры этих правил уже готов. Как заявил 7 июля в ходе первого чтения законопроекта в Госдуме статс-секретарь — заместитель министра цифрового развития Иван Лебедев, порядок оценки будет включать критерии, по которым можно будет определить, отвечает ли модель духовно-нравственным ценностям и задачам технологического развития страны.

Какие ценности возьмут за основу

Перечень традиционных российских духовно-нравственных ценностей закреплён в указе президента от 9 ноября 2022 года № 809 (в редакции от 4 марта 2026 года). В него входят:

  • жизнь, достоинство, права и свободы человека

  • патриотизм, гражданственность, служение Отечеству

  • крепкая семья и созидательный труд

  • приоритет духовного над материальным

  • гуманизм, милосердие и справедливость

  • коллективизм, взаимопомощь и взаимоуважение

  • историческая память и единство народов России

Отдельного акта, где духовно-нравственные ценности были бы прописаны применительно именно к ИИ, готовить не планируют. Вместо этого совместно с бизнесом разработают специальные бенчмарки, по которым и будут тестировать модели.

Как будет работать проверка

Инициировать создание испытательной лаборатории сможет правительственная комиссия по цифровизации — по представлению Минцифры. Сама процедура выглядит так:

  1. разработчик подаёт заявление с описанием архитектуры модели, сведениями о себе и механизмах фильтрации контента

  2. лаборатория тестирует ответы модели с помощью бенчмарков

  3. отдельно проверяется возможность обхода ограничений, включая промпт-инъекции

  4. по итогам проверки лаборатория направляет заключение в правительственную комиссию

Положительное заключение станет одним из этапов присвоения статуса национальной или суверенной модели, а вместе с ним — доступа к мерам государственной поддержки.

Всеобщей обязательной проверки для всех ИИ-моделей на рынке закон не вводит — речь идёт только о тех разработках, которые претендуют на статус суверенных или национальных. Сам закон вступает в силу с 1 сентября 2026 года, за исключением отдельных положений.

Мнение ИИ

С точки зрения машинного анализа данных, российская модель проверки на «духовно-нравственные ценности» находит параллели в азиатском опыте регулирования генеративных технологий. Китай еще в середине 2020-х годов закрепил требование к разработчикам использовать только «законные данные» для обучения моделей и раскрывать эти сведения регулятору — по сути тот же принцип содержательного контроля, только сформулированный через призму защиты данных, а не идеологии. Разница в терминологии показательна: пекинский подход апеллирует к юридической чистоте обучающей выборки, московский — к соответствию системе ценностей из указа №809.

Технический аспект, который статья не раскрывает: как именно бенчмарки будут измерять «приоритет духовного над материальным» в ответах языковой модели — критерий, плохо поддающийся формализации в отличие от проверки данных на легальность происхождения. Останется ли такая оценка воспроизводимой и прозрачной для разработчиков, или превратится в закрытую процедуру с непредсказуемым результатом?


Самые интересные и важные новости на нашем канале в Telegram