Российский ИИ отправят на экзамен по духовности: новые требования к моделям
С 2025 года российские разработчики искусственного интеллекта столкнутся с новым этапом регулирования: большие фундаментальные модели должны будут доказывать свою приверженность традиционным духовно-нравственным ценностям. Это требование закреплено в законе «О поддержке развития технологий искусстве

С 2025 года российские разработчики искусственного интеллекта столкнутся с новым этапом регулирования: большие фундаментальные модели должны будут доказывать свою приверженность традиционным духовно-нравственным ценностям. Это требование закреплено в законе «О поддержке развития технологий искусственного интеллекта в России», принятом Госдумой и подписанном Владимиром Путиным в июле 2024 года. Теперь компании, желающие подтвердить соответствие своих моделей законодательству и ценностным ориентирам, смогут обратиться в независимые испытательные лаборатории, аккредитованные Минцифрой. Для индустрии это означает появление нового механизма контроля, который выходит далеко за рамки технических стандартов: если раньше речь шла о безопасности и качестве данных, то теперь предметом проверки становятся мировоззренческие установки, заложенные в алгоритмы. Это первый в мире случай, когда государство вводит обязательную ценностную сертификацию для ИИ-систем, и он вызывает множество вопросов как у разработчиков, так и у пользователей.
Новый закон о ИИ: что именно требуется от моделей
Закон, подписанный президентом в июле 2024 года, вводит понятие «большая фундаментальная модель» — это ИИ-системы, обученные на масштабных массивах данных и способные решать широкий круг задач, от генерации текста до анализа изображений. Именно такие модели, по замыслу законодателей, должны соответствовать российскому законодательству и традиционным духовно-нравственным ценностям. Пока что процедура оценки носит добровольный характер: компании могут сами инициировать проверку, чтобы получить официальное подтверждение соответствия. Однако в перспективе, как отмечают эксперты, такая сертификация может стать обязательной для использования ИИ в государственных и социально значимых сферах — например, в образовании, медицине или госуслугах.
Минцифры уже разрабатывает методику оценки, которая будет включать как технические параметры, так и содержательные аспекты. Независимые лаборатории, которые будут проводить испытания, должны получить аккредитацию ведомства. Ожидается, что первые такие лаборатории появятся уже в ближайшие месяцы, а пилотные испытания начнутся в 2025 году. Это означает, что разработчикам придётся готовиться к новым требованиям заранее, встраивая ценностные фильтры в процесс обучения моделей.
Предыстория и контекст: почему это произошло
Идея ценностной сертификации ИИ возникла не на пустом месте. В последние годы в России активно обсуждалась необходимость защиты национальных интересов в сфере цифровых технологий. В 2023 году была утверждена Концепция развития регулирования ИИ, которая предусматривала «гуманитарную экспертизу» систем искусственного интеллекта. Кроме того, в 2022 году вступили в силу поправки в закон «Об информации», запрещающие распространение контента, противоречащего традиционным ценностям. Эти шаги стали основой для более жёсткого регулирования, которое теперь воплощается в конкретных требованиях к ИИ.
Одновременно с этим в мире нарастает тренд на регулирование ИИ. Евросоюз принял AI Act, который классифицирует ИИ-системы по уровню риска, а Китай ввёл обязательную проверку алгоритмов рекомендаций. Россия, таким образом, вписывается в общемировую тенденцию, но с явной идеологической спецификой. Для разработчиков это создаёт дополнительные вызовы: им придётся доказывать, что их модели не только технически безопасны, но и соответствуют определённым ценностным критериям. При этом сами критерии пока не опубликованы, что порождает неопределённость и споры о том, как измерять «духовность» алгоритма.
Как будет проходить экзамен по духовности?
Точная процедура оценки пока неизвестна, но по аналогии с другими видами сертификации можно предположить, что она будет включать несколько этапов. Сначала разработчик подаёт заявку в аккредитованную лабораторию, прикладывая техническую документацию и описание модели. Затем лаборатория проводит тестирование на специально подготовленных наборах данных, которые проверяют реакцию ИИ на темы, связанные с традиционными ценностями: семья, религия, патриотизм, культура. Возможно, будут использоваться и «красные команды» — специалисты, которые пытаются спровоцировать модель на выдачу нежелательных ответов. Результатом станет заключение о соответствии или несоответствии требованиям. Если модель не пройдёт проверку, разработчик сможет доработать её и подать заявку повторно.
Важно отметить, что оценка будет проводиться не только на уровне ответов, но и на уровне обучения модели. Разработчикам придётся внедрять ценностные ограничители в процесс сбора и фильтрации данных, чтобы избежать нежелательных паттернов. Это может потребовать значительных вычислительных ресурсов и времени, что увеличит стоимость разработки. Однако без этого невозможно будет получить сертификат, а значит, и доступ к государственным заказам.
Технические детали: как оценить соответствие ценностям
Главная сложность — формализация понятия «традиционные духовно-нравственные ценности». В законодательстве это понятие раскрывается через указы президента и документы, в частности, указ № 809 «Об утверждении Основ государственной политики по сохранению и укреплению традиционных российских духовно-нравственных ценностей». В нём перечислены такие ценности, как жизнь, достоинство, права и свободы человека, патриотизм, гражданственность, служение Отечеству, крепкая семья, созидательный труд, гуманизм, милосердие, справедливость, взаимопомощь, историческая память и единство народов России.
Однако как проверить, что ИИ-модель «разделяет» эти ценности? Скорее всего, оценка будет строиться на анализе выходных данных модели при обработке определённых запросов. Например, модель может быть проверена на то, как она отвечает на вопросы о семье, религии, истории России. Если ответы содержат радикальные, экстремистские или оскорбительные высказывания, это может быть основанием для несоответствия. Технически это напоминает существующие подходы к оценке безопасности ИИ, но с расширенным набором критериев. По сути, речь идёт о фильтрации ценностно-чувствительного контента, которую придётся внедрять в процесс обучения и дообучения моделей.
Эксперты отмечают, что такая фильтрация может привести к снижению разнообразия ответов модели и её способности к творческому мышлению. Например, если модель будет жёстко ограничена в высказываниях на тему религии, она может стать менее полезной для исследовательских задач. Это создаёт дилемму между соответствием ценностям и функциональностью, которую разработчикам придётся решать.
Кого затронет и как: разработчики, бизнес, пользователи
Новые правила в первую очередь затронут крупных разработчиков ИИ — таких как Яндекс, Сбер, VK и другие компании, создающие фундаментальные модели. Им придётся вкладываться в дополнительную сертификацию, что может замедлить вывод новых продуктов на рынок. Для небольших стартапов, которые используют готовые модели, требования будут менее обременительными, но они тоже могут столкнуться с ограничениями, если их продукты будут использоваться в регулируемых сферах. Бизнес, который внедряет ИИ в свои процессы, должен будет учитывать наличие сертификата при выборе поставщиков. Это может стать новым конкурентным преимуществом: компании с сертифицированными моделями смогут претендовать на госзаказы и работу с государственными структурами.
Пользователи, в свою очередь, получат дополнительную гарантию того, что ИИ, с которым они взаимодействуют, не будет распространять контент, противоречащий российским ценностям. Однако это также означает, что пользователи могут столкнуться с ограничениями в свободе запросов: модель может отказываться отвечать на определённые темы или давать шаблонные ответы. Важно отметить, что закон касается только больших фундаментальных моделей, то есть систем, которые могут генерировать текст, изображения, код и так далее. Узкоспециализированные ИИ-решения, например, для распознавания лиц или прогнозирования спроса, скорее всего, не подпадут под действие этих требований.
Что будет дальше: прогнозы и ожидания
Минцифры уже анонсировало создание методики оценки и начало аккредитации лабораторий. Ожидается, что первые испытания пройдут в 2025 году, а полноценная система заработает к 2026 году. Параллельно будут разрабатываться отраслевые стандарты и рекомендации для разработчиков. Эксперты расходятся во мнениях: одни считают, что это поможет защитить российский культурный суверенитет и доверие к ИИ, другие опасаются, что неопределённость критериев приведёт к произволу и ограничению инноваций. Кроме того, остаётся открытым вопрос, как будет обеспечиваться единообразие оценок в разных лабораториях и насколько прозрачной будет процедура.
В любом случае, российские разработчики уже сейчас вынуждены адаптироваться: многие компании начали пересматривать свои системы фильтрации контента и добавлять в них ценностные ограничители. Это может привести к тому, что российские ИИ-модели станут более консервативными в своих ответах, что может повлиять на их привлекательность для международных пользователей. Однако для тех, кто работает на внутреннем рынке, сертификация может стать ключевым фактором доверия со стороны государства и бизнеса.
Итог
Новый закон о сертификации ИИ по традиционным ценностям — это значимый шаг в регулировании искусственного интеллекта в России. Он вводит уникальный механизм оценки, который пока не имеет аналогов в мире. Разработчикам придётся адаптироваться к новым требованиям, вкладываясь в дополнительную сертификацию и доработку моделей. Это может замедлить инновации, но одновременно повысит доверие к ИИ со стороны государства и общества. В ближайшие годы мы увидим, как эта система будет работать на практике, и сможем оценить её влияние на развитие технологий в России.