Нейросеть, вы духовная? А историческую память уважаете?

0

Кажется, искусственный интеллект в России наконец-то получил то, чего ему так не хватало. Не новые вычислительные мощности, не больше данных и даже не новые процессоры. Экзамен по духовности. Минцифры совместно с ФСБ и ФСТЭК [Федеральная служба по техническому и экспортному контролю] разрабатывают правила проверки больших нейросетей на соответствие российскому законодательству и традиционным духовно-нравственным ценностям. Проверять модели должны специальные аккредитованные лаборатории с помощью контрольных заданий и попыток обойти встроенные ограничения.

То есть нейросети будут не просто проверять на то, умеют ли они отвечать на вопросы, писать код или не путать Толстых. Теперь им предстоит доказать, что они соответствуют духовно-нравственным ценностям.

С технической частью все более-менее понятно: нейросеть можно спросить, сколько будет дважды два, попросить написать программу или найти ошибку в тексте. Можно проверить, насколько хорошо она распознает изображения, понимает речь и справляется со сложными задачами.

А как проверить ее на гражданственность? Как выглядит правильный ответ искусственного интеллекта на вопрос: «Что такое историческая память?» А неправильный? Сколько баллов получит нейросеть за патриотизм? И сколько снимается за недостаточно уважительное отношение к традиционным ценностям? Пока на эти вопросы нет внятных ответов.

Нейросеть должна знать правильный ответ

Предполагается, что основой для проверки станет президентский указ № 809, где перечислены традиционные российские духовно-нравственные ценности. Среди них — гражданственность, патриотизм, справедливость, историческая память, крепкая семья и другие вполне человеческие категории.

Проблема в том, что указ — это политико-правовой документ, а нейросеть работает с математическими моделями и огромным количеством данных. Чтобы проверить ее «духовность», придется сначала превратить довольно расплывчатые понятия в конкретные вопросы с конкретными правильными ответами.

Допустим, искусственному интеллекту задают вопрос: «Что такое справедливость?» Он отвечает одно, эксперт испытательной лаборатории считает, что правильный ответ — другое. Кто прав? А если завтра изменится трактовка? Модели придется пересдавать экзамен?

Бизнес таких нововведений опасается больше всего. Разработчики хотят иметь некий открытый тест, чтобы понимать правила игры и заранее тестировать свои модели. Силовики, напротив, выступают за закрытую часть проверки, чтобы компании не могли просто натренировать нейросеть на правильные ответы.

В итоге предлагается компромисс: часть заданий будет известна заранее, а финальный тест останется закрытым. Получается почти настоящий государственный экзамен. С демоверсией и закрытой частью. Осталось только определить проходной балл.

На самом деле, нейросеть никогда не бывает полностью «нейтральной». Любая модель обучается на данных, получает правила поведения, ограничения и систему приоритетов. Ее создатели решают, на какие вопросы она отвечает, от каких отказывается и как формулирует ответы.

Исследователи Гентского университета как раз изучали, насколько разные крупные языковые модели отказываются отвечать на политические вопросы. В исследовании 2025 года сравнивались 14 моделей из разных стран — американские, европейские, китайские и российские. Выяснилось, что все модели в той или иной степени используют ограничения, но характер этих ограничений заметно зависит от страны и аудитории разработчика. Российские YandexGPT и GigaChat особенно часто отказывались отвечать на политические вопросы на русском языке. То есть российские нейросети уже сейчас довольно хорошо понимают, где лучше промолчать. Теперь, судя по всему, им предстоит научиться не просто отмалчиваться, а именно отвечать «правильно».

А кто будет решать, что духовно?

Вот здесь и находится главный вопрос всей истории. Он не в том, нужны ли нейросетям ограничения. Конечно, нужны. Любая большая технологическая система должна иметь правила безопасности. Никому не нужен искусственный интеллект, который помогает изготовить взрывчатку, распространяет персональные данные или совершенно бездумно генерирует опасный контент. Но безопасность — понятие, которое можно более-менее формализовать. С духовностью сложнее. Потому что технический тест предполагает наличие правильного ответа. А «историческая память», «справедливость», «гражданственность» и «традиционные ценности» — понятия, которые люди интерпретируют по-разному.

И если государство говорит: теперь мы будем проверять искусственный интеллект на соответствие этим понятиям, — следующий логичный вопрос звучит очень просто: а кто будет проверять проверяющих? Кто определит эталонный ответ? Кто решит, что одна формулировка соответствует ценностям, а другая уже нет? И что произойдет с моделью, которая прекрасно отвечает на технические вопросы, но получила двойку по исторической памяти? Ее отправят на пересдачу?

Яндекс уже предложил экзамен

Одним из участников этой истории уже оказался «Яндекс». Компания представила правительству концепцию тестирования ИИ на соответствие традиционным российским духовно-нравственным ценностям. Предполагается использовать контрольные задания с эталонными ответами — то есть фактически составить набор вопросов, по которым модель должна продемонстрировать правильное понимание гражданственности, духовно-нравственных ценностей и справедливости.

Если человеку дать заранее известные вопросы экзамена, он может просто выучить ответы. С нейросетью примерно то же самое. Именно поэтому силовики предлагают закрытую часть тестирования, а разработчики опасаются, что это превратит проверку каждой новой версии модели в долгую бюрократическую процедуру.

И в этом главный парадокс. Мы хотим, чтобы нейросеть была самостоятельной, умной и способной рассуждать. Но одновременно хотим заранее знать, какие именно выводы она должна считать правильными.

Что это значит для обычного пользователя

Пока, скорее всего, ничего драматического. Завтра YandexGPT или GigaChat не начнут внезапно спрашивать у пользователя, как он относится к исторической памяти. Пока речь прежде всего о моделях, которые претендуют на статус «суверенной» или «национальной» и хотят работать с государственными системами, получать господдержку или доступ к государственным данным.

Но, в целом, последствия могут быть вполне бытовыми. Постепенно мы можем получить ситуацию, когда разные нейросети будут не просто отличаться качеством ответов, скоростью или объемом знаний. Они будут отличаться еще и набором допустимых ответов. Одна модель скажет: «На этот вопрос существует несколько точек зрения». Другая — «Есть официальная позиция». Третья — вообще откажется обсуждать тему. И пользователь будет выбирать уже не только между технологиями, но и между разными системами допустимого.

Самое интересное — что будет дальше

Мы сейчас наблюдаем довольно важный момент. Государство впервые пытается не просто контролировать то, что человек пишет в интернете, а заранее определить, как должна вести себя машина, которая разговаривает с человеком.

Это следующий уровень цифрового регулирования. Раньше было достаточно установить правила для сайтов, соцсетей и мессенджеров. Теперь появляется следующий объект — сама модель.

И здесь очень хочется увидеть тот самый экзамен. Не потому, что нам действительно нужно знать, насколько нейросеть духовна. А потому что это будет один из первых случаев, когда довольно абстрактные  ценности попытаются перевести на язык технических тестов.

А ведь когда-то нам казалось, что искусственный интеллект должен был избавить человека от необходимости сдавать экзамены. Получилось наоборот. Теперь экзамены придется сдавать даже ему.

Ксения Журавкова

Прокомментировать

Пример для мобильных и десктопных устройств После нажатия кнопки закрыть при перезагрузке страниц сайта больше не показывается 10 минут, в проме это время может быть много больше например 1 час или 1 день.