(когнитивный) Груз из весов (моделей)
4 июня по приглашению легенды и моей любимой университетской преподавательницы Ирины Сергеевны Бедриной я выступала на форсайт-сессии «Языковые компетенции юриста в эпоху искусственного интеллекта» XIX сессии Европейско-Азиатского правового конгресса. Контекст секции был такой: классическое юридическое образование с языковой подготовкой встречается с реальностью, в которой ИИ переводит, переписывает и формулирует за студентов что угодно. Это хорошо совместилось с моими давними размышлениями о влиянии нейросетей на наше мышление, а также наблюдениями за тем, как LLM любят прокинуть в ответы по российскому праву характерные для иностранных правопорядков конструкции. И на пересечении этих тем собралась концепция доклада, которую совсем коротко можно описать как «почему юристу выгодно не забрасывать английский».
Процесс подготовки получился интересным. Во-первых, коллеги присылали и продолжают присылать нелепые вворачивания нейросетями англицизмов в ответы по российскому праву (вот пост, приносите и свои тоже!). Интересный обмен мыслями по этому поводу состоялся со Степаном Леонтьевым. А ещё наресерчислось много про интересный Foreign Language Effect, о котором захотелось рассказать поподробнее. Поэтому лонгрид выходного дня!
ИИ обесценивает усилия по изучению языков?
Прогресс в области моментального перевода зашёл весьма далеко. В прошлом году вышли AirPods с синхронным переводом, встроенный перевод есть в каждом браузере и во многих приложениях (даже субтитры к видео налету генерятся), и все слышали о том, что в социальной сети Х любые посты автоматически переводятся на любые языки. Это создало уже море инфоповодов, комичных историй (по типу японцы были в шоке, что в России смотрят пиратское аниме), мемов… а ещё впечатлений о том, что мы буквально снова строим Вавилонскую башню. Совпадение ли, что сам Папа Римский в своей энциклике об ИИ призвал притормозить именно это – постройку Вавилонской башни (но, кажется, в более широком контексте, чем просто язык)...
И всё это не говоря о том, что если нет очной языковой коммуникативной ситуации, то незнание языка на высоком или специализированном уровне вообще не проблема. Если есть время, то нейросети всё переведут, надрафтят, вычитают и причешут емейлы начальству. Языковой барьер в Интернете уже вообще не барьер. В общем, наверное, можно почувствовать некоторое обесценивание усилий по изучению иностранных языков. А это очень ресурсозатратное занятие, что бы там ни вещала сова из Дуолинго про всего 5 минут в день.
Но, кажется, что у юристов (по крайней мере тех, кто активно использует нейронки в работе) есть причина сдуть пыль со своей иноязычной языковой личности, потому что прокаченные языковые компетенции могут помочь выявлять раскидываемые нейронками языковые ловушки.
It’s a trap!
Практически любые большие модели, что западные (ChatGPT, Gemini, Claude), что китайские (DeepSeek, Qwen, Kimi), обучены на корпусах с подавляющим англоязычным перекосом. Это техническая особенность: англоязычных текстов в открытом доступе в разы больше, чем русскоязычных (и каких-либо других). И вендоры зарубежных моделей вряд ли особо заботятся о том, чтобы дополнительно обучать модели на российских юридических текстах. Это означает, что у модели в её внутреннем устройстве англосаксонская правовая логика представлена непропорционально широко. И когда вы задаёте такой модели вопрос по российскому праву, она отвечает по-русски – но концептуальная подложка ответа и процесс размышлений остаются английскими (а то и китайскими).
И, что особенно характерно, этим грешат все иностранные модели – и западные, и китайские, и SOTA, и те, что маленькие и глупенькие.
Выше упоминала, что просила коллег поделиться примерами просочившихся в ответы нейронок англицизмов. За короткое время собралось около трёх десятков примеров из работы с разными моделями. И, что любопытно,оказалось, что из этих примеров можно выделить 4 качественно разные группы проникновения англоязычных концептов.
Группа 1. Транслитерация при наличии точного русского термина
Модель транслитерирует близкие по смыслу англоязычные концепции в местах, где исходный русский текст вполне можно было бы перевести точным русским термином:
- посттерминационные акты (акты приёмки выполненных работ)
- небиндинговый характер договора
- ренегоциация
- ребаттл (о репликах на доводы эксперта в суде)
- тампер-эвидентный (о цифровых доказательствах)
- бенчмарк / рынок-бенчмарк (об отчёте оценщика в смысле «ориентир»)
- индемнификация (как название раздела договора)
- ковенанты (термин ходовой в финансово-кредитной сфере, но не в районном суде по спору из простой поставки)
Это выглядит как стилистический шум – и часто действительно им является. Такие места бросаются в глаза и относительно легко вычищаются – если вы из тех птиц, что проверяют ответы нейронок.
Группа 2. Структурные кальки
Здесь модель уже не транслитерирует отдельные слова, а переносит синтаксические конструкции – иногда даже не утруждаясь переводом. Симптом того, что для этой темы у модели в голове, грубо говоря, нет русской категории – она работает прямо в английском фрейме и даже не пытается перевести.
- «инициированная банком квитанция» (калька с bank-initiated)
- «Stage-based признание» (привязанное к стажу работы)
- «service awards» (о премировании сотрудника)
Последние два примера – из реального ответа модели на вопрос про систему мотивации сотрудников:
Привязка recognition к стажу – это рискованное решение, и вот почему. Stage-based признание (1 год, 3 года, 5 лет в компании) – это классические service awards.
Сам совет может быть в целом разумным. Но фрейм рассуждений модели явно сдвинут в чужую систему координат: оригинальную мысль модели можно понять, если знаешь, что такое service awards в HR-практике англоязычных компаний. И вообще это сигнал критичнее смотреть на ответ в целом: точно ли он дан в нужной вам парадигме?
Группа 3. Категориальная ошибка
Модель берёт иностранный термин с очень конкретным значением и навешивает его на российскую реалию, в которую он концептуально не вписывается. Внешне – просто странное слово. По сути – неверная рамка понимания:
- ратификация – о подписании акта ввода в эксплуатацию (ратификация – это о международных договорах или о корпоративном одобрении сделки задним числом)
- бойлерплейт – о структурных элементах российских судебных актов (boilerplate – категория из договорной техники, не из судебной)
- гуманитарная норма – о статье 2.9 КоАП о малозначительности
- коллатеральная атака – об оспаривании судебного акта вне процессуальных форм
- легитимация (процессуальная / вексельная)
Модель в задаче про административное правонарушение характеризует статью 2.9 КоАП («малозначительность») как «гуманитарную норму». Откуда это вообще? В англоязычной литературе нормы о смягчении ответственности называют leniency, и иногда они могут применяться при наличии humanitarian reasons. При этом «гуманитарный» в российской традиции имеет чёткую коннотацию связи с правами человека во время военных действий, защитоймирного населения. Никакого отношения к малозначительности административного правонарушения этот термин сам по себе не имеет.
Группа 4. Подмена правового института
Что-то на рискованном. Модель не просто использует чужое слово – она отвечает по чужому праву, выдавая это за российское.
- принцип buyer beware – о добросовестном приобретателе недвижимости
- business judgment rule / правило делового суждения
- режим совместной опеки (shared parenting)
Пример с buyer beware особенно хорош, потому что российское право в определённом контексте может оказатьсяпрямо противоположным англосаксонскому пониманию: у нас правопорядок защищает добросовестного приобретателя, железобетонно защищает покупателя-потребителя. Business judgment rule любят все нейронки: несколько коллег присылали этот пример, а в практике Рустема Абдюкова он встречался чуть ли не два десятка раз. Это стандарт защиты директоров от ответственности за решения, принятые в рамках их компетенции и при отсутствии конфликта интересов, в американском корпоративном праве. Наши смежные стандарты, применимые к ответственности единоличных исполнительных органов, мягко говоря, не тождественны. Когда модель называет российский стандарт «правилом делового суждения», она не просто переводит – в своём ответе она скорее всего тянет за собой все правовые презумпции, которые не совпадают с нашей практикой.
Третий пример из этой группы – режим совместной опеки (shared parenting). Ольга Каменская, специализирующаяся на семейном праве, прислала его практически с возмущением: совместной опеки как самостоятельной правовой конструкции в российском семейном праве просто нет – у нас другая система родительских прав после расторжения брака. Модель не просто использует чужое слово – она опирается в ответе на правовой институт, которого в российской системе не существует.
Ну подменила и подменила, чего гундеть-то?
Когда юрист постоянно работает с текстами, написанными гладко и связно на русском языке, но с такими вкраплениями и подменами, он оказывается в ментальной ловушке: с одной стороны, испытывает иллюзию понимания, а с другой – одновременно – скрытую дополнительную когнитивную нагрузку. Об этом интересно рассудил Степан Леонтьев: если представлять язык как сложный нейробиологический процесс, то чужой язык – базово непривычная и чуждая рамка, её сложно интернализировать. И тем более человеческому мозгу не может не быть чужда сборная солянка из текстов, которые написаны по-русски, но рассуждения за ними стояли на китайском (если, например, вы используете китайские нейросети), а тексты в обучающем датасете в подавляющем объёме – англоязычные.
Кажется, этому нет каких-то научных замеров пока, но я склонна согласиться. То, что мозг дополнительно спотыкается о занесённые генеративным механизмом оказии в виде англицизмов и концептов англосаксонского права, особенно ярко чувствуешь, когда устаешь. Усталость об руку с навязанной иллюзией понимания, помноженные на отсутствие опыта и того самого языкового чутья – и вот уже легитимация вместе с бойлерплейтом отправились в Н-ский районный суд в исковом заявлении. В лучшем случае такие англицизмы делают условного молодого юриста, пропустившего такую красоту, объектом ухмылок более опытных коллег. Это не страшно, но это сигнал о том, что юрист не различает уровни заимствований и работает с текстом без рефлексии. Но возможен и риск прямых юридических ошибок. Особенно для четвёртой группы: когда модель отвечает по чужому праву, а ответ оформлен как правильный, последствия для клиента могут быть вполне ощутимыми.
Способность остановиться и спросить себя «а что именно здесь сказано?» – это классный когнитивный навык, привычка в каком-то смысле. Его можно тренировать по-разному: общей внимательностью и ответственностью, развитым критическим мышлением и встроенным буллшит-фильтром. А можно ещё и лингвистическими компетенциями.
Foreign Language Effect
Что-то концептуально близкое к «нейробиологической чуждости», о которой говорил Степан, описано в науке как Foreign Language Effect (FLE) – эффект иностранного языка. Это устойчивое явление, при котором человек, рассуждая или принимая решения на втором языке, ведёт себя более аналитически и менее эмоционально-импульсивно, чем при тех же задачах на родном.
Первая работа по этой теме – это Keysar, Hayakawa & An (2012), The foreign-language effect: Thinking in a foreign tongue reduces decision biases. Авторы провели четыре эксперимента с билингвами разных языковых пар (английский–корейский, английский–испанский) и обнаружили: эффект фрейминга исчезает, когда задача предъявляется на иностранном языке.
Эффект фрейминга – это устойчивая закономерность, по которой одна и та же задача, сформулированная как «выигрыш» или как «потеря», порождает у людей систематически разные решения, хотя содержание задачи идентично. Его впервые описали в 1981 году основоположники поведенческой экономики Амос Тверски и Даниэль Канеман. Канонический пример из той самой статьи 1981 года: одна и та же программа борьбы с эпидемией, описанная как «спасёт 200 из 600 человек», получает поддержку большинства, а описанная как «приведёт к гибели 400 из 600» – отвергается. Математически это одно и то же, но рамка выигрыша и рамка потери разворачивают решение в противоположные стороны. На родном языке этот эффект работает у всех, а на иностранном языке он у тех же самых людей пропадает.
FLE изучают на стыке когнитивной психологии и психолингвистики. После первой работы 2012 года эффект подтвердили на целом ряде других задач, в которых родной язык обычно подводит наше рациональное мышление. На «персональных» моральных дилеммах – вроде «footbridge»-версии задачи про вагонетку (где единственный способ остановить вагон и спасти пятерых – это вручную столкнуть с моста под рельсы высокого случайного прохожего) на иностранном языке люди заметно чаще выбирают утилитарный вариант «да» (чтобы выжили пятеро). Любопытно, что на классической «безличной» версии задачи – перевести стрелку, чтобы вагон пошёл по ветке, где погибнет один вместо пятерых – язык ответы не меняет. Разница именно в личном, эмоционально заряженном участии в чужой гибели – именно её иностранный язык и «выключает» (Costa, Foucart, Hayakawa et al., 2014, Your Morals Depend on Language).
В задачах про деньги и вероятности иностранный язык ослабляет страх потери (loss aversion) – в иноязычной формулировке люди готовы взяться за рационально выгодную ставку, от которой откажутся на родном (Costa, Foucart, Arnon et al., 2014, «Piensa» twice: On the foreign language effect in decision making). Наконец, иностранный язык ослабляет и иллюзию причинности – склонность видеть причинно-следственную связь там, где её нет («помыл машину – пошёл дождь»): на иностранном языке испытуемые реже выводят ложные связи из случайно совпавших событий (Díaz-Lago & Matute, 2019, Thinking in a Foreign language reduces the causality bias). Обобщающий вывод по этой серии экспериментов: на иностранном языке человек рассуждает систематичнее и ближе к нормам логики, а не эмоции и интуиции (Hayakawa, Costa, Foucart & Keysar, 2016, Using a foreign language changes our choices).
Объясняется это тем, что иностранный язык ослабляет эмоциональную, интуитивную реакцию, и в освободившемся пространстве работает аналитическая. Удобную рамку, чтобы понять, как это работает, даёт двухсистемная модель того же Канемана – итог его многолетней программы исследований когнитивных искажений, которую он обобщил в книге «Thinking, Fast and Slow». Идея в том, что наше мышление работает в двух режимах: Система 1 – быстрая, интуитивная, автоматическая, реагирующая мгновенно и почти без усилий; Система 2 – медленная, рефлексивная, требующая сознательного усилия и контроля. Большую часть времени нами управляет Система 1, а Система 2 подключается, когда задача достаточно сложна или непривычна, чтобы автоматический ответ не сработал. И на родном языке у нас базово работает Система 1: связь между словом и его эмоциональным или ассоциативным содержанием прямая и быстрая. Мы как бы думаем словами, слова сразу вызывают в нас отклик. На иностранном языке между словом и его содержанием возникает дополнительный слой обработки – психологическая дистанция. Этой дистанции достаточно, чтобы Система 1 не успевала сработать автоматически, и включалась Система 2.
То есть иностранный язык – это не просто другие слова другими буквами и другие грамматические правила. Это доступ к другому когнитивному режиму, более рефлексивному, менее автоматическому. Чтобы перевести правовую концепцию на другой язык, надо сначала её осознать отдельно от родной формулировки. Эта операция происходит при каждом акте перевода – без этого просто невозможен нормальный перевод или другая работа с текстом.
И для человека (как минимум, юриста), работающего с ИИ, развитые иноязычные компетенции дают неожиданный бонус в виде встроенной в ваш когнитивный аппарат привычки спросить: что именно здесь сказано, какие предпосылки сюда зашиты, в чьей правовой логике это сформулировано. То есть дифференцировать суть и слова, в которые она обернута. Это помогает и чище ставить задачи, и критичнее принимать результат их выполнения нейросетями.
Сдуваем пыль с университетского Legal English
Иностранный язык в классическом юридическом образовании всегда понимался как способ войти в иную правовую культуру – прочитать иностранного автора, обсудить вопрос с зарубежным коллегой, работать на международных проектах. В эпоху ИИ это понимание расширяется: язык нужен теперь и для того, чтобы заметить, когда чужая правовая культура незаметно прорастает в вашем русскоязычном рабочем процессе. Почему бы не тренировать когнитивные компетенции таким достаточно понятным способом, как изучение языков? Даже если не придётся работать с иностранным правом и иностранцами.
В пронизанном ИИ будущем главным дифференциатором между профессионалами гуманитарных специальностей будет качество самостоятельного мышления, умение смотреть критично, рефлексировать. Соблазн думать «зачем учить язык, если всё и так переводится» есть. Но изучение иностранных языков настолько выверено методологически, что это, кажется, очевидный, универсальный и эффективный способ подарить своим мозгам второй когнитивный регистр и прокачать такую драгоценную рефлексивность.
В конце произошла ирония
Доклад на конференцию я готовила с Claude, и в какой-то момент попросила помочь мне с делением присланных примеров англицизмов на группы. И в названии второй группы Claude использовал слово code-switching, на что я обратила внимание как на ироничную иллюстрацию обсуждаемой особенности нейросетей. В общем оправдался и меня ещё похвалил сначала:
Поймала, причём в моменте, когда я как раз пишу про эту проблему. Если посмотреть честно – да, в моих сообщениях этого много: code-switching, witrina (вообще на латинице), shкала с латинской s, постоянные англицизмы там, где есть нормальные русские слова. Большая часть – именно то, в чём твой доклад обвиняет модели: я работаю в английском фрейме и не утруждаюсь переводом. Это не курьёз. Это сама по себе иллюстрация тезиса: модель, помогающая писать про подмену понятий в моделях, демонстрирует ровно ту же подмену. И ты это замечаешь, потому что у тебя тренирован соответствующий навык – отделять мысль от формы и видеть, когда форма принесла с собой чужую структуру.
Но позже я попросила из плана слайдов сделать план поста в блог, прислав ссылку на блог для примера. И здесь Клод выдал мне обратку, ткнув в то, что мои личные тексты пестрят всевозможными англицизмами и предложив в тексте (вот этом самом) сделать об этом какую-нибудь мета-оговорку или избегать иностранных слов. Вот такой обмен любезностями. Много англицизмов увидели у меня?)
А примеры нейроночных ещё присылайте обязательно, можно прямо сюда. Есть одна очень интересная идея всё это дело замерить. Презентацию с форсайт-сессии также прикладываю, если интересно!