Мой защитник — нейросеть: как ChatGPT сдавал адвокатский экзамен и превзошел ведущих практиков

GPT-4 — модернизированная языковая модель на основе искусственного интеллекта, выпущенная компанией OpenAI — набрала 297 баллов на юридическом экзамене в США. Его проходят реальные кандидаты, чтобы получить адвокатскую лицензию. Оцениваются знания, тип мышления, а также проводятся тесты, имитирующие работу юриста. Нейросети удалось ответить правильно на 76% вопросов. Исследователи заявили, что этого достаточно для допуска к юридической практике в большинстве американских штатов. «Сфера» проверила нашумевшую нейросеть и попросила ее вынести объективные решения по известным состоявшимся делам, а также спросила, был ли ошибочным реальный вердикт.
Время прочтения: 7 минут

А моральные принципы?

Около четырех месяцев назад ChatGPT на базе предыдущей версии языковой модели (GPT-3.5) не набрал проходного балла на экзамене на степень бакалавра. Верными оказались лишь 50% ответов. За короткий срок технология значительно усовершенствовалась: больше всего специалистов удивила способность нейросети писать адвокатские эссе и проходить тесты.

По словам юриста направления интеллектуальной собственности и коммерческих споров Юридической группы «Совет» Тимура Фатыхова, нейросети могут справляться с фактологией и формировать определенные выводы, однако выполнить весь цикл работ на данный момент не способны.

«Часто стороны судебного процесса лгут, отстаивая свою позицию. Нейросети могут сопоставлять имеющиеся факты и на их основе выстроить логическую цепочку, но они не способны искать нестыковки в позициях сторон, смотреть и оценивать реакцию участников процесса и выявлять истину. Надо понимать, что информация никогда не будет полной, как «в учебнике по уголовному праву», что требует присутствия человеческого фактора при принятии решения», — поясняет эксперт в беседе со «Сферой».

Также роль играет отсутствие личного контакта. Нередки случаи, когда судьям и адвокатам приходится проявлять высокие психологические навыки, взаимодействуя со сторонами, и делать необходимые для разрешения судебного спора выводы. Нейросеть такими способностями не обладает: она не может учитывать дополнительные обстоятельства помимо правовых.

«В уголовном процессе часто возникают этические и моральные дилеммы, которые не поняты компьютерной программой. Например, решение о том, должен ли адвокат выступать за защиту клиента, которого он считает виновным, может быть основано на личной этике и моральных принципах», — подчеркивает юрист.

Сюда же относятся и случаи рассмотрения дел судьями, в отношении которых или в отношении близких которых совершались подобные преступления — очевидно они могут быть предвзятыми при вынесении решения.

«Стоит учитывать контекстуальные аспекты. В уголовном процессе может возникнуть множество ситуаций, которые требуют их учета, что может быть затруднительно для анализа нейросетью. Например, наличие смягчающих обстоятельств, которые программа не учитывает», — резюмировал Тимур Фатыхов.

Оценка судебного решения

«Сфера» решила протестировать ChatGPT на языковой модели текущего поколения GPT-3.5. Мы попросили ее разобрать несколько нашумевших звездных процессов и указать, насколько верные решения вынесли судьи и присяжные.

В прошлом июне в США завершился судебный процесс между звездой «Пиратов Карибского моря» Джонни Деппом и его бывшей женой, актрисой Эмбер Херд. Разбирательства длились полтора месяца, а сам иск был подан еще в 2019 году. Депп решил судиться с экс-супругой из-за статьи в The Washington Post, в которой артистка назвала себя жертвой домашнего насилия. Херд выдвинула встречный иск и потребовала 100 миллионов «зеленых» за побои и психологическое насилие в браке. В конечном счете присяжные, у которых ушло на принятие решения два дня, встали на сторону Деппа. Было вынесено единогласное решение, что статья, написанная Херд, являлась клеветой.

Мы попросили ChatGPT оценить результат и перечислить факторы, на которых основывались присяжные, принимая решение. Вот что нам ответила нейросеть:

«Как модель искусственного интеллекта, я не имею личных убеждений или предубеждений и не могу высказывать мнение о конкретных судебных делах. Однако, из того, что мне известно, это дело было довольно сложным и имело много аспектов. Эмбер Херд обвиняла Джонни Деппа в домашнем насилии, в то время как Депп утверждал, что Херд была насильницей в их отношениях. Присяжные пришли к выводу, что жалобы Херд не были подтверждены достаточными доказательствами, и что Депп не был виновен в насилии. Также влияние на решение присяжных могли оказать дополнительные факторы, такие как качество доказательств, показания свидетелей и, в том числе, давление со стороны общественности и прессы. Однако, следует помнить, что решение присяжных не всегда является окончательным, и оно может быть оспорено в суде в дальнейшем».

В рейтинге самых скандальных бракоразводных процессов среди знаменитостей Анджелина Джоли и Брэд Питт занимают первое место. Их роман начался в 2004 году, а спустя 12 лет актриса подала на развод, сославшись на непримиримые разногласия и потребовав единоличной опеки над их шестью детьми. В прессе писали, что Питт якобы употребляет алкоголь и наркотики, затем проявляя жестокость по отношению к детям. В процессе развода актриса несколько раз подавала прошение о единоличной опеке над детьми, а актёр подавал встречный иск — о совместной. В ноябре 2016 года Питта оправдали в деле о жестоком обращении с детьми и еще через несколько лет опеку признали совместной.

«При принятии решения о совместной опеке над детьми, суд учитывает множество факторов, включая, но не ограничиваясь: благополучие детей, их интересы, здоровье и безопасность, а также поведение и качества родителей. Если Брэд Питт был обвинен в неправильном поведении по отношению к детям, то это могло повлиять на решение суда. Однако, если суд решил, что совместная опека обоих родителей будет лучшим решением для благополучия детей, то это было принято на основе обстоятельств дела и законодательства, действующего в данной юрисдикции. В любом случае, если возникают проблемы в отношениях между родителями или в их поведении по отношению к детям, существуют различные механизмы и инструменты, которые могут помочь защитить интересы несовершеннолетних», — написала нейросеть.

Вопрос о том, заменит ли искусственный интеллект юристов и судей в ближайшем будущем, наверное, многим уже набил оскомину. Тем не менее, это факт — нейросети будут и дальше активно развиваться, ставя под сомнение необходимость самых разнообразных профессий. Искусственный интеллект уже способен ставить медицинские диагнозы, писать тексты и прогнозировать различные явления. Однако в настоящее время нейросеть способна ошибаться, давать необъективные и не самые точные ответы.

Узнать больше о том, какие технологии активно внедряются в нашу жизнь и как они регулируются, можно из курса юриста Елены Авакян «Цифровые технологии и право» на площадке Legal Academy.

Рекомендуем

Авторский взгляд

Как алгоритмы влияют на наши решения и где проходит граница закона

Цифровые сервисы становятся все удобнее. Они сами подбирают товары, ранжируют предложения, рекомендуют услуги и предлагают «лучший» вариант. Человеку остается лишь нажать кнопку «согласен». Где проходит граница между полезной персонализацией и манипуляцией выбором? И почему юристам сегодня важно анализировать не только пользовательские соглашения, но и сами интерфейсы цифровых сервисов? Об этом в авторской колонке рассказывает кандидат юридических наук, руководитель правовой и корпоративной поддержки финтех-группы, эксперт по правовому регулированию цифровых сервисов и потребительского права Валерий Белов.

Статья

Цифровой двойник: как Россия учится наказывать за дипфейки и чего ждать от законотворцев

Дипфейки из технологической новинки превратились в один из самых опасных инструментов мошенничества. Только в 2025 году МВД зафиксировало 675 400 преступлений с использованием информационно-коммуникационных технологий. Это 38% от общего числа зарегистрированных преступлений. За девять месяцев того же года АНО «Диалог Регионы» выявила в рунете 342 дипфейка. Это в четыре раза больше, чем за весь 2024 год, а их суммарный охват превысил 122 млн просмотров. При этом законодательство пока лишь ищет ответ на вопрос, где проходит граница ответственности за создание и использование цифровых двойников. Какие меры обсуждаются и чего ждать бизнесу и гражданам, обсудили вместе с экспертами.

Статья

ГОСТ для игрушек с ИИ: как планируют защищать данные детей

С 1 сентября 2026 года в России вступает в силу ГОСТ Р «Игрушки с применением технологий искусственного интеллекта. Общие требования» — первый в мире нацстандарт, который регулирует не только физическую безопасность детских игрушек с ИИ, но и работу их алгоритмов, защиту персональных данных и психоэмоциональное воздействие на ребенка. Подробнее — в материале «Сферы».

Нужно хоть что-то написать