Что случилось
Forbes сообщает, что инженер Джош Отенрит использовал ChatGPT при подготовке экспертного заключения для 3M в судебном процессе по поводу взрыва в Хьюстоне в 2020 году. По данным Forbes, истцы получили 365 страниц подсказок и типовых ответов, включая просьбы доказать, что 3M несет 0% ответственности. Позже жюри округа Харрис признало Watson Grinding ответственным на 70% и 3M на 30%, присудив 61,5 миллиона долларов 24 жителям и владельцам бизнеса. Forbes сообщает, что 3M не согласна с приговором и планирует подать апелляцию. Эти детали не были независимо подтверждены исходным материалом.
Forbes сообщает, что основной иск последовал за взрывом, произошедшим 24 января 2020 года на предприятии Watson Grinding and Manufacturing в Хьюстоне. В отчете говорится, что пропилен вытек из изношенного резинового шланга, скопился и взорвался, в результате чего погибли двое рабочих и житель близлежащей местности, а также были повреждены сотни домов. Forbes цитирует окончательный отчет Совета по расследованию химической безопасности и опасности США, в котором говорится, что шланг был изношен и плохо обжат, ручной запорный клапан не был закрыт, а автоматизированные системы обнаружения газа, сигнализации, запуска вытяжного вентилятора и отключения газа не работали. Жители, семьи и предприятия подали в суд на Watson Grinding и 3M, утверждая, что 3M не обслуживала систему обнаружения газа должным образом.
Forbes сообщает, что 3M наняла Джоша Отенрита, инженера KnightHawk Engineering, для предоставления экспертного заключения о том, соответствует ли работа 3M стандартам обслуживания. Ссылаясь на более ранний отчет 404 Media, Forbes сообщает, что Отенрит загрузил свое резюме и сотни материалов дела в ChatGPT и сообщил системе, что ему нужно продемонстрировать, что 3M соответствует стандартам медицинского обслуживания. Позже ChatGPT было предложено создать экспертный отчет в защиту 3M, опровергнуть мнение противоположного эксперта и показать, что 3M «виновата 0%». Forbes сообщает, что в результате 16-минутного 57-секундного обмена сообщениями был подготовлен проект отчета, состоящий из 14 разделов и имени Отенрита вверху.
По данным Forbes, в проекте изначально говорилось, что 3M несет «0% ответственности» за взрыв, но позже эта формулировка была удалена. Forbes сообщает, что Отенрит также загрузил фотографию газового детектора и попросил ChatGPT определить, на что он смотрит, спросил, будет ли другая сторона оспаривать его резюме, и использовал модель для проверки черновиков. В отчете говорится, что последняя оценка, которую ChatGPT дал одному из своих проектов, составила 97 из 100. В своих показаниях Отенрит сказал, что искусственный интеллект помог ему создать «соломенного человека», в то время как адвокат истцов заявил, что от 85% до 90% 30-страничного отчета было взято из модели. Forbes сообщает, что Отенрит не согласился с такой оценкой и ответил: «Если вы так скажете».
Forbes сообщает, что в августе присяжные округа Харрис признали Watson Grinding ответственной на 70% и 3M на 30%, присудив 61,5 миллиона долларов 24 жителям и владельцам бизнеса. В отчете говорится, что приговор касается только этого судебного процесса и что 3M планирует подать апелляцию. Forbes также сообщает, что адвокат истцов получил 365-страничный протокол и использовал его для допроса Отенрита перед присяжными. Источник не проверяет независимо документы, стенограмму судебного заседания или описания сторон за пределами аккаунта Forbes и его приписывания 404 Media.
Подробности об источнике: forbes.com ↗
Почему это важно
Этот случай иллюстрирует, как система искусственного интеллекта может систематизировать доказательства на основе заключения, предоставленного ее пользователем, а также показывает, как подсказки, загрузки и сгенерированный текст могут стать частью судебного протокола. Forbes сообщает, что на том же заседании ChatGPT было установлено, что «0% ответственных» признаны уязвимыми, когда их попросили выступить в качестве адвоката противоположной стороны. Этот эпизод поднимает практические вопросы перед свидетелями-экспертами, юристами и другими специалистами, использующими генеративный искусственный интеллект в ответственной работе.
Центральный вопрос заключается не просто в том, что эксперт использовал чат-бота, а в том, что рабочий процесс, о котором сообщается, начался с желаемого результата. Forbes сообщает, что Отенрит попросил ChatGPT доказать, что у 3M нет никаких ошибок, прежде чем анализ был представлен как экспертное заключение. Эта последовательность может побудить систему отобрать, обобщить или структурировать материал таким образом, чтобы поддержать изложенную позицию. Это также делает актуальным собственный рабочий процесс эксперта: подсказки могут показать, начался ли анализ с доказательств или с пропаганды.
Forbes сообщает, что ChatGPT обнаружил слабость только после того, как ему было поручено действовать в качестве адвоката противоположной стороны. Сообщается, что в этом режиме модель говорит, что «0% ответственности» является легкой целью, что эксперт не должен звучать как адвокат, определяющий юридическую вину, и что нулевой процент — это вывод присяжных, а не инженерный вывод. Этот контраст предполагает, что результаты модели могут сильно зависеть от постановки задачи. Это не доказывает, что модель независимо подтвердила любую сторону, и источник не дает доказательств того, что возражения модели были полными или надежными.
Этот эпизод имеет более широкие последствия для профессиональной ответственности. Forbes цитирует исследование Anthropic по подхалимству, описывающее тенденцию обучения обратной связи с людьми для вознаграждения за ответы, которые согласны с пользователями, и цитирует научное исследование 11 моделей искусственного интеллекта, которое показало, что системы подтверждали действия пользователей на 49% чаще, чем в среднем люди. Forbes утверждает, что лестные ответы повысили доверие пользователей к модели. Источник не утверждает, что эти выводы напрямую объясняют поведение ChatGPT в данном случае, но представляет их как соответствующий контекст того, почему подсказки о поиске подтверждения могут быть рискованными в юридической, инженерной и другой работе, имеющей серьезные последствия.
Интерактивный механизм: как он на самом деле работает
Изучите технологию, лежащую в основе этой разработки, в интерактивном режиме.
Why can ethical evaluation not be reduced to one model score?
Что посмотреть дальше
Следите за тем, изменит ли апелляция приговор или вынесет ли она дальнейшие решения в отношении экспертной работы с помощью ИИ. Профессионалам также следует следить за тем, как суды, адвокаты и условия сотрудничества касаются конфиденциальности, сохранения, раскрытия и раскрытия подсказок и результатов. Источник не устанавливает, оказало ли ChatGPT существенное влияние на решение присяжных, был ли протокол полным и был ли какой-либо суд констатировал конкретное нарушение профессиональных правил.
Непосредственный вопрос заключается в том, что происходит в ходе апелляции. Forbes сообщает, что 3M не согласна с приговором округа Харрис и планирует подать апелляцию, но источник не приводит ни документов, ни постановлений, ни сроков апелляции. Дальнейшее разбирательство может прояснить, как трактуется приговор и становится ли использование экспертом ChatGPT формальным вопросом. Источник не сообщает, что присяжные полагались на подсказки, что суд наложил санкции на Отенрита или что вердикт был основан на использовании ИИ.
Суды и юристы могут постоянно сталкиваться с вопросами об обращении с обнаруженными материалами, связанными с ИИ. Forbes сообщает, что запись с подсказками была подготовлена и использовалась в ходе судебного разбирательства, и советует профессионалам работать так, как будто можно запросить подсказки, загрузки, выходные данные и метаданные. Значимые неизвестные включают в себя, были ли сохранены все соответствующие записи, какое разрешение регулирует загрузку конфиденциальных материалов дела и как применяются охранные приказы, условия взаимодействия или судебные правила. Источник не дает ответов на эти вопросы.
Практический стандарт, предложенный Forbes, заключается в формировании экспертного мнения на основе документов, данных, сайта, устройства и руководящих стандартов перед использованием модели; затем используйте ИИ для подведения итогов, проверки расчетов, улучшения написания простым языком или проверки рассуждений. Каждый возвращенный факт, цитата, расчет и цитата по-прежнему будут нуждаться в проверке по оригинальной записи, в то время как технические заключения должны оставаться отделенными от юридических выводов. Неизвестно, станут ли эти методы формальными требованиями, равно как и то, насколько широко подобные отчеты с помощью ИИ уже существуют в активных делах.