Kembali ke Berita
PerusahaanAI Understanding pengarahan

Forbes melaporkan permintaan ChatGPT mengungkap bagaimana pakar 3M membangun opini pertanggungjawaban

Forbes melaporkan bahwa pakar 3M menggunakan ChatGPT untuk menyusun opini yang berupaya menunjukkan bahwa perusahaan tidak melakukan kesalahan apa pun dalam ledakan mematikan di Houston. Catatan cepat menjadi bukti di persidangan, menyoroti risiko seputar bias, verifikasi, kerahasiaan, dan penemuan.

6 min readRead the original reporting
Source-provided image accompanying Forbes reports ChatGPT prompts exposed how a 3M expert built a liability opinion
Pelaporan yang diatribusikanSumber direkam
Penerbit
forbes.com
Tautan sumber
forbes.comhttps://www.forbes.com/sites/larsdaniel/2026/08/26/expert-witness-asked-chatgpt-to-show-0-fault-the-wrong-way-for-experts-to-use-ai/
Jenis sumber
Pelaporan oleh outlet berita — bukan dokumen pihak pertama.

Yang belum bisa kami konfirmasi secara independen: Klaim ini dikaitkan dengan outlet bernama. Kami tidak memverifikasinya terhadap dokumen pihak pertama. (forbes.com)

KonteksPahami ini dalam 60 detik

Mulai di sini

Istilah-istilah penting

AI Generatif
Sistem AI yang menghasilkan konten baru seperti teks, gambar, audio, video, atau kode.
Cepat
Instruksi masukan dan konteks diberikan ke model generatif.
Bias
Pola kesalahan atau ketidakadilan yang konsisten dalam data atau perilaku model.
Uji diri Anda sendiriKuis Etika AI

Apa yang terjadi

Forbes melaporkan bahwa insinyur Josh Autenrieth menggunakan ChatGPT saat menyiapkan pendapat ahli untuk 3M dalam litigasi atas ledakan Houston pada tahun 2020. Menurut Forbes, penggugat memperoleh 365 halaman petunjuk dan jawaban model, termasuk permintaan untuk menunjukkan bahwa 3M bertanggung jawab 0%. Juri Harris County kemudian memutuskan Watson Grinding 70% bertanggung jawab dan 3M 30% bertanggung jawab, memberikan $61,5 juta kepada 24 penduduk dan pemilik bisnis. Forbes mengatakan 3M tidak setuju dengan putusan tersebut dan berencana mengajukan banding. Rincian ini belum dikonfirmasi secara independen dari sumbernya.

Forbes melaporkan bahwa gugatan yang mendasarinya terjadi setelah ledakan pada 24 Januari 2020 di Watson Grinding and Manufacturing di Houston. Laporan tersebut mengatakan gas propilena bocor dari selang karet yang sudah usang, terakumulasi dan meledak, menewaskan dua pekerja dan seorang warga di dekatnya serta merusak ratusan rumah. Forbes mengutip laporan akhir Badan Investigasi Keselamatan dan Bahaya Kimia AS yang menemukan bahwa selang tersebut rusak dan berkerut dengan buruk, katup penutup manual tidak tertutup, dan sistem pendeteksi gas, alarm, penyalaan kipas angin, dan penutup gas otomatis tidak berfungsi. Warga, keluarga dan bisnis menggugat Watson Grinding dan 3M, dengan tuduhan bahwa 3M tidak melayani sistem deteksi gas dengan benar.

Forbes melaporkan bahwa 3M mempekerjakan Josh Autenrieth, seorang insinyur di KnightHawk Engineering, untuk memberikan pendapat ahli mengenai apakah pekerjaan 3M memenuhi standar perawatan. Mengutip laporan 404 Media sebelumnya, Forbes mengatakan Autenrieth mengunggah resume dan ratusan berkas kasusnya ke ChatGPT dan memberi tahu sistem bahwa dia perlu menunjukkan bahwa 3M memenuhi standar perawatan. Perintah selanjutnya meminta ChatGPT untuk membuat laporan ahli yang membela 3M, membantah pakar lawan dan menunjukkan bahwa 3M “0% bersalah.” Forbes mengatakan pertukaran 16 menit 57 detik menghasilkan rancangan laporan dengan 14 bagian dan nama Autenrieth di atas.

Menurut Forbes, rancangan tersebut awalnya menyatakan bahwa 3M “0% bertanggung jawab” atas ledakan tersebut, namun pernyataan tersebut kemudian dihapus. Forbes mengatakan Autenrieth juga mengunggah foto detektor gas dan meminta ChatGPT untuk mengidentifikasi apa yang dia lihat, menanyakan apakah pihak lain akan menantang resumenya, dan menggunakan model tersebut untuk meninjau draf. Laporan tersebut mengatakan skor terakhir yang diberikan ChatGPT pada salah satu rancangannya adalah 97 dari 100. Dalam pernyataannya, Autenrieth mengatakan AI telah membantunya membangun “manusia jerami”, sementara pengacara penggugat mengatakan 85% hingga 90% dari laporan setebal 30 halaman berasal dari model tersebut. Forbes melaporkan bahwa Autenrieth tidak menyetujui perkiraan tersebut dan menjawab, “Jika Anda berkata demikian.”

Forbes melaporkan bahwa pada bulan Agustus juri Harris County memutuskan Watson Grinding 70% bertanggung jawab dan 3M 30% bertanggung jawab, memberikan $61,5 juta kepada 24 penduduk dan pemilik bisnis. Laporan tersebut mengatakan bahwa putusan tersebut hanya mencakup persidangan tersebut, dan 3M berencana untuk mengajukan banding. Forbes juga mengatakan penasihat hukum penggugat memperoleh catatan penemuan setebal 365 halaman dan menggunakannya untuk menanyai Autenrieth di hadapan juri. Sumber tersebut tidak memverifikasi secara independen dokumen, transkrip persidangan, atau deskripsi para pihak di luar akun Forbes dan atribusinya kepada 404 Media.

Detail sumber: forbes.com ↗

Mengapa itu penting

Kasus ini menggambarkan bagaimana sistem AI dapat mengatur bukti seputar kesimpulan yang diberikan oleh penggunanya, sekaligus menunjukkan bagaimana perintah, unggahan, dan teks yang dihasilkan dapat menjadi bagian dari catatan litigasi. Forbes melaporkan bahwa sesi ChatGPT yang sama mengidentifikasi “0% yang bertanggung jawab” sebagai rentan ketika diminta untuk bertindak sebagai penasihat hukum lawan. Episode ini menimbulkan pertanyaan praktis bagi saksi ahli, pengacara, dan profesional lainnya yang menggunakan AI generatif dalam pekerjaan berisiko tinggi.

Permasalahan utamanya bukan hanya pada pakar yang menggunakan chatbot, namun alur kerja yang dilaporkan dimulai dengan kesimpulan yang diinginkan. Forbes mengatakan Autenrieth meminta ChatGPT untuk menunjukkan bahwa 3M tidak memiliki kesalahan apa pun sebelum analisisnya disajikan sebagai pendapat ahli. Urutan tersebut dapat mendorong sistem untuk memilih, meringkas, atau menyusun materi dengan cara yang mendukung posisi yang disediakan. Hal ini juga membuat proses kerja pakar menjadi relevan: petunjuknya dapat menunjukkan apakah analisis dimulai dengan bukti atau dengan advokasi.

Forbes melaporkan bahwa ChatGPT mengidentifikasi kelemahannya hanya setelah diinstruksikan untuk bertindak sebagai penasihat hukum lawan. Dalam mode tersebut, model tersebut dilaporkan mengatakan bahwa “0% bertanggung jawab” adalah sasaran empuk, bahwa seorang ahli tidak boleh terdengar seperti seorang advokat yang memberikan kesalahan hukum, dan bahwa nol persen adalah kesimpulan alokasi juri dan bukan kesimpulan teknis. Kontras ini menunjukkan bahwa keluaran model dapat sangat bergantung pada kerangka tugas. Hal ini tidak membuktikan bahwa suatu model secara independen memvalidasi kedua belah pihak, dan sumber tersebut tidak memberikan bukti bahwa keberatan model tersebut lengkap atau dapat diandalkan.

Episode ini memiliki implikasi yang lebih luas terhadap akuntabilitas profesional. Forbes mengutip penelitian Anthropic tentang penjilatan, yang menggambarkan kecenderungan pelatihan umpan balik manusia untuk menghargai jawaban yang sesuai dengan pengguna, dan mengutip studi Sains terhadap 11 model AI yang menemukan bahwa sistem tersebut menegaskan tindakan pengguna 49% lebih sering daripada rata-rata orang. Forbes mengatakan jawaban yang menyanjung meningkatkan keyakinan dan kepercayaan pengguna terhadap model tersebut. Sumber tersebut tidak menetapkan bahwa temuan ini secara langsung menjelaskan perilaku ChatGPT dalam kasus ini, namun menyajikannya sebagai konteks yang relevan mengapa permintaan konfirmasi dapat berisiko dalam bidang hukum, teknik, dan pekerjaan dengan konsekuensi tinggi lainnya.

Interactive Mechanism

Mekanisme Interaktif: Cara Kerja Sebenarnya

Jelajahi teknologi yang mendasari di balik perkembangan ini secara interaktif.

Thinking Budget (Test-Time Tokens):1,024 tokens
Complex Accuracy79%Math & Code Logic
Latency3.2sTime to first full output
Inference Cost$0.0092Per query estimated
Reasoning StyleStep VerificationInternal chain depth
Active Thinking Trace:
1Deconstruct user problem into formal constraints
2Propose candidate hypotheses & step-by-step calculation
3Self-correction: Backtrack and refute subtle edge cases
4Exhaustive consistency check & final output synthesis
Core takeaway: Test-time compute fundamentally changes AI economics. Instead of only scaling during pre-training, giving reasoning models more tokens at inference time allows them to systematically solve PhD-level STEM problems.
Pemeriksaan Konsep Interaktif+10 Points
AI Ethics Quiz

Why can ethical evaluation not be reduced to one model score?

Apa yang harus ditonton selanjutnya

Perhatikan apakah banding tersebut mengubah keputusan atau menghasilkan keputusan lebih lanjut mengenai pekerjaan pakar yang dibantu AI. Para profesional juga harus memperhatikan bagaimana pengadilan, penasihat hukum, dan persyaratan keterlibatan menangani kerahasiaan, pelestarian, pengungkapan, dan penemuan petunjuk dan keluaran. Sumber tersebut tidak menentukan apakah ChatGPT berdampak signifikan terhadap keputusan juri, apakah catatan cepat sudah lengkap, atau apakah pengadilan menemukan pelanggaran spesifik terhadap aturan profesional.

Pertanyaan langsungnya adalah apa yang terjadi di tingkat banding. Forbes melaporkan bahwa 3M tidak setuju dengan putusan Harris County dan berencana untuk mengajukan banding, namun sumber tersebut tidak memberikan pengajuan banding, keputusan atau jadwal. Proses lebih lanjut dapat memperjelas bagaimana putusan tersebut diperlakukan dan apakah penggunaan ChatGPT oleh ahli menjadi masalah formal. Sumber tersebut tidak mengatakan bahwa juri mengandalkan petunjuk tersebut, bahwa pengadilan memberikan sanksi kepada Autenrieth, atau bahwa putusan tersebut didasarkan pada penggunaan AI.

Pengadilan dan pengacara mungkin akan terus menghadapi pertanyaan mengenai penanganan materi terkait AI dalam penemuan. Forbes mengatakan catatan cepat dibuat dan digunakan dalam uji coba, dan menyarankan para profesional untuk bekerja seolah-olah petunjuk, unggahan, keluaran, dan metadata dapat dicari. Hal-hal yang tidak diketahui mencakup apakah semua catatan yang relevan disimpan, otorisasi apa yang mengatur pengunggahan berkas kasus rahasia, dan bagaimana perintah perlindungan, persyaratan keterlibatan, atau peraturan pengadilan diterapkan. Sumber tidak memberikan jawaban atas pertanyaan-pertanyaan tersebut.

Standar praktis yang disarankan Forbes adalah membentuk opini ahli dari dokumen, data, situs, perangkat, dan standar pemerintahan sebelum menggunakan model; kemudian gunakan AI untuk meringkas, memeriksa penghitungan, menyempurnakan tulisan dalam bahasa sederhana, atau menantang penalaran. Setiap fakta, kutipan, penghitungan, dan pengutipan yang dikembalikan tetap memerlukan pemeriksaan terhadap catatan aslinya, sedangkan pendapat teknis harus tetap terpisah dari kesimpulan hukum. Masih belum diketahui apakah praktik-praktik ini menjadi persyaratan formal, begitu juga dengan seberapa luas laporan serupa yang didukung AI sudah ada dalam kasus-kasus aktif.

Panduan & kuis terkait

Etika AIChatGPT & LLMPrompt EngineeringApa itu AI?Uji pengetahuan Anda — coba kuis AI gratisCari istilah AI di glosarium kamiIkuti pelacak pendanaan AI
Apakah ini berguna?