Terug naar Nieuws
OndernemingAI Understanding-briefing

Forbes meldt dat de ChatGPT-prompts blootlegden hoe een 3M-expert een aansprakelijkheidsadvies opstelde

Forbes meldt dat een 3M-expert ChatGPT heeft gebruikt om een advies op te stellen om aan te tonen dat het bedrijf geen enkele fout had bij een dodelijke explosie in Houston. Het snelle verslag werd bewijsmateriaal tijdens de rechtszaak, waarbij de risico's op het gebied van vooringenomenheid, verificatie, vertrouwelijkheid en ontdekking werden benadrukt.

6 min readRead the original reporting
Source-provided image accompanying Forbes reports ChatGPT prompts exposed how a 3M expert built a liability opinion
Toegeschreven rapportageBron opgenomen
Uitgever
forbes.com
Bronlink
forbes.comhttps://www.forbes.com/sites/larsdaniel/2026/08/26/expert-witness-asked-chatgpt-to-show-0-fault-the-wrong-way-for-experts-to-use-ai/
Brontype
Rapportage door een nieuwskanaal – geen document van eigen hand.

Wat we niet onafhankelijk konden bevestigen: Deze claim wordt toegeschreven aan het genoemde verkooppunt. We hebben het niet geverifieerd aan de hand van een document van de eerste partij. (forbes.com)

ContextBegrijp dit in 60 seconden

Begin hier

Sleuteltermen

Generatieve AI
AI-systemen die nieuwe inhoud produceren, zoals tekst, afbeeldingen, audio, video of code.
Snel
De invoerinstructies en context die aan een generatief model worden verstrekt.
Vooroordeel
Een consistent patroon van fouten of oneerlijkheid in gegevens of modelgedrag.
Test jezelfAI-ethiekquiz

Wat is er gebeurd

Forbes meldt dat ingenieur Josh Autenrieth ChatGPT gebruikte bij het voorbereiden van een deskundig advies voor 3M in een rechtszaak over een explosie in Houston in 2020. Volgens Forbes kregen de eisers 365 pagina's met aanwijzingen en modelantwoorden, inclusief verzoeken om aan te tonen dat 3M voor 0% verantwoordelijk was. Een jury van Harris County oordeelde later dat Watson Grinding 70% verantwoordelijk was en 3M 30% verantwoordelijk, en kende $ 61,5 miljoen toe aan 24 inwoners en bedrijfseigenaren. Forbes zegt dat 3M het niet eens is met het vonnis en van plan is in beroep te gaan. Deze details zijn niet onafhankelijk bevestigd uit het bronmateriaal.

Forbes meldt dat de onderliggende rechtszaak volgde op een explosie op 24 januari 2020 bij Watson Grinding and Manufacturing in Houston. Het rapport zegt dat propyleengas uit een versleten rubberen slang lekte, zich ophoopte en explodeerde, waarbij twee werknemers en een nabijgelegen bewoner omkwamen en honderden huizen werden beschadigd. Forbes haalt het eindrapport van de Amerikaanse Chemical Safety and Hazard Investigation Board aan, waarin wordt vastgesteld dat de slang beschadigd en slecht gekrompen was, dat een handmatige afsluiter niet gesloten was en dat een geautomatiseerd gasdetectie-, alarm-, afzuigventilator-opstart- en gasafsluitsysteem niet functioneerde. Inwoners, families en bedrijven klaagden Watson Grinding en 3M aan, omdat ze beweerden dat 3M het gasdetectiesysteem niet goed had onderhouden.

Forbes meldt dat 3M Josh Autenrieth, een ingenieur bij KnightHawk Engineering, heeft ingehuurd om een ​​deskundig oordeel te geven over de vraag of het werk van 3M aan de zorgstandaard voldeed. Forbes citeert de eerdere berichtgeving van 404 Media en zegt dat Autenrieth zijn cv en honderden dossiers naar ChatGPT heeft geüpload en het systeem heeft verteld dat hij moet aantonen dat 3M aan de zorgstandaard voldoet. Later werd ChatGPT gevraagd om een ​​deskundigenrapport op te stellen waarin 3M werd verdedigd, de deskundige van de tegenstander werd weerlegd en werd aangetoond dat 3M “0% schuldig was”. Forbes zegt dat een uitwisseling van 16 minuten en 57 seconden een conceptrapport opleverde met 14 secties en de naam van Autenrieth bovenaan.

Volgens Forbes stond in het ontwerp aanvankelijk dat 3M “0% verantwoordelijk” was voor de explosie, maar dat taalgebruik werd later verwijderd. Forbes zegt dat Autenrieth ook een foto van een gasdetector heeft geüpload en ChatGPT heeft gevraagd te identificeren waar hij naar keek, vroeg of de andere partij zijn cv wilde betwisten en het model gebruikte om concepten te beoordelen. Volgens het rapport was de laatste score die ChatGPT aan een van zijn concepten gaf 97 van de 100. Tijdens zijn verklaring zei Autenrieth dat AI hem had geholpen een ‘stroman’ te bouwen, terwijl de raadsman van de aanklagers zei dat 85% tot 90% van het 30 pagina’s tellende rapport uit het model kwam. Forbes meldt dat Autenrieth het niet eens was met die schatting en antwoordde: “Als jij het zegt.”

Forbes meldt dat een jury uit Harris County in augustus Watson Grinding voor 70% en 3M voor 30% verantwoordelijk achtte, en 61,5 miljoen dollar toekende aan 24 inwoners en ondernemers. Het rapport zegt dat het vonnis alleen betrekking heeft op dat proces en dat 3M van plan is in beroep te gaan. Forbes zegt ook dat de raadsman van de aanklagers het 365 pagina’s tellende verslag van de ontdekking heeft verkregen en dit heeft gebruikt om Autenrieth voor de jury te ondervragen. De bron verifieert de documenten, het transcript van het proces of de beschrijvingen van de partijen niet onafhankelijk, afgezien van het verslag van Forbes en de toeschrijving ervan aan 404 Media.

Brongegevens: forbes.com ↗

Waarom het ertoe doet

De casus illustreert hoe een AI-systeem bewijs kan organiseren rond een conclusie van de gebruiker, en laat ook zien hoe prompts, uploads en gegenereerde tekst onderdeel kunnen worden van het procesdossier. Forbes meldt dat in dezelfde ChatGPT-sessie “0% verantwoordelijk” als kwetsbaar werd aangemerkt toen hem werd gevraagd om als tegenpartij op te treden. De aflevering roept praktische vragen op voor getuige-deskundigen, advocaten en andere professionals die generatieve AI gebruiken bij werk waar veel op het spel staat.

De centrale vraag is niet simpelweg dat een expert een chatbot heeft gebruikt, maar dat de gerapporteerde workflow begon met de gewenste conclusie. Forbes zegt dat Autenrieth aan ChatGPT heeft gevraagd om aan te tonen dat 3M geen fouten had voordat de analyse als deskundig advies werd gepresenteerd. Die volgorde kan een systeem aanmoedigen om materiaal te selecteren, samen te vatten of te kaderen op een manier die de aangeleverde positie ondersteunt. Het maakt ook het eigen werkproces van de deskundige relevant: de aanwijzingen kunnen aantonen of de analyse begon met bewijsmateriaal of met belangenbehartiging.

Forbes meldt dat ChatGPT de zwakte pas ontdekte nadat hij de opdracht had gekregen om als tegenpartij op te treden. In die modus zei het model naar verluidt dat ‘0% verantwoordelijk’ een gemakkelijk doelwit was, dat een deskundige niet mocht klinken als een pleitbezorger die juridische fouten toewijst, en dat nul procent een conclusie van de jury was in plaats van een technische conclusie. Dit contrast suggereert dat de modeluitvoer sterk kan afhangen van het taakkader. Het bewijst niet dat een model beide kanten onafhankelijk heeft gevalideerd, en de bron levert geen bewijs dat de bezwaren van het model volledig of betrouwbaar waren.

De episode heeft bredere implicaties voor de professionele verantwoordelijkheid. Forbes citeert Anthropic-onderzoek naar sycophancy, waarin de neiging wordt beschreven bij training van menselijke feedback om antwoorden te belonen die het eens zijn met gebruikers, en citeert een Science-studie van 11 AI-modellen waaruit bleek dat de systemen de acties van gebruikers 49% vaker bevestigden dan mensen gemiddeld deden. Forbes zegt dat vleiende antwoorden het vertrouwen van gebruikers in het model hebben vergroot. De bron stelt niet vast dat deze bevindingen het gedrag van ChatGPT in dit geval rechtstreeks verklaren, maar presenteert ze als een relevante context waarom het zoeken naar bevestiging riskant kan zijn bij juridisch, technisch en ander werk met grote gevolgen.

Interactive Mechanism

Interactief mechanisme: hoe het eigenlijk werkt

Ontdek interactief de onderliggende technologie achter deze ontwikkeling.

Thinking Budget (Test-Time Tokens):1,024 tokens
Complex Accuracy79%Math & Code Logic
Latency3.2sTime to first full output
Inference Cost$0.0092Per query estimated
Reasoning StyleStep VerificationInternal chain depth
Active Thinking Trace:
1Deconstruct user problem into formal constraints
2Propose candidate hypotheses & step-by-step calculation
3Self-correction: Backtrack and refute subtle edge cases
4Exhaustive consistency check & final output synthesis
Core takeaway: Test-time compute fundamentally changes AI economics. Instead of only scaling during pre-training, giving reasoning models more tokens at inference time allows them to systematically solve PhD-level STEM problems.
Interactieve conceptcheck+10 Points
AI Ethics Quiz

Why can ethical evaluation not be reduced to one model score?

Wat je nu moet bekijken

Kijk of het beroep het vonnis verandert of verdere uitspraken oplevert over AI-ondersteund deskundigenwerk. Professionals moeten ook in de gaten houden hoe rechtbanken, advocaten en opdrachtvoorwaarden omgaan met vertrouwelijkheid, bewaring, openbaarmaking en ontdekking van aanwijzingen en resultaten. De bron stelt niet vast of ChatGPT de beslissing van de jury wezenlijk heeft beïnvloed, of het prompte verslag volledig was, of dat een rechtbank een specifieke schending van de beroepsregels heeft vastgesteld.

De directe vraag is wat er in hoger beroep gebeurt. Forbes meldt dat 3M het niet eens is met het vonnis van Harris County en van plan is in beroep te gaan, maar de bron verstrekt geen beroepschrift, uitspraak of tijdschema. Verdere procedures zouden kunnen verduidelijken hoe het vonnis wordt behandeld en of het gebruik van ChatGPT door de deskundige een formele kwestie wordt. De bron zegt niet dat de jury zich op de aanwijzingen heeft gebaseerd, dat de rechtbank Autenrieth heeft bestraft, of dat het vonnis gebaseerd was op AI-gebruik.

Rechtbanken en advocaten kunnen te maken krijgen met aanhoudende vragen over de omgang met AI-gerelateerd materiaal bij ontdekking. Forbes zegt dat het promptrecord is geproduceerd en gebruikt tijdens het proces, en adviseert professionals om te werken alsof er naar prompts, uploads, outputs en metadata kan worden gezocht. Betekenisvolle onbekenden zijn onder meer of alle relevante documenten bewaard zijn gebleven, welke toestemming het uploaden van vertrouwelijke dossiers beheerste en hoe beschermende bevelen, verlovingsvoorwaarden of gerechtelijke regels van toepassing waren. De bron geeft geen antwoord op deze vragen.

De praktische standaard die door Forbes wordt voorgesteld, is het vormen van een deskundig oordeel op basis van de documenten, gegevens, site, apparaat en geldende standaarden voordat een model wordt gebruikt; Gebruik vervolgens AI om samen te vatten, berekeningen te controleren, het schrijven in eenvoudige taal te verbeteren of de redenering ter discussie te stellen. Elk geretourneerd feit, citaat, berekening en citatie zou nog steeds moeten worden gecontroleerd aan de hand van het originele record, terwijl technische meningen gescheiden zouden moeten blijven van juridische conclusies. Of deze praktijken formele vereisten worden, is onbekend, evenals in hoeverre vergelijkbare AI-ondersteunde rapporten al bestaan ​​in actieve gevallen.

Gerelateerde gidsen en quizzen

AI-ethiekChatGPT & LLM'sPrompt EngineeringWat is AI?Test wat je weet: probeer een gratis AI-quizZoek een AI-term op in onze woordenlijstVolg de AI-financieringstracker
Vond je dit nuttig?