Τι έγινε
Ένα οκτασέλιδο σημείωμα που δημοσιεύτηκε στο arXiv στις 3 Αυγούστου 2026 αναφέρει ότι η έντυπη απόδειξη ενός άπληστου λήμματος κλιματισμού στο Κεφάλαιο 6 του βιβλίου OpenAI's Ten Advances in Mathematics and Theoretical Computer Science αντιστρέφει μια συνθήκη μεταξύ συμπληρωματικών γεγονότων. Οι συγγραφείς λένε ότι η δήλωση του λήμματος είναι σωστή, παρέχουν ένα αντιπαράδειγμα στην έντυπη διαδικασία και δίνουν μια διορθωμένη απόδειξη που περιγράφουν ως τοπική επισκευή.
Μια σύντομη σημείωση που δημοσιεύτηκε στο arXiv στις 3 Αυγούστου 2026 από τους Mikołaj Sienicki και Krzysztof Sienicki αναφέρει ένα σφάλμα στην έντυπη απόδειξη ενός λήμματος μέσα στο Κεφάλαιο 6 ενός εγγράφου OpenAI με τίτλο Ten Advances in Computer Sciences and Theoret. Η καταχώριση arXiv (2608.14673) έχει καταχωρηθεί στην Τεχνητή Νοημοσύνη και διασταυρώνεται στην Quantum Physics και τα μεταδεδομένα της περιγράφουν ένα έγγραφο οκτώ σελίδων με πέντε αναφορές. Σύμφωνα με τη σημείωση, το κεφάλαιο υποστηρίζει ένα θεώρημα εκθετικής παράλληλης επανάληψης που καλύπτει όλα τα πεπερασμένα μπερδεμένα παιχνίδια δύο παικτών, ενός γύρου - περίπου, μια δήλωση ότι η πιθανότητα να κερδίσεις ένα τέτοιο παιχνίδι πέφτει εκθετικά όταν παίζονται πολλά αντίγραφα ταυτόχρονα από παίκτες που μοιράζονται κβαντική εμπλοκή.
Το αμφισβητούμενο βήμα είναι αυτό που η σημείωση ονομάζει λήμμα ποσοτικής άπληστης προετοιμασίας, που χρησιμοποιείται νωρίς στην επιχειρηματολογία του κεφαλαίου. Η δουλειά του είναι να επιλέξει ένα μικρό σύνολο συντεταγμένων, D, έτσι ώστε αφού εξαρτηθεί από τους παίκτες που κερδίζουν κάθε συντεταγμένη στο D, κερδίζεται μια τυχαία επιλεγμένη υπόλοιπη συντεταγμένη με μέση πιθανότητα τουλάχιστον 1−δ. Οι συγγραφείς δεν αμφισβητούν αυτή τη δήλωση. λένε ότι είναι σωστό. Η αντίρρησή τους είναι στο επιχείρημα που τυπώνεται από κάτω. Όπως γράφτηκε, το τεστ συνέχισης της διαδικασίας εκφράζεται με όρους μέσης επιτυχίας, ενώ το επόμενο βήμα απαιτεί την ύπαρξη μιας συγκεκριμένης συντεταγμένης που φέρει μεγάλη πιθανότητα αστοχίας υπό όρους. Η σημείωση λέει ότι ο υπονοούμενος είναι ψευδής.
Για να υποστηρίξουν τον ισχυρισμό, οι συγγραφείς δίνουν ένα ρητό αντιπαράδειγμα και λένε ότι ακόμη και απλά παραδείγματα μπορούν να αφήσουν την έντυπη διαδικασία χωρίς έγκυρη επόμενη κίνηση — δηλαδή, ο βρόχος όπως γράφεται μπορεί να σταματήσει αντί να παράγει τη συντεταγμένη που χρειάζεται. Στη συνέχεια προσδιορίζουν ποια θεωρούν ότι είναι η επιδιωκόμενη συνθήκη συνέχισης, που δηλώνεται με όρους αποτυχίας και όχι επιτυχίας, και παρέχουν μια πλήρη διορθωμένη απόδειξη. Χαρακτηρίζουν την επισκευή ως τοπική: η δήλωση του λήμματος είναι αμετάβλητη, όπως και οι παράμετροι που αντλεί από αυτό το υπόλοιπο κεφάλαιο, επομένως τα βήματα προς τα κάτω που παραθέτουν το λήμμα δεν πρέπει να ξαναγραφούν.
Η σημείωση είναι ασυνήθιστα σαφής σχετικά με το τι δεν καθορίζει. Οι συγγραφείς γράφουν ότι η διόρθωσή τους δεν πρέπει να εκληφθεί ως ανεξάρτητη επαλήθευση του κύριου θεωρήματος της παράλληλης επανάληψης. διόρθωσαν ένα πρώιμο λήμμα, όχι το κεφάλαιο. Αρκετά πράγματα είναι άγνωστα από την ίδια την πηγή. Δεν κατονομάζει ποιο μοντέλο παρήγαγε το κεφάλαιο, δεν περιγράφει πώς δημιουργήθηκε το κείμενο ή δεν αναφέρει πόση ανθρώπινη επεξεργασία έλαβε πριν από τη δημοσίευση. Δεν αναφέρει καμία επισημοποίηση από μηχάνημα ελεγμένης είτε της εσφαλμένης είτε της διορθωμένης απόδειξης, δεν περιλαμβάνει καμία απάντηση από OpenAI και — ως προεκτύπωση arXiv — δεν φέρει καμία ένδειξη αξιολόγησης από ομοτίμους. Ο ισχυρισμός ότι η έντυπη απόδειξη είναι κατεστραμμένη και η επισκευή είναι έγκυρη είναι, σε αυτό το στάδιο, ο ισχυρισμός των συγγραφέων, ανοιχτός στον ίδιο έλεγχο που εφάρμοσαν.
Γιατί έχει σημασία
Η αναφερόμενη αποτυχία δεν είναι μια παραισθησιακή παραπομπή ή ένας επινοημένος αριθμός, αλλά μια ενιαία αντίστροφη ανισότητα κρυμμένη σε ένα κατά τα άλλα αληθοφανές επιχείρημα - το είδος του ελαττώματος που επιβιώνει μετά από ένα ξεκούραστο και εντοπίζεται μόνο με ανάγνωση γραμμή προς γραμμή. Είναι ένα συγκεκριμένο σημείο δεδομένων σε ένα άλυτο ερώτημα: πώς πρέπει να ελέγχονται τα μαθηματικά που παράγονται από την τεχνητή νοημοσύνη προτού βασιστούν σε αυτά.
Οι περισσότερες δημόσιες συζητήσεις για λάθη τεχνητής νοημοσύνης στην τεχνική γραφή επικεντρώνονται σε προφανείς αστοχίες: κατασκευασμένες παραπομπές, επινοημένοι αριθμοί, αριθμητική που καταρρέει κατά την επιθεώρηση. Το ελάττωμα που περιγράφεται εδώ είναι διαφορετικό είδος. Ένας όρος που δηλώθηκε σε ένα συμβάν γράφτηκε πάνω από το συμπλήρωμά του — επιτυχία όπου χρειαζόταν αποτυχία. Η γύρω πεζογραφία διαβάζεται σωστά, το λήμμα που αποδεικνύεται είναι αληθές και οι παράμετροι ευθυγραμμίζονται. Αυτός ο συνδυασμός είναι που το κάνει δύσκολο: το επιχείρημα είναι εύλογο σε κάθε επίπεδο εκτός από αυτό που αποφασίζει αν λειτουργεί. Οι αναθεωρητές που ελέγχουν τη δήλωση, τις σταθερές και το συνολικό σχήμα μπορούν να το περάσουν και να χάσουν το διάλειμμα.
Αυτό έχει πρακτικές συνέπειες για οποιονδήποτε χρησιμοποιεί μοντέλα για να συντάξει παραγώγους, ορίσματα ορθότητας αλγορίθμων ή αναλύσεις πρωτοκόλλων. Η επιβεβαίωση ότι ένα αποτέλεσμα είναι αληθές δεν είναι το ίδιο με την επιβεβαίωση ότι η παρεχόμενη απόδειξη το αποδεικνύει. Σε αυτή την περίπτωση και τα δύο πράγματα συνέβη να διαχωρίζονται: ο ισχυρισμός επέζησε, ο συλλογισμός όχι. Σε άλλες περιπτώσεις, η ίδια κατηγορία ολίσθησης θα μπορούσε να υποστηρίξει ένα συμπέρασμα που είναι απλώς λάθος, χωρίς εξωτερικό έλεγχο για να το πιάσει. Η λειτουργική μονάδα ανασκόπησης για τα μαθηματικά που παράγονται από την τεχνητή νοημοσύνη φαίνεται να είναι το ατομικό συμπερασματικό βήμα, όχι το θεώρημα, και αυτό είναι δαπανηρή ανθρώπινη εργασία.
Το επεισόδιο επισημαίνει επίσης την επίσημη επαλήθευση ως εργαλείο διάκρισης. Η αντιστροφή πολικότητας μεταξύ συμπληρωματικών γεγονότων είναι ακριβώς το είδος του ελαττώματος που συλλαμβάνει μηχανικά ένας βοηθός απόδειξης, επειδή ο τύπος του παραγόμενου αντικειμένου δεν ταιριάζει με τον τύπο που απαιτείται στο επόμενο βήμα. Αυτό το κεφάλαιο, όπως περιγράφηκε, ήταν τα μαθηματικά πεζογραφίας, έλεγξε τον τρόπο με τον οποίο ελέγχονταν πάντα τα μαθηματικά της πεζογραφίας — από τους αναγνώστες. Καθώς τα συστήματα τεχνητής νοημοσύνης παράγουν περισσότερες υποψήφιες αποδείξεις από αυτές που μπορούν να διαβάσουν οι ειδικοί, το χάσμα μεταξύ αυτού που μπορεί να δημιουργηθεί και αυτού που μπορεί να ελεγχθεί διευρύνεται και ο μηχανικός έλεγχος είναι ο προφανής υποψήφιος για το κλείσιμο.
Χρειάζεται κάποια προσοχή σχετικά με το πόσο μακριά πρέπει να διαβάσετε αυτό. Είναι ένα λήμμα σε ένα κεφάλαιο ενός εγγράφου, που αναφέρεται από δύο συγγραφείς σε ένα σημείωμα οκτώ σελίδων. Δεν παρέχει κανένα ποσοστό σφάλματος, καμία σύγκριση με αποδείξεις που έχουν γραφτεί από τον άνθρωπο σε παρόμοια έκταση, και κανένα στοιχείο σχετικά με το αν αυτό το είδος λάθους είναι σπάνιο ή κοινό στα μαθηματικά που δημιουργούνται από την τεχνητή νοημοσύνη. Τα έγγραφα που έχουν συνταχθεί από τον άνθρωπο φέρουν επίσης επισκευάσιμα σφάλματα και η βιβλιογραφία έχει μακρά παράδοση ακριβώς σε αυτό το είδος διορθωτικής σημείωσης. Το νέο είναι το θέμα: το ελαττωματικό κείμενο προήλθε από ένα σύστημα, το οποίο δημοσιεύτηκε από μια εταιρεία με έντονο ενδιαφέρον για το πώς κρίνεται η μαθηματική του απόδοση.
Interactive Mechanism: How It Actually Works
Explore the underlying technology behind this development interactively.
What is the best response when AI Models Explained makes a mistake in production?
Τι να παρακολουθήσετε στη συνέχεια
Εάν ο OpenAI αναγνωρίζει ή διορθώνει το κεφάλαιο, εάν άλλα κεφάλαια διενεργούν παρόμοιους ελέγχους και εάν κάποιος επαληθεύει ανεξάρτητα το κύριο θεώρημα παράλληλης επανάληψης στο οποίο τροφοδοτεί το διορθωμένο λήμμα. Αξίζει επίσης να παρακολουθήσετε εάν η επισημοποίηση που ελέγχεται από μηχανή γίνεται κανόνας για αποδείξεις που δημιουργούνται από AI.
Το πρώτο πράγμα που πρέπει να παρακολουθήσετε είναι εάν ο OpenAI ανταποκρίνεται — με ένα λάθος, ένα αναθεωρημένο κεφάλαιο ή μια ουσιαστική διαφωνία. Μια ορατή διόρθωση θα υποδηλώνει ότι το έγγραφο διατηρείται ως τεχνικό αντικείμενο και όχι ως επίδειξη. Η σιωπή θα άφηνε τους αναγνώστες να συμβιβάσουν το δημοσιευμένο κείμενο με ένα σημείωμα τρίτου μέρους. Το αν η διόρθωση, εάν γίνει, ταιριάζει με αυτήν που προτείνεται εδώ, είναι μια ξεχωριστή ερώτηση που αξίζει να παρακολουθήσετε, καθώς μια διαφορετική επισκευή ενδέχεται να μην διατηρήσει τις παραμέτρους στις οποίες βασίζεται αργότερα το κεφάλαιο.
Δεύτερον, εάν άλλα κεφάλαια του ίδιου εγγράφου εξετάζονται συγκρίσιμα. Ένας μόνο έλεγχος είναι ανέκδοτο. ένα σύνολο ανεξάρτητων ελέγχων στις δέκα απαιτούμενες προκαταβολές θα αρχίσει να χαρακτηρίζει πόσο αξιόπιστη είναι η συλλογή και πού συγκεντρώνονται οι τρόποι αποτυχίας. Το εμπόδιο είναι ότι αυτού του είδους η αναθεώρηση απαιτεί ειδικούς του τομέα που είναι πρόθυμοι να αφιερώσουν σοβαρό χρόνο στην παραγωγή κάποιου άλλου, με μικρή συμβατική ακαδημαϊκή ανταμοιβή για να το κάνουν.
Τρίτον, αν κάποιος επαληθεύει ανεξάρτητα το κύριο θεώρημα της παράλληλης επανάληψης το διορθωμένο λήμμα υποστηρίζει. Οι συγγραφείς ήταν ρητά ότι δεν το έκαναν. Μέχρι να συμβεί αυτό, η κατάσταση των αποδεικτικών στοιχείων είναι ότι ένα πρώιμο βήμα έχει τώρα μια απόδειξη που οι συντάκτες του πιστεύουν ότι είναι έγκυρη και ο μεγαλύτερος ισχυρισμός παραμένει ανεξέλεγκτος στο κοινό. Μια μηχανικά ελεγμένη επισημοποίηση του κεφαλαίου - ή ακόμα και μόνο του λήμματος - θα άλλαζε απότομα πόσο βάρος μπορεί να φέρει το αποτέλεσμα.
Τέταρτον, εάν διαμορφώνονται κανόνες γύρω από την αποκάλυψη και τον έλεγχο των μαθηματικών που δημιουργούνται από την τεχνητή νοημοσύνη: επισήμανση ποια επιχειρήματα παράγονται από μοντέλο, δηλώνοντας ποιος ανθρώπινος ή αυτοματοποιημένος έλεγχος εφαρμόστηκε και αντιμετώπιση των μη επαληθευμένων αποδείξεων ως προσχέδια και όχι ως αποτελέσματα. Τα περιοδικά και οι διακομιστές προεκτύπωσης έχουν προχωρήσει αργά σε παρόμοιες ερωτήσεις. Αυτή η σημείωση είναι επίσης προεκτύπωση και δεν έχει αξιολογηθεί από ομοτίμους, επομένως η δική της λήψη — είτε οι ειδικοί στην κβαντική παράλληλη επανάληψη επιβεβαιώνουν το αντιπαράδειγμα και αποδέχονται την επισκευή — είναι μέρος του τι πρέπει να ακολουθήσει.