Τι έγινε
Οι ερευνητές Eric S. Qiu και Joyce Gill παρουσιάζουν το Adversarial Review, ένα ελάχιστο πρωτόκολλο συνεργασίας για την αναθεώρηση του κώδικα πράκτορα. Το σύστημα χρησιμοποιεί έναν κύριο παράγοντα κωδικοποίησης, έναν αναθεωρητή και έναν κριτικό που αμφισβητεί την αναθεώρηση με έμφαση στα στοιχεία προτού ο παράγοντας κωδικοποίησης κάνει αλλαγές.
Η δημοσίευση, που υποβλήθηκε στο arXiv στις 16 Αυγούστου 2026, περιγράφει την Αναθεώρηση Αντιμετώπισης ως τη μέση λύση μεταξύ δύο κοινών προσεγγίσεων για συστήματα κωδικοποίησης πολλαπλών πρακτόρων. Προηγούμενα συστήματα διαχωρισμένα με ρόλους μπορεί να χρησιμοποιούν πολλούς πράκτορες, αλλά οι συγγραφείς λένε ότι η απόδοση μπορεί να εμφανίσει φθίνουσες αποδόσεις καθώς αυξάνεται ο αριθμός των πρακτόρων. Συστήματα που αντιμετωπίζουν πρόσθετους παράγοντες μόνο ως παθητικούς υποπαράγοντες μπορεί να μειώσουν αυτό το γενικό κόστος, αλλά και να αφαιρέσουν μεγάλο μέρος της αλληλεπίδρασης μεταξύ των παραγόντων. Η AR διατηρεί μια μικρή συνεργασία, ενώ αναθέτει διακριτές ευθύνες σε τρεις πράκτορες: έναν κύριο παράγοντα κωδικοποίησης, έναν αναθεωρητή και έναν κριτικό.
Ο αναθεωρητής αξιολογεί τον κώδικα που παράγεται από τον κύριο πράκτορα. Στη συνέχεια, ο κριτικός ελέγχει την κριτική μέσω αυτού που οι συγγραφείς περιγράφουν ως δομημένη διαφωνία. Αυτή η διαφωνία εμφανίζεται πριν ο κύριος πράκτορας επεξεργαστεί τον κώδικα, καθιστώντας τη διαδικασία αναθεώρησης ένα σημείο ελέγχου απόφασης και όχι μια μη δομημένη ανταλλαγή μεταξύ πολλών πρακτόρων. Η πηγή χαρακτηρίζει το πρωτόκολλο ως τεκμηριωμένο, αλλά η περίληψη δεν καθορίζει τις ακριβείς προτροπές, τις απαιτήσεις αποδεικτικών στοιχείων, τη μορφή διαφωνίας ή τα κριτήρια που χρησιμοποιούνται για να καθοριστεί πότε ο κύριος πράκτορας πρέπει να αποδεχτεί μια προτεινόμενη αλλαγή.
Οι συγγραφείς αναφέρουν δοκιμές σε τρεις αξιολογήσεις κωδικοποίησης. Στο LiveCodeBench, λένε ότι η AR πέτυχε το υψηλότερο ποσοστό επιτυχίας μεταξύ των δοκιμασμένων μεθόδων και ξεπέρασε τις επιδόσεις της βασικής γραμμής πέντε παραγόντων ενώ χρησιμοποιούσε τρεις πράκτορες. Στο SWE-PRBench, οι συγγραφείς λένε ότι μια αφελής έκδοση του AR αποκάλυψε έναν τρόπο αποτυχίας με ψευδή συναίνεση: οι πράκτορες συμφώνησαν χωρίς επαρκή στοιχεία. Αναφέρουν ότι μια απλή επανάληψη προτροπής προσθέτοντας ρητή διαφωνία παρήγαγε το υψηλότερο F1 μεταξύ των δοκιμασμένων μεθόδων. Στο SWE-bench Verified, αναφέρουν επίσης βελτιώσεις σε σχέση με τις βασικές γραμμές σε εργασίες κωδικοποίησης σε επίπεδο αποθετηρίου. Η πηγή δεν παρέχει τις υποκείμενες βαθμολογίες, τα διαστήματα εμπιστοσύνης, τις ταυτότητες μοντέλων, τον αριθμό εργασιών ή τις στατιστικές δοκιμές.
Η εργασία αναγνωρίζεται ως αποδεκτή στο Εργαστήριο ICML 2026 στο DL4C. Αυτή η κατάσταση επιβεβαιώνει τη δηλωμένη αποδοχή του εργαστηρίου από τους συγγραφείς, αλλά δεν είναι το ίδιο με την απόδειξη ότι η μέθοδος έχει αναπαραχθεί ή επικυρωθεί ανεξάρτητα στην παραγωγή. Η πηγή που είναι διαθέσιμη εδώ είναι μια περίληψη και βιβλιογραφική εγγραφή arXiv. δεν αποδεικνύει ότι το AR αναπτύσσεται δημόσια, είναι ενσωματωμένο σε ένα εμπορικό προϊόν κωδικοποίησης ή έχει αποδειχθεί αποτελεσματικό για έργα λογισμικού εκτός των αναφερόμενων αξιολογήσεων.
Γιατί έχει σημασία
Η εργασία αντιμετωπίζει ένα πρακτικό πρόβλημα αξιοπιστίας στα συστήματα κωδικοποίησης AI: η προσθήκη περισσότερων πρακτόρων δεν βελτιώνει απαραίτητα την απόδοση σε επίπεδο αποθετηρίου και οι πράκτορες μπορούν να συμφωνήσουν χωρίς επαρκή στοιχεία. Εάν το αναφερόμενο μοτίβο υπερβαίνει τα δοκιμασμένα σημεία αναφοράς, η δομημένη διαφωνία θα μπορούσε να προσφέρει έναν σχετικά ελαφρύ τρόπο βελτίωσης της ποιότητας της κριτικής.
Οι πράκτορες κωδικοποίησης τεχνητής νοημοσύνης εκτελούν όλο και περισσότερο εργασίες που απαιτούν περισσότερα από τη δημιουργία μιας τοπικά εύλογης ενημέρωσης κώδικα. Πρέπει να ερμηνεύσουν ένα αποθετήριο, να κάνουν αλλαγές σε αρχεία, να εκτελέσουν ή να αιτιολογήσουν τις δοκιμές και να αποφασίσουν εάν μια προτεινόμενη λύση είναι επαρκής. Ένας μηχανισμός αναθεώρησης που ελέγχει τόσο τον κώδικα όσο και την ίδια την αναθεώρηση στοχεύει σε μια αδυναμία που μπορεί να αφήσει ανεπίλυτη η συνηθισμένη παραγωγή με ένα πέρασμα: ένας αναθεωρητής μπορεί να παράγει μια σίγουρη αλλά μη υποστηριζόμενη αξιολόγηση και άλλοι πράκτορες μπορούν να την αποδεχτούν επειδή τα αποτελέσματά τους συγκλίνουν.
Το αναφερόμενο αποτέλεσμα ψευδούς συναίνεσης είναι ιδιαίτερα σημαντικό. Υποδηλώνει ότι η απλή ανάθεση διαφορετικών ρόλων στους πράκτορες δεν εγγυάται χρήσιμη διαφωνία. Στον λογαριασμό της πηγής, το πρωτόκολλο έγινε πιο αποτελεσματικό στο SWE-PRBench μετά την ρητά απαιτούμενη διαφωνία. Αυτό το εύρημα, εάν επαναληφθεί, θα στρέψει την προσοχή από τον αριθμό των πρακτόρων ως τον κύριο μοχλό σχεδιασμού και προς την ποιότητα των κανόνων αλληλεπίδρασης. Ένα μικρότερο σύστημα θα μπορούσε να είναι πιο εύκολο στη λειτουργία, την επιθεώρηση και τον προϋπολογισμό από μια μεγαλύτερη ομάδα πρακτόρων, αν και η πηγή δεν ποσοτικοποιεί αυτά τα λειτουργικά οφέλη.
Για προγραμματιστές και οργανισμούς, η πιθανή αξία δεν είναι ότι τρεις πράκτορες παράγουν αυτόματα σωστό λογισμικό. Αντίθετα, το AR προσφέρει μια υπόθεση σχεδιασμού: οι πράκτορες ελέγχου κώδικα μπορεί να είναι πιο αξιόπιστοι όταν ένα στοιχείο έχει επιφορτιστεί με την αμφισβήτηση των αποδεικτικών στοιχείων του αναθεωρητή πριν γίνουν αποδεκτές οι αλλαγές. Ένα τέτοιο σημείο ελέγχου θα μπορούσε να βοηθήσει στην εμφάνιση δοκιμών που λείπουν, μη υποστηριζόμενες υποθέσεις ή διαφωνίες σχετικά με τη συμπεριφορά του αποθετηρίου. Ωστόσο, η πηγή δεν αναφέρει ποια είδη σφαλμάτων βελτιώθηκαν, εάν η μέθοδος εντόπισε ελαττώματα ασφαλείας ή αν μείωσε τις επιβλαβείς παλινδρομήσεις. Αυτές οι παραλείψεις περιορίζουν ό,τι μπορεί να συναχθεί υπεύθυνα σχετικά με την πρακτική ασφάλεια.
Τα αποτελέσματα έχουν επίσης σημασία για αξιολόγηση. Το LiveCodeBench, το SWE-PRBench και το SWE-bench Verified μετρούν διαφορετικές πτυχές της απόδοσης κωδικοποίησης, αλλά οι βελτιώσεις συγκριτικής αξιολόγησης δεν δημιουργούν από μόνες τους καλύτερα αποτελέσματα σε πραγματικά αποθετήρια. Η περίληψη δεν αναφέρει εάν οι εργασίες επιλέχθηκαν εκ των προτέρων, εάν οι προτροπές συντονίστηκαν στα σύνολα αξιολόγησης, πώς χειρίστηκαν οι αναθεωρητές δοκιμές αποτυχίας ή εάν οι βασικές γραμμές έλαβαν συγκρίσιμους προϋπολογισμούς διακριτικών και πρόσβαση στο εργαλείο. Χωρίς αυτές τις λεπτομέρειες, η αναφερόμενη κατάταξη αποτελεί απόδειξη για περαιτέρω έρευνα, όχι γενική απόδειξη ότι η δομημένη διαφωνία είναι ανώτερη.
Διαδραστικός Μηχανισμός: Πώς λειτουργεί στην πραγματικότητα
Εξερευνήστε την υποκείμενη τεχνολογία πίσω από αυτήν την εξέλιξη διαδραστικά.
crm_get_transaction(id='4092').What most distinguishes an AI agent from a basic chatbot?
Τι να παρακολουθήσετε στη συνέχεια
Τα βασικά ερωτήματα είναι εάν τα κέρδη επαναλαμβάνονται σε περισσότερα αποθετήρια, γλώσσες, μοντέλα και πραγματικές ομάδες μηχανικής και πόσο το πρωτόκολλο αυξάνει την καθυστέρηση και το κόστος. Η πηγή δεν παρέχει αριθμητικά αποτελέσματα, πειραματικές διαμορφώσεις, αναλύσεις σφαλμάτων ή στοιχεία σχετικά με τη χρήση παραγωγής, επομένως τα ευρήματα θα πρέπει να αντιμετωπίζονται ως προκαταρκτικά.
Η πρώτη προτεραιότητα είναι η αναπαραγωγή με το πλήρες χαρτί, τον κώδικα, τις προτροπές και τις πειραματικές ρυθμίσεις. Οι αναγνώστες θα πρέπει να αναζητήσουν τα ακριβή ποσοστά επιτυχίας και τις βαθμολογίες F1, τον αριθμό και τη σύνθεση των εργασιών, τα μοντέλα που χρησιμοποιούνται για κάθε πράκτορα, τους προϋπολογισμούς διακριτικών και εργαλείων και τον ορισμό κάθε γραμμής βάσης. Οι μελέτες κατάλυσης θα ήταν ιδιαίτερα χρήσιμες: θα μπορούσαν να ελέγξουν εάν τα κέρδη προέρχονται από τον κριτικό ρόλο, από ρητή γλώσσα διαφωνίας, από πρόσθετους υπολογισμούς ή από διαφορές στον αριθμό των κύκλων ανασκόπησης.
Ένα δεύτερο ζήτημα είναι η γενίκευση. Η πηγή ονομάζει τρία σημεία αναφοράς, αλλά δεν καθορίζει την απόδοση σε γλώσσες προγραμματισμού, ιδιόκτητα αποθετήρια, μακροχρόνιες εργασίες συντήρησης, νέες αρχιτεκτονικές ή ομάδες με ανθρώπινους αναθεωρητές. Είναι επίσης άγνωστο εάν η μέθοδος λειτουργεί όταν οι δοκιμές είναι ελλιπείς ή παραπλανητικές, όταν η τεκμηρίωση του χώρου αποθήκευσης έρχεται σε διένεξη με την υλοποίηση ή όταν ένας κριτικός πρέπει να αξιολογήσει μια αναθεώρηση που περιλαμβάνει ασφάλεια, απόρρητο ή διαμόρφωση ανάπτυξης. Αυτές οι περιπτώσεις μπορεί να παράγουν διαφορετικούς συμβιβασμούς από τις εργασίες αναφοράς.
Τα λειτουργικά κόστη αξίζουν την ίδια προσοχή. Το AR χρησιμοποιεί λιγότερους πράκτορες από την αναφερόμενη βασική γραμμή πέντε παραγόντων, αλλά εξακολουθεί να προσθέτει ένα στάδιο αναθεώρησης και κριτικής πριν από την επεξεργασία. Αυτό μπορεί να αυξήσει τον λανθάνοντα χρόνο, τις κλήσεις μοντέλων, την κατανάλωση περιβάλλοντος και το κόστος υποδομής, ακόμη και αν ο συνολικός αριθμός πρακτόρων είναι χαμηλότερος. Η πηγή δεν δίνει μετρήσεις για αυτούς τους παράγοντες και δεν αναφέρει πόσο συχνά ο κριτικός ανατρέπει τον κριτικό, πώς επιλύονται οι διαφωνίες ή εάν οι επαναλαμβανόμενες προκλήσεις μπορούν να δημιουργήσουν περιττές αλλαγές. Οι μελλοντικές αναφορές θα πρέπει να συνδέουν τα κέρδη ακρίβειας με το κόστος και τον χρόνο αντί να παρουσιάζουν μόνο τον αριθμό των πρακτόρων.
Τέλος, οι χρήστες θα πρέπει να παρακολουθούν στοιχεία από ανεξάρτητες μηχανολογικές αναπτύξεις και ανθρωποκεντρικές μελέτες. Η πηγή δεν αποδεικνύει ότι το AR βελτιώνει την εμπιστοσύνη των προγραμματιστών, την κατανόηση κριτικών ή τα ποσοστά συμβάντων, ούτε δείχνει πώς ανταποκρίνονται οι άνθρωποι όταν οι πράκτορες διαφωνούν. Μια ισχυρή αξιολόγηση θα μετρούσε τόσο τα τεχνικά αποτελέσματα όσο και το κόστος αποτυχίας, συμπεριλαμβανομένων των ψευδών εγκρίσεων, των ψευδών απορρίψεων, των παλινδρομήσεων και των αστοχιών που σχετίζονται με την ασφάλεια. Μέχρι να διατεθούν αυτά τα στοιχεία, το πιο αξιόπιστο συμπέρασμα είναι ότι το Adversarial Review είναι ένα πολλά υποσχόμενο ερευνητικό πρωτόκολλο με ισχυρισμούς αναφοράς που δικαιολογούν έλεγχο και αναπαραγωγή.