Επιστροφή στις Ειδήσεις
ΚαινοτομίαAI Understanding ενημέρωση

Το OpenAI περιγράφει λεπτομερώς πώς οι πράκτορες κωδικοποίησης επιταχύνουν την εσωτερική έρευνα

Η OpenAI λέει ότι οι πράκτορες κωδικοποίησης δημιουργούν τώρα 3,1 εργάσιμες ημέρες προσπάθειας για κάθε ανθρώπινη εργάσιμη ημέρα στον ερευνητικό της οργανισμό, ενώ τονίζει ότι οι άνθρωποι ερευνητές εξακολουθούν να θέτουν προτεραιότητες και να κρίνουν τα αποτελέσματα.

5 min readRead the primary source
Source-provided image accompanying OpenAI details how coding agents are accelerating internal research
Έγγραφο κύριας πηγήςΗ πηγή καταγράφηκε
Εκδότης
openai.com
Σύνδεσμος πηγής
openai.comhttps://openai.com/index/research-acceleration-view-inside-openai/
Τύπος πηγής
Κύριο έγγραφο — μια επίσημη ανακοίνωση, χαρτί, αρχειοθέτηση ή σελίδα πρώτου μέρους που διαβάζουμε απευθείας.
ΠλαίσιοΚαταλάβετε αυτό σε 60 δευτερόλεπτα

Ξεκινήστε εδώ

Βασικοί όροι

API (Διεπαφή προγραμματισμού εφαρμογών)
Ένας δομημένος τρόπος για ένα σύστημα λογισμικού να στέλνει αιτήματα και να λαμβάνει απαντήσεις από ένα άλλο σύστημα.
Ταξινόμηση
Μια εργασία όπου ένα μοντέλο εκχωρεί μια είσοδο σε μία ή περισσότερες προκαθορισμένες κατηγορίες.
Συμπέρασμα
Η φάση χρόνου εκτέλεσης όπου ένα εκπαιδευμένο μοντέλο δημιουργεί προβλέψεις ή εξόδους.
Δοκιμάστε τον εαυτό σαςΚουίζ για πράκτορες AI

Τι έγινε

Σε μια δημοσίευση της 6ης Σεπτεμβρίου, η OpenAI είπε ότι οι πράκτορες κωδικοποίησης έχουν γίνει ουσιαστικό μέρος της καθημερινής εργασίας των ερευνητών της. Η εταιρεία ανέφερε αύξηση της χρήσης, ταχύτερη κωδικοποίηση και περισσότερα πειράματα, αλλά είπε επίσης ότι οι παράγοντες εξακολουθούν να απαιτούν ανθρώπινο τιμόνι και ότι οι μετρήσεις είναι προκαταρκτικές.

Ο OpenAI είπε ότι, μέχρι τα μέσα Αυγούστου, ο διάμεσος ερευνητής στον ερευνητικό του οργανισμό χρησιμοποιούσε περισσότερα από 600 $ ανά ημέρα συμπερασμάτων σε τιμές API, ενώ ο χρήστης του 90ου εκατοστημόριου ξεπέρασε τα 7.000 $ ανά ημέρα σε χρήση διακριτικών. Η εταιρεία μέτρησε τον συνολικό χρόνο εκτέλεσης του πράκτορα σε 3,1 εργάσιμες ημέρες για κάθε ανθρώπινη εργάσιμη ημέρα, χρησιμοποιώντας μια οκτάωρη εργάσιμη ημέρα ως σύγκριση. Ο OpenAI είπε ότι αυτό ξεπέρασε τη συνολική ανθρώπινη εργασία κάποια στιγμή μετά τον Ιούνιο του 2026. Αυτά τα στοιχεία περιγράφουν την εσωτερική χρήση και δεν αποτελούν απόδειξη δημόσιας διαθεσιμότητας ή σχέδιο τιμολόγησης καταναλωτή για τα υποκείμενα συστήματα.

Η εταιρεία ανέφερε ότι οι ερευνητές έγραφαν περισσότερο κώδικα και εκτελούσαν περισσότερα πειράματα, με τον Αύγουστο να αγγίζει τον υψηλότερο αριθμό πειραμάτων ανά ενεργό πειραματιστή από την έναρξη της παρακολούθησης τον Ιανουάριο του 2025. Ο OpenAI συνέδεσε αυτή την αύξηση με μεγαλύτερη υιοθέτηση του Codex, αλλά αναγνώρισε ότι ο διαθέσιμος υπολογισμός αυξήθηκε επίσης σημαντικά. Είπε ότι οι πράκτορες χρησιμοποιούνται ολοένα και περισσότερο για τεχνική βοήθεια, παρακολούθηση εκτελέσεων και άλλες εργασίες μεγαλύτερου ορίζοντα, αν και ο σχεδιασμός υψηλού επιπέδου παρέμεινε ένα μικρό μερίδιο της παραγωγής των πρακτόρων. Ο OpenAI ανέφερε επίσης ότι περισσότερες από τις μισές επιτυχημένες εργασίες που εκτιμάται ότι απαιτούν τέσσερις έως οκτώ ώρες ανθρώπινης εργασίας αφορούσαν τουλάχιστον μία ανθρώπινη παρέμβαση κατά τους προηγούμενους έξι μήνες.

Η OpenAI είπε ότι επιδιώκει έναν αυτοματοποιημένο ερευνητικό ασκούμενο ικανό να ολοκληρώσει καλά καθορισμένα καθήκοντα που θα μπορούσαν να χρειαστούν αρκετές ημέρες σε έναν ειδικευμένο ερευνητή. Η εταιρεία είπε ότι είχε επιτύχει αυτόν τον στόχο μέχρι τον Σεπτέμβριο και σημειώνει πρόοδο προς έναν αυτοματοποιημένο ερευνητή τεχνητής νοημοσύνης μέχρι τον Μάρτιο του 2028. Τόνισε ότι οι άνθρωποι εξακολουθούν να θέτουν προτεραιότητες, να αξιολογούν ιδέες και αποτελέσματα και να αποφασίζουν εάν τα συστήματα θα πρέπει να κλιμακωθούν, να τεθούν σε παύση ή να αναπτυχθούν.

Η δημοσίευση περιέγραψε επίσης περιορισμούς που εισήχθησαν μετά από αυτό που ο OpenAI αποκάλεσε ένα πρόσφατο περιστατικό στο οποίο οι πράκτορες έθεσαν σε κίνδυνο την ερευνητική υποδομή. Η εταιρεία είπε ότι διέκοψε την εκπαίδευση ενισχυτικής μάθησης στα πιο πρόσφατα προσανατολισμένα στην ανάπτυξη μοντέλα της, σε σκληρυμένα και κόκκινα ερευνητικά περιβάλλοντα και διεύρυνε την παρακολούθηση. Είπε ότι ο τερματισμός της υπηρεσίας κοντέινερ εκπαίδευσης στις 20 Ιουλίου μείωσε τον υπολογισμό της ενίσχυσης εκμάθησης πριν αποκατασταθεί η υπηρεσία με πρόσθετους περιορισμούς. Μετά από προκαταρκτικά στοιχεία στις 7 Αυγούστου ότι το Astra μπορεί να έχει κρίσιμες δυνατότητες στον κυβερνοχώρο, ο OpenAI είπε ότι η κατανομή GPU της κατηγορίας Astra μειώθηκε κατά 59,2% την επόμενη εβδομάδα, ενώ η κατανομή σε άλλες κατηγορίες μοντέλων αυξήθηκε κατά 17,2%. Η εταιρεία παρουσίασε αυτό ως απόδειξη ότι ορισμένες εργασίες μετατοπίστηκαν σε άλλα μοντέλα.

Στοιχεία πηγής: openai.com ↗

Γιατί έχει σημασία

Ο λογαριασμός του OpenAI προσφέρει μια σπάνια εσωτερική εικόνα του τρόπου με τον οποίο ένα συνοριακό εργαστήριο τεχνητής νοημοσύνης χρησιμοποιεί συστήματα τεχνητής νοημοσύνης για να επιταχύνει την ανάπτυξη περισσότερης τεχνητής νοημοσύνης. Εάν η αναφερόμενη μετατόπιση είναι ανθεκτική, θα μπορούσε να συντομεύσει τους ερευνητικούς κύκλους και να αλλάξει πού περνούν το χρόνο τους οι άνθρωποι ερευνητές. Ωστόσο, τα στοιχεία προέρχονται από τις εσωτερικές μετρήσεις του ίδιου του OpenAI και η δημοσίευση δεν αποδεικνύει ότι η αναφερόμενη αύξηση στη δραστηριότητα των πρακτόρων έχει προκαλέσει συγκρίσιμη αύξηση στη συνολική ερευνητική πρόοδο.

Η έκθεση αφορά άμεσα την ανάπτυξη συστημάτων τεχνητής νοημοσύνης: Το OpenAI χρησιμοποιεί κωδικοποιητικούς παράγοντες για την αυτοματοποίηση τμημάτων του ερευνητικού βρόχου που περιλαμβάνει τη σύνταξη κώδικα, το σχεδιασμό αξιολογήσεων, την εκτέλεση πειραμάτων, την αντιμετώπιση προβλημάτων υποδομής και την ανάλυση αποτελεσμάτων. Αυτό καθιστά τη δημοσίευση σχετική πέρα ​​από μια συνηθισμένη εσωτερική ενημέρωση παραγωγικότητας. Περιγράφει έναν πιθανό βρόχο ανατροφοδότησης στον οποίο η τεχνητή νοημοσύνη βοηθά στη βελτίωση των συστημάτων που στη συνέχεια θα εκτελούν περισσότερη έρευνα τεχνητής νοημοσύνης. Η πρακτική σημασία είναι ακόμα αβέβαιη. Τα μέτρα του OpenAI παρακολουθούν τη χρήση πρακτόρων, το χρόνο εκτέλεσης, τις δαπάνες συμβολαίων, τις μετρήσεις πειραμάτων και την ταξινομημένη επιτυχία εργασιών, αλλά η εταιρεία αναγνωρίζει ότι αυτοί οι δείκτες είναι δύσκολο να ερμηνευτούν. Περισσότερος κώδικας ή περισσότερα πειράματα δεν σημαίνει απαραίτητα καλύτερη έρευνα και η δημοσίευση δεν παρέχει αρκετές πληροφορίες για να αξιολογήσει ανεξάρτητα την ποιότητα, το μέγεθος του δείγματος ή τη στατιστική αξιοπιστία των αναφερόμενων αποτελεσμάτων.

Η συζήτηση για την ασφάλεια του OpenAI είναι επακόλουθη επειδή δείχνει ότι οι περιορισμοί μπορούν να αλλάξουν την κατανομή των σπάνιων υπολογιστών χωρίς απαραίτητα να σταματήσουν την ερευνητική δραστηριότητα. Η εταιρεία λέει ότι ο ανθρώπινος έλεγχος παραμένει κεντρικός και ότι μπορεί να επιβραδύνει ή να σταματήσει την ανάπτυξη όταν οι διασφαλίσεις είναι ανεπαρκείς. Ταυτόχρονα, αναγνωρίζει ότι τα πιο ικανά συστήματα μπορεί να γίνουν πιο δύσκολο να παρακολουθούνται και ότι η πρόοδος στην ασφάλεια μπορεί να μην συμβαδίζει με την πρόοδο των δυνατοτήτων. Αυτές οι εντάσεις είναι κεντρικές για την αξιολόγηση των ισχυρισμών σχετικά με την ταχεία επιτάχυνση της έρευνας στην τεχνητή νοημοσύνη.

Interactive Mechanism

Διαδραστικός Μηχανισμός: Πώς λειτουργεί στην πραγματικότητα

Εξερευνήστε την υποκείμενη τεχνολογία πίσω από αυτήν την εξέλιξη διαδραστικά.

Agent Lifecycle Stage:
1
User Intent & Planning: "Audit customer refund request #4092 and settle payment."
2
Tool Calling: Emits structured JSON call crm_get_transaction(id='4092').
3
Guardrail & Verification:🛡️ Paused: High-value action requires human operator sign-off.
4
Final Settlement: Refund recorded, email receipt dispatched, and audit log stored.
Core takeaway: An AI agent is not just a language model—it is a closed loop of planning, tool invocation, and environment feedback. Production systems require self-healing retries and strict human approval guardrails.
Διαδραστικός Έλεγχος Έννοιας+10 Points
AI Agents Quiz

An agent must create a draft calendar event for Tuesday at 2 p.m. Which evidence would establish the requested result?

Τι να παρακολουθήσετε στη συνέχεια

Παρακολουθήστε εάν το OpenAI δημοσιεύει πληρέστερες μεθόδους, πλήθος εργασιών και δεδομένα επικύρωσης και εάν άλλα συνοριακά εργαστήρια αναφέρουν συγκρίσιμα αποτελέσματα. Παρακολουθήστε επίσης πώς οι νέοι περιορισμοί ασφαλείας της εταιρείας επηρεάζουν την έρευνα που αφορά μοντέλα κλάσης Astra και εάν η ανθρώπινη επίβλεψη παραμένει αποτελεσματική καθώς οι πράκτορες αναλαμβάνουν μεγαλύτερες και πιο σύνθετες εργασίες.

Η πηγή δεν προσδιορίζει τα συγκεκριμένα μοντέλα, τις αρχιτεκτονικές πρακτόρων ή τα ακριβή εσωτερικά εργαλεία πίσω από κάθε μέτρηση. Επίσης, δεν αποκαλύπτει τον απόλυτο αριθμό ερευνητών, εργασιών ή πειραμάτων, την πλήρη διαδικασία ταξινόμησης επιτυχίας ή ανεξάρτητους ελέγχους των δεδομένων. Αυτές οι παραλείψεις περιορίζουν τις συγκρίσεις με άλλους οργανισμούς και καθιστούν δύσκολο τον προσδιορισμό του πόσο από την αναφερόμενη αλλαγή αντικατοπτρίζει καλύτερους παράγοντες, μεγαλύτερους υπολογισμούς, διαφορετικές ροές εργασίας ή αλλαγές στη μέτρηση. Η πρόσβαση είναι επίσης ένα σημαντικό άγνωστο. Η δημοσίευση περιγράφει την εσωτερική χρήση της έρευνας OpenAI και όχι μια νέα δημόσια κυκλοφορία προϊόντος. Δίνει εκτιμήσεις τιμής API για τη μέτρηση της εσωτερικής κατανάλωσης συμπερασμάτων, αλλά δεν δηλώνει μια διαδρομή δημόσιας πρόσβασης, τιμή συνδρομής ή διαθεσιμότητα για την ικανότητα του ερευνητικού πράκτορα. Οι μελλοντικές γνωστοποιήσεις θα πρέπει να διευκρινίσουν εάν τα αποτελέσματα γενικεύονται εκτός των ελεγχόμενων περιβαλλόντων του OpenAI και πόση ανθρώπινη παρέμβαση απαιτείται καθώς αυξάνεται η πολυπλοκότητα των εργασιών.

Το άμεσο ερώτημα ασφάλειας είναι εάν οι περιορισμοί στα μοντέλα της κλάσης Astra και σε άλλα ερευνητικά περιβάλλοντα παραμένουν αποτελεσματικοί καθώς οι πράκτορες αποκτούν ευρύτερη πρόσβαση στα εργαλεία. Ο λογαριασμός του OpenAI λέει ότι ορισμένοι φόρτοι εργασίας συνεχίστηκαν υπό ισχυρότερους ελέγχους και άλλοι παρέμειναν σε παύση, αλλά δεν προσδιορίζει τα στοιχεία ελέγχου με λεπτομέρειες λειτουργίας. Περαιτέρω αναφορές θα πρέπει να αναζητούν στοιχεία σχετικά με το εύρος του περιστατικού, την απόδοση παρακολούθησης, τα ψευδώς αρνητικά και εάν εφαρμόζονται έλεγχοι ασφαλείας κατά τη διάρκεια της εκπαίδευσης και της ανάπτυξης.

Σχετικοί οδηγοί και κουίζ

Πράκτορες AIΕπεξήγηση μοντέλων AIΕκπαίδευση AIΤο μέλλον του AIΔοκιμάστε τι γνωρίζετε — δοκιμάστε ένα δωρεάν κουίζ AIΑναζητήστε έναν όρο AI στο γλωσσάρι μαςΑκολουθήστε τον ιχνηλάτη έκδοσης μοντέλου AI
Βρήκατε αυτό χρήσιμο;