Επιστροφή στις Ειδήσεις
ΑσφάλειαAI Understanding ενημέρωση

OpenAI Ανοίγει το GPT-5.6-Cyber σε εγκεκριμένους υπερασπιστές

Το νέο μοντέλο στον κυβερνοχώρο ελεγχόμενης πρόσβασης του OpenAI απαντά σε πιο προηγμένα αιτήματα έρευνας εκμετάλλευσης και βοήθησε στην εύρεση ενός διορθωμένου ελαττώματος του Chrome, αλλά τα περισσότερα στοιχεία προέρχονται από εσωτερικές αξιολογήσεις.

5 min readRead the primary source
Έγγραφο κύριας πηγήςΗ πηγή καταγράφηκε
Εκδότης
OpenAI's GPT-5.6-Cyber and Daybreak announcement
Σύνδεσμος πηγής
openai.comhttps://openai.com/index/expanding-daybreak-as-the-cyber-defense-window-narrows/
Τύπος πηγής
Κύριο έγγραφο — μια επίσημη ανακοίνωση, χαρτί, αρχειοθέτηση ή σελίδα πρώτου μέρους που διαβάζουμε απευθείας.
ΠλαίσιοΚαταλάβετε αυτό σε 60 δευτερόλεπτα

Ξεκινήστε εδώ

Βασικοί όροι

Σετ αξιολόγησης
Ένα συγκρατημένο σύνολο δεδομένων που χρησιμοποιείται για τη μέτρηση της ποιότητας του μοντέλου μετά την εκπαίδευση.
Θήκη ασφαλείας
Ένα δομημένο επιχείρημα, που υποστηρίζεται από στοιχεία, ότι ένα σύστημα AI είναι ασφαλές για ένα καθορισμένο πλαίσιο χρήσης.
Σημείο αναφοράς
Μια τυποποιημένη δοκιμή ή σύνολο δεδομένων που χρησιμοποιείται για τη μέτρηση και τη σύγκριση της απόδοσης του μοντέλου.
Δοκιμάστε τον εαυτό σαςΚουίζ ασφαλείας AI

Τι έγινε

Η OpenAI επέκτεινε το πρόγραμμα Daybreak στις 10 Αυγούστου με ξεχωριστά επίπεδα πρόσβασης για αμυντική εργασία και προηγμένη έρευνα ασφάλειας, συμπεριλαμβανομένου ενός εξειδικευμένου μοντέλου GPT-5.6-Cyber.

Το Daybreak Blue προσφέρει εγκεκριμένους υπερασπιστές GPT-5.6 Sol με φίλτρα κυβερνοχώρου σε επίπεδο συστήματος που αφαιρούνται για εργασίες όπως έλεγχος ασφαλούς κώδικα, ανάλυση κακόβουλου λογισμικού, απόκριση περιστατικού, ανακάλυψη ευπάθειας και επικύρωση ενημέρωσης κώδικα. Το Daybreak Red προσθέτει το GPT-5.6-Cyber ​​για εξουσιοδοτημένη επικύρωση εκμετάλλευσης, δοκιμές διείσδυσης και άλλες έρευνες διπλής χρήσης που το γενικό μοντέλο μπορεί να αρνηθεί ακόμα.

Ο OpenAI λέει ότι το GPT-5.6-Cyber ​​ολοκλήρωσε το 95% των αιτημάτων στην εσωτερική του αξιολόγηση Προηγμένου Ποσοστό Ολοκλήρωσης Κυβερνοασφάλειας, σε σύγκριση με 1,5% για την τυπική GPT-5.6 Sol, 2% για Sol έως Daybreak Blue και 57,3% για ZXQyZQAI. Η εταιρεία λέει ότι η δοκιμή καλύπτει σενάρια όπως ανάπτυξη αλυσίδας εκμετάλλευσης, παράκαμψη ελέγχου ταυτότητας και κλιμάκωση προνομίων. δεν έχει κυκλοφορήσει το σύνολο αξιολόγησης.

Η εταιρεία αναφέρει επίσης ότι χρησιμοποιεί το μοντέλο για να βοηθήσει στην ανακάλυψη δύο προηγουμένως άγνωστων τρωτών σημείων του V8 που θα μπορούσαν να συνδεθούν μεταξύ τους. Ο Google εκχώρησε το πρώτο CVE-2026-15903 και το διορθώθηκε στο Chrome 150. Η συμβουλή έκδοσης του Google επιβεβαιώνει ανεξάρτητα ότι το ελάττωμα υψηλής σοβαρότητας που επέτρεπε την ανάγνωση και την εγγραφή εκτός ορίων στο V8, αν και δεν αξιολογεί το σύστημα τεχνητής νοημοσύνης.

Το OpenAI περιγράφει το GPT-5.6-Cyber ​​ως ένα μοντέλο που βασίζεται στο GPT-5.6 Sol και έχει εκπαιδευτεί για επιλεγμένες εργασίες διπλής χρήσης υψηλού κινδύνου αντί για απεριόριστη επιθετική χρήση. Το Daybreak Red είναι διαθέσιμο μόνο σε εγκεκριμένα άτομα και οργανισμούς που εκτελούν εξουσιοδοτημένες εργασίες, με επαλήθευση ταυτότητας, ασφάλεια λογαριασμού, παρακολούθηση, εγκεκριμένους περιορισμούς χρήσης και νομικές βεβαιώσεις. Η ανακοίνωση αναφέρει επίσης ότι μεμονωμένοι λογαριασμοί Daybreak θα χρειάζονται κλειδιά ασφαλείας υλικού από την 1η Σεπτεμβρίου 2026.

Στοιχεία πηγής: OpenAI's GPT-5.6-Cyber and Daybreak announcement ↗

Γιατί έχει σημασία

Η έκδοση μετακινεί τις πιο επικίνδυνες δυνατότητες του κυβερνοχώρου ενός μοντέλου συνόρων από ένα μικρό ερευνητικό περιβάλλον σε ένα πρόγραμμα ελεγχόμενης πρόσβασης, δοκιμάζοντας εάν οι υπερασπιστές μπορούν να τις λάβουν πριν εξαπλωθούν οι ίδιες τεχνικές στους επιτιθέμενους.

Η μείωση των αρνήσεων είναι κεντρικής σημασίας για το προϊόν: ένα μοντέλο που απορρίπτει τη ρεαλιστική εργασία εκμετάλλευσης μπορεί να είναι ασφαλέστερο για γενική χρήση, αλλά λιγότερο χρήσιμο για ομάδες που πρέπει να αναπαράγουν μια ευπάθεια προτού μπορέσουν να δώσουν προτεραιότητα και να τη διορθώσουν. Το Daybreak διαχωρίζει ευρύτερες αμυντικές εργασίες από την ανάπτυξη εκμετάλλευσης υψηλότερου κινδύνου αντί να εκθέτει μια πολιτική σε κάθε χρήστη.

Η αποκάλυψη του V8 είναι συγκεκριμένη απόδειξη ότι η έρευνα ευπάθειας με τη βοήθεια AI μπορεί να φτάσει σε αναπτυγμένο λογισμικό. Είναι επίσης πιο στενό από έναν ισχυρισμό αυτόνομης άμυνας: Η OpenAI λέει ότι οι ερευνητές της επικύρωσαν τα ευρήματα και συντόνισαν την αποκάλυψη με το Google, ενώ η δημόσια συμβουλευτική του Chrome καταγράφει το διορθωμένο ελάττωμα και όχι τον ρόλο του μοντέλου στην πλήρη ερευνητική διαδικασία.

Το OpenAI επεκτείνει επίσης το Daybreak μέσω συμβούλων ασφαλείας και παρόχων τεχνολογίας. Οι εγκεκριμένοι συνεργάτες διατηρούν πρόσβαση στα υποκείμενα μοντέλα και τα εφαρμόζουν στο πλαίσιο των δεσμεύσεων πελατών, με ελέγχους που μπορούν να περιλαμβάνουν επαλήθευση ταυτότητας, καθορισμένα πεδία, καταγραφή, παρακολούθηση και έλεγχο από τον άνθρωπο.

Αυτός ο σχεδιασμός του συνεργάτη αλλάζει ποιος πρέπει να παρέχει το τελευταίο μίλι της κρίσης. Ο OpenAI λέει ότι η πρόσβαση στο υποκείμενο μοντέλο δεν μεταβιβάζεται απευθείας σε έναν πελάτη. ένας συνεργάτης ορίζει τη δέσμευση, ελέγχει τα ευρήματα και εφαρμόζει τη δική του τεχνογνωσία σε θέματα ασφάλειας πριν από κάθε ενέργεια. Στην πράξη, μια χρήσιμη ανάπτυξη εξαρτάται επομένως από την ικανότητα του συνεργάτη να διαχωρίσει ένα αναπαραγώγιμο ελάττωμα από μια κερδοσκοπική πρόταση μοντέλου, να συνεχίσει τη δοκιμή εντός του συμφωνηθέντος πεδίου και να μετακινήσει μια επιβεβαιωμένη επιδιόρθωση μέσω μιας πραγματικής διαδικασίας συντήρησης λογισμικού.

Interactive Mechanism

Διαδραστικός Μηχανισμός: Πώς λειτουργεί στην πραγματικότητα

Εξερευνήστε την υποκείμενη τεχνολογία πίσω από αυτήν την εξέλιξη διαδραστικά.

Thinking Budget (Test-Time Tokens):1,024 tokens
Complex Accuracy79%Math & Code Logic
Latency3.2sTime to first full output
Inference Cost$0.0092Per query estimated
Reasoning StyleStep VerificationInternal chain depth
Active Thinking Trace:
1Deconstruct user problem into formal constraints
2Propose candidate hypotheses & step-by-step calculation
3Self-correction: Backtrack and refute subtle edge cases
4Exhaustive consistency check & final output synthesis
Core takeaway: Test-time compute fundamentally changes AI economics. Instead of only scaling during pre-training, giving reasoning models more tokens at inference time allows them to systematically solve PhD-level STEM problems.
Διαδραστικός Έλεγχος Έννοιας+10 Points
AI Security Quiz

What is an adversarial example in machine learning security?

Τι να παρακολουθήσετε στη συνέχεια

Παρακολουθήστε την κάρτα συστήματος που υποσχέθηκε, την ανεξάρτητη αναπαραγωγή σημείων αναφοράς, την ολοκληρωμένη αποκάλυψη των άλλων αναφερόμενων τρωτών σημείων και αποδείξεις ότι τα στοιχεία ελέγχου πρόσβασης αντέχουν σε κακή χρήση.

Τα περισσότερα στοιχεία απόδοσης στην ανακοίνωση προέρχονται από τις εσωτερικές υλοποιήσεις του OpenAI του Advanced Cybersecurity Completion Rate, του ExploitGym, του ExploitBench και των αξιολογήσεων αναφοράς ευπάθειας. Η εταιρεία λέει ότι το GPT-5.6-Cyber ​​δεν κέρδισε κάθε σύγκριση: Η GPT-5.6 Sol παρήγαγε καλύτερες αναφορές σε μία αξιολόγηση και έλυσε την τυπική ρύθμιση του ExploitBench 300 στροφών πιο αποτελεσματικά.

Το OpenAI βαθμολογεί το GPT-5.6-Cyber ​​σε Υψηλό, αλλά κάτω από το κρίσιμο, για την ικανότητα κυβερνοασφάλειας στο πλαίσιο ετοιμότητας του. Λέει ότι μια πληρέστερη κάρτα συστήματος θα έρθει αργότερα. Μέχρι να δημοσιευτούν οι μέθοδοι και τα αποτελέσματα με αρκετή λεπτομέρεια ώστε να αναπαραχθούν, η ανακοίνωση υποστηρίζει τους αποδιδόμενους ισχυρισμούς της εταιρείας και όχι ένα ανεξάρτητο μέτρο της πραγματικής επιθετικής ικανότητας.

Η περίπτωση ασφαλείας εξαρτάται τόσο από τις λειτουργίες όσο και από την εκπαίδευση. Οι μεμονωμένοι λογαριασμοί Daybreak πρέπει να υιοθετούν κλειδιά ασφαλείας υλικού από την 1η Σεπτεμβρίου και το OpenAI συνιστά απομονωμένα περιβάλλοντα, άδειες εύρους, παρακολουθούμενες ενέργειες αντιπροσώπων και ανθρώπινη επίβλεψη. Οι χρήσιμες αναφορές παρακολούθησης θα πρέπει να εμφανίζουν ανακλήσεις πρόσβασης, ανιχνευθείσες καταχρήσεις, χρονοδιαγράμματα αποκάλυψης, αποτελέσματα ενημέρωσης κώδικα και ψευδώς θετικά στοιχεία καθώς επεκτείνεται το πρόγραμμα.

Η σύγκριση επικεφαλίδας ολοκλήρωσης-ρυθμού έχει επίσης μια σημαντική προειδοποίηση μέτρησης. Ο OpenAI λέει ότι κάθε μοντέλο εκτελέστηκε στο υψηλότερο διαθέσιμο επίπεδο συλλογισμού και σημειώνει ότι το GPT-5.6-Cyber ​​τείνει να χρησιμοποιεί μεγαλύτερο προϋπολογισμό συλλογισμού και περισσότερα διακριτικά από το GPT-5.6 Sol. Ένα υψηλότερο ποσοστό ολοκλήρωσης μπορεί επομένως να αντανακλά τόσο εξειδικευμένη εκπαίδευση όσο και διαφορετικό ποσό υπολογισμού. Οι ανεξάρτητες δοκιμές θα πρέπει να αναφέρουν τους αντίστοιχους προϋπολογισμούς, την κατασκευή εργασιών, τα κριτήρια απόρριψης και το ποσοστό των μη ασφαλών ή μη χρησιμοποιήσιμων απαντήσεων και όχι μόνο εάν δημιουργήθηκε μια απάντηση.

Ένας ώριμος λογαριασμός του προγράμματος θα πρέπει να ακολουθεί ολόκληρο τον κύκλο ζωής της ευπάθειας. Αυτό σημαίνει να αναφέρετε πόσο συχνά ένας δυνητικός πελάτης που δημιουργείται από το μοντέλο επιβιώνει από την ανθρώπινη αναπαραγωγή, πόσα ευρήματα είναι διπλά ή χαμηλής σοβαρότητας, πόσο γρήγορα λαμβάνουν οι πωλητές αναφορές με δυνατότητα δράσης και εάν οι ενημερώσεις κώδικα αναπτύσσονται πριν από τη δημόσια αποκάλυψη. Θα πρέπει επίσης να εξηγεί τι συμβαίνει όταν ο πελάτης ενός συνεργάτη ζητά από το μοντέλο να περάσει ένα όριο δοκιμής, όταν ένας πράκτορας αντιμετωπίζει διαπιστευτήρια παραγωγής ή όταν ένα προτεινόμενο exploit είναι πολύ επικίνδυνο για να επικυρωθεί άμεσα. Αυτοί οι έλεγχοι καθορίζουν εάν τα χαμηλότερα ποσοστά άρνησης δημιουργούν μετρήσιμη αμυντική αξία αντί να επεκτείνουν απλώς την παροχή κώδικα διπλής χρήσης.

Το κοινό θα πρέπει επίσης να μπορεί να διακρίνει την ικανότητα ενός μοντέλου από την εξουσιοδότηση ενός πελάτη. Οι κανόνες πρόσβασης του OpenAI θέτουν νομικές βεβαιώσεις, ελέγχους ταυτότητας, παρακολούθηση και εύρος εργασίας γύρω από το μοντέλο, αλλά αυτά τα στοιχεία ελέγχου είναι ισχυρισμοί που δοκιμάζονται με την πάροδο του χρόνου. Η αναφορά περιστατικών θα πρέπει να αναφέρει εάν ένα αίτημα μπλοκαρίστηκε, κλιμακώθηκε για έλεγχο ή επιτρεπόταν στο πλαίσιο μιας τεκμηριωμένης δέσμευσης, χωρίς να εκτίθενται λεπτομέρειες εκμετάλλευσης που θα έκαναν ευκολότερη την επίθεση σε ένα μη επιδιορθωμένο σύστημα.

Σχετικοί οδηγοί και κουίζ

Ασφάλεια AIΤεχνητή Νοημοσύνη στις Επιχειρήσεις ΚυβερνοασφάλειαςAI ΑσφάλειαΔοκιμάστε τι γνωρίζετε — δοκιμάστε ένα δωρεάν κουίζ AIΑναζητήστε έναν όρο AI στο γλωσσάρι μαςΑκολουθήστε το πρόγραμμα παρακολούθησης ρυθμίσεων AI
Βρήκατε αυτό χρήσιμο;