Τι έγινε
Η OpenAI επέκτεινε το πρόγραμμα Daybreak στις 10 Αυγούστου με ξεχωριστά επίπεδα πρόσβασης για αμυντική εργασία και προηγμένη έρευνα ασφάλειας, συμπεριλαμβανομένου ενός εξειδικευμένου μοντέλου GPT-5.6-Cyber.
Το Daybreak Blue προσφέρει εγκεκριμένους υπερασπιστές GPT-5.6 Sol με φίλτρα κυβερνοχώρου σε επίπεδο συστήματος που αφαιρούνται για εργασίες όπως έλεγχος ασφαλούς κώδικα, ανάλυση κακόβουλου λογισμικού, απόκριση περιστατικού, ανακάλυψη ευπάθειας και επικύρωση ενημέρωσης κώδικα. Το Daybreak Red προσθέτει το GPT-5.6-Cyber για εξουσιοδοτημένη επικύρωση εκμετάλλευσης, δοκιμές διείσδυσης και άλλες έρευνες διπλής χρήσης που το γενικό μοντέλο μπορεί να αρνηθεί ακόμα.
Ο OpenAI λέει ότι το GPT-5.6-Cyber ολοκλήρωσε το 95% των αιτημάτων στην εσωτερική του αξιολόγηση Προηγμένου Ποσοστό Ολοκλήρωσης Κυβερνοασφάλειας, σε σύγκριση με 1,5% για την τυπική GPT-5.6 Sol, 2% για Sol έως Daybreak Blue και 57,3% για ZXQyZQAI. Η εταιρεία λέει ότι η δοκιμή καλύπτει σενάρια όπως ανάπτυξη αλυσίδας εκμετάλλευσης, παράκαμψη ελέγχου ταυτότητας και κλιμάκωση προνομίων. δεν έχει κυκλοφορήσει το σύνολο αξιολόγησης.
Η εταιρεία αναφέρει επίσης ότι χρησιμοποιεί το μοντέλο για να βοηθήσει στην ανακάλυψη δύο προηγουμένως άγνωστων τρωτών σημείων του V8 που θα μπορούσαν να συνδεθούν μεταξύ τους. Ο Google εκχώρησε το πρώτο CVE-2026-15903 και το διορθώθηκε στο Chrome 150. Η συμβουλή έκδοσης του Google επιβεβαιώνει ανεξάρτητα ότι το ελάττωμα υψηλής σοβαρότητας που επέτρεπε την ανάγνωση και την εγγραφή εκτός ορίων στο V8, αν και δεν αξιολογεί το σύστημα τεχνητής νοημοσύνης.
Το OpenAI περιγράφει το GPT-5.6-Cyber ως ένα μοντέλο που βασίζεται στο GPT-5.6 Sol και έχει εκπαιδευτεί για επιλεγμένες εργασίες διπλής χρήσης υψηλού κινδύνου αντί για απεριόριστη επιθετική χρήση. Το Daybreak Red είναι διαθέσιμο μόνο σε εγκεκριμένα άτομα και οργανισμούς που εκτελούν εξουσιοδοτημένες εργασίες, με επαλήθευση ταυτότητας, ασφάλεια λογαριασμού, παρακολούθηση, εγκεκριμένους περιορισμούς χρήσης και νομικές βεβαιώσεις. Η ανακοίνωση αναφέρει επίσης ότι μεμονωμένοι λογαριασμοί Daybreak θα χρειάζονται κλειδιά ασφαλείας υλικού από την 1η Σεπτεμβρίου 2026.
Στοιχεία πηγής: OpenAI's GPT-5.6-Cyber and Daybreak announcement ↗
Γιατί έχει σημασία
Η έκδοση μετακινεί τις πιο επικίνδυνες δυνατότητες του κυβερνοχώρου ενός μοντέλου συνόρων από ένα μικρό ερευνητικό περιβάλλον σε ένα πρόγραμμα ελεγχόμενης πρόσβασης, δοκιμάζοντας εάν οι υπερασπιστές μπορούν να τις λάβουν πριν εξαπλωθούν οι ίδιες τεχνικές στους επιτιθέμενους.
Η μείωση των αρνήσεων είναι κεντρικής σημασίας για το προϊόν: ένα μοντέλο που απορρίπτει τη ρεαλιστική εργασία εκμετάλλευσης μπορεί να είναι ασφαλέστερο για γενική χρήση, αλλά λιγότερο χρήσιμο για ομάδες που πρέπει να αναπαράγουν μια ευπάθεια προτού μπορέσουν να δώσουν προτεραιότητα και να τη διορθώσουν. Το Daybreak διαχωρίζει ευρύτερες αμυντικές εργασίες από την ανάπτυξη εκμετάλλευσης υψηλότερου κινδύνου αντί να εκθέτει μια πολιτική σε κάθε χρήστη.
Η αποκάλυψη του V8 είναι συγκεκριμένη απόδειξη ότι η έρευνα ευπάθειας με τη βοήθεια AI μπορεί να φτάσει σε αναπτυγμένο λογισμικό. Είναι επίσης πιο στενό από έναν ισχυρισμό αυτόνομης άμυνας: Η OpenAI λέει ότι οι ερευνητές της επικύρωσαν τα ευρήματα και συντόνισαν την αποκάλυψη με το Google, ενώ η δημόσια συμβουλευτική του Chrome καταγράφει το διορθωμένο ελάττωμα και όχι τον ρόλο του μοντέλου στην πλήρη ερευνητική διαδικασία.
Το OpenAI επεκτείνει επίσης το Daybreak μέσω συμβούλων ασφαλείας και παρόχων τεχνολογίας. Οι εγκεκριμένοι συνεργάτες διατηρούν πρόσβαση στα υποκείμενα μοντέλα και τα εφαρμόζουν στο πλαίσιο των δεσμεύσεων πελατών, με ελέγχους που μπορούν να περιλαμβάνουν επαλήθευση ταυτότητας, καθορισμένα πεδία, καταγραφή, παρακολούθηση και έλεγχο από τον άνθρωπο.
Αυτός ο σχεδιασμός του συνεργάτη αλλάζει ποιος πρέπει να παρέχει το τελευταίο μίλι της κρίσης. Ο OpenAI λέει ότι η πρόσβαση στο υποκείμενο μοντέλο δεν μεταβιβάζεται απευθείας σε έναν πελάτη. ένας συνεργάτης ορίζει τη δέσμευση, ελέγχει τα ευρήματα και εφαρμόζει τη δική του τεχνογνωσία σε θέματα ασφάλειας πριν από κάθε ενέργεια. Στην πράξη, μια χρήσιμη ανάπτυξη εξαρτάται επομένως από την ικανότητα του συνεργάτη να διαχωρίσει ένα αναπαραγώγιμο ελάττωμα από μια κερδοσκοπική πρόταση μοντέλου, να συνεχίσει τη δοκιμή εντός του συμφωνηθέντος πεδίου και να μετακινήσει μια επιβεβαιωμένη επιδιόρθωση μέσω μιας πραγματικής διαδικασίας συντήρησης λογισμικού.
Διαδραστικός Μηχανισμός: Πώς λειτουργεί στην πραγματικότητα
Εξερευνήστε την υποκείμενη τεχνολογία πίσω από αυτήν την εξέλιξη διαδραστικά.
What is an adversarial example in machine learning security?
Τι να παρακολουθήσετε στη συνέχεια
Παρακολουθήστε την κάρτα συστήματος που υποσχέθηκε, την ανεξάρτητη αναπαραγωγή σημείων αναφοράς, την ολοκληρωμένη αποκάλυψη των άλλων αναφερόμενων τρωτών σημείων και αποδείξεις ότι τα στοιχεία ελέγχου πρόσβασης αντέχουν σε κακή χρήση.
Τα περισσότερα στοιχεία απόδοσης στην ανακοίνωση προέρχονται από τις εσωτερικές υλοποιήσεις του OpenAI του Advanced Cybersecurity Completion Rate, του ExploitGym, του ExploitBench και των αξιολογήσεων αναφοράς ευπάθειας. Η εταιρεία λέει ότι το GPT-5.6-Cyber δεν κέρδισε κάθε σύγκριση: Η GPT-5.6 Sol παρήγαγε καλύτερες αναφορές σε μία αξιολόγηση και έλυσε την τυπική ρύθμιση του ExploitBench 300 στροφών πιο αποτελεσματικά.
Το OpenAI βαθμολογεί το GPT-5.6-Cyber σε Υψηλό, αλλά κάτω από το κρίσιμο, για την ικανότητα κυβερνοασφάλειας στο πλαίσιο ετοιμότητας του. Λέει ότι μια πληρέστερη κάρτα συστήματος θα έρθει αργότερα. Μέχρι να δημοσιευτούν οι μέθοδοι και τα αποτελέσματα με αρκετή λεπτομέρεια ώστε να αναπαραχθούν, η ανακοίνωση υποστηρίζει τους αποδιδόμενους ισχυρισμούς της εταιρείας και όχι ένα ανεξάρτητο μέτρο της πραγματικής επιθετικής ικανότητας.
Η περίπτωση ασφαλείας εξαρτάται τόσο από τις λειτουργίες όσο και από την εκπαίδευση. Οι μεμονωμένοι λογαριασμοί Daybreak πρέπει να υιοθετούν κλειδιά ασφαλείας υλικού από την 1η Σεπτεμβρίου και το OpenAI συνιστά απομονωμένα περιβάλλοντα, άδειες εύρους, παρακολουθούμενες ενέργειες αντιπροσώπων και ανθρώπινη επίβλεψη. Οι χρήσιμες αναφορές παρακολούθησης θα πρέπει να εμφανίζουν ανακλήσεις πρόσβασης, ανιχνευθείσες καταχρήσεις, χρονοδιαγράμματα αποκάλυψης, αποτελέσματα ενημέρωσης κώδικα και ψευδώς θετικά στοιχεία καθώς επεκτείνεται το πρόγραμμα.
Η σύγκριση επικεφαλίδας ολοκλήρωσης-ρυθμού έχει επίσης μια σημαντική προειδοποίηση μέτρησης. Ο OpenAI λέει ότι κάθε μοντέλο εκτελέστηκε στο υψηλότερο διαθέσιμο επίπεδο συλλογισμού και σημειώνει ότι το GPT-5.6-Cyber τείνει να χρησιμοποιεί μεγαλύτερο προϋπολογισμό συλλογισμού και περισσότερα διακριτικά από το GPT-5.6 Sol. Ένα υψηλότερο ποσοστό ολοκλήρωσης μπορεί επομένως να αντανακλά τόσο εξειδικευμένη εκπαίδευση όσο και διαφορετικό ποσό υπολογισμού. Οι ανεξάρτητες δοκιμές θα πρέπει να αναφέρουν τους αντίστοιχους προϋπολογισμούς, την κατασκευή εργασιών, τα κριτήρια απόρριψης και το ποσοστό των μη ασφαλών ή μη χρησιμοποιήσιμων απαντήσεων και όχι μόνο εάν δημιουργήθηκε μια απάντηση.
Ένας ώριμος λογαριασμός του προγράμματος θα πρέπει να ακολουθεί ολόκληρο τον κύκλο ζωής της ευπάθειας. Αυτό σημαίνει να αναφέρετε πόσο συχνά ένας δυνητικός πελάτης που δημιουργείται από το μοντέλο επιβιώνει από την ανθρώπινη αναπαραγωγή, πόσα ευρήματα είναι διπλά ή χαμηλής σοβαρότητας, πόσο γρήγορα λαμβάνουν οι πωλητές αναφορές με δυνατότητα δράσης και εάν οι ενημερώσεις κώδικα αναπτύσσονται πριν από τη δημόσια αποκάλυψη. Θα πρέπει επίσης να εξηγεί τι συμβαίνει όταν ο πελάτης ενός συνεργάτη ζητά από το μοντέλο να περάσει ένα όριο δοκιμής, όταν ένας πράκτορας αντιμετωπίζει διαπιστευτήρια παραγωγής ή όταν ένα προτεινόμενο exploit είναι πολύ επικίνδυνο για να επικυρωθεί άμεσα. Αυτοί οι έλεγχοι καθορίζουν εάν τα χαμηλότερα ποσοστά άρνησης δημιουργούν μετρήσιμη αμυντική αξία αντί να επεκτείνουν απλώς την παροχή κώδικα διπλής χρήσης.
Το κοινό θα πρέπει επίσης να μπορεί να διακρίνει την ικανότητα ενός μοντέλου από την εξουσιοδότηση ενός πελάτη. Οι κανόνες πρόσβασης του OpenAI θέτουν νομικές βεβαιώσεις, ελέγχους ταυτότητας, παρακολούθηση και εύρος εργασίας γύρω από το μοντέλο, αλλά αυτά τα στοιχεία ελέγχου είναι ισχυρισμοί που δοκιμάζονται με την πάροδο του χρόνου. Η αναφορά περιστατικών θα πρέπει να αναφέρει εάν ένα αίτημα μπλοκαρίστηκε, κλιμακώθηκε για έλεγχο ή επιτρεπόταν στο πλαίσιο μιας τεκμηριωμένης δέσμευσης, χωρίς να εκτίθενται λεπτομέρειες εκμετάλλευσης που θα έκαναν ευκολότερη την επίθεση σε ένα μη επιδιορθωμένο σύστημα.