Τι έγινε
Σύμφωνα με το BBC, ο συνιδρυτής του Anthropic, Τζακ Κλαρκ, δήλωσε ότι οι εταιρείες μπορεί τελικά να χρειαστεί να διατηρούν «διακόπτες εξόντωσης» της τεχνητής νοημοσύνης που μπορούν να ελεγχθούν από ανεξάρτητους τρίτους. Ο Κλαρκ είπε ότι τα περισσότερα εργαστήρια τεχνητής νοημοσύνης, συμπεριλαμβανομένου του Anthropic, έχουν ήδη τρόπους να τερματίσουν τα συστήματα, αλλά δεν περιέγραψε τον τεχνικό σχεδιασμό τους ούτε παρείχε στοιχεία ανεξάρτητης επαλήθευσης.
Το BBC αναφέρει ότι ο Jack Clark, ένας από τους επτά ιδρυτές του Anthropic, είπε ότι η κοινωνία μπορεί τελικά να θέλει κανόνες που να απαιτούν από τις εταιρείες τεχνητής νοημοσύνης να έχουν έναν τρόπο να απενεργοποιούν εντελώς το λογισμικό εάν αυτό γίνει πολύ επικίνδυνο. Πραγματοποίησε το θέμα ως μέρος μιας ευρύτερης συζήτησης πολιτικής αντί να ανακοινώσει ένα νέο προϊόν ή πολιτική Anthropic.
Ο Clark είπε στο BBC ότι «τα περισσότερα εργαστήρια έχουν διαφορετικούς τρόπους για να μπορούν να τραβήξουν την πρίζα», συμπεριλαμβανομένου του Anthropic. Αναρωτήθηκε συγκεκριμένα εάν οι εταιρείες θα πρέπει να υποχρεωθούν να διαθέτουν διακόπτη kill και εάν αυτός ο διακόπτης θα πρέπει να είναι επαληθεύσιμος από τρίτο μέρος. Η αναφορά δεν παρέχει τεχνική περιγραφή των ελέγχων του Anthropic, καμία ανεξάρτητη αξιολόγηση και κανένα προτεινόμενο πρότυπο επαλήθευσης.
Τα σχόλια έγιναν εν μέσω ανανεωμένης δημόσιας συζήτησης σχετικά με καταστροφικούς κινδύνους τεχνητής νοημοσύνης και αφού ο διευθύνων σύμβουλος της Anthropic, Dario Amodei, ζήτησε να επιβραδυνθεί ο ρυθμός ανάπτυξης της τεχνητής νοημοσύνης και να παρακολουθείται στενότερα η ανάπτυξη. Το BBC σημειώνει επίσης ότι οι αμερικανοί νομοθέτες έχουν προτείνει έναν νόμο Kill Switch που θα απαιτούσε τρόπους για να κλείσουν προβληματικά εργαλεία τεχνητής νοημοσύνης και να δώσει σε ορισμένες κυβερνητικές υπηρεσίες την εξουσία να απαιτούν την απενεργοποίηση ή τον περιορισμό των εργαλείων.
Η έκθεση αναφέρει ότι ο πρόεδρος των ΗΠΑ Ντόναλντ Τραμπ έχει απορρίψει τις προσπάθειες επιβράδυνσης της ανάπτυξης της τεχνητής νοημοσύνης. Σημειώνει επίσης ότι ορισμένα στοιχεία του κλάδου πιστεύουν ότι οι φόβοι για την εξαφάνιση του ανθρώπου από την τεχνητή νοημοσύνη είναι υπερεκτιμημένοι ή μπορεί να έχουν σκοπό να δημιουργήσουν διαφημιστική εκστρατεία. Αυτές οι αντιδράσεις παρέχουν το πλαίσιο, αλλά η έκθεση του BBC δεν επιλύει τα υποκείμενα τεχνικά ή πολιτικά ερωτήματα.
Γιατί έχει σημασία
Ένας υποχρεωτικός, ανεξάρτητα επαληθευμένος μηχανισμός τερματισμού λειτουργίας θα μετέτρεπε μια σε μεγάλο βαθμό εσωτερική πρακτική ασφάλειας σε πιθανή ρυθμιστική απαίτηση. Η πρόταση εξετάζει ένα πρακτικό ερώτημα σχετικά με τον έλεγχο σε όλο και πιο ικανά συστήματα AI, αλλά η έκθεση δεν καθορίζει εάν οι υπάρχοντες διακόπτες kill θα λειτουργούσαν ενάντια σε κάθε τρόπο αποτυχίας, πόσο γρήγορα θα μπορούσαν να λειτουργήσουν ή ποιος θα είχε την εξουσία να τους ενεργοποιήσει.
Η πρόταση είναι συνεπακόλουθη επειδή εστιάζει σε έναν επιβλητικό έλεγχο και όχι σε μια γενική έκκληση για ασφαλέστερη τεχνητή νοημοσύνη. Εάν εγκριθεί, η ανεξάρτητη επαλήθευση θα μπορούσε να απαιτήσει από τις εταιρείες να αποδείξουν ότι υπάρχουν μηχανισμοί τερματισμού λειτουργίας, ότι είναι προσβάσιμοι σε εξουσιοδοτημένα μέρη και δεν μπορούν να απενεργοποιηθούν αθόρυβα. Η πηγή δεν αναφέρει εάν κάποιο τρέχον σύστημα πληροί αυτές τις προϋποθέσεις.
Ένας διακόπτης kill δεν θα αντιμετωπίσει από μόνος του κάθε κίνδυνο AI. Η αναφορά δεν καθορίζει εάν ένας τερματισμός λειτουργίας θα μπορούσε να σταματήσει τα βάρη των αντιγραμμένων μοντέλων, τα συστήματα που λειτουργούν σε πολλούς παρόχους, τα τοπικά αναπτυγμένα μοντέλα ή τους πράκτορες που έχουν ήδη προβεί σε εξωτερικές ενέργειες. Επίσης, δεν διευκρινίζει πώς οι ρυθμιστικές αρχές θα εξισορροπήσουν την επείγουσα επέμβαση έναντι της κακής χρήσης ή των μη εξουσιοδοτημένων τερματισμών λειτουργίας.
Το ζήτημα της πολιτικής κερδίζει την προσοχή μαζί με ευρύτερα επιχειρήματα σχετικά με το εάν η ανάπτυξη της συνοριακής τεχνητής νοημοσύνης θα πρέπει να επιβραδυνθεί. Ο Κλαρκ ήταν αντίθετος με την παραμονή της τεχνητής νοημοσύνης ως «εντελώς ανεξέλεγκτη βιομηχανία», αλλά το BBC αναφέρει ότι δεν έχει συμφωνηθεί η θέση του κλάδου, η κυβερνητική δέσμευση, το χρονοδιάγραμμα υλοποίησης, η εκτίμηση κόστους ή η απόδειξη ότι η νομοθεσία θα προχωρήσει.
Διαδραστικός Μηχανισμός: Πώς λειτουργεί στην πραγματικότητα
Εξερευνήστε την υποκείμενη τεχνολογία πίσω από αυτήν την εξέλιξη διαδραστικά.
crm_get_transaction(id='4092').Why can ethical evaluation not be reduced to one model score?
Τι να παρακολουθήσετε στη συνέχεια
Οι επόμενες σημαντικές εξελίξεις θα είναι συγκεκριμένη νομοθετική γλώσσα, τεχνικά πρότυπα για επαλήθευση και στοιχεία σχετικά με τον τρόπο με τον οποίο λειτουργούν οι έλεγχοι τερματισμού λειτουργίας σε ρεαλιστικές δοκιμές. Δεν είναι επίσης σαφές εάν οι υπεύθυνοι χάραξης πολιτικής θα εφαρμόσουν τέτοιες απαιτήσεις σε προγραμματιστές μοντέλων, προγραμματιστές, παρόχους cloud ή και στους τρεις.
Παρακολουθήστε το κείμενο και την πρόοδο του προτεινόμενου νόμου Kill Switch των ΗΠΑ, συμπεριλαμβανομένων των συστημάτων που θα κάλυπτε και ποιες υπηρεσίες θα μπορούσαν να διατάξουν τερματισμό λειτουργίας. Η πηγή δεν αποδεικνύει ότι το νομοσχέδιο έχει ψηφιστεί ή ότι παρόμοιοι κανόνες υπάρχουν αλλού.
Τα τεχνικά πρότυπα θα έχουν μεγαλύτερη σημασία από την ετικέτα "διακόπτης σκοτώματος". Χρήσιμες λεπτομέρειες θα περιλαμβάνουν ανεξάρτητες δοκιμές, έλεγχο ταυτότητας της αρχής τερματισμού λειτουργίας, προστασίες από παραβίαση, χρόνους απόκρισης, αρχεία ελέγχου και πώς λειτουργούν τα στοιχεία ελέγχου όταν τα συστήματα διανέμονται σε παρόχους cloud ή συνδεδεμένα εργαλεία.
Οι γνωστοποιήσεις του ίδιου του Anthropic θα μπορούσαν να διευκρινίσουν ποιους ελέγχους χρησιμοποιεί επί του παρόντος, ποιες απειλές αντιμετωπίζει και εάν οι εξωτερικοί αξιολογητές τους έχουν δοκιμάσει. Καμία τέτοια τεκμηρίωση ή αποτέλεσμα δοκιμής δεν παρέχεται στην αναφορά του BBC.
Η έκθεση συνδέει τις παρατηρήσεις του Clark με μια ευρύτερη συζήτηση για την ασφάλεια, αλλά δεν επιβεβαιώνει ανεξάρτητα τους ισχυρισμούς ότι η τεχνητή νοημοσύνη θα μπορούσε να σκοτώσει όλους τους ανθρώπους ή να καθορίσει τις πιθανότητες που αναφέρουν οι ερευνητές του Anthropic. Αυτές οι εκτιμήσεις κινδύνου παραμένουν αμφισβητούμενες και δεν θα πρέπει να αντιμετωπίζονται ως πορίσματα αυτής της έκθεσης.