Επιστροφή στις Ειδήσεις
πολιτικήAI Understanding ενημέρωση

Ο συνιδρυτής του Anthropic λέει ότι οι διακόπτες θανάτωσης AI μπορεί να χρειαστεί να είναι υποχρεωτικοί

Ο συνιδρυτής του Anthropic, Τζακ Κλαρκ, δήλωσε στο BBC ότι οι κυβερνήσεις μπορεί τελικά να χρειαστεί να απαιτήσουν από τις εταιρείες τεχνητής νοημοσύνης να διατηρούν ανεξάρτητα επαληθεύσιμους τρόπους για να τερματίσουν τα επικίνδυνα συστήματα.

4 min readRead the original reporting
Source-provided image accompanying Anthropic co-founder says AI kill switches may need to be mandatory
Αναφορά που αποδίδεταιΗ πηγή καταγράφηκε
Εκδότης
bbc.com
Σύνδεσμος πηγής
bbc.comhttps://www.bbc.com/news/articles/cqgk5e2j0gg8o
Τύπος πηγής
Αναφορά από ειδησεογραφικό μέσο — όχι έγγραφο πρώτου μέρους.

Αυτό που δεν μπορέσαμε να επιβεβαιώσουμε ανεξάρτητα: Αυτός ο ισχυρισμός αποδίδεται στο ονομαζόμενο κατάστημα. Δεν το επαληθεύσαμε με έγγραφο πρώτου μέρους. (bbc.com)

ΠλαίσιοΚαταλάβετε αυτό σε 60 δευτερόλεπτα

Ξεκινήστε εδώ

Δοκιμάστε τον εαυτό σαςΚουίζ ηθικής AI

Τι έγινε

Σύμφωνα με το BBC, ο συνιδρυτής του Anthropic, Τζακ Κλαρκ, δήλωσε ότι οι εταιρείες μπορεί τελικά να χρειαστεί να διατηρούν «διακόπτες εξόντωσης» της τεχνητής νοημοσύνης που μπορούν να ελεγχθούν από ανεξάρτητους τρίτους. Ο Κλαρκ είπε ότι τα περισσότερα εργαστήρια τεχνητής νοημοσύνης, συμπεριλαμβανομένου του Anthropic, έχουν ήδη τρόπους να τερματίσουν τα συστήματα, αλλά δεν περιέγραψε τον τεχνικό σχεδιασμό τους ούτε παρείχε στοιχεία ανεξάρτητης επαλήθευσης.

Το BBC αναφέρει ότι ο Jack Clark, ένας από τους επτά ιδρυτές του Anthropic, είπε ότι η κοινωνία μπορεί τελικά να θέλει κανόνες που να απαιτούν από τις εταιρείες τεχνητής νοημοσύνης να έχουν έναν τρόπο να απενεργοποιούν εντελώς το λογισμικό εάν αυτό γίνει πολύ επικίνδυνο. Πραγματοποίησε το θέμα ως μέρος μιας ευρύτερης συζήτησης πολιτικής αντί να ανακοινώσει ένα νέο προϊόν ή πολιτική Anthropic.

Ο Clark είπε στο BBC ότι «τα περισσότερα εργαστήρια έχουν διαφορετικούς τρόπους για να μπορούν να τραβήξουν την πρίζα», συμπεριλαμβανομένου του Anthropic. Αναρωτήθηκε συγκεκριμένα εάν οι εταιρείες θα πρέπει να υποχρεωθούν να διαθέτουν διακόπτη kill και εάν αυτός ο διακόπτης θα πρέπει να είναι επαληθεύσιμος από τρίτο μέρος. Η αναφορά δεν παρέχει τεχνική περιγραφή των ελέγχων του Anthropic, καμία ανεξάρτητη αξιολόγηση και κανένα προτεινόμενο πρότυπο επαλήθευσης.

Τα σχόλια έγιναν εν μέσω ανανεωμένης δημόσιας συζήτησης σχετικά με καταστροφικούς κινδύνους τεχνητής νοημοσύνης και αφού ο διευθύνων σύμβουλος της Anthropic, Dario Amodei, ζήτησε να επιβραδυνθεί ο ρυθμός ανάπτυξης της τεχνητής νοημοσύνης και να παρακολουθείται στενότερα η ανάπτυξη. Το BBC σημειώνει επίσης ότι οι αμερικανοί νομοθέτες έχουν προτείνει έναν νόμο Kill Switch που θα απαιτούσε τρόπους για να κλείσουν προβληματικά εργαλεία τεχνητής νοημοσύνης και να δώσει σε ορισμένες κυβερνητικές υπηρεσίες την εξουσία να απαιτούν την απενεργοποίηση ή τον περιορισμό των εργαλείων.

Η έκθεση αναφέρει ότι ο πρόεδρος των ΗΠΑ Ντόναλντ Τραμπ έχει απορρίψει τις προσπάθειες επιβράδυνσης της ανάπτυξης της τεχνητής νοημοσύνης. Σημειώνει επίσης ότι ορισμένα στοιχεία του κλάδου πιστεύουν ότι οι φόβοι για την εξαφάνιση του ανθρώπου από την τεχνητή νοημοσύνη είναι υπερεκτιμημένοι ή μπορεί να έχουν σκοπό να δημιουργήσουν διαφημιστική εκστρατεία. Αυτές οι αντιδράσεις παρέχουν το πλαίσιο, αλλά η έκθεση του BBC δεν επιλύει τα υποκείμενα τεχνικά ή πολιτικά ερωτήματα.

Στοιχεία πηγής: bbc.com ↗

Γιατί έχει σημασία

Ένας υποχρεωτικός, ανεξάρτητα επαληθευμένος μηχανισμός τερματισμού λειτουργίας θα μετέτρεπε μια σε μεγάλο βαθμό εσωτερική πρακτική ασφάλειας σε πιθανή ρυθμιστική απαίτηση. Η πρόταση εξετάζει ένα πρακτικό ερώτημα σχετικά με τον έλεγχο σε όλο και πιο ικανά συστήματα AI, αλλά η έκθεση δεν καθορίζει εάν οι υπάρχοντες διακόπτες kill θα λειτουργούσαν ενάντια σε κάθε τρόπο αποτυχίας, πόσο γρήγορα θα μπορούσαν να λειτουργήσουν ή ποιος θα είχε την εξουσία να τους ενεργοποιήσει.

Η πρόταση είναι συνεπακόλουθη επειδή εστιάζει σε έναν επιβλητικό έλεγχο και όχι σε μια γενική έκκληση για ασφαλέστερη τεχνητή νοημοσύνη. Εάν εγκριθεί, η ανεξάρτητη επαλήθευση θα μπορούσε να απαιτήσει από τις εταιρείες να αποδείξουν ότι υπάρχουν μηχανισμοί τερματισμού λειτουργίας, ότι είναι προσβάσιμοι σε εξουσιοδοτημένα μέρη και δεν μπορούν να απενεργοποιηθούν αθόρυβα. Η πηγή δεν αναφέρει εάν κάποιο τρέχον σύστημα πληροί αυτές τις προϋποθέσεις.

Ένας διακόπτης kill δεν θα αντιμετωπίσει από μόνος του κάθε κίνδυνο AI. Η αναφορά δεν καθορίζει εάν ένας τερματισμός λειτουργίας θα μπορούσε να σταματήσει τα βάρη των αντιγραμμένων μοντέλων, τα συστήματα που λειτουργούν σε πολλούς παρόχους, τα τοπικά αναπτυγμένα μοντέλα ή τους πράκτορες που έχουν ήδη προβεί σε εξωτερικές ενέργειες. Επίσης, δεν διευκρινίζει πώς οι ρυθμιστικές αρχές θα εξισορροπήσουν την επείγουσα επέμβαση έναντι της κακής χρήσης ή των μη εξουσιοδοτημένων τερματισμών λειτουργίας.

Το ζήτημα της πολιτικής κερδίζει την προσοχή μαζί με ευρύτερα επιχειρήματα σχετικά με το εάν η ανάπτυξη της συνοριακής τεχνητής νοημοσύνης θα πρέπει να επιβραδυνθεί. Ο Κλαρκ ήταν αντίθετος με την παραμονή της τεχνητής νοημοσύνης ως «εντελώς ανεξέλεγκτη βιομηχανία», αλλά το BBC αναφέρει ότι δεν έχει συμφωνηθεί η θέση του κλάδου, η κυβερνητική δέσμευση, το χρονοδιάγραμμα υλοποίησης, η εκτίμηση κόστους ή η απόδειξη ότι η νομοθεσία θα προχωρήσει.

Interactive Mechanism

Διαδραστικός Μηχανισμός: Πώς λειτουργεί στην πραγματικότητα

Εξερευνήστε την υποκείμενη τεχνολογία πίσω από αυτήν την εξέλιξη διαδραστικά.

Agent Lifecycle Stage:
1
User Intent & Planning: "Audit customer refund request #4092 and settle payment."
2
Tool Calling: Emits structured JSON call crm_get_transaction(id='4092').
3
Guardrail & Verification:🛡️ Paused: High-value action requires human operator sign-off.
4
Final Settlement: Refund recorded, email receipt dispatched, and audit log stored.
Core takeaway: An AI agent is not just a language model—it is a closed loop of planning, tool invocation, and environment feedback. Production systems require self-healing retries and strict human approval guardrails.
Διαδραστικός Έλεγχος Έννοιας+10 Points
AI Ethics Quiz

Why can ethical evaluation not be reduced to one model score?

Τι να παρακολουθήσετε στη συνέχεια

Οι επόμενες σημαντικές εξελίξεις θα είναι συγκεκριμένη νομοθετική γλώσσα, τεχνικά πρότυπα για επαλήθευση και στοιχεία σχετικά με τον τρόπο με τον οποίο λειτουργούν οι έλεγχοι τερματισμού λειτουργίας σε ρεαλιστικές δοκιμές. Δεν είναι επίσης σαφές εάν οι υπεύθυνοι χάραξης πολιτικής θα εφαρμόσουν τέτοιες απαιτήσεις σε προγραμματιστές μοντέλων, προγραμματιστές, παρόχους cloud ή και στους τρεις.

Παρακολουθήστε το κείμενο και την πρόοδο του προτεινόμενου νόμου Kill Switch των ΗΠΑ, συμπεριλαμβανομένων των συστημάτων που θα κάλυπτε και ποιες υπηρεσίες θα μπορούσαν να διατάξουν τερματισμό λειτουργίας. Η πηγή δεν αποδεικνύει ότι το νομοσχέδιο έχει ψηφιστεί ή ότι παρόμοιοι κανόνες υπάρχουν αλλού.

Τα τεχνικά πρότυπα θα έχουν μεγαλύτερη σημασία από την ετικέτα "διακόπτης σκοτώματος". Χρήσιμες λεπτομέρειες θα περιλαμβάνουν ανεξάρτητες δοκιμές, έλεγχο ταυτότητας της αρχής τερματισμού λειτουργίας, προστασίες από παραβίαση, χρόνους απόκρισης, αρχεία ελέγχου και πώς λειτουργούν τα στοιχεία ελέγχου όταν τα συστήματα διανέμονται σε παρόχους cloud ή συνδεδεμένα εργαλεία.

Οι γνωστοποιήσεις του ίδιου του Anthropic θα μπορούσαν να διευκρινίσουν ποιους ελέγχους χρησιμοποιεί επί του παρόντος, ποιες απειλές αντιμετωπίζει και εάν οι εξωτερικοί αξιολογητές τους έχουν δοκιμάσει. Καμία τέτοια τεκμηρίωση ή αποτέλεσμα δοκιμής δεν παρέχεται στην αναφορά του BBC.

Η έκθεση συνδέει τις παρατηρήσεις του Clark με μια ευρύτερη συζήτηση για την ασφάλεια, αλλά δεν επιβεβαιώνει ανεξάρτητα τους ισχυρισμούς ότι η τεχνητή νοημοσύνη θα μπορούσε να σκοτώσει όλους τους ανθρώπους ή να καθορίσει τις πιθανότητες που αναφέρουν οι ερευνητές του Anthropic. Αυτές οι εκτιμήσεις κινδύνου παραμένουν αμφισβητούμενες και δεν θα πρέπει να αντιμετωπίζονται ως πορίσματα αυτής της έκθεσης.

Σχετικοί οδηγοί και κουίζ

Ηθική του AIΠράκτορες AIΕπεξήγηση μοντέλων AIΔοκιμάστε τι γνωρίζετε — δοκιμάστε ένα δωρεάν κουίζ AIΑναζητήστε έναν όρο AI στο γλωσσάρι μαςΑκολουθήστε το πρόγραμμα παρακολούθησης ρυθμίσεων AI
Βρήκατε αυτό χρήσιμο;