Ενημερώνεται καθημερινά1982 επαληθευμένες ιστορίες

AI News. Χωρίς τον θόρυβο.

Η κάλυψη της τεχνητής νοημοσύνης ελεγμένης πηγής για την κυκλοφορία προϊόντων, τις αλλαγές πολιτικής, την έρευνα για την ασφάλεια και τις κινήσεις της βιομηχανίας, που εξηγείται σε απλά αγγλικά από μια μη κερδοσκοπική εκπαιδευτική ομάδα.

Αρχείο ειδήσεων

Αρχείο ειδήσεων AI — Σελίδα 164

Ιστορίες τεχνητής νοημοσύνης ελεγμένες από πηγές, πρώτα οι νεότερες, για άτομα που πρέπει να κατανοήσουν την τεχνητή νοημοσύνη χωρίς να κυνηγούν τη διαφημιστική εκστρατεία.

Source-provided image accompanying Benchmark Says Top Multimodal Models Score Under 10% at Reading Words From Pen Sounds and Hand MotionΚορυφαία ιστορίαΚαινοτομία7 min διαβάστε

Το σημείο αναφοράς λέει ότι τα κορυφαία πολυτροπικά μοντέλα έχουν βαθμολογία κάτω από 10% στην ανάγνωση λέξεων από ήχους στυλό και κίνηση χεριών

Ένα νέο χαρτί arXiv εισάγει μια δοκιμή στην οποία τα μοντέλα πρέπει να συνάγουν μια γραπτή λέξη από ήχο με στυλό και βίντεο κίνησης με το χέρι, χωρίς να φαίνεται μελάνι. Οι συγγραφείς αναφέρουν ότι οι άνθρωποι με ακρίβεια διατεταγμένων γραμμάτων άνω του 80% και τα κορυφαία μοντέλα κάτω από 10% — και ότι η παροχή και των δύο τρόπων στα μοντέλα συχνά έκανε τα αποτελέσματα χειρότερα.Διαβάστε ιστορίαΕπαληθευμένη πηγή: arxiv.org

Επαληθευμένη προμήθεια

Κάθε ιστορία συνδέεται με τα ισχυρότερα διαθέσιμα στοιχεία: αρχικές πηγές όταν είναι διαθέσιμες, διαφορετικά αποδίδονται σαφώς αναφορές.

Απλά αγγλικά

Τι συνέβη, γιατί έχει σημασία και τι να παρακολουθήσετε — χωρίς την ορολογία.

Χωρίς πληρωτικό

Όταν το σήμα είναι λεπτό, δεν δημοσιεύουμε τίποτα αντί να συμπληρώνουμε τη ροή.

9 ιστορίες
  1. ΚαινοτομίαΚαινοτομία7 min διαβάστε

    Μελέτη αναπαραγωγής λέει ότι τα FLOP εξακολουθούν να προβλέπουν λάθος χρόνο εκτέλεσης AI και η προτεινόμενη επιδιόρθωση αποτυγχάνει σε νεότερο υλικό

    Μια προεκτύπωση από δύο ερευνητές αναπαράγει μια προηγούμενη μελέτη σχετικά με το γιατί ίσες μετρήσεις FLOP δεν σημαίνουν ίσο χρόνο εκτέλεσης. Επιβεβαιώνει τον υποκείμενο ισχυρισμό, αλλά αναφέρει ότι ο τύπος διόρθωσης α-FLOPs γενικά υποτιμά το χρόνο εκτέλεσης σε νεότερο υλικό, το οποίο εμφανίζει άλματα και ταλαντώσεις που ο τύπος δεν καταγράφει.arxiv.org
  2. ΕπιχείρησηΕπιχείρηση6 min διαβάστε

    Το έγγραφο συγκριτικής αξιολόγησης βρίσκει τέσσερις τρόπους αναζήτησης δεδομένων επιχείρησης με LLMs Όλα Βαθμολογία κάτω από 26%

    Μια νέα προεκτύπωση arXiv φέρνει τέσσερις αρχιτεκτονικές για αναζήτηση σε φυσική γλώσσα εταιρικών βάσεων δεδομένων μεταξύ τους σε ένα συνθετικό δίγλωσσο σημείο αναφοράς. Καμία δεν απάντησε σωστά πάνω από το ένα τέταρτο των περιπτώσεων και το σχέδιο που σημείωσε την υψηλότερη βαθμολογία δεν ήταν το ασφαλέστερο ή το φθηνότερο.arxiv.org
  3. ΚαινοτομίαΚαινοτομία7 min διαβάστε

    Το Paper προτείνει βαθμολόγηση αντιπροσώπων ασφαλείας AI χωρίς ετικέτες με τη μέτρηση της σύγκλισης σε ένα ισχυρότερο μοντέλο

    Μια νέα προεκτύπωση του arXiv υποστηρίζει ότι οι ομάδες ασφαλείας μπορούν να κρίνουν εάν ένας πράκτορας τεχνητής νοημοσύνης εξοπλισμένος με μνήμη ή ανάκτηση μαθαίνει μετρώντας πόσο κλείνει το χάσμα σε ένα ισχυρότερο μοντέλο «δασκάλου» και όχι σε επισημασμένα σημεία αναφοράς που είναι συχνά σπάνια ή μπαγιάτικα. Κρίνοντας από ένα μοντέλο παρόμοιας ισχύος δεν έδωσε κανένα χρησιμοποιήσιμο σήμα.arxiv.org
  4. ΚαινοτομίαΚαινοτομία7 min διαβάστε

    Νέες δοκιμές συγκριτικής αξιολόγησης αν οι Βοηθοί AI μπορούν να θυμούνται ένα έτος χρήσης τηλεφώνου

    Μια τεχνική έκθεση 17 συντακτών που δημοσιεύτηκε στο arXiv παρουσιάζει το MobileMem, ένα σημείο αναφοράς και ένα πλαίσιο για τη μακροπρόθεσμη μνήμη στη συσκευή, που δημιουργήθηκε από μια συλλογή εμπειριών κινητής τηλεφωνίας σε κλίμακα έτους. Η περίληψη περιγράφει το σχέδιο, αλλά δεν αναφέρει βαθμολογίες και οι βασικές λεπτομέρειες σχετικά με τα υποκείμενα δεδομένα παραμένουν άγνωστες.arxiv.org
  5. ΚαινοτομίαΚαινοτομία7 min διαβάστε

    Αναφορές σε έντυπη μορφή Αρθρωτής οργάνωσης που μοιάζει με εγκέφαλο που αναδύεται μέσα σε μεγάλα γλωσσικά μοντέλα

    Μια νέα προεκτύπωση του arXiv λέει ότι τα μεγάλα γλωσσικά μοντέλα αναπτύσσουν λειτουργικά εξειδικευμένη εσωτερική δομή που ευθυγραμμίζεται με διαφορετικά δίκτυα ανθρώπινου εγκεφάλου, βασισμένα σε αναλύσεις κυκλωμάτων σε 46 εργασίες σε τέσσερις γνωστικούς τομείς. Η αφηρημένη σελίδα αφήνει άγνωστες βασικές μεθοδολογικές λεπτομέρειες.arxiv.org
  6. ΚαινοτομίαΚαινοτομία7 min διαβάστε

    Paper Finds Late Layers of a Mixture-of-Experts Model Tolerate Heavy Expert masking

    Μια προεκτύπωση αναφέρει ότι η απενεργοποίηση των ειδικών χαμηλού μεγέθους στα τελευταία πέντε επίπεδα ενός μοντέλου Mixture-of-Experts 35 δισεκατομμυρίων παραμέτρων διατήρησε πολύ περισσότερα χρησιμοποιήσιμα αποτελέσματα μετάφρασης κώδικα από το να απλωθούν οι ίδιες περικοπές σε όλα τα επίπεδα. Καλύπτει ένα μοντέλο και ένα σημείο αναφοράς, και η περίληψη δεν αναφέρει ξεκάθαρη γραμμή βάσης.arxiv.org
  7. ΑσφάλειαΑσφάλεια7 min διαβάστε

    Τα σφάλματα CoreBreak επιτρέπουν στα Εργαλεία Agent να λειτουργούν χωρίς να έχει ποτέ κληθεί το μοντέλο

    Ένα ερευνητικό σημείωμα της Cloud Security Alliance περιγράφει το CoreBreak, ένα μοτίβο ελαττωμάτων στο Amazon Bedrock AgentCore, στο Agent Development Kit του Google και στα πακέτα πλεξούδας AI SDK της Vercel που επέτρεπαν στα εργαλεία να εκτελούνται χωρίς περιστροφή μοντέλου – αφήνοντας τα προστατευτικά κιγκλιδώματα σε επίπεδο μοντέλου.labs.cloudsecurityalliance.org

Μία χρήσιμη ενημέρωση κάθε εβδομάδα

Συνεχίστε με την τεχνητή νοημοσύνη χωρίς να ζείτε στη ροή.

Λάβετε επαληθευμένες ειδήσεις τεχνητής νοημοσύνης της εβδομάδας, πρωτότυπα δεδομένα, χρήσιμα εργαλεία, επιλογές εκμάθησης και νέες θέσεις εργασίας AI.

Send me
One email a week. Switch any time.

Προσεγγίστε άτομα που μαθαίνουν AI

Να προσλάβετε έναν επαγγελματία τεχνητής νοημοσύνης ή να λανσάρετε ένα χρήσιμο προϊόν τεχνητής νοημοσύνης; Βάλτε το μπροστά σε ανθρώπους που ήρθαν εδώ για να μάθουν και να δράσουν.

Δημοσιεύστε μια εργασία AIΥποβάλετε ένα εργαλείο AI