Ενημερώνεται καθημερινά2286 επαληθευμένες ιστορίες
AI News. Χωρίς τον θόρυβο.
Η κάλυψη της τεχνητής νοημοσύνης ελεγμένης πηγής για την κυκλοφορία προϊόντων, τις αλλαγές πολιτικής, την έρευνα για την ασφάλεια και τις κινήσεις της βιομηχανίας, που εξηγείται σε απλά αγγλικά από μια μη κερδοσκοπική εκπαιδευτική ομάδα.
Επαληθευμένη προμήθεια
Κάθε ιστορία συνδέεται με τα ισχυρότερα διαθέσιμα στοιχεία: αρχικές πηγές όταν είναι διαθέσιμες, διαφορετικά αποδίδονται σαφώς αναφορές.
Απλά αγγλικά
Τι συνέβη, γιατί έχει σημασία και τι να παρακολουθήσετε — χωρίς την ορολογία.
Χωρίς πληρωτικό
Όταν το σήμα είναι λεπτό, δεν δημοσιεύουμε τίποτα αντί να συμπληρώνουμε τη ροή.
Περισσότερες ιστορίες
9 ιστορίεςΚαινοτομία
Οι πράκτορες κώδικα χάνουν την αξιοπιστία τους όταν ο κώδικας ξαναγράφεται χωρίς να αλλάξει το νόημά του, διαπιστώνει η μελέτη
Μια προεκτύπωση arXiv αναφέρει ότι οι πράκτορες κώδικα μπορούν να αποδίδουν διαφορετικά σε σημασιολογικά ισοδύναμες βάσεις κώδικα, με εφέ που ποικίλλουν ανά μοντέλο, πλαίσιο πράκτορα και σημείο αναφοράς.arxiv.orgΚαινοτομία
Μοντέλο Βελτιωμένης Ασαφής Λογικής για Διάγνωση Βλαβών Μετασχηματιστή Ισχύος με χρήση Βελτιώσεων Μεθόδου Βασικού Αερίου IEEE
Αυτή η μελέτη παρουσιάζει ένα βελτιωμένο μοντέλο που συνδυάζει τη Fuzzy Logic με τη μέθοδο IEEE Key Gas Method (FL-KGM) που εισάγει εκλεπτυσμένες συναρτήσεις ιδιότητας μέλους, βελτιστοποιημένα σύνολα ασαφών κανόνων και έναν νέο διαχωρισμό CO και CO2 για την εξάλειψη των διαγνωστικών ασυνεπειών.arxiv.orgΚαινοτομία
Νέα προεκτύπωση αναφέρει κέρδη από μοντέλα γλωσσών με βρόχο στην κλήση εργαλείων πολλαπλών βημάτων
Μια μελέτη arXiv αξιολογεί κυκλικά και συμβατικά μοντέλα γλώσσας σε τρία σημεία αναφοράς κλήσης εργαλείων, αναφέροντας ισχυρότερα αποτελέσματα σε ροές εργασίας που απαιτούν πολλαπλές εξαρτημένες κλήσεις API και μια δυνητικά πιο αποτελεσματική προσαρμοστική υπολογιστική προσέγγιση.arxiv.orgΚαινοτομία
Το Adversarial Review δοκιμάζει τη δομημένη διαφωνία για την αναθεώρηση κωδικού αντιπροσώπου
Ένα νέο έγγραφο arXiv προτείνει ένα πρωτόκολλο ελέγχου κώδικα τριών παραγόντων στο οποίο ένας αναθεωρητής αξιολογεί τον κώδικα ενός πράκτορα και ένας κριτικός ελέγχει τον έλεγχο πριν από την πραγματοποίηση τροποποιήσεων. Οι συγγραφείς αναφέρουν βελτιωμένα αποτελέσματα συγκριτικής αξιολόγησης σε σχέση με τις δοκιμασμένες γραμμές βάσης, ενώ εντοπίζουν επίσης ψευδή συναίνεση ως τρόπο αποτυχίας.arxiv.orgΚαινοτομία
Η μελέτη του ArXiv αναφέρει μεγάλα κέρδη από την ομιλία μίσους στη Ρωμαϊκή Ουρντού από την προσαρμογή του LoRA
Μια προεκτύπωση arXiv συγκρίνει τη λεπτομέρεια μηδενικής λήψης και απόδοσης παραμέτρων για ανίχνευση ομιλίας μίσους στα ρωμαϊκά Ουρντού. Οι συγγραφείς αναφέρουν ότι η προσαρμογή LoRA αύξησε την απόδοση της F1 από 0,56 σε πάνω από 0,93 σε ένα σώμα που περιέχει περισσότερα από 72.000 σχολιασμένα σχόλια.arxiv.orgΑσφάλεια
Η προκαταρκτική δοκιμή FraudBench βρίσκει τους τραπεζικούς πράκτορες ευάλωτους στην προσαρμοστική απάτη
Ένα έγγραφο arXiv παρουσιάζει το FraudBench, ένα σημείο αναφοράς για τον έλεγχο του κατά πόσον οι τραπεζικοί πράκτορες που χρησιμοποιούν εργαλεία μπορούν να ανιχνεύσουν απάτη που εκτυλίσσεται στις συνομιλίες. Σε μια προκαταρκτική αξιολόγηση μιας δοκιμής, τέσσερις πράκτορες σημείωσαν 49% έως 65% στην ασφάλεια επίθεσης.arxiv.orgΚαινοτομία
Apple researchers report scaling law for training models with scarce data
A study of more than 2,000 language-model training runs says scarce target data can be repeated 15–20 times in mixtures, with the best rate varying by scale and compute.machinelearning.apple.comΚαινοτομία
Apple Researchers Propose Lexical Substitutions to Improve Multilingual Model Training
Apple researchers describe LINK, a pretraining intervention that replaces selected English words with word-level translations from a target language. The paper reports improvements across eight languages and five model sizes, including up to a twofold speedup in reaching equivalent downstream performance.machinelearning.apple.comπολιτική
Position paper calls for certification before AI agents make market decisions
A position paper reports tacit collusion by DeepSeek-R1 agents in a simulated Bertrand pricing market, even after human prompts against collusion. It argues that observed-behavior certification should precede deployment of reasoning agents in economic markets; the evidence and safeguards remain preliminary.arxiv.org
Μία χρήσιμη ενημέρωση κάθε εβδομάδα
Συνεχίστε με την τεχνητή νοημοσύνη χωρίς να ζείτε στη ροή.
Λάβετε επαληθευμένες ειδήσεις τεχνητής νοημοσύνης της εβδομάδας, πρωτότυπα δεδομένα, χρήσιμα εργαλεία, επιλογές εκμάθησης και νέες θέσεις εργασίας AI.
Προσεγγίστε άτομα που μαθαίνουν AI
Να προσλάβετε έναν επαγγελματία τεχνητής νοημοσύνης ή να λανσάρετε ένα χρήσιμο προϊόν τεχνητής νοημοσύνης; Βάλτε το μπροστά σε ανθρώπους που ήρθαν εδώ για να μάθουν και να δράσουν.
Δημοσιεύστε μια εργασία AIΥποβάλετε ένα εργαλείο AI