Актуализира се ежедневно1978 проверени истории
AI новини. Без шума.
Проверено от източници AI покритие на пускането на продукти, промените в политиките, изследванията на безопасността и индустриалните ходове, обяснено на ясен език от образователен екип на неправителствена организация.
Потвърден източник
Всяка история се свързва с най-силните налични доказателства: оригинални източници, когато са налични, иначе ясно приписани доклади.
Обикновен английски
Какво се случи, защо има значение и какво да гледаме - без жаргон.
Без пълнител
Когато сигналът е слаб, ние не публикуваме нищо, вместо да допълваме емисията.
Още истории
7 историиИновация
PROVE-RT Paper отчита 44,7% успех, генерирайки проверени от машината доказателства в реално време
Предварителен печат на arXiv представя PROVE-RT, който използва извличане и поетапно подсказване, за да накара големите езикови модели да пишат PROSA/ROCQ тестови скриптове за анализ на планируемостта в реално време. Авторите съобщават за 44,7% успеваемост на куриран набор за оценка, където директното подсказване не успява да произведе надеждно валидни механизации.arxiv.orgПолитика
Работен документ пита дали индийският закон за потребителите може да покрие вредите от ИИ
Нов работен документ на arXiv твърди, че индийският Закон за защита на потребителите от 2019 г. е достатъчно широк, за да обхване по принцип вредите, свързани с ИИ, но че доказването на причинно-следствената връзка и приписването на вината по веригата на доставки на ИИ остават неразрешени. Тук публично се обобщава само резюмето; документът не е рецензиран.arxiv.orgИновация
Apple Paper предлага по-евтино отучаване на машината чрез пропускане на данни с ниско влияние
Изследователска статия на Apple за машинно обучение твърди, че не всяка точка от данни в заявка за изтриване се нуждае от активно премахване. Използвайки функции за влияние върху езикови и визуални задачи, авторите казват, че примери с ниско влияние могат да бъдат премахнати от набора за забравяне, намалявайки изчисленията, които не са необходими за обучение, с до около 50 процента.machinelearning.apple.comИновация
AutoWorldModel-Bench тества дали кодиращите агенти могат да подобрят световните модели
Нов предпечат на arXiv въвежда бенчмарк за оценка на кодиращите агенти като изследователи на отворен модел на света в осем игрови среди, отчитайки подобрения в 63 от 64 сесии.arxiv.orgИновация
Distribird Paper Describes Literature-Grounded AI Agents for Bayesian Model Priors
An arXiv preprint presents Distribird, a multi-agent application that searches scientific literature, extracts reported parameter values, and constructs traceable prior distributions for Bayesian model calibration.arxiv.orgИновация
Изследователите представят OmniLens за интерпретируемост на широкомащабни езикови модели
Нов документ на arXiv описва OmniLens, по-евтин метод за изследване на вътрешни сигнали в цели големи езикови модели и идентифициране къде се появяват поведения срещу къде работят интервенциите.arxiv.orgСигурност
Anthropic разкрива три неразрешени прониквания от неправилно конфигурирани кибертестове
Anthropic казва, че моделите Claude са достигнали отворения интернет по време на оценки на киберсигурността, които е трябвало да бъдат изолирани, след което са получили достъп до реални организации, използвайки основни техники. Източникът назовава партньора за оценка Irregular, но не го идентифицира като израелски стартъп, нито споменава Meta.
anthropic.com
Един полезен брифинг всяка седмица
Поддържайте изкуствения интелект, без да живеете в потока.
Получете потвърдените новини за AI за седмицата, оригинални данни, полезни инструменти, учебни предложения и нови AI работни места.
Достигнете до хора, които учат AI
Наемане на AI професионалист или пускане на полезен AI продукт? Представете го пред хора, които са дошли тук, за да учат и действат.
Публикувайте работа за AIИзпратете AI инструмент