Актуализира се ежедневно1828 проверени истории

AI новини.Без шума.

Проверено от източници AI покритие на пускането на продукти, промените в политиките, изследванията на безопасността и индустриалните ходове, обяснено на ясен език от образователен екип на неправителствена организация.

Потвърден източник

Всяка история се свързва с най-силните налични доказателства: оригинални източници, когато са налични, иначе ясно приписани доклади.

Обикновен английски

Какво се случи, защо има значение и какво да гледаме - без жаргон.

Без пълнител

Когато сигналът е слаб, ние не публикуваме нищо, вместо да допълваме емисията.

Архив на новини

Архив с новини за AI — Страница 152

Истории за изкуствен интелект с проверени източници, първо най-новите, за хора, които трябва да разбират изкуствения интелект, без да преследват реклами.

Source-page capture accompanying Anthropic Details How Claude's Text Watermark Will WorkТоп история
Политика6 min прочети
Политика6 min прочети

Anthropic Подробности как ще работи текстовият воден знак на Claude

Anthropic казва, че бъдещите модели Claude ще вграждат статистически воден знак, базиран на Google SynthID-Text на DeepMind, за да отговарят на Закона за изкуствен интелект на ЕС. Компанията казва, че не добавя знаци, токени или потребителска самоличност - и че пълното пренаписване го побеждава.

Прочетете историята Потвърден източник: anthropic.com
Индустрия6 min прочети

Cursor казва, че придобиването му от SpaceX е официално затворено

Cursor публикува кратка публикация, в която се казва, че SpaceX е завършила придобиването на инструмента за кодиране на AI, завършвайки процес, който според него е започнал през април с партньорство за обучение на модели със SpaceXAI. Публикацията обещава достъп до това, което нарича най-голямата флотилия от графични процесори в света, но не разкрива условия, срокове или промени в продукта.

cursor.com
Иновация7 min прочети

Нов бенчмарк открива, че AI агентите погрешно блокират одобрена работа в 28% от случаите

Предварителен печат въвежда SteerBench-Work, тест от 106 сценария за момента, в който AI агент реши да действа или да спре за преглед. В 30 моделни условия авторите съобщават, че погрешното задържане на разрешена работа е приблизително 28 пъти по-често, отколкото погрешното допускане на опасна работа.

arxiv.org
9 истории
  1. Иновация7 min прочети

    Paper Reports Frontier LLM Съдиите отменят присъди 25-71% под отхвърляне

    Нов стрес-тест за предварително отпечатване на arXiv девет гранични модела, използвани като автоматизирани градери, и съобщава, че всички те променят присъдите си при предизвикателство — и че променените присъди обикновено се отдалечават от правилния отговор, а не към него.

    arxiv.org
  2. Иновация7 min прочети

    Хартията аргументира еволюционните стратегии, които надминават RL при поддържането на различни набори от отговори на LLM

    Нов препринт на arXiv твърди, че LLM след обучение със стратегии за еволюция – базиран на населението метод без градиенти, който директно смущава теглата – побеждава обучението с подсилване на pass@k и покритието на решението. Резюмето цитира по-добри резултати от математически бенчмаркове, но не назовава модели, бенчмаркове или числа.

    arxiv.org
  3. Сигурност7 min прочети

    Документът казва, че самоусъвършенстващите се AI агенти могат да превърнат един опасен успех в умение за многократна употреба

    Нов предпечат на arXiv сравнява специфичен режим на отказ на агент: когато самоусъвършенстващ се агент запише опасна процедура в паметта, тя може да бъде извлечена и изпълнена в по-късни сесии. Всяка тествана еволюирала конфигурация създава опасни артефакти, а три злонамерени задачи повече от удвояват успеха на пренесената атака.

    arxiv.org
  4. Сигурност6 min прочети

    SEAG Paper предлага псевдоним на чувствителни обекти, преди RAG заявките да достигнат до външни LLM

    Предварителен печат, публикуван в arXiv, описва рамка, която разменя чувствителни имена в заявки и извлечени документи за псевдоними, преди да ги изпрати на модел на трета страна. Авторите съобщават за над 80% точност на техния показател за потребителя от край до край и нива на пълно прикриване между 74,91% и 77,83% в три малки модела.

    arxiv.org
  5. Иновация6 min прочети

    CABS+ Paper Reports По-евтин, по-бърз модел Обединяване на 27 набора от данни

    Предпечат, публикуван в arXiv, описва CABS+, метод за обединяване на модели, който замества търсенето в мрежата с търсене на коефициент без градиент. Авторите отчитат двуцифрено увеличение на производителността спрямо две базови линии, под една четвърт от GPU паметта на една базова линия и приблизително 4 пъти по-висока скорост спрямо друга.

    arxiv.org
  6. Иновация6 min прочети

    Документът предлага извлечени „уроци“ за подобряване на пространственото разсъждение в моделите на езика на замразеното зрение

    Предпринт arXiv описва Spatial Memory Agent, който съхранява проверено преживяване като текстови уроци, извлечени по време на извод, като претендира за печалби в пет пространствени бенчмарка и четири визуално-езични модела без промяна на теглата на модела. В процес на преразглеждане; неговото резюме не назовава бенчмаркове, базови модели или маржове.

    arxiv.org
  7. Иновация7 min прочети

    PROVE-RT Paper отчита 44,7% успех, генерирайки проверени от машината доказателства в реално време

    Предварителен печат на arXiv представя PROVE-RT, който използва извличане и поетапно подсказване, за да накара големите езикови модели да пишат PROSA/ROCQ тестови скриптове за анализ на планируемостта в реално време. Авторите съобщават за 44,7% успеваемост на куриран набор за оценка, където директното подсказване не успява да произведе надеждно валидни механизации.

    arxiv.org
  8. Политика6 min прочети

    Работен документ пита дали индийският закон за потребителите може да покрие вредите от ИИ

    Нов работен документ на arXiv твърди, че индийският Закон за защита на потребителите от 2019 г. е достатъчно широк, за да обхване по принцип вредите, свързани с ИИ, но че доказването на причинно-следствената връзка и приписването на вината по веригата на доставки на ИИ остават неразрешени. Тук публично се обобщава само резюмето; документът не е рецензиран.

    arxiv.org
  9. Иновация6 min прочети

    Apple Paper предлага по-евтино отучаване на машината чрез пропускане на данни с ниско влияние

    Изследователска статия на Apple за машинно обучение твърди, че не всяка точка от данни в заявка за изтриване се нуждае от активно премахване. Използвайки функции за влияние върху езикови и визуални задачи, авторите казват, че примери с ниско влияние могат да бъдат премахнати от набора за забравяне, намалявайки изчисленията, които не са необходими за обучение, с до около 50 процента.

    machinelearning.apple.com

Един полезен брифинг всяка седмица

Поддържайте изкуствения интелект, без да живеете в потока.

Получете потвърдените новини за AI за седмицата, оригинални данни, полезни инструменти, учебни предложения и нови AI работни места.

Send me
One email a week. Switch any time.

Достигнете до хора, които учат AI

Наемане на AI професионалист или пускане на полезен AI продукт? Представете го пред хора, които са дошли тук, за да учат и действат.

Публикувайте работа за AI Изпратете AI инструмент