Актуализира се ежедневно2000 проверени истории
AI новини. Без шума.
Проверено от източници AI покритие на пускането на продукти, промените в политиките, изследванията на безопасността и индустриалните ходове, обяснено на ясен език от образователен екип на неправителствена организация.
Потвърден източник
Всяка история се свързва с най-силните налични доказателства: оригинални източници, когато са налични, иначе ясно приписани доклади.
Обикновен английски
Какво се случи, защо има значение и какво да гледаме - без жаргон.
Без пълнител
Когато сигналът е слаб, ние не публикуваме нищо, вместо да допълваме емисията.
Още истории
9 историиИновация
Study maps 46 language models built for Portuguese
A systematic mapping study catalogs 46 Portuguese language models and compares architectures, training resources, licensing, code, data, and weights. The authors say the field is growing but difficult to assess because information is spread across papers, technical reports, repositories, and project documentation.arxiv.orgИновация
Interpretability study links Qwen3-4B’s overconfident answers to a certainty-biased mechanism
An arXiv study reports that Qwen3-4B favors certainty over uncertainty in controlled reasoning tasks and identifies model features that may drive the imbalance. The authors say targeted interventions reduced overconfident errors, but the abstract does not disclose effect sizes or testing details.arxiv.orgИновация
The Deontic Gap: Large Language Models and the Modal Language of Obligation
Modal auxiliaries such as must, should, and have to mark necessity and obligation within the contexts of speaker authority and interpersonal stance.arxiv.orgСигурност
Paper proposes obscuring refusal signals to resist abliteration attacks
An arXiv preprint introduces a weight-editing method intended to make safety refusals harder to extract and remove. The paper reports stronger post-abliteration refusal scores on two open models, with different tradeoffs in general-purpose performance.arxiv.orgИновация
Хартията съобщава за временен метод за откриване на халюцинации на ниво символ
Предпринт arXiv описва детектор на халюцинации, който съчетава текстови статистики, сигнали за включване и изненада на езиков модел в последователности, вместо да преценява токените независимо. Неговият модел BiGRU достигна AUC от 0,840 на RAGTruth, според вестника.arxiv.orgИновация
Entity tracking emerges at 410 million parameters, exceeds humans across naturalistic narratives
Understanding language requires tracking entities across discourse - i.e., knowing where things are and how they change, even when not explicitly stated.arxiv.orgИновация
Paper reports compiler-guided search improves Lean theorem-proving efficiency
An arXiv preprint proposes an adaptive proof-search method for context-dependent Lean 4 projects. Its authors report a 12.8-percentage-point average pass-rate improvement within a pass@32 budget while using 21.9% fewer LLM calls than pass@k baselines.arxiv.orgИновация
Benchmark разделя решаването на геометрия от конструирането на диаграма
Нов бенчмарк с отворен код тества дали моделите на основата могат да конструират верни геометрични диаграми, а не само да разрешават основните проблеми. Неговите автори съобщават, че оценените модели са постигнали среден процент на успех при компилиране от 36,14%, разкривайки празнина между математическите отговори и използваемите визуални конструкции.arxiv.orgИновация
Подравняването е всичко, от което се нуждаете: Обучение без инструкции за общи модели на аудио език
Нов подход към обучението на мултимодални големи езикови модели (MLLM) елиминира необходимостта от обширен надзор, специфичен за задачата.arxiv.org
Един полезен брифинг всяка седмица
Поддържайте изкуствения интелект, без да живеете в потока.
Получете потвърдените новини за AI за седмицата, оригинални данни, полезни инструменти, учебни предложения и нови AI работни места.
Достигнете до хора, които учат AI
Наемане на AI професионалист или пускане на полезен AI продукт? Представете го пред хора, които са дошли тук, за да учат и действат.
Публикувайте работа за AIИзпратете AI инструмент