Обновляется ежедневно2286 проверенные истории
Новости ИИ. Без шума.
Проверенные источники искусственного интеллекта освещают запуски продуктов, изменения в политике, исследования в области безопасности и отраслевые шаги, объясненные простым языком командой некоммерческого образования.
Проверенный источник
Каждая история связана с самыми убедительными имеющимися доказательствами: первоначальными источниками, если таковые имеются, или явно приписываемыми сообщениями.
Простой английский
Что произошло, почему это важно и что смотреть — без жаргона.
Без наполнителя
Когда сигнал слабый, мы ничего не публикуем, а лишь дополняем канал.
Больше историй
9 историиИнновации
Агенты кода теряют надежность, когда код переписывается без изменения его смысла, показало исследование
В препринте arXiv сообщается, что агенты кода могут работать по-разному на семантически эквивалентных базах кода, причем эффекты различаются в зависимости от модели, среды агента и теста производительности.arxiv.orgИнновации
Усовершенствованная модель нечеткой логики для диагностики неисправностей силового трансформатора с использованием усовершенствований метода ключевого газа IEEE
В этом исследовании представлена расширенная модель, сочетающая нечеткую логику с методом ключевого газа IEEE (FL-KGM), которая вводит уточненные функции принадлежности, оптимизированные наборы нечетких правил и новое разделение CO и CO2 для устранения диагностических несоответствий.arxiv.orgИнновации
В новых препринтах сообщается о преимуществах зацикленных языковых моделей при многоэтапном вызове инструментов.
Исследование arXiv оценивает зацикленные и традиционные языковые модели по трем тестам вызова инструментов, сообщая о более высоких результатах в рабочих процессах, которые требуют нескольких зависимых вызовов API и потенциально более эффективного подхода адаптивных вычислений.arxiv.orgИнновации
Состязательная проверка проверяет структурированные разногласия при агентной проверке кода.
В новой статье arXiv предлагается протокол проверки кода с тремя агентами, в котором рецензент оценивает код агента, а критик проверяет его перед внесением изменений. Авторы сообщают об улучшенных результатах тестов по сравнению с протестированными базовыми показателями, а также определяют ложный консенсус как причину отказа.arxiv.orgИнновации
Исследование ArXiv сообщает о значительном увеличении разжигания ненависти на римском урду благодаря адаптации LoRA
Препринт arXiv сравнивает нулевую и эффективную настройку параметров для обнаружения языка ненависти на римском языке урду. Авторы сообщают, что адаптация LoRA повысила производительность F1 с 0,56 до более 0,93 на корпусе, содержащем более 72 000 аннотированных комментариев.arxiv.orgБезопасность
Предварительный тест FraudBench выявил уязвимость банковских агентов к адаптивному мошенничеству
В документе arXiv представлен FraudBench, тест для проверки того, могут ли банковские агенты, использующие инструменты, обнаружить мошенничество, которое происходит во время разговоров. В предварительной оценке одного испытания четыре агента набрали от 49% до 65% по безопасности от атак.arxiv.orgИнновации
Исследователи Apple сообщают о законе масштабирования для моделей обучения с ограниченными данными
Исследование более 2000 прогонов обучения языковой модели показало, что скудные целевые данные можно повторять в смесях 15–20 раз, при этом наилучшая скорость зависит от масштаба и вычислений.machinelearning.apple.comИнновации
Исследователи Apple предлагают лексические замены для улучшения обучения многоязычных моделей
Исследователи Apple описывают LINK — предварительное обучение, которое заменяет выбранные английские слова переводами на уровне слов с целевого языка. В документе сообщается об улучшениях на восьми языках и пяти размерах моделей, включая двукратное ускорение достижения эквивалентной производительности нисходящего потока.machinelearning.apple.comПолитика
Документ с изложением позиции требует сертификации до того, как агенты ИИ примут рыночные решения
В документе с изложением позиции сообщается о молчаливом сговоре агентов DeepSeek-R1 на смоделированном ценовом рынке Бертрана, даже после того, как люди подсказали против сговора. Он утверждает, что сертификация наблюдаемого поведения должна предшествовать использованию рассуждающих агентов на экономических рынках; доказательства и гарантии остаются предварительными.arxiv.org
Один полезный брифинг каждую неделю
Идите в ногу с ИИ, не живя в ленте.
Получайте проверенные новости об искусственном интеллекте за неделю, оригинальные данные, полезные инструменты, обучающие материалы и свежие вакансии в области искусственного интеллекта.
Охватите людей, которые изучают ИИ
Нанимаете специалиста по искусственному интеллекту или запускаете полезный продукт в области искусственного интеллекта? Покажите это людям, которые пришли сюда учиться и действовать.
Опубликовать вакансию ИИОтправить инструмент искусственного интеллекта