Актуализира се ежедневно1515 проверени истории

AI новини.Без шума.

Проверено от източници AI покритие на пускането на продукти, промените в политиките, изследванията на безопасността и индустриалните ходове, обяснено на ясен език от образователен екип на неправителствена организация.

Потвърден източник

Всяка история се свързва с най-силните налични доказателства: оригинални източници, когато са налични, иначе ясно приписани доклади.

Обикновен английски

Какво се случи, защо има значение и какво да гледате – без данък върху жаргона.

Без пълнител

Когато сигналът е слаб, ние не публикуваме нищо, вместо да допълваме емисията.

Архив на новини

Архив с новини за AI — Страница 78

Нарастващ поток от проверени гледни точки за хора, които трябва да разберат AI, без да преследват реклами.

Primary-source image accompanying Dataset scarcity weakens multilingual embedding evaluations, Slavic-language study findsТоп история
Иновация5 min прочети
Иновация5 min прочети

Недостигът на набор от данни отслабва оценките на многоезичното вграждане, установява изследване на славянски език

Нов препринт arXiv установява, че редките и корелирани набори от данни правят класирането на многоезичния модел за вграждане по-малко надеждно в славянските езици и предлага мярка за сила на доказателства за тълкуване на резултатите от бенчмарк.

Прочетете историята Потвърден източник: arxiv.org
Иновация5 min прочети

FARCA предлага обучителни сигнали, претеглени спрямо надеждността, за да се намалят фактическите грешки в езиковите модели

Нов предпечат на arXiv предлага FARCA, метод за обучение с подсилване, който присвоява фактически надзор на конкретни токени и отхвърля доказателства, оценени като ненадеждни. Авторите съобщават за подобрена фактология в множество сравнителни показатели, като същевременно запазват общи разсъждения, но източникът не предоставя числени резултати или...

arxiv.org
Продукт6 min прочети

Shadowfetch Linux 3.0 добавя Fireline контроли за AI кодиращи агенти

Linuxiac съобщава, че Shadowfetch Linux 3.0 въвежда Fireline, набор от функции за пясъчна среда, контролни точки, одит и контролирани инструменти за автономни кодиращи агенти. Източникът не проверява независимо твърденията за сигурност или производителност на системата.

linuxiac.com
9 истории
  1. Иновация5 min прочети

    Резултатите, базирани на изкуствен интелект, картографират дигитализацията в холандските работни места, се казва в предпечат

    Нов предпечат arXiv предлага базиран на изкуствен интелект метод за измерване на това доколко длъжностите и уменията са свързани с дигиталната работа. Приложен към милиони холандски работни профили, методът идентифицира неравномерна дигитализация и зависимо от пътя движение към цифрови професии.

    arxiv.org
  2. Сигурност5 min прочети

    Проучването установява, че скринингът на езика на омразата на LLM е по-малко последователен в скриптовете на урду

    Предварителна версия на arXiv съобщава, че пет големи езикови модела са променили класификациите на вредно съдържание в урду скриптове и английски преводи, разкривайки измерима пропуска в безопасността „Пропуснато в урду“.

    arxiv.org
  3. Иновация5 min прочети

    MemUse открива, че разговорната AI памет работи по различен начин, отколкото предполагат тестовете за извикване

    Четиримесечно проучване за внедряване установи, че способността на AI система да си спомня минали факти не предсказва удовлетвореността на потребителите или дали тя естествено използва тези факти в разговор.

    arxiv.org
  4. Иновация5 min прочети

    TrustDABench открива, че LLM често произвеждат неподдържани анализи на структурирани данни

    Нов бенчмарк съобщава, че осем големи езикови модела често не успяват да открият противоречиви доказателства или да запазят правилните анализи, когато електронните таблици и таблици се променят.

    arxiv.org
  5. Иновация5 min прочети

    Проучването установява, че автоматичните резултати за креативност могат да се разминават с човешките преценки на историите за LLM

    Нов предпечат arXiv съобщава, че автоматизираните показатели и съдиите за LLM често не успяват да съвпаднат с човешките оценки за креативност в кратките истории, като съдиите систематично предпочитат стилове на писане, генерирани от AI.

    arxiv.org
  6. Иновация5 min прочети

    Подпомогнатият от AI скрининг на тестови елементи може да промени това, което експертите преглеждат, установява предпечат

    Предпринтът на arXiv съобщава, че представителството, структурният скрининг и изборът на класиране могат значително да променят кои артикули, генерирани от AI, от Големите пет, достигат до психометричен преглед, дори когато глобалните обобщения изглеждат стабилни.

    arxiv.org
  7. Иновация6 min прочети

    Предпечатът казва, че участието на студентите трябва да промени начина, по който се валидират измерванията на LLM за разговор в класната стая

    Препечатка съобщава, че четирима многоезични ученици от осми клас оспориха класификациите на LLM на техните математически дискусии, твърдейки, че анотациите за възрастни и стандартните резултати могат да пропуснат собствените интерпретации на учениците.

    arxiv.org
  8. Иновация7 min прочети

    Паметта за извличане стеснява празнината на езиковите модели по отношение на редки синтактични модели

    Ново проучване на arXiv съобщава, че предоставянето на езикови модели на достъп до съхранени примери подобрява тяхната чувствителност към синтактични контрасти, включващи редки думи, въпреки че празнината не е елиминирана.

    arxiv.org
  9. Сигурност6 min прочети

    Проучване установява, че LLM с локално кодиране могат да халюцинират имена на пакети, които създават рискове от небрежност

    Проучване на arXiv предлага двуслоен детектор за халюцинации на името на пакета в модели на местни кодиращи езици, съобщавайки, че нивата на халюцинации са се увеличили от 0–10% при рутинни подкани до 40–73% при противопоставящи се подкани.

    arxiv.org

Един полезен брифинг всяка седмица

Поддържайте изкуствения интелект, без да живеете в потока.

Получете потвърдените новини за AI за седмицата, оригинални данни, полезни инструменти, учебни предложения и нови AI работни места.

Send me
One email a week. Switch any time.

Изграждайте с нашата аудитория

Наемане на AI професионалист или пускане на полезен AI продукт? Представете го пред хора, които са дошли тук, за да учат и действат.

Публикувайте работа за AI Изпратете AI инструмент