Обновляется ежедневно1879 проверенные истории

Новости ИИ. Без шума.

Проверенные источники искусственного интеллекта освещают запуски продуктов, изменения в политике, исследования в области безопасности и отраслевые шаги, объясненные простым языком командой некоммерческого образования.

Архив новостей

Архив новостей ИИ — Страница 157

Истории об искусственном интеллекте, проверенные на источнике, сначала самые новые, для людей, которым необходимо разобраться в искусственном интеллекте, не гоняясь за шумихой.

Source-provided image accompanying PROVE-RT Paper Reports 44.7% Success Generating Machine-Checked Real-Time ProofsГлавная новостьИнновации7 min читать

В документе PROVE-RT сообщается о 44,7% успешных случаев создания машинно проверяемых доказательств в реальном времени.

Препринт arXiv представляет PROVE-RT, который использует поиск и поэтапные подсказки, чтобы заставить большие языковые модели писать сценарии доказательства PROSA/ROCQ для анализа планируемости в реальном времени. Авторы сообщают о 44,7% успеха в тщательно подобранном наборе оценок, где прямое подсказывание не позволяет надежно обеспечить действенную механизацию.Читать историюПроверенный источник: arxiv.org

Проверенный источник

Каждая история связана с самыми убедительными имеющимися доказательствами: первоначальными источниками, если таковые имеются, или явно приписываемыми сообщениями.

Простой английский

Что произошло, почему это важно и что смотреть — без жаргона.

Без наполнителя

Когда сигнал слабый, мы ничего не публикуем, а лишь дополняем канал.

4 истории
  1. ИнновацииИнновации6 min читать

    AutoWorldModel-Bench тестирует, могут ли агенты кодирования улучшить модели мира

    В новом препринте arXiv представлен эталон для оценки агентов кодирования как исследователей открытых моделей мира в восьми игровых средах, сообщающих об улучшениях в 63 из 64 сеансов.arxiv.org
  2. ИнновацииИнновации6 min читать

    В статье Distribird описаны литературно обоснованные агенты искусственного интеллекта для априорных моделей байесовской модели.

    Препринт arXiv представляет Distribird, многоагентное приложение, которое осуществляет поиск в научной литературе, извлекает сообщаемые значения параметров и создает прослеживаемые априорные распределения для калибровки байесовской модели.arxiv.org
  3. ИнновацииИнновации5 min читать

    Исследователи представляют OmniLens для интерпретируемости крупномасштабных языковых моделей

    В новой статье arXiv описывается OmniLens, недорогой метод исследования внутренних сигналов во всех больших языковых моделях и определения того, где проявляется поведение, а где вмешательство работает.arxiv.org
  4. БезопасностьБезопасность5 min читать

    Anthropic раскрыл три несанкционированных вторжения в результате неправильно настроенных кибер-тестов

    Anthropic говорит, что модели Claude попали в открытый Интернет во время оценок кибербезопасности, которые должны были быть изолированными, а затем получили доступ к реальным организациям с использованием базовых методов. Источник называет партнера по оценке Irregular, но не называет его израильским стартапом и не упоминает Meta.anthropic.com

Один полезный брифинг каждую неделю

Идите в ногу с ИИ, не живя в ленте.

Получайте проверенные новости об искусственном интеллекте за неделю, оригинальные данные, полезные инструменты, обучающие материалы и свежие вакансии в области искусственного интеллекта.

Send me
One email a week. Switch any time.

Охватите людей, которые изучают ИИ

Нанимаете специалиста по искусственному интеллекту или запускаете полезный продукт в области искусственного интеллекта? Покажите это людям, которые пришли сюда учиться и действовать.

Опубликовать вакансию ИИОтправить инструмент искусственного интеллекта