Günlük olarak güncellenir1425 doğrulanmış hikayeler

Yapay Zeka Haberleri.Gürültü olmadan.

Source-checked AI coverage of product launches, policy shifts, safety research, and industry moves, explained in plain English by a nonprofit education team.

Verified sourcing

Every story links to the strongest available evidence: original sources when available, otherwise clearly attributed reporting.

Düz İngilizce

Ne oldu, neden önemli ve ne izlenecek; jargon vergisi yok.

Dolgu yok

Sinyal zayıf olduğunda feed'i doldurmak yerine hiçbir şey yayınlamayız.

Haber arşivi

Yapay zeka haber arşivi — Sayfa 117

Aldatmaca peşinde koşmadan yapay zekayı anlaması gereken insanlar için giderek artan doğrulanmış bakış açıları akışı.

9 hikayeler
  1. Yenilik6 min okumak

    Makalede "Gölge Değerlendirmeleri" Tanıtılıyor: Yapay Zeka Ajanları Mühendislik Yaptı Ancak İki Araştırma Sorusunda Başarısız Oldu

    24 yazarlı bir ön baskı, öncü AI ajanlarının yayınlanmamış iki NeurIPS 2026 sunumunun merkezi araştırma sorularını denemesini ve ardından makalelerin kendi yazarlarının sonuçları derecelendirmesini sağladı. Ajanlar altı gün boyunca mühendislik işlerini yardım almadan yürüttüler ancak araştırma açıkça reddedildi.

    arxiv.org
  2. Ürün7 min okumak

    Warp, Kodlama Aracıları Filolarını Çalıştırmak için Kod Olarak Yapılandırma Sistemi olan "Fabrikalara" Erken Erişimi Açıyor

    Warp, kodlama aracısı filolarını CLI, API, SDK ve MCP tarafından yönetilen tek bir YAML dosyasında kod depoları, modeller, izinler ve insan kontrol noktaları olarak tanımlayan Warp Fabrikaları için erken erişim isteklerini alıyor. Otomasyon ve maliyet rakamları satıcı iddialarına dayanmaktadır: fiyatlandırma, genel kullanılabilirlik tarihi veya bağımsız test yoktur.

    warp.dev
  3. Yenilik7 min okumak

    Benchmark, En İyi Multimodal Modellerin Kalem Seslerinden ve El Hareketlerinden Kelimeleri Okumada %10'un Altında Puan Aldığını Söyledi

    Yeni bir arXiv makalesi, modellerin mürekkep olmadan, kalem çiziklerinden ve el hareketi videolarından yazılı bir kelime çıkarması gereken bir testi tanıtıyor. Yazarlar, insanlarda %80'in üzerinde sıralı harf doğruluğu ve önde gelen modellerin %10'un altında olduğunu ve modellere her iki yöntemi de vermenin genellikle sonuçları daha kötü hale getirdiğini bildiriyor.

    arxiv.org
  4. Yenilik7 min okumak

    Paper, Aracı Farkında Önbellek Yönetiminin Çoklu Aracı Sunumunda İlk Belirteç Gecikmesini %45'e Kadar Azalttığını Söyledi

    Yeni bir arXiv ön baskısı, açık kaynaklı vLLM sunucusu üzerine inşa edilmiş ve bir sonraki adımda hangi aracının çalışacağına bağlı olarak bir modelin anahtar/değer önbelleğinde neyin tutulacağına karar veren bir katman olan CacheScout'u tanımlıyor. Yazarlar çift haneli gecikme ve üretim artışı bildirdiler; özette iş yükleri, modeller ve donanım belirtilmemiştir.

    arxiv.org
  5. Yenilik7 min okumak

    OpenAI Yapay Zeka Tarafından Oluşturulan Kanıtın Denetimi Tersine Dönmüş Bir Koşul Buluyor ve Bir Onarım Yayınlıyor

    İki araştırmacı, OpenAI'in matematik belgesinin 6. Bölümündeki bir lemma kanıtında kutupsallık hatası bulunduğunu söylüyor: bir sonraki adımın büyük bir koşullu başarısızlığa ihtiyaç duyduğu ortalama başarı açısından bir test. Bir karşı örnek ve düzeltilmiş bir kanıt veriyorlar ve bunun, bölümün ana teoreminin doğrulanması olmadığı konusunda uyarıda bulunuyorlar.

    arxiv.org
  6. Yenilik7 min okumak

    Çoğaltma Çalışması, FLOP'ların Yapay Zeka Çalışma Zamanını Hala Yanlış Tahmin Ettiğini ve Önerilen Düzeltmenin Daha Yeni Donanımda Başarısız Olduğunu Söylüyor

    İki araştırmacının ön baskısı, eşit FLOP sayılarının neden eşit yürütme süresi anlamına gelmediğine dair daha önceki bir çalışmayı yeniden üretiyor. Temel iddiayı doğruluyor ancak α-FLOP düzeltme formülünün genellikle daha yeni donanımdaki çalışma süresini olduğundan düşük tahmin ettiğini, bu da formülün yakalayamadığı sıçramaları ve salınımları gösterdiğini bildiriyor.

    arxiv.org

One useful briefing each week

Keep up with AI without living in the feed.

Get the week’s verified AI news, original data, useful tools, learning picks, and fresh AI jobs.

Send me
One email a week. Switch any time.

Build with our audience

Hiring an AI professional or launching a useful AI product? Put it in front of people who came here to learn and act.

Post an AI job Submit an AI tool