Günlük olarak güncellenir1792 doğrulanmış hikayeler

Yapay Zeka Haberleri.Gürültü olmadan.

Ürün lansmanları, politika değişiklikleri, güvenlik araştırmaları ve sektör hamleleriyle ilgili kaynak kontrollü yapay zeka kapsamı, kar amacı gütmeyen bir eğitim ekibi tarafından sade İngilizceyle açıklanıyor.

Doğrulanmış kaynak

Her hikaye en güçlü mevcut kanıtlara bağlanır: mevcut olduğunda orijinal kaynaklar, aksi takdirde açıkça atfedilen haberler.

Düz İngilizce

What happened, why it matters, and what to watch — without the jargon.

Dolgu yok

Sinyal zayıf olduğunda feed'i doldurmak yerine hiçbir şey yayınlamayız.

Haber arşivi

Yapay zeka haber arşivi — Sayfa 148

Source-checked AI stories, newest first, for people who need to understand AI without chasing hype.

Source-provided image accompanying Paper Introduces "Shadow Evaluations": AI Agents Did the Engineering but Failed Two Research QuestionsEn önemli hikaye
Yenilik6 min okumak
Yenilik6 min okumak

Makalede "Gölge Değerlendirmeleri" Tanıtılıyor: Yapay Zeka Ajanları Mühendislik Yaptı Ancak İki Araştırma Sorusunda Başarısız Oldu

24 yazarlı bir ön baskı, öncü AI ajanlarının yayınlanmamış iki NeurIPS 2026 sunumunun merkezi araştırma sorularını denemesini ve ardından makalelerin kendi yazarlarının sonuçları derecelendirmesini sağladı. Ajanlar altı gün boyunca mühendislik işlerini yardım almadan yürüttüler ancak araştırma açıkça reddedildi.

Hikayeyi oku Doğrulanmış kaynak: arxiv.org
9 hikayeler
  1. Yenilik7 min okumak

    Paper, Aracı Farkında Önbellek Yönetiminin Çoklu Aracı Sunumunda İlk Belirteç Gecikmesini %45'e Kadar Azalttığını Söyledi

    Yeni bir arXiv ön baskısı, açık kaynaklı vLLM sunucusu üzerine inşa edilmiş ve bir sonraki adımda hangi aracının çalışacağına bağlı olarak bir modelin anahtar/değer önbelleğinde neyin tutulacağına karar veren bir katman olan CacheScout'u tanımlıyor. Yazarlar çift haneli gecikme ve üretim artışı bildirdiler; özette iş yükleri, modeller ve donanım belirtilmemiştir.

    arxiv.org
  2. Yenilik7 min okumak

    OpenAI Yapay Zeka Tarafından Oluşturulan Kanıtın Denetimi Tersine Dönmüş Bir Koşul Buluyor ve Bir Onarım Yayınlıyor

    İki araştırmacı, OpenAI'in matematik belgesinin 6. Bölümündeki bir lemma kanıtında kutupsallık hatası bulunduğunu söylüyor: bir sonraki adımın büyük bir koşullu başarısızlığa ihtiyaç duyduğu ortalama başarı açısından bir test. Bir karşı örnek ve düzeltilmiş bir kanıt veriyorlar ve bunun, bölümün ana teoreminin doğrulanması olmadığı konusunda uyarıda bulunuyorlar.

    arxiv.org
  3. Yenilik7 min okumak

    Çoğaltma Çalışması, FLOP'ların Yapay Zeka Çalışma Zamanını Hala Yanlış Tahmin Ettiğini ve Önerilen Düzeltmenin Daha Yeni Donanımda Başarısız Olduğunu Söylüyor

    İki araştırmacının ön baskısı, eşit FLOP sayılarının neden eşit yürütme süresi anlamına gelmediğine dair daha önceki bir çalışmayı yeniden üretiyor. Temel iddiayı doğruluyor ancak α-FLOP düzeltme formülünün genellikle daha yeni donanımdaki çalışma süresini olduğundan düşük tahmin ettiğini, bu da formülün yakalayamadığı sıçramaları ve salınımları gösterdiğini bildiriyor.

    arxiv.org
  4. Yenilik7 min okumak

    Paper, Daha Güçlü Bir Modele Yakınsamayı Ölçerek Yapay Zeka Güvenlik Aracılarının Etiketsiz Derecelendirilmesini Öneriyor

    Yeni bir arXiv ön baskısı, güvenlik ekiplerinin, bellek veya erişim donanımlı bir yapay zeka aracısının, çoğunlukla kıt veya bayat olan etiketli ölçütler yerine, daha güçlü bir "öğretmen" modeliyle aradaki farkı ne kadar kapattığını ölçerek öğrenip öğrenmediğini değerlendirebileceğini öne sürüyor. Benzer şekilde güçlü bir modele bakılırsa kullanılabilir bir sinyal verilmedi.

    arxiv.org
  5. Yenilik7 min okumak

    Yeni Karşılaştırma Testleri Yapay Zeka Asistanlarının Bir Yıllık Telefon Kullanımını Hatırlayıp Hatırlayamadığını Test Ediyor

    arXiv'de yayınlanan 17 yazarlı bir teknik rapor, yıllık ölçekte mobil deneyimler koleksiyonundan oluşturulan, cihazdaki uzun vadeli belleğe yönelik bir kıyaslama ve çerçeve olan MobileMem'i tanıtıyor. Özet, tasarımı açıklıyor ancak herhangi bir puan bildirmiyor ve temel verilerle ilgili önemli ayrıntılar açıklanmıyor.

    arxiv.org
  6. Yenilik7 min okumak

    Kağıt, Uzmanların Karma Modelinin Son Katmanlarını Ağır Uzman Maskelemesini Tolere Ediyor

    Bir ön baskı, 35 milyar parametreli Uzmanlar Karması modelinin son beş katmanındaki düşük büyüklükteki uzmanların devre dışı bırakılmasının, aynı kesintileri tüm katmanlara yaymaktan çok daha kullanışlı kod çevirisi çıktılarını koruduğunu bildiriyor. Bir modeli ve bir kıyaslamayı kapsıyor ve özet, maskesiz bir temel çizginin olmadığını bildiriyor.

    arxiv.org
  7. Güvenlik7 min okumak

    CoreBreak Kusurları Aracı Araçların Model Çağrılmadan Çalıştırılmasına İzin Verir

    Bir Cloud Security Alliance araştırma notu, Amazon Bedrock AgentCore'daki bir kusur modeli olan CoreBreak'i, Google'nin Agent Geliştirme Kitini ve Vercel'in AI SDK koşum paketlerini açıklayarak araçların model dönüşü olmadan çalıştırılmasına izin vererek model düzeyindeki korkulukları incelenecek hiçbir şey bırakmadı.

    labs.cloudsecurityalliance.org

Her hafta bir faydalı brifing

Akışta yaşamadan, yapay zekaya ayak uydurun.

Haftanın doğrulanmış yapay zeka haberlerini, orijinal verilerini, faydalı araçları, öğrenme önerilerini ve yeni yapay zeka işlerini edinin.

Send me
One email a week. Switch any time.

Reach people who are learning AI

Bir yapay zeka profesyonelini işe almak mı yoksa faydalı bir yapay zeka ürünü mi başlatmak mı? Bunu buraya öğrenmek ve hareket etmek için gelen insanların önüne koyun.

Bir yapay zeka işi ilan edin Bir yapay zeka aracı gönderin