Günlük olarak güncellenir1866 doğrulanmış hikayeler

Yapay Zeka Haberleri. Gürültü olmadan.

Ürün lansmanları, politika değişiklikleri, güvenlik araştırmaları ve sektör hamleleriyle ilgili kaynak kontrollü yapay zeka kapsamı, kar amacı gütmeyen bir eğitim ekibi tarafından sade İngilizceyle açıklanıyor.

Doğrulanmış kaynak

Her hikaye en güçlü mevcut kanıtlara bağlanır: mevcut olduğunda orijinal kaynaklar, aksi takdirde açıkça atfedilen haberler.

Düz İngilizce

Ne oldu, neden önemli ve ne izlenecek - jargon olmadan.

Dolgu yok

Sinyal zayıf olduğunda feed'i doldurmak yerine hiçbir şey yayınlamayız.

9 hikayeler
  1. EndüstriEndüstri6 min okumak

    Cursor, SpaceX Tarafından Satın Alınmasının Resmi Olarak Kapatıldığını Söyledi

    Cursor, SpaceX'in yapay zeka kodlama aracını satın almayı tamamladığını ve SpaceXAI ile model eğitimi ortaklığıyla Nisan ayında başladığını söylediği süreci tamamladığını belirten kısa bir gönderi yayınladı. Gönderi, dünyanın en büyük GPU filosu olarak adlandırdığı şeye erişim sözü veriyor ancak herhangi bir şart, zaman çizelgesi veya ürün değişikliğini açıklamıyor.cursor.com
  2. YenilikYenilik7 min okumak

    Yeni Karşılaştırma, Yapay Zeka Aracılarının Onaylanan Çalışmayı %28 Oranında Yanlışlıkla Engellediğini Buluyor

    Bir ön baskı, bir yapay zeka temsilcisinin inceleme için harekete geçmeye veya duraklatmaya karar verdiği anın 106 senaryolu bir testi olan SteerBench-Work'ü tanıtıyor. Yazarlar, 30 model koşulunda, izin verilen işin yanlışlıkla tutulmasının, güvenli olmayan çalışmaya yanlışlıkla izin verilmesinden kabaca 28 kat daha yaygın olduğunu bildiriyor.arxiv.org
  3. YenilikYenilik7 min okumak

    Paper, Evrim Stratejilerinin Yüksek Lisans Cevap Kümelerini Çeşitli Tutma Konusunda RL'yi Geçtiğini Savunuyor

    Yeni bir arXiv ön baskısı, evrim stratejilerine sahip eğitim sonrası LLM'lerin (ağırlıkları doğrudan bozan popülasyon tabanlı, gradyan içermeyen bir yöntem) pass@k ve çözüm kapsamındaki takviyeli öğrenmeyi geride bıraktığını savunuyor. Özette daha iyi matematik kıyaslama sonuçlarından bahsediliyor ancak model, kıyaslama veya sayı belirtilmemiş.arxiv.org
  4. GüvenlikGüvenlik7 min okumak

    Paper, Kendini Geliştiren Yapay Zeka Aracılarının Güvenli Olmayan Bir Başarıyı Yeniden Kullanılabilir Bir Beceriye Dönüştürebileceğini Söyledi

    Yeni bir arXiv ön baskısı, belirli bir aracı hata modunu karşılaştırır: Kendini geliştiren bir aracı, güvenli olmayan bir prosedürü belleğe yazdığında, daha sonraki oturumlarda geri alınabilir ve yürütülebilir. Test edilen her geliştirilmiş konfigürasyon, güvenli olmayan yapılar üretti ve üç kötü amaçlı görev, aktarım saldırılarının başarısını iki kattan fazla artırdı.arxiv.org
  5. GüvenlikGüvenlik6 min okumak

    SEAG Belgesi, RAG Sorguları Harici LLM'lere Ulaşmadan Önce Hassas Varlıkların Takma Adlandırılmasını Öneriyor

    arXiv'e gönderilen bir ön baskı, sorgulardaki hassas adları değiştiren ve alınan belgeleri üçüncü taraf bir modele göndermeden önce takma adlarla değiştiren bir çerçeveyi açıklar. Yazarlar, üç küçük modelde uçtan uca kullanıcı metriklerinde %80'in üzerinde doğruluk ve %74,91 ile %77,83 arasında tam gizleme oranları bildirmektedir.arxiv.org
  6. YenilikYenilik6 min okumak

    Makale, Dondurulmuş Görüş-Dil Modellerinde Uzamsal Akıl Yürütmeyi Geliştirmek İçin Alınan "Dersler" Öneriyor

    Bir arXiv ön baskısı, doğrulanmış deneyimi çıkarım zamanında alınan metin dersleri olarak saklayan Uzamsal Bellek Aracısını tanımlar ve model ağırlıklarını değiştirmeden beş uzamsal kıyaslama ve dört görüş dili modelinde kazanç elde edildiğini iddia eder. İnceleniyor; Özetinde hiçbir kıyaslama, temel model veya marj belirtilmez.arxiv.org
  7. YenilikYenilik7 min okumak

    PROVE-RT Paper, Makine Tarafından Kontrol Edilen Gerçek Zamanlı Kanıtlar Üretmede %44,7 Başarı Bildiriyor

    Bir arXiv ön baskısı, büyük dil modellerinin gerçek zamanlı programlanabilirlik analizi için PROSA/ROCQ prova komut dosyaları yazmasını sağlamak için alma ve aşamalı yönlendirmeyi kullanan PROVE-RT'yi sunar. Yazarlar, doğrudan yönlendirmenin geçerli mekanizasyonları güvenilir bir şekilde üretmede başarısız olduğu, seçilmiş bir değerlendirme setinde %44,7'lik bir başarı oranı bildirmektedir.arxiv.org

Her hafta bir faydalı brifing

Akışta yaşamadan, yapay zekaya ayak uydurun.

Haftanın doğrulanmış yapay zeka haberlerini, orijinal verilerini, faydalı araçları, öğrenme önerilerini ve yeni yapay zeka işlerini edinin.

Send me
One email a week. Switch any time.

Yapay zekayı öğrenen insanlara ulaşın

Bir yapay zeka profesyonelini işe almak mı yoksa faydalı bir yapay zeka ürünü mi başlatmak mı? Bunu buraya öğrenmek ve hareket etmek için gelen insanların önüne koyun.

Bir yapay zeka işi ilan edinBir yapay zeka aracı gönderin