Günlük olarak güncellenir1866 doğrulanmış hikayeler
Yapay Zeka Haberleri. Gürültü olmadan.
Ürün lansmanları, politika değişiklikleri, güvenlik araştırmaları ve sektör hamleleriyle ilgili kaynak kontrollü yapay zeka kapsamı, kar amacı gütmeyen bir eğitim ekibi tarafından sade İngilizceyle açıklanıyor.
Doğrulanmış kaynak
Her hikaye en güçlü mevcut kanıtlara bağlanır: mevcut olduğunda orijinal kaynaklar, aksi takdirde açıkça atfedilen haberler.
Düz İngilizce
Ne oldu, neden önemli ve ne izlenecek - jargon olmadan.
Dolgu yok
Sinyal zayıf olduğunda feed'i doldurmak yerine hiçbir şey yayınlamayız.
Daha fazla hikaye
9 hikayelerEndüstri
Cursor, SpaceX Tarafından Satın Alınmasının Resmi Olarak Kapatıldığını Söyledi
Cursor, SpaceX'in yapay zeka kodlama aracını satın almayı tamamladığını ve SpaceXAI ile model eğitimi ortaklığıyla Nisan ayında başladığını söylediği süreci tamamladığını belirten kısa bir gönderi yayınladı. Gönderi, dünyanın en büyük GPU filosu olarak adlandırdığı şeye erişim sözü veriyor ancak herhangi bir şart, zaman çizelgesi veya ürün değişikliğini açıklamıyor.
cursor.comYenilik
Yeni Karşılaştırma, Yapay Zeka Aracılarının Onaylanan Çalışmayı %28 Oranında Yanlışlıkla Engellediğini Buluyor
Bir ön baskı, bir yapay zeka temsilcisinin inceleme için harekete geçmeye veya duraklatmaya karar verdiği anın 106 senaryolu bir testi olan SteerBench-Work'ü tanıtıyor. Yazarlar, 30 model koşulunda, izin verilen işin yanlışlıkla tutulmasının, güvenli olmayan çalışmaya yanlışlıkla izin verilmesinden kabaca 28 kat daha yaygın olduğunu bildiriyor.arxiv.orgYenilik
Paper Reports Frontier LLM Hakimleri Kararlarını Döndürdü %25-71 Geri Bildirim Altında
Yeni bir arXiv ön baskı, otomatik sınıflandırıcı olarak kullanılan dokuz sınır modelini stres testinden geçiriyor ve hepsinin itiraz karşısında kararlarını değiştirdiğini ve değişen kararların genellikle doğru cevaba doğru değil, ondan uzaklaştığını bildiriyor.arxiv.orgYenilik
Paper, Evrim Stratejilerinin Yüksek Lisans Cevap Kümelerini Çeşitli Tutma Konusunda RL'yi Geçtiğini Savunuyor
Yeni bir arXiv ön baskısı, evrim stratejilerine sahip eğitim sonrası LLM'lerin (ağırlıkları doğrudan bozan popülasyon tabanlı, gradyan içermeyen bir yöntem) pass@k ve çözüm kapsamındaki takviyeli öğrenmeyi geride bıraktığını savunuyor. Özette daha iyi matematik kıyaslama sonuçlarından bahsediliyor ancak model, kıyaslama veya sayı belirtilmemiş.arxiv.orgGüvenlik
Paper, Kendini Geliştiren Yapay Zeka Aracılarının Güvenli Olmayan Bir Başarıyı Yeniden Kullanılabilir Bir Beceriye Dönüştürebileceğini Söyledi
Yeni bir arXiv ön baskısı, belirli bir aracı hata modunu karşılaştırır: Kendini geliştiren bir aracı, güvenli olmayan bir prosedürü belleğe yazdığında, daha sonraki oturumlarda geri alınabilir ve yürütülebilir. Test edilen her geliştirilmiş konfigürasyon, güvenli olmayan yapılar üretti ve üç kötü amaçlı görev, aktarım saldırılarının başarısını iki kattan fazla artırdı.arxiv.orgGüvenlik
SEAG Belgesi, RAG Sorguları Harici LLM'lere Ulaşmadan Önce Hassas Varlıkların Takma Adlandırılmasını Öneriyor
arXiv'e gönderilen bir ön baskı, sorgulardaki hassas adları değiştiren ve alınan belgeleri üçüncü taraf bir modele göndermeden önce takma adlarla değiştiren bir çerçeveyi açıklar. Yazarlar, üç küçük modelde uçtan uca kullanıcı metriklerinde %80'in üzerinde doğruluk ve %74,91 ile %77,83 arasında tam gizleme oranları bildirmektedir.arxiv.orgYenilik
CABS+ Paper, 27 Veri Kümesi Arasında Modelin Daha Ucuz ve Daha Hızlı Birleştirildiğini Bildiriyor
arXiv'e gönderilen bir ön baskı, ızgara aramasını gradyansız katsayı aramasıyla değiştiren bir model birleştirme yöntemi olan CABS+'ı anlatıyor. Yazarlar, iki temel çizgide çift haneli performans artışı, bir temelin GPU belleğinin dörtte birinden daha az ve diğerine göre kabaca 4 kat hız artışı bildiriyor.arxiv.orgYenilik
Makale, Dondurulmuş Görüş-Dil Modellerinde Uzamsal Akıl Yürütmeyi Geliştirmek İçin Alınan "Dersler" Öneriyor
Bir arXiv ön baskısı, doğrulanmış deneyimi çıkarım zamanında alınan metin dersleri olarak saklayan Uzamsal Bellek Aracısını tanımlar ve model ağırlıklarını değiştirmeden beş uzamsal kıyaslama ve dört görüş dili modelinde kazanç elde edildiğini iddia eder. İnceleniyor; Özetinde hiçbir kıyaslama, temel model veya marj belirtilmez.arxiv.orgYenilik
PROVE-RT Paper, Makine Tarafından Kontrol Edilen Gerçek Zamanlı Kanıtlar Üretmede %44,7 Başarı Bildiriyor
Bir arXiv ön baskısı, büyük dil modellerinin gerçek zamanlı programlanabilirlik analizi için PROSA/ROCQ prova komut dosyaları yazmasını sağlamak için alma ve aşamalı yönlendirmeyi kullanan PROVE-RT'yi sunar. Yazarlar, doğrudan yönlendirmenin geçerli mekanizasyonları güvenilir bir şekilde üretmede başarısız olduğu, seçilmiş bir değerlendirme setinde %44,7'lik bir başarı oranı bildirmektedir.arxiv.org
Her hafta bir faydalı brifing
Akışta yaşamadan, yapay zekaya ayak uydurun.
Haftanın doğrulanmış yapay zeka haberlerini, orijinal verilerini, faydalı araçları, öğrenme önerilerini ve yeni yapay zeka işlerini edinin.
Yapay zekayı öğrenen insanlara ulaşın
Bir yapay zeka profesyonelini işe almak mı yoksa faydalı bir yapay zeka ürünü mi başlatmak mı? Bunu buraya öğrenmek ve hareket etmek için gelen insanların önüne koyun.
Bir yapay zeka işi ilan edinBir yapay zeka aracı gönderin