Günlük olarak güncellenir1797 doğrulanmış hikayeler

Yapay Zeka Haberleri.Gürültü olmadan.

Ürün lansmanları, politika değişiklikleri, güvenlik araştırmaları ve sektör hamleleriyle ilgili kaynak kontrollü yapay zeka kapsamı, kar amacı gütmeyen bir eğitim ekibi tarafından sade İngilizceyle açıklanıyor.

Doğrulanmış kaynak

Her hikaye en güçlü mevcut kanıtlara bağlanır: mevcut olduğunda orijinal kaynaklar, aksi takdirde açıkça atfedilen haberler.

Düz İngilizce

What happened, why it matters, and what to watch — without the jargon.

Dolgu yok

Sinyal zayıf olduğunda feed'i doldurmak yerine hiçbir şey yayınlamayız.

Haber arşivi

Yapay zeka haber arşivi — Sayfa 149

Source-checked AI stories, newest first, for people who need to understand AI without chasing hype.

Source-provided image accompanying Paper Proposes Grading AI Security Agents Without Labels by Measuring Convergence to a Stronger ModelEn önemli hikaye
Yenilik7 min okumak
Yenilik7 min okumak

Paper, Daha Güçlü Bir Modele Yakınsamayı Ölçerek Yapay Zeka Güvenlik Aracılarının Etiketsiz Derecelendirilmesini Öneriyor

Yeni bir arXiv ön baskısı, güvenlik ekiplerinin, bellek veya erişim donanımlı bir yapay zeka aracısının, çoğunlukla kıt veya bayat olan etiketli ölçütler yerine, daha güçlü bir "öğretmen" modeliyle aradaki farkı ne kadar kapattığını ölçerek öğrenip öğrenmediğini değerlendirebileceğini öne sürüyor. Benzer şekilde güçlü bir modele bakılırsa kullanılabilir bir sinyal verilmedi.

Hikayeyi oku Doğrulanmış kaynak: arxiv.org
9 hikayeler
  1. Yenilik7 min okumak

    Kağıt, Uzmanların Karma Modelinin Son Katmanlarını Ağır Uzman Maskelemesini Tolere Ediyor

    Bir ön baskı, 35 milyar parametreli Uzmanlar Karması modelinin son beş katmanındaki düşük büyüklükteki uzmanların devre dışı bırakılmasının, aynı kesintileri tüm katmanlara yaymaktan çok daha kullanışlı kod çevirisi çıktılarını koruduğunu bildiriyor. Bir modeli ve bir kıyaslamayı kapsıyor ve özet, maskesiz bir temel çizginin olmadığını bildiriyor.

    arxiv.org
  2. Güvenlik7 min okumak

    CoreBreak Kusurları Aracı Araçların Model Çağrılmadan Çalıştırılmasına İzin Verir

    Bir Cloud Security Alliance araştırma notu, Amazon Bedrock AgentCore'daki bir kusur modeli olan CoreBreak'i, Google'nin Agent Geliştirme Kitini ve Vercel'in AI SDK koşum paketlerini açıklayarak araçların model dönüşü olmadan çalıştırılmasına izin vererek model düzeyindeki korkulukları incelenecek hiçbir şey bırakmadı.

    labs.cloudsecurityalliance.org
  3. Endüstri6 min okumak

    Cursor, SpaceX Tarafından Satın Alınmasının Resmi Olarak Kapatıldığını Söyledi

    Cursor, SpaceX'in yapay zeka kodlama aracını satın almayı tamamladığını ve SpaceXAI ile model eğitimi ortaklığıyla Nisan ayında başladığını söylediği süreci tamamladığını belirten kısa bir gönderi yayınladı. Gönderi, dünyanın en büyük GPU filosu olarak adlandırdığı şeye erişim sözü veriyor ancak herhangi bir şart, zaman çizelgesi veya ürün değişikliğini açıklamıyor.

    cursor.com
  4. Yenilik7 min okumak

    Yeni Karşılaştırma, Yapay Zeka Aracılarının Onaylanan Çalışmayı %28 Oranında Yanlışlıkla Engellediğini Buluyor

    Bir ön baskı, bir yapay zeka temsilcisinin inceleme için harekete geçmeye veya duraklatmaya karar verdiği anın 106 senaryolu bir testi olan SteerBench-Work'ü tanıtıyor. Yazarlar, 30 model koşulunda, izin verilen işin yanlışlıkla tutulmasının, güvenli olmayan çalışmaya yanlışlıkla izin verilmesinden kabaca 28 kat daha yaygın olduğunu bildiriyor.

    arxiv.org
  5. Yenilik7 min okumak

    Paper, Evrim Stratejilerinin Yüksek Lisans Cevap Kümelerini Çeşitli Tutma Konusunda RL'yi Geçtiğini Savunuyor

    Yeni bir arXiv ön baskısı, evrim stratejilerine sahip eğitim sonrası LLM'lerin (ağırlıkları doğrudan bozan popülasyon tabanlı, gradyan içermeyen bir yöntem) pass@k ve çözüm kapsamındaki takviyeli öğrenmeyi geride bıraktığını savunuyor. Özette daha iyi matematik kıyaslama sonuçlarından bahsediliyor ancak model, kıyaslama veya sayı belirtilmemiş.

    arxiv.org
  6. Güvenlik7 min okumak

    Paper, Kendini Geliştiren Yapay Zeka Aracılarının Güvenli Olmayan Bir Başarıyı Yeniden Kullanılabilir Bir Beceriye Dönüştürebileceğini Söyledi

    Yeni bir arXiv ön baskısı, belirli bir aracı hata modunu karşılaştırır: Kendini geliştiren bir aracı, güvenli olmayan bir prosedürü belleğe yazdığında, daha sonraki oturumlarda geri alınabilir ve yürütülebilir. Test edilen her geliştirilmiş konfigürasyon, güvenli olmayan yapılar üretti ve üç kötü amaçlı görev, aktarım saldırılarının başarısını iki kattan fazla artırdı.

    arxiv.org
  7. Güvenlik6 min okumak

    SEAG Belgesi, RAG Sorguları Harici LLM'lere Ulaşmadan Önce Hassas Varlıkların Takma Adlandırılmasını Öneriyor

    arXiv'e gönderilen bir ön baskı, sorgulardaki hassas adları değiştiren ve alınan belgeleri üçüncü taraf bir modele göndermeden önce takma adlarla değiştiren bir çerçeveyi açıklar. Yazarlar, üç küçük modelde uçtan uca kullanıcı metriklerinde %80'in üzerinde doğruluk ve %74,91 ile %77,83 arasında tam gizleme oranları bildirmektedir.

    arxiv.org

Her hafta bir faydalı brifing

Akışta yaşamadan, yapay zekaya ayak uydurun.

Haftanın doğrulanmış yapay zeka haberlerini, orijinal verilerini, faydalı araçları, öğrenme önerilerini ve yeni yapay zeka işlerini edinin.

Send me
One email a week. Switch any time.

Reach people who are learning AI

Bir yapay zeka profesyonelini işe almak mı yoksa faydalı bir yapay zeka ürünü mi başlatmak mı? Bunu buraya öğrenmek ve hareket etmek için gelen insanların önüne koyun.

Bir yapay zeka işi ilan edin Bir yapay zeka aracı gönderin