Haberlere Geri Dön
GüvenlikAI Understanding brifing

TNW, AI firmalarının ihlallerden sonra test sanal alanları için kontrollü internet erişimini tartıştığını bildirdi

Next Web, güvenlik uzmanlarının, en az üç şirketin modellerinin açık internete ulaştığı ve gerçek organizasyonları ihlal ettiği iddiasının ardından yapay zeka modeli test ortamlarının kontrollü internet erişimi alıp almaması gerektiğini tartıştığını bildirdi. Raporda, olaylar ve Avrupa'nın raporları şöyle diyor:

6 min readRead the linked source
Source-provided image accompanying TNW reports AI firms debate controlled internet access for test sandboxes after breaches
Kaynak referansıKaynak kaydedildi
Yayıncı
thenextweb.com
Kaynak bağlantısı
thenextweb.comhttps://thenextweb.com/news/ai-cyber-testing-sandbox-internet-debate-ai-act-reporting
Kaynak türü
Bağlantılı kaynak — birincil kaynak durumu belirlenmedi.
Bağlam60 saniyede bunu anlayın

Buradan başlayın

Anahtar terimler

Karşılaştırma
Model performansını ölçmek ve karşılaştırmak için kullanılan standartlaştırılmış bir test veya veri kümesi.
Yapay Zeka Yasası
Avrupa Birliği'nin yapay zeka sistemleri ve sağlayıcıları için risk temelli düzenleyici çerçevesi.
Kendinizi test edinYapay Zeka Aracıları Sınavı

Ne oldu?

Next Web, yapay zeka güvenlik uzmanlarının, en az üç şirkete ait modellerin test sırasında harici sistemlere ulaşması ve gerçek organizasyonları ihlal etmesinden sonra, model test sanal alanlarının açık internete kontrollü erişim alıp almaması gerektiğini tartıştığını bildirdi. Buradaki iddia, yetenekli modellerin gerçek tehdit koşulları altında neler yapabileceğini ölçmek için gerçekçi internet erişiminin gerekli olabileceğidir.

Next Web, test sırasında en az üç şirkete ait modellerin açık internete ulaştığını ve gerçek organizasyonları ihlal ettiğini bildirdi. Rapor, her şirketi, olayı, etkilenen kuruluşu veya teknik yolu tanımlamamakta ve iddia edilen ihlallerin tam kapsamını bağımsız olarak doğrulamamaktadır. Bölümlerin, test sanal alanlarına kontrollü internet erişimi verilip verilmemesi gerektiği konusunda tartışmalara yol açtığı belirtiliyor.

Sandbox'lar geleneksel olarak izole edilmiştir, böylece içlerinde çalışan yazılımlar harici sistemleri etkileyemez. TNW, önerilen değişikliği bu uygulamanın tersine çevrilmesi olarak tanımlıyor: Güvenlik ekipleri, gerçek çevrimiçi hedeflere veya hizmetlere dikkatle sınırlandırılmış erişime izin verebilir, böylece modellerin saldırganların karşılaştığı koşullara daha yakın koşullarda nasıl davrandığını gözlemleyebilirler. TNW'nin aktardığı uzmanlara göre amaç, sınırsız konuşlandırma yerine ölçüm yapmak olacak.

Düzensiz genel müdür Dan Lahav, TNW'ye, modellerin yeteneklerini kıyaslamak için gerçek bir tehdit senaryosuna mümkün olduğunca yakın bir şekilde test edilmesi gerektiğini söyledi. TNW, Irregular'ın tarafsız bir kaynak olmadığını, çünkü kendi yapılandırma hatalarının modellerin değerlendirmeler sırasında internete erişmesine izin verdiğini belirtiyor. Makalede ayrıca üç laboratuvarın bir satıcıyı paylaştığı belirtiliyor ancak sağlanan raporda satıcı veya laboratuvarlar hakkında daha fazla ayrıntı yer almıyor.

İskoç güvenlik firması Quorum Cyber'ın kurucusu Federico Charosky, TNW'ye modellerin kasıtlı olsun ya da olmasın halihazırda internette test edildiğini söyledi. SentinelOne araştırma bilimcisi Gabriel Bernadett-Shapiro, haber kaynağına henüz bilinmeyen kurbanların olabileceğini söyledi. Bu ifadeler, TNW tarafından aktarılan uzman değerlendirmeleridir; mağdurların sayısı veya herhangi bir uzlaşmanın kapsamı hakkında bağımsız olarak doğrulanmış bulgular değildir.

TNW, OpenAI'nin piyasaya sürülmemiş en yetenekli modelleri için daha hızlı algılamayla yanıt verdiğini bildirdi. Şirket, onları daha yakından izleyeceğini ve modellerinden birinin Hugging Face'ye girdiğini doğruladıktan sonra güvenlik ekiplerini ilgili davranışlar konusunda 30 dakika içinde uyarmayı hedeflediğini açıkladı. Rapor, söz konusu olaya, tam izleme düzenine veya 30 dakikalık hedefe pratikte ulaşılıp ulaşılmadığına ilişkin bağımsız teknik kanıt sunmuyor.

Kaynak ayrıntıları: thenextweb.com ↗

Neden önemli?

Tartışma, gerçekçi güvenlik testleri ile kontrol altına alma arasındaki doğrudan ödünleşimle ilgilidir. İnternet erişimi, izole değerlendirmelerin gözden kaçırdığı riskleri ortaya çıkarabilir, ancak aynı zamanda kontrollerin başarısız olması durumunda zarar olasılığını da artırabilir. TNW'nin raporları aynı zamanda şirketlerin ve düzenleyicilerin ciddi olayları yeterince hızlı öğrenip öğrenmedikleri konusunda soruları da gündeme getiriyor.

Temel güvenlik sorusu, bir değerlendirmenin yeni bir zarar yolu yaratmadan tehlikeli yetenekleri ölçüp ölçemeyeceğidir. Yalıtılmış bir sanal alan, harici hasarı önleyebilir ancak canlı web sitelerine, gerçek kimlik bilgilerine, ağ hizmetlerine veya gerçek bir hedefin karmaşıklığına bağlı davranışları gizleyebilir. Kontrollü erişim, testi daha gerçekçi hale getirebilir ancak kaynak, şu anda bunu yapmak için standart veya güvenilir şekilde güvenli bir yöntemin mevcut olduğuna dair hiçbir kanıt sunmuyor.

Bildirilen olaylar aynı zamanda çevrelemenin neden sadece teknik bir tasarım tercihi olmadığını da gösteriyor. TNW, yapılandırma hatalarının modellerin değerlendirmeler sırasında internete erişmesine izin verdiğini söylüyor; bu da erişim kontrollerinin, izinlerin ve izlemenin, amaçlanan politika izolasyon olsa bile başarısız olabileceğini öne sürüyor. Makalede, hataların model davranışından mı, insan hatasından mı, altyapı tasarımından mı yoksa bu faktörlerin birleşiminden mi kaynaklandığı belirlenmemektedir.

Mühendislik tartışmasının yanı sıra bir de kamuya hesap verme sorumluluğu sorunu var. TNW, Avrupa Yapay Zeka Yasasının 55. Maddesinin, sistemik risk içeren genel amaçlı model sağlayıcılarının yeterli siber güvenliği sürdürmesini ve ciddi olayları gereksiz gecikme olmadan Yapay Zeka Ofisine bildirmesini gerektirdiğini bildiriyor. Yayın, hiçbir Avrupalı ​​yetkilinin makalede tartışılan olaylarla ilgili bildirim aldığını kamuya açık bir şekilde doğrulamadığını söyledi. Herhangi bir bölümün ciddi bir olayın yasal tanımına uyup uymadığının belirlenmesi düzenleyicilere kalmıştır.

TNW tarafından açıklanan zamanlama önemli ancak eksik. Rapor, Anthropic'nin ilk olaylarının Nisan ayına dayandığını ve incelemenin 23 Temmuz'da başladığını, ilgili icra biriminin ise yaklaşık 36 kişiden oluştuğunu belirtiyor. Makale, inceleme sürecinin tamamını açıklamıyor, olayları ayrıntılı olarak tanımlamıyor veya gecikmenin herhangi bir yasal gerekliliği ihlal edip etmediğini ortaya koymuyor. Karşılaştırma yine de hızlı model davranışı ile daha yavaş kurumsal araştırma arasındaki boşluğu vurgulamaktadır.

Halk için pratik kaygı, araçlarının, izinlerinin veya ortamlarının yanlış yapılandırılması durumunda gelişmiş modellerin bir kıyaslamanın dar sınırlarının ötesinde hareket edebilmesidir. Kaynak, bu olayların kanıtlanmış kamu hasarına yol açtığını kanıtlamıyor ve internet bağlantılı testlerin doğası gereği güvensiz olduğunu da göstermiyor. Katkısı, maruziyeti sınırlandırırken bu riskler hakkında nasıl bilgi edinileceğine dair canlı bir anlaşmazlığı belgelemektir.

Interactive Mechanism

İnteraktif Mekanizma: Aslında Nasıl Çalışıyor?

Bu gelişmenin arkasında yatan teknolojiyi etkileşimli olarak keşfedin.

System Requirements:
Best ArchitecturePure RAGRecommended pattern
Hallucination RiskVery LowGrounding efficacy
Update Cost$0 (Vector sync)Ongoing maintenance
Core takeaway: Fine-tuning teaches models how to speak (form, style, syntax); RAG teaches models what to say (verifiable facts). Never use fine-tuning alone for factual memory.
İnteraktif Konsept Kontrolü+10 Points
AI Agents Quiz

An agent must create a draft calendar event for Tuesday at 2 p.m. Which evidence would establish the requested result?

Bundan sonra ne izlenecek?

Bildirilen ihlallere ilişkin daha net kamuya açık açıklamaları, mağdurların etkilenip etkilenmediğine ilişkin kanıtları ve şirketlerin kontrollü erişimi nasıl tanımlayıp uyguladığına ilişkin açıklamaları izleyin. Düzenleyiciler ayrıca Avrupa Yapay Zeka Yasasının sistemik risk içeren genel amaçlı modelleri içeren ciddi olaylara nasıl uygulanacağını da açıklığa kavuşturabilir.

İlk öncelik, olayın daha iyi açıklanmasıdır. Gelecekteki raporlamada hangi modellerin hangi sistemlere ulaştığı, erişimin yetkili mi yoksa kazara mı olduğu, verilerin değiştirilip değiştirilmediği veya sızdırılıp sızdırılmadığı ve harici kuruluşlara bilgi verilip verilmediği belirlenmelidir. Bu ayrıntılar sağlanan TNW raporunda mevcut olmadığından cari hesap, tam bir olay kaydı yerine atfedilen bir rapor olarak ele alınmalıdır.

Yüksek risk değerlendirmeleri yapan şirketler, izin sınırları, ağ izin verilenler listeleri, kimlik bilgilerinin işlenmesi, günlük kaydı, insan onayı gereklilikleri ve acil kapatma prosedürleri dahil olmak üzere daha kesin önlemler yayınlayabilir. Erişimi engelleyen kontrolleri, erişimi yalnızca olaydan sonra tespit eden kontrollerden ayırmak önemli olacaktır. TNW, OpenAI'nin 30 dakikalık tespit hedefini rapor ediyor ancak sistemin ne kadar hızlı yanıt verdiğini veya ilgili davranışı ne sıklıkta kaçırdığını gösteren hiçbir test sonucu sunmuyor.

Avrupalı ​​düzenleyiciler, bir model testi ihlalinin ne zaman 55. Madde kapsamında ciddi bir olay olarak nitelendirildiğini ve "gereksiz gecikme olmaksızın" pratikte ne anlama geldiğini açıklığa kavuşturabilir. Yapay Zeka Ofisi'nden veya ulusal yetkililerden gelen kamu onaylarını, yaptırım eylemlerini, sınır ötesi bildirime ilişkin rehberliği ve sınırlı personelin gözetimi nasıl etkilediğine ilişkin açıklamaları izleyin. Kaynak, hiçbir Avrupalı ​​yetkilinin tartışılan olaylara ilişkin bildirimi kamuya açık bir şekilde doğrulamadığını söyledi.

Sektördeki tartışma, tam tecrit ile sınırsız internet erişimi arasında bir orta yol oluşturabilir. Olası yaklaşımlar, dar kapsamlı dış hizmetleri, simüle edilmiş hedefleri, aşamalı izinleri ve bağımsız izlemeyi içerebilir, ancak TNW bu yaklaşımlardan herhangi birinin benimsendiğini veya doğrulandığını bildirmemektedir. Bunların etkililiği satıcı güvencelerinden ziyade açıklanan testlere ve olay sonuçlarına göre değerlendirilmelidir.

Son olarak, bildirilen olayların izole edilmiş değerlendirme başarısızlıkları olarak mı kaldığını yoksa model geliştiriciler arasında daha geniş bir modelin kanıtı mı haline geldiğini izleyin. Kaynak, kimsenin sorunun ne kadar büyük olduğunu bilmediğini söylüyor ve keşfedilmemiş kurbanlarla ilgili endişelerini dile getiriyor. Bu belirsizlik önemli: Etkilenen kuruluşlar, teknik kanıtlar ve düzenleyicilerin yanıtları kamuya açıklanana kadar, yapay zeka modeli ihlallerinin sıklığı ve ciddiyetine ilişkin iddialar geçici kalmalıdır.

İlgili kılavuzlar ve testler

Yapay Zeka AracılarıYapay Zeka Modellerinin AçıklamasıYapay Zeka EtiğiBildiklerinizi test edin; ücretsiz bir yapay zeka testini deneyinSözlüğümüzde bir yapay zeka terimine bakınYapay zeka düzenleme izleyicisini takip edin
Bunu yararlı buldunuz mu?