Ne oldu?
VentureBeat, Anthropic'nin, müdahale edip etmeyeceğine karar vermeden önce bir konuşmanın tüm içeriğini okumak için Slack tabanlı AI aracısı Claude Tag'i güncellediğini bildirdi. Şirket, kaynağın bağımsız bir kıyaslama veya ayrıntılı bir metodoloji sunmamasına rağmen, değişikliğin Claude'nin ne zaman konuşacağına ilişkin muhakemesini yaklaşık %30 oranında iyileştirdiğini söylüyor.
VentureBeat, Anthropic'nin bu ayın başlarında Claude Etiketini güncellediğini, böylece Claude'nin mesajları tek tek yargılamak yerine tüm Slack konuşmasını değerlendirdiğini bildirdi. Önceki tasarım, Claude'nin her mesaja yanıt verip vermemesi konusunda ikili bir karar vermek için hafif bir sınıflandırıcı kullanıyordu. Güncellenen sistemin bu sınıflandırıcıyı kaldırdığı ve dört seçenek arasından seçim yapmadan önce Claude'ye daha geniş kanal bağlamı, hafızası ve kalıcı talimatlar verdiği bildiriliyor: satır içi yanıtlama, bir başlıkta daha derin bir çalışma başlatma, sorunu mevcut bir iş akışına yönlendirme veya hiçbir şey söylememe.
VentureBeat'e göre Anthropic, değişikliğin Claude'yi hem ne zaman müdahale edeceğine ne zaman müdahale etmeyeceğine karar verme konusunda yaklaşık %30 daha iyi hale getirdiğini söylüyor. Makalede aynı hatayı araştıran iki mühendisin yer aldığı bir örnek veriliyor: Mesajlardan biri bir teori içeriyor, diğeri ise destekleyici kanıtlar içeriyor; ancak her iki mesaj da tek başına bir yanıtı haklı çıkarmaz. Bu durumda, güncellenen Claude Etiketinin bir ileti dizisi açabileceği ve araştırmaya başlayabileceği bildiriliyor. VentureBeat ayrıca Claude'nin sürekli olarak ekleyecek yararlı hiçbir şeyin olmadığı kanallarda hareketsiz kalabileceğini de bildiriyor.
Makale, güncellemenin Anthropic'nin "çok oyunculu yapay zeka" olarak adlandırdığı daha geniş stratejisinin bir parçası olduğunu söylüyor. Anthropic'nin kurumsal ürün başkanı Scott White, VentureBeat'e şirketin bağlantıyı, daha güçlü modelleri ve mevcut işbirliği yazılımına yerleştirmeyi proaktif aracıları pratik kılan koşullar olarak gördüğünü söyledi. Kaynak, Claude'nin erişiminin, aracının izinleri ile istekte bulunan kullanıcının izinleri arasındaki en kısıtlayıcı örtüşme nedeniyle kısıtlandığını ve Anthropic'nin kanal içeriğinin başka bir kanalda gösterilmeyeceğini söylediğini bildirdi. Bu iddialar kaynakta bağımsız olarak doğrulanmamıştır.
Kaynak ayrıntıları: venturebeat.com ↗
Neden önemli?
Güncelleme, Claude Etiketini yalnızca doğrudan istendiğinde yanıt veren bir sohbet robotu yerine proaktif, paylaşılan bir işyeri temsilcisine doğru hareket ettiriyor. Bu, ekipler arasındaki aktarımları azaltabilir ancak aynı zamanda izinlerin, anında enjeksiyon savunmalarının, maliyet kontrollerinin ve net insan sorumluluğunun önemini de artırır.
Pratik değişiklik yalnızca Claude'nin daha fazla metin görebilmesi değildir. Artık bir sorunun eyleme geçmeyi hak edip etmediğine karar vermek için mesajlar arasındaki ilişkileri kullanabilir, bu da aracıyı daha çok ekip iş akışının bir katılımcısı haline getirir. VentureBeat, White'ın bunu yapay zekanın yalıtılmış görevleri yerine getirmesinden daha büyük projelere veya organizasyonel hedeflere doğru bir geçiş olarak gördüğünü bildiriyor. Bu modelde sistemin değeri, bir kullanıcının isteğine daha iyi bir yanıt üretmek yerine, bilgilerin insanlar, kanallar ve kurumsal araçlar arasında birbirine bağlanmasına bağlıdır.
VentureBeat, potansiyel faydanın bir örneği olarak White'ın Anthropic içindeki deneyimini sunuyor. Kendisi, Claude'nin daha önce bir veri bilimciye devredilmesini gerektiren bazı veri analizlerini gerçekleştirebildiğini ve bu sayede insanlara tartışma ve muhakeme için daha fazla zaman tanınabildiğini söyledi. Makale ayrıca Claude'nin ilgili kişileri getirmeden önce hata günlüklerini, son kod değişikliklerini ve ilgili Slack tartışmalarını birbirine bağladığı site güvenilirliği kullanım senaryosuna ilişkin açıklamayı da rapor ediyor. Bunlar şirket taraflı hesaplardır, bağımsız verimlilik çalışmaları değildir ve kaynak, aynı sonuçların diğer kuruluşlarda da ortaya çıktığını kanıtlamamaktadır.
Güncelleme aynı zamanda daha büyük bir yönetim sorununu da ortaya çıkarıyor. Slack'e ve bağlı sistemlere sürekli erişimi olan bir aracı, kullanıcıların birlikte incelememiş olabileceği bilgilere göre hareket edebilir; içeriğe yerleştirilmiş hatalar veya kötü niyetli talimatlar da onun davranışını etkileyebilir. VentureBeat, Anthropic'nin bu riskleri ele almak için model düzeyinde sınıflandırıcılar, müşteri tarafından yapılandırılabilir uyumluluk ve analitik kontrolleri, üçüncü taraf güvenlik entegrasyonları ve izin kısıtlamaları kullandığını bildiriyor. Kaynak, başarısızlık oranlarını, bağımsız güvenlik testlerinin ayrıntılarını veya güvenlik önlemlerinin tüm anında ekleme veya veri sızıntısı senaryolarını önlediğine dair kanıt sağlamaz.
İnteraktif Mekanizma: Aslında Nasıl Çalışıyor?
Bu gelişmenin arkasında yatan teknolojiyi etkileşimli olarak keşfedin.
crm_get_transaction(id='4092').An agent must create a draft calendar event for Tuesday at 2 p.m. Which evidence would establish the requested result?
Bundan sonra ne izlenecek?
Temel açık sorular, iddia edilen iyileştirmenin işyerinde ölçülebilir kazanımlara dönüşüp dönüşmeyeceği, her zaman açık bağlamın sonuçta ne kadara mal olacağı ve işletmelerin, işi ne zaman başlatacağına karar verebilecek bir aracıyı nasıl yöneteceğidir. VentureBeat, Anthropic'nin genişletilmiş içeriği kalıcı olarak kullanım sınırlarının dışında tutma taahhüdünde bulunmadığını bildirdi.
İlk test, %30'luk iyileşmenin pratik öneme sahip olup olmadığıdır. VentureBeat, değerlendirmenin boyutunu veya bileşimini, temel hata oranını, test edilen konuşma türlerini veya sonucun dahili bir değerlendirmeden gelip gelmediğini belirtmez. Ayrıca daha az gözden kaçan sorun, daha az gereksiz kesinti, daha hızlı çözüm süreleri veya daha iyi iş sonuçları gösteren bağımsız müşteri verileri de sağlamaz. Bu nedenle alıcılar bu rakamı üretkenlik kazanımlarının kanıtlanmış bir kanıtı olarak görmek yerine Anthropic tarafından rapor edilen bir ürün ölçütü olarak ele almalıdır.
Fiyatlandırma ve kaynak kullanımı henüz kararsız. VentureBeat, ek kanal içeriğinin şu anda herhangi bir plandaki kullanım veya harcama limitlerine dahil edilmediğini bildirdi ancak White bu politikanın devam edip etmeyeceğini söylemeyi reddetti. Anthropic'nin, maliyet ve performansı dengelemeyi amaçlayan model yetkilerinin yanı sıra aracı kimlikleri veya rol tabanlı gruplarla bağlantılı bütçe sınırları sunduğu bildiriliyor. Kaynak, sistemin ne kadar bağlamı işleyebildiğini, kanalları ne sıklıkta değerlendirdiğini, gelecekteki fiyatlandırmanın ne olabileceğini ve kuruluşların proaktif kararların maliyetini denetleyip denetleyemeyeceğini belirsiz bırakıyor.
Daha uzun vadeli soru, doğrudan talep olmadan iş başlatan acentelere işletmelerin ne kadar yetki vereceğidir. VentureBeat, White'ın en sonunda kuruluşların Claude projeleri ve hatta üç aylık hedefler verdiğini, sistemin hangi projelere dikkat edilmesi gerektiğine ve hangi kişilerin dahil edilmesi gerektiğine karar verdiğini hayal ettiğini bildirdi. Bu, bu raporda kanıtlanmış bir yetenek değil, ileriye dönük bir vizyon olmaya devam etmektedir. Ayrıca hesap verebilirlik, çalışanların onayı, üst kademeye iletme, denetlenebilirlik ve bir temsilcinin tavsiyelerinin kurumsal öncelikleri sessizce şekillendirip şekillendiremeyeceği hakkında çözülmemiş soruları da gündeme getiriyor. Rekabet de önemli olacak: Microsoft, Google ve Salesforce büyük işyeri platformlarını kontrol ederken, Anthropic çapraz sistemler düzenlemenin diğer satıcıların dağıtım ve entegrasyonlarına olan bağımlılığını telafi edebileceğine inanıyor.