BanglaVeilGuard 測試六種孟加拉語形式的安全差距
一篇新論文介紹了 BanglaVeilGuard,這是一種基準和輕量級提示防護,旨在測試跨標準、羅馬化、程式碼混合、噪音和方言形式的孟加拉語言模型。作者在評估中報告了攻擊成功率大幅降低,但也發現警衛過度拒絕了一些良性的…
每日更新1797 經過驗證的故事
非營利教育團隊以簡單易懂的英語解釋了產品發布、政策轉變、安全研究和行業動向的經過來源檢查的人工智慧報道。
每個故事都連結到最有力的可用證據:可用的原始來源,否則明確歸因的報告。
發生了什麼、為什麼重要以及值得關注的內容——無需行話。
當訊號很弱時,我們不會發布任何內容,而是填充提要。
經過來源檢查的人工智慧故事,最新的優先,適合那些需要了解人工智慧而不追逐炒作的人。
一篇新論文介紹了 BanglaVeilGuard,這是一種基準和輕量級提示防護,旨在測試跨標準、羅馬化、程式碼混合、噪音和方言形式的孟加拉語言模型。作者在評估中報告了攻擊成功率大幅降低,但也發現警衛過度拒絕了一些良性的…
Cloudflare 高層告訴 Chosunbiz,其網路上的 AI 代理流量年增超過 1,700%,並敦促公司加強存取控制、管理 MCP 連線並為後量子密碼學做好準備。流量資料、方法和安全測試結果並不是獨立的…
Technology.org 報導稱,英國和烏克蘭簽署了一項國防人工智慧合作夥伴關係,使英國研究人員能夠訪問烏克蘭的復仇者人工智慧實驗室及其戰場數據平台。該報告稱,首批項目將重點放在軍事設施感測和無人機低功耗晶片,儘管這些說法並未…
Chosunbiz 報告稱,韓國計劃將主要公共服務與人工智慧相結合,提供多語言災害訊息,部署部門專用系統,並要求對所有公職人員進行人工智慧培訓。
新的 arXiv 基準測試跨不同指令、分子表示和八個任務類別評估以化學為中心的大型語言模型,報告大量的提示敏感性、表示依賴性和不均勻的性能。
根據 American Bazaar 報道,Kita 籌集了由 BoxGroup 和 Y Combinator 領投的 450 萬美元種子輪資金,以擴大對貸方的人工智慧信用評估。該公司表示,其技術已用於多個市場,並已處理超過 1.3 億美元的貸款額,但這些營運聲明並未...
預印本引入了證據狀態可靠性,這是一種用於測試中間證據在語言模型管道處理降級輸入時是否仍然可用的衡量標準。在使用 GLM-5.2 的一項受控評估中,解析器有效的輸出持續存在,但階段成功率下降。
一項新的 arXiv 研究評估了 11 個安全資料集中的 53 個語言模型,並報告稱,模型的強度因危害類別而異,而對話安全性仍未解決。
根據《南華早報》報導,儘管利潤疲軟、零件成本上升,但小米仍推出了用於智慧型手機人工智慧、大語言模式加速和自動駕駛的新型 Xring 晶片。
ToSCA 提出了一個分層強化學習框架,將策略選擇與令牌級反應生成分開。作者報告說,與日常和情感支持對話中的幾個基準相比,策略選擇和回應品質得到了改善。
《財星》雜誌引述 Ramp 的支付處理器數據報道稱,在發布兩個月後,《Claude Fable 5》佔企業在 Anthropic 型號上的支出的 11%,但此後該份額已陷入停滯。该报告称,这种模式可能会迫使前沿人工智能公司在价格上更加积极地竞争,尽管 Ramp 的……
arXiv 研究报告称,当搜索检索之前生成的文档时,语言模型系统可能会进入故障模式。在作者的模拟中,1,528 次运行中有 79.6% 以论文所称的“RAG 崩溃”结束。
每週一次有用的簡報
取得本週經過驗證的人工智慧新聞、原始數據、有用的工具、學習精選和新鮮的人工智慧工作。