發生了什麼事
根據彭博社報道,Anthropic 執行長 Dario Amodei 敦促人工智慧產業放慢其最先進模型的開發速度,並表示 Anthropic 將實施額外的安全措施,包括第三方評估人員。彭博社也報道稱,與 OpenAI 和 xAI 相關的領導人呼籲放慢人工智慧的發展。本文並未獨立確定這些提案的範圍、時間安排或可執行性。
彭博社報導,Anthropic 執行長 Dario Amodei 於 9 月 12 日發表了一篇長篇部落格文章,呼籲在更廣泛的行業中「放慢」改進先進人工智慧模型的步伐。根據彭博社報道,Amodei 提到了該技術帶來的不斷升級的風險,並表示 Anthropic 將引入新的安全措施,包括使用第三方評估程序。
彭博社的報告也框架了這項聲明,同時也提出了其他技術領導者呼籲減緩前沿人工智慧發展的呼聲,其中包括 OpenAI 執行長 Sam Altman 和 Elon Musk。除了報導中呼籲放慢步伐之外,消息人士在文章本身中沒有詳細說明這些領導人的提議。
來源是二次報告。 Anthropic 提案的存在和措辭在此歸因於彭博社的帳戶以及該帳戶中描述的連結帖子;本次評估尚未對它們進行獨立確認。彭博社沒有具體說明 Anthropic 的新評估流程何時開始、將涵蓋哪些系統、誰將有資格成為評估員,或該公司是否會發布結果。
為什麼這很重要
較慢的開發速度可能會影響前沿人工智慧系統的訓練、發布和部署速度,而獨立評估可以對安全聲明進行額外的審查。其重要性取決於這些呼籲是否成為競爭公司所採用的具體、可衡量的承諾。彭博社報告了這些提議及其陳述的理由,但消息來源沒有提供獨立證據證明發展已經放緩或提議的保障措施正在有效運作。
該提案解決了先進人工智慧中的一個核心治理問題:競相改進功能日益強大的系統的公司可能面臨在安全測試成熟之前發布或擴展這些系統的壓力。獨立評估人員可以在公司自己的測試之外增加審查,但其價值將取決於對相關係統的存取、避免利益衝突以及報告有意義的發現的能力。
只有當自願放慢對培訓計劃、部署閾值或發布決策產生明顯變化時,它才具有實際意義。消息來源沒有報告暫停、具有約束力的行業協議、政府要求或任何人工智慧產品可用性的變化。它還沒有確定擬議的措施會減少特定風險。
对于用户和组织来说,直接的实际影响是不确定性,而不是已知的产品变化。彭博社没有报告新的准入条件、定价或限制。主要的潜在影响在于未来的模型发布以及公司在部署模型之前提供的证据。
互動機制:它實際上是如何運作的
以互動方式探索這項發展背後的基礎技術。
Why can ethical evaluation not be reduced to one model score?
接下來看什麼
請注意具體的時間表、將涵蓋哪些模型或功能的定義,以及有關第三方評估者的獨立性和權威性的詳細資訊。同樣重要的是要了解其他人工智慧開發商是否採取了類似的承諾,以及政府或客戶是否制定了合規激勵措施。彭博社沒有報告消費者訪問、產品可用性或定價的任何變化。
接下來的重要細節是 Anthropic 承諾的範圍和時間:將評估哪些模型、評估者是否是 Anthropic 的外部人員、他們可以檢查哪些資訊以及他們的發現是否會被發布。來源中沒有指定這些條件。
目前尚不清楚OpenAI、xAI或其他主要开发商是否会做出类似的承诺。一个广泛的、协调的标准可能比单独的声明更有效,但彭博社报道说没有这样的协议。
关注实施证据,例如延迟发布、新的评估报告、修订的部署政策或对安全发现如何影响发射决策的公开解释。消息人士还没有提供任何证据表明所报告的电话已经改变了开发活动。