人類學研究所:研究人員被禁止克勞德用於潛在的生物武器研究

人因工程公司已禁止將Claude用於潛在的生物武器研究。了解這項嚴格決定的詳情,以及人工智慧巨頭如何​​應對其被濫用的風險。

你需要知道的最重要的事情

  • 研究人員透過隱藏自己的位置並將危險的研究拆分成看似無害的請求,繞過了克勞德的保護措施,使人類公司難以確定他們的真實意圖。
  • 危險不在於人工智慧失控,而是它能夠加速對人類有害的生物活動,賦予人類新的能力,並在合法使用和惡意使用之間製造灰色地帶。
  • 應對人工智慧濫用需要開發先進的安全措施,以識別多次互動中的可疑行為模式和規避限制的嘗試,而不是單獨評估每個請求。

大型人工智慧公司長期以來一直警告稱,他們的模型可能助長生物武器的研發。在此背景下,Anthropic公司透露,由於部分研究人員的行為引發了嚴重擔憂,該公司已不得不暫停向其提供服務。有通報指出,新的監管機構正在監控人工智慧的濫用情況,這凸顯了這些警告的重要性。

根據《紐約時報》報道,Anthropic 今年已封禁了多名用戶,原因是檢測到一些活動高度可疑,疑似與生物武器研究有關。

澄清一下:Anthropic公司並沒有確鑿的證據證明這些研究人員試圖開發致命病原體。

先進的生物學技術本身就具有「雙重用途」;可能研發出救命疫苗的研究成果,也可能被用於危險的目的。但Anthropic公司發現了這種可疑行為。據報道,研究人員繞過地域限制存取雲端,並採取措施掩蓋其研究目的。這種行為模式足以讓Anthropic公司決定終止這項服務。

他們是如何繞過克勞德的安全措施的?

研究人員並沒有真正「入侵」Claude模型。據Anthropic公司稱,他們只是找到了方法來隱藏他們訪問該模型的入口以及他們最終想要達到的目的。

據報道,曾有一名研究人員使用自動產生的帳戶,透過位於美國的虛擬基礎設施,從不受支援的地區存取了雲端服務。 Anthropic公司也發現,雲端服務請求被路由到一個服務於眾多生命科學研究人員(包括隸屬於民用和軍用機構的病毒學家)的平台。

研究人員也試圖掩蓋其研究目的,以避免觸發雲端保護措施。這在生物學領域尤其難以察覺,因為即使某個單獨的請求是為一項規模更大、潛在危險的項目做出貢獻,它也可能看起來完全合法。

據報道,其中一起案例涉及一位科學家尋求克勞德的幫助,起草一份研究經費申請書,旨在對基孔肯雅病毒進行基因改造,以研究其傳播性和免疫逃逸等特性。該案例表明,克勞德可以用於撰寫研究申請書等複雜任務。這類研究可能具有合法的科學目的,而這正是安特羅皮克公司表示無法確定研究人員的最終意圖是善意還是惡意的原因。

然而,Anthropic 認為,敏感研究和試圖掩蓋活動的組合足以關閉這些帳戶。

為什麼生物學是檢驗人工智慧的終極標準?

人工智慧無法在培養皿中混合化學物質,也無法使用物理實驗室設備製造生物武器。但它可以成為強大的加速器。

對於經驗豐富的實驗室工作者而言,一款優秀的AI模型能夠幫助他們解讀複雜的研究,分析數據,探索並解決問題,並彌合專業技術上的差距。它可以為人類提供所需的一切,使他們能夠更輕鬆、更快捷地完成具有挑戰性的任務。

這使得人工智慧公司處於一個巨大的灰色地帶。一位法學學者和一位生物武器研發者可能會提出許多相同的問題。濫用不一定表現為單一、明確的指控。任何人都可以將一個大型專案分解成數十個看似無害的任務,這使得安全系統很難掌握全局,尤其是在人們日益擔憂人工智慧濫用的情況下。

此外,還存在假陽性的問題。如果這些保障措施過於嚴格,可能會​​扼殺合法的科學研究;如果過於寬鬆,則可能使潛在的危險活動蒙混過關。

這一切都取決於人的意圖。

克勞德正在打電話,背景是人本主義的標誌。

尤其是在雅各布·考克森昨天從人為因素公司辭職之後,人們對人工智慧的擔憂達到了白熱化的程度,因此澄清這裡沒有發生的事情至關重要。我們擔心模型失控或自主智能體自行行動,但克勞德並沒有失控,也沒有任何自主人工智慧體開始自行策劃生物武器。一切都在人類的掌控之中。

這使得危險更加迫在眉睫。令人擔憂的並非超級人工智慧突然決定傷害人類,而是強大的模式賦予了人們原本可能不具備的能力。

對於使用雲端服務撰寫郵件、摘要文件或編寫程式碼的一般使用者而言,一切照舊。但對於整個產業來說,情況已經發生了變化,促使許多人重新評估他們對雲端服務的使用方式

那麼,人工智慧公司究竟能做什麼呢?

這個問題沒有完美的解決方案。屏蔽顯而易見的問題只有在使用者清楚自己想要做什麼時才有效。如果用戶將一個潛在危險的項目拆分成幾十個看似無害的請求,人工智慧公司就需要能夠識別全局情況的安全措施,而不是孤立地判斷每個請求。

這可能意味著要尋找反覆試圖繞過模型安全限制的行為,監控互動過程中出現的可疑模式,並對最強大的科學功能實施更嚴格的控制。公司還可以在推出新模型之前進行測試,以確定其能否幫助經驗不足的人員執行潛在危險的生物學工作。

但每增加一項安全措施都會帶來權衡。試圖檢測生物武器研發者的系統,也可能將正在進行相關計畫的研究人員標記為異常。這就是為什麼Anthropic公司披露資訊如此重要的原因。人工智慧安全的下一步是確定,當某種看似合法的行為模式變得足夠危險,以至於公司需要介入時,該如何界定。



評論被關閉。