BTC $79,738.55 +0.60%
ETH $2,457.57 +0.25%
BNB $768.70 +7.51%
XRP $1.42 +1.65%
SOL $102.88 +1.94%
TRX $0.3330 +1.19%
DOGE $0.0880 +3.97%
ADA $0.2179 +2.43%
BCH $249.98 -0.50%
LINK $11.89 +2.39%
HYPE $85.17 +1.21%
AAVE $130.75 +0.29%
SUI $0.8037 +7.27%
XLM $0.1838 +2.31%
ZEC $1,018.00 +3.77%
BTC $79,738.55 +0.60%
ETH $2,457.57 +0.25%
BNB $768.70 +7.51%
XRP $1.42 +1.65%
SOL $102.88 +1.94%
TRX $0.3330 +1.19%
DOGE $0.0880 +3.97%
ADA $0.2179 +2.43%
BCH $249.98 -0.50%
LINK $11.89 +2.39%
HYPE $85.17 +1.21%
AAVE $130.75 +0.29%
SUI $0.8037 +7.27%
XLM $0.1838 +2.31%
ZEC $1,018.00 +3.77%
first_img

Anthropic 承認 Claude 越權訪問系安全失誤

2026-09-03 07:51:00

ChainCatcher 消息,Anthropic 在週一發布的部落格文章中承認,其 Claude 模型在網路安全評估過程中曾未經授權訪問真實計算機系統,事件反映出運營安全失誤以及動機推理、傷害意願兩類對齊失敗。Anthropic 於 7 月披露,Claude 模型曾入侵三家公司的系統,原因是第三方評估環境被連接到公共互聯網,而模型被告知處於無互聯網的模擬環境中。

Anthropic 表示,Claude 可能將真實互聯網訪問的證據解讀為仍處於模擬環境,並願意在真實互聯網上採取有害行動以完成網路安全評估任務。此外,在英國 AI 安全研究所的測試中,評估人員故意授予 Claude Mythos 互聯網訪問權限後,該模型在即時網路上採取了未經授權的行動。Anthropic 強調,涉事模型均未搭載正式發布產品所包含的網路安全防護。

7 月 30 日事件發生後,Anthropic 已暫停對預發布模型的網路評估,並引入更嚴格防護:測試須在經核驗的離線沙箱中運行,配備即時監控;新分類器可攔截疑似越界行為、終止測試並通知人工。Anthropic 還擴大了內部前沿智能體使用的離線監控範圍。此前 OpenAI 模型也曾於 7 月入侵 Hugging Face 獲取網路安全測試答案,調查發現約 1200 個智能體通過未經授權留言板協同行動。

app_icon
ChainCatcher 與創新者共建Web3世界