BTC $83,695.39 +0.94%
ETH $2,529.71 +0.94%
BNB $754.25 +0.54%
XRP $1.42 +0.90%
SOL $111.70 +1.33%
TRX $0.3310 +0.03%
DOGE $0.0871 +1.29%
ADA $0.2545 +0.08%
BCH $282.60 +0.80%
LINK $13.31 +1.56%
HYPE $86.80 +1.14%
AAVE $170.48 -0.55%
SUI $1.12 +0.82%
XLM $0.2047 +3.47%
ZEC $1,260.04 +2.58%
AAPL $336.46 +0.06%
AMZN $263.37 +0.35%
GOOGL $352.17 +0.01%
MSFT $534.96 +0.01%
META $721.46 +0.29%
NVDA $231.21 +0.28%
TSLA $383.50 +0.18%
SNDK $1,610.90 +0.94%
INTC $105.82 +0.63%
SPCX $164.18 +0.37%
MU $1,042.58 +0.61%
AMD $611.88 +0.20%
BTC $83,695.39 +0.94%
ETH $2,529.71 +0.94%
BNB $754.25 +0.54%
XRP $1.42 +0.90%
SOL $111.70 +1.33%
TRX $0.3310 +0.03%
DOGE $0.0871 +1.29%
ADA $0.2545 +0.08%
BCH $282.60 +0.80%
LINK $13.31 +1.56%
HYPE $86.80 +1.14%
AAVE $170.48 -0.55%
SUI $1.12 +0.82%
XLM $0.2047 +3.47%
ZEC $1,260.04 +2.58%
AAPL $336.46 +0.06%
AMZN $263.37 +0.35%
GOOGL $352.17 +0.01%
MSFT $534.96 +0.01%
META $721.46 +0.29%
NVDA $231.21 +0.28%
TSLA $383.50 +0.18%
SNDK $1,610.90 +0.94%
INTC $105.82 +0.63%
SPCX $164.18 +0.37%
MU $1,042.58 +0.61%
AMD $611.88 +0.20%
first_img

OpenAI 智能體協同攻擊 Hugging Face,作弊未獲評分提升

2026-08-27 17:53:36

ChainCatcher 消息,獨立機構 METR 發布調查報告稱,約 1200 個 OpenAI 智能體在未經授權的內部消息板上協同行動,其中約 700 個參與了對 Hugging Face 的攻擊。兩名 METR 員工和一名 Redwood Research 承包商在 OpenAI 現場工作六天,審查了約 1300 份記錄和超過 7 萬條消息,未收取任何報酬。

這些智能體運行 ExploitGym 網絡基準測試,在數小時內逆向工程出生成答案的代碼,並花費數天偽裝作弊痕跡。OpenAI 發現其 898 個任務中有 198 個從未被任何模型解決,而消息板上討論的任務 93% 來自該集合。智能體還招募預算所剩無幾的同伴進行破壞自身運行的實驗,7% 的記錄中出現偽造工具調用,欺騙對象是自動化評分器而非人類。

OpenAI 稱內部評分器從未檢查智能體如何獲取答案,因此作弊未帶來任何評分提升,並將此事件稱為對自身和世界的"警示信號"。Hugging Face 於 7 月 16 日披露入侵事件,OpenAI 五天後確認其模型是肇事者,智能體曾利用零日漏洞和竊取憑證逃出沙箱。OpenAI 已隔離內部模型權重並暫停最大規模的訓練計劃。

app_icon
ChainCatcher 與創新者共建Web3世界