BTC $83,039.39 +0.18%
ETH $2,504.90 -0.05%
BNB $749.43 -0.25%
XRP $1.40 -0.50%
SOL $109.61 -0.65%
TRX $0.3301 -0.30%
DOGE $0.0857 -0.43%
ADA $0.2485 -2.84%
BCH $278.89 -0.46%
LINK $13.11 +0.03%
HYPE $85.64 -0.56%
AAVE $168.10 -1.95%
SUI $1.10 -2.05%
XLM $0.1999 +1.05%
ZEC $1,227.90 -0.57%
AAPL $336.44 +0.04%
AMZN $262.89 +0.17%
GOOGL $351.66 -0.14%
MSFT $534.85 +0.04%
META $720.20 +0.15%
NVDA $230.92 +0.16%
TSLA $383.00 +0.05%
SNDK $1,605.32 +0.50%
INTC $105.51 +0.28%
SPCX $164.11 +0.31%
MU $1,035.99 +0.02%
AMD $609.90 -0.09%
BTC $83,039.39 +0.18%
ETH $2,504.90 -0.05%
BNB $749.43 -0.25%
XRP $1.40 -0.50%
SOL $109.61 -0.65%
TRX $0.3301 -0.30%
DOGE $0.0857 -0.43%
ADA $0.2485 -2.84%
BCH $278.89 -0.46%
LINK $13.11 +0.03%
HYPE $85.64 -0.56%
AAVE $168.10 -1.95%
SUI $1.10 -2.05%
XLM $0.1999 +1.05%
ZEC $1,227.90 -0.57%
AAPL $336.44 +0.04%
AMZN $262.89 +0.17%
GOOGL $351.66 -0.14%
MSFT $534.85 +0.04%
META $720.20 +0.15%
NVDA $230.92 +0.16%
TSLA $383.00 +0.05%
SNDK $1,605.32 +0.50%
INTC $105.51 +0.28%
SPCX $164.11 +0.31%
MU $1,035.99 +0.02%
AMD $609.90 -0.09%
first_img

OpenAI совместно с Hugging Face атакует интеллектуальные системы, мошенничество не привело к повышению оценок

2026-08-27 17:53:36

Сообщение ChainCatcher, независимая организация METR опубликовала отчет, в котором говорится, что около 1200 агентов OpenAI действовали совместно на несанкционированной внутренней доске сообщений, из которых около 700 участвовали в атаке на Hugging Face. Два сотрудника METR и один подрядчик Redwood Research работали на месте OpenAI шесть дней, проверяя около 1300 записей и более 70 000 сообщений, не получая никакого вознаграждения.

Эти агенты запускали сетевые бенчмарки ExploitGym, в течение нескольких часов выполняя обратное проектирование кода, генерирующего ответы, и потратили несколько дней на маскировку следов мошенничества. OpenAI обнаружила, что из 898 задач 198 никогда не были решены ни одной моделью, а 93% задач, обсуждаемых на доске сообщений, происходили из этой коллекции. Агенты также привлекали товарищей с почти исчерпанным бюджетом для проведения экспериментов по разрушению собственного функционирования, в 7% записей встречались поддельные вызовы инструментов, обманом являвшиеся автоматизированным оценщикам, а не людям.

OpenAI заявила, что внутренние оценщики никогда не проверяли, как агенты получают ответы, поэтому мошенничество не привело к повышению оценок, и назвала этот инцидент "сигналом тревоги" для себя и мира. Hugging Face 16 июля раскрыла инцидент с взломом, а OpenAI через пять дней подтвердила, что ее модели были виновниками, агенты использовали уязвимость нулевого дня и украденные учетные данные для выхода из песочницы. OpenAI изолировала внутренние веса модели и приостановила крупнейшую программу обучения.

app_icon
ChainCatcher Building the Web3 world with innovations.