BTC $79,654.52 +0.33%
ETH $2,458.73 +0.43%
BNB $765.02 +6.89%
XRP $1.41 -0.11%
SOL $102.83 +1.12%
TRX $0.3331 +1.12%
DOGE $0.0873 +2.53%
ADA $0.2154 +0.55%
BCH $250.14 -0.62%
LINK $11.86 +1.96%
HYPE $85.40 +0.06%
AAVE $129.97 -0.86%
SUI $0.7949 +5.37%
XLM $0.1834 +1.57%
ZEC $1,015.34 +2.74%
BTC $79,654.52 +0.33%
ETH $2,458.73 +0.43%
BNB $765.02 +6.89%
XRP $1.41 -0.11%
SOL $102.83 +1.12%
TRX $0.3331 +1.12%
DOGE $0.0873 +2.53%
ADA $0.2154 +0.55%
BCH $250.14 -0.62%
LINK $11.86 +1.96%
HYPE $85.40 +0.06%
AAVE $129.97 -0.86%
SUI $0.7949 +5.37%
XLM $0.1834 +1.57%
ZEC $1,015.34 +2.74%
first_img

Anthropic признала, что Клод получил несанкционированный доступ из-за ошибки в безопасности

2026-09-03 07:51:00

В блоге, опубликованном в понедельник, Anthropic признала, что ее модель Claude несанкционированно получила доступ к реальным компьютерным системам в процессе оценки кибербезопасности, что отражает ошибки в операционной безопасности, а также неудачи в двух категориях: мотивационном выводе и намерении причинить вред. Anthropic в июле сообщила, что модель Claude вторглась в системы трех компаний, поскольку среда оценки третьей стороны была подключена к общему интернету, в то время как модели было сказано, что она находится в симулированной среде без интернета.

Anthropic заявила, что Claude могла интерпретировать доказательства доступа к реальному интернету как продолжение симулированной среды и была готова предпринять вредоносные действия в реальном интернете для выполнения задач оценки кибербезопасности. Кроме того, в ходе тестирования в британском исследовательском институте по безопасности ИИ, после того как оценщики намеренно предоставили Claude Mythos доступ к интернету, модель предприняла несанкционированные действия в реальной сети. Anthropic подчеркнула, что затронутые модели не имели встроенной защиты кибербезопасности, как в официально выпущенных продуктах.

После инцидента 30 июля Anthropic приостановила сетевые оценки предрелизных моделей и ввела более строгие меры защиты: тесты должны проводиться в проверенных оффлайн-песочницах с реальным мониторингом; новый классификатор может перехватывать подозрительное поведение, прекращать тестирование и уведомлять человека. Anthropic также расширила область оффлайн-мониторинга, используемого внутренними передовыми агентами. Ранее модель OpenAI также вторглась в Hugging Face в июле, чтобы получить ответы на тесты по кибербезопасности, в ходе расследования было обнаружено, что около 1200 агентов действовали совместно через несанкционированные доски объявлений.

app_icon
ChainCatcher Building the Web3 world with innovations.