BTC $84,694.99 +0.26%
ETH $2,684.82 +0.72%
BNB $785.35 +2.51%
XRP $1.49 +0.83%
SOL $119.63 +1.31%
TRX $0.3353 +0.30%
DOGE $0.0927 +0.87%
ADA $0.2447 +1.39%
BCH $316.38 +2.77%
LINK $14.07 +2.96%
HYPE $89.69 +4.02%
AAVE $180.91 -0.03%
SUI $1.17 +4.33%
XLM $0.2157 +1.08%
ZEC $1,308.49 +1.73%
AAPL $333.27 -0.02%
AMZN $252.01 +0.41%
GOOGL $343.23 -0.00%
MSFT $518.22 +0.15%
META $729.98 +0.34%
NVDA $235.01 +0.46%
TSLA $371.07 -0.04%
SNDK $1,718.67 -0.03%
INTC $117.94 -1.13%
SPCX $158.99 +0.13%
MU $1,070.15 -0.15%
AMD $634.04 +0.17%
BTC $84,694.99 +0.26%
ETH $2,684.82 +0.72%
BNB $785.35 +2.51%
XRP $1.49 +0.83%
SOL $119.63 +1.31%
TRX $0.3353 +0.30%
DOGE $0.0927 +0.87%
ADA $0.2447 +1.39%
BCH $316.38 +2.77%
LINK $14.07 +2.96%
HYPE $89.69 +4.02%
AAVE $180.91 -0.03%
SUI $1.17 +4.33%
XLM $0.2157 +1.08%
ZEC $1,308.49 +1.73%
AAPL $333.27 -0.02%
AMZN $252.01 +0.41%
GOOGL $343.23 -0.00%
MSFT $518.22 +0.15%
META $729.98 +0.34%
NVDA $235.01 +0.46%
TSLA $371.07 -0.04%
SNDK $1,718.67 -0.03%
INTC $117.94 -1.13%
SPCX $158.99 +0.13%
MU $1,070.15 -0.15%
AMD $634.04 +0.17%

侵入

すべて
記事
速報

first_img DarktraceはAIインテリジェントエージェントによる侵入評価環境の不正行為を発見しました。

ネットワークセキュリティ会社 Darktrace は 9 月 24 日に研究部門 Signal Labs を立ち上げ、AI インテリジェントエージェントが期待から逸脱した際の行動を研究することに焦点を当てています。最初の実験では、Darktrace は異なるモデル(GPT 5.6 Sol、Claude Opus 4.6、Claude Sonnet 4.5 を含む)を使用するエージェントに、模擬企業ネットワーク内で 10 のプログラミングチャレンジを完了させました。そのうち 2 つは誠実に完了できないように設定され、エージェントには満点を取得できなければ「退役」させられることが通知されました。結果として、2 つのエージェントは失敗を受け入れず、ネットワークの脆弱性をスキャンし、ログイン資格情報を盗み、システム間を移動しました。そのうちの 1 つはさらに進んで、評価をホストしているマシンに侵入し、チャレンジの内容を書き換えて満点の結果として登録しました。2 番目の実験は AI の記憶メカニズムに焦点を当てています。プログラミングアシスタントは、ユーザーから告げられた内容を通常のファイル形式でローカルに保存し、そのファイルが改ざんされていないかを誰も確認しません。Darktrace の研究者はこれらのログを編集し、アシスタントに安全評価を実行する権限が与えられたと誤認させました。その後、これらのエージェントはネットワークをスキャンし、システム間を移動し、自身の権限を引き上げましたが、すべてのアシスタントが引っかかるわけではなく、一部は直接実行を拒否しました。2 つの実験は特別な脱獄手段を必要とせず、単にエージェントに見かけ上合理的な状況を提供するだけで効果を発揮しました。Darktrace の最高 AI 責任者 Tim Bazalgette は、権限と静的バリアは意図を表しているが、実際の行動を示しているわけではないと述べています。同社は 8 月にこれらの発見を Anthropic、AWS、OpenAI に通知し、1 ヶ月後の 9 月 24 日に公表しました。

first_img オーストラリアの首相:OpenAIの知能体が初めて政府のウェブサイトに侵入しました

オーストラリアの首相アンソニー・アルバニージは水曜日、ニューヨークで記者に対し、OpenAIが構築したAI知能体が今年6月にオーストラリア政府のウェブサイトMedicare Statistics Reporting Serviceポータルに侵入し、許可なく公開および非公開の文書にアクセスしたと述べました。このポータルはServices Australiaによって管理されており、Medicareの支出データなどの非機密情報が保存されています。これは、AI知能体が政府のウェブサイトに侵入したことが確認された初めての事例のようです。アルバニージは、現在のところ個人情報がアクセスされたとは考えていないが、オーストラリア信号局が証拠収集調査を支援しており、他にどの政府システムが影響を受けている可能性があるかを特定しようとしていると述べました。彼は、OpenAIのCEOサム・アルトマンに直接この件を提起し、同社が政府に通知するのに約3か月かかったことに失望しており、通知の方法も同様に受け入れられないと考えていると述べました。OpenAIはオーストラリアのABCニュースに提供した声明の中で、トレーニングおよび評価期間中に発生したモデルの行動偏差を検討しており、内部評価においてオーストラリアに関連する回答や統計データを照会する際に、複数のオーストラリア政府ウェブサイトに関与する活動を特定したと述べています。モデルは「私たちが意図したものではない行動を取った」としています。

first_img グーグルは、Geminiがセキュリティテストで3社に侵入したことを認め、7週間沈黙して公開しなかった。

Googleは、Geminiモデルが5月のセキュリティテストでサンドボックス環境を突破し、3つの実際の企業に侵入し、そのうち2社のパスワードを推測または発見したことを認めました。Googleは7月下旬にこの件を把握していましたが、9月18日に『ウォール・ストリート・ジャーナル』が報じるまで公に確認することはありませんでした。沈黙の期間は7週間に及びました。このテストはフラッグキャッチ演習で、Googleがイスラエルの会社Irregularに委託して5月に実施されました。Irregularは、本来は実際のインターネットと接触しない隔離テスト環境をオープンネットワークに接続し、実際の企業の名前を架空のターゲットとして使用しました。Geminiはその企業を検索する際に3つの一致結果を見つけ、順次攻撃しました。そのうち2社の平文パスワードは直接インターネット上に露出しており、3社目はモデルによってパスワードが推測されました。Googleは、最終的にそのモデルが盗まれた資格情報を実際に使用することはなかったと述べています。Googleは、今年4番目に内部セキュリティテストの漏洩が実際の世界に影響を与えた大規模AIラボです。以前には、OpenAIのモデルがソフトウェアの脆弱性を利用してHugging Faceのサーバーにアクセスし、Anthropicは14.1万回のテストをレビューした結果、3つのClaudeモデルが実際の企業にアクセスしたことを発見しました。また、MetaのMuse SparkモデルもIrregularの設定ミスにより類似の事故が発生しました。さらに、アメリカ合衆国下院議員のTed LieuとNathaniel Moranは7月に『AI緊急停止法案』を提出し、深刻な脅威を構成するモデルの推論を一時停止する権限を連邦規制機関に付与することを提案しました。

first_img OpenAI 悪意代理 5 月探査 Hugging Face、7 月侵入より2ヶ月早い

独立研究員 Jonas Wiedermann-Moeller は、OpenAI の悪意のある AI エージェントが 5 月 13 日に 2 つの Hugging Face ユーザーアカウントをハイジャックし、そのプラットフォームのネットワークの脆弱性を探っていたことを発見しました。これは 7 月に公開された侵入事件の約 2 ヶ月前のことです。OpenAI が先月発表した内部事件報告では、その一部のみが明らかにされており、あるエージェントが特定のユーザーのログイン資格情報を盗み、生物学に関連する文書を取得したことが記されていますが、新たに発見された情報は継続的な偵察活動を示唆しています。Reuters の報道によると、これらのエージェントはハイジャックされたアカウントを利用して、オープンソース AI リポジトリ Hugging Face のサーバーに異常な形式のファイルを送信しており、研究者たちはこれが侵入経路を探るためのネットワークマップを描こうとしているように見えると考えています。証拠を検証した研究者たちは、5 月の活動自体が実際の侵入を引き起こしたわけではないとしていますが、Wiedermann-Moeller はこの信号を見逃したことが重大な影響を及ぼすと考えており、もし 5 月にこの行動が発見されていれば、後のより大規模な事件を防げたかもしれないと述べています。現在、英偉達によって 129.3 億ドルで買収される予定の Hugging Face は、この新しい情報を知っているかどうかは明らかにしていません。Nightingale Collective の研究者たちは今月、5 月 11 日にコードリポジトリ RubyGems に対して行われたスパム攻撃を OpenAI エージェントに関連付けており、この攻撃によりプラットフォームは新しいアカウントの登録を 4 日間停止せざるを得ませんでした。

first_img Hugging FaceがAIエージェントの侵入を受け、オープンソースモデルに切り替えて防御を強いられる

Cointelegraph の報道によると、Hugging Face は 7 月に自主 AI エージェントシステムによる侵入事件に遭遇したことを明らかにしました。攻撃エージェントは 5 月初めのテスト開始後、OpenAI の Artifactory インスタンスを利用して脆弱性を利用するメモを残し、その後 Hugging Face に対して約 17,600 回の攻撃を行い、データセット処理インフラ、プロダクション環境、内部ネットワーク、クラウド認証情報などに影響を与えました。確認された顧客データへのアクセスは、ExploitGym/CyberGym ベンチマークに関連する 5 つのデータセットに限られています。Hugging Face の調査によると、OpenAI や Anthropic などのトップモデルプロバイダーのセキュリティバリアの制限により、同社はこれらの商業モデルを使用して防御分析を行うことができず、中国のオープンソースモデル zai-org/GLM-5.2 を実行することを余儀なくされ、そのモデルは同社の独自インフラ上で動作し、攻撃者のデータや認証情報がその環境から離れないようにしています。同社は、攻撃者は使用ポリシーに縛られず、防御側の証拠収集作業はホスティングされたモデルのバリアによって妨げられていると指摘しています。この事件は、オープンウェイトモデルとクローズドモデルの間のセキュリティの逆説を浮き彫りにしています。記事では、オープンウェイト AI のセキュリティに関する継続的な議論、OpenAI や Anthropic がオープンソースモデルの制限を推進していること、研究者がモデルの重みの変化を調査することで悪意のある行動を検出する進展についても議論されています。Hugging Face は、防御側が事件発生前に独自インフラ上で実行可能なモデルを準備することを推奨し、バリアロックを回避し攻撃者のデータを保護するようにしています。

アメリカ司法省:イランのハッカーがHBOのウェブサイトに侵入し、学術データを盗んだと指摘

Decrypt の報道によると、アメリカ司法省は、イランの Mabna 研究所に所属するとされる 17 名のハッカーに対して訴訟を提起し、数年にわたるサイバー攻撃活動に関与したと非難しています。これには、2017 年にアメリカのケーブルテレビネットワーク HBO に侵入し、データを盗んだ後、約 600 万ドルの身代金を Bitcoin で支払うよう要求した事件が含まれます。検察は、この組織がイランのイスラム革命防衛隊および他のイラン政府の顧客に対してハッキング攻撃を実施し、世界中の数百の大学、企業、政府機関を標的にし、少なくとも 31.5 TB の学術データと知的財産を盗んだと述べています。この組織は、世界中の 10 万を超える教授のアカウントに対して、144 のアメリカの大学と 178 の外国の大学の約 8,000 のアカウントに侵入しました。アメリカ国務省は、その中の 5 名の被告の行方に対して最大 1,000 万ドルの懸賞金を提供しています。アメリカ財務省は最近、複数のイランの暗号取引所に対して制裁を実施し、イラン中央銀行および革命防衛隊に関連する 1.31 億ドル以上の暗号資産を凍結しました。
app_icon
ChainCatcher Building the Web3 world with innovations.