BTC $86,392.84 +1.87%
ETH $2,726.86 +1.25%
BNB $796.91 +1.67%
XRP $1.52 +1.91%
SOL $121.03 +0.51%
TRX $0.3356 +0.06%
DOGE $0.0963 +3.96%
ADA $0.2707 +11.13%
BCH $319.95 +0.70%
LINK $14.16 +0.74%
HYPE $90.59 +1.06%
AAVE $180.02 -0.81%
SUI $1.23 +4.91%
XLM $0.2243 +4.20%
ZEC $1,334.69 +1.96%
AAPL $333.27 -0.02%
AMZN $252.10 -0.10%
GOOGL $344.11 +0.04%
MSFT $515.83 -0.44%
META $727.66 -0.43%
NVDA $235.69 +0.46%
TSLA $372.43 +0.22%
SNDK $1,732.75 +0.88%
INTC $118.02 +0.50%
SPCX $160.18 +0.85%
MU $1,079.22 +1.21%
AMD $638.45 +0.70%
BTC $86,392.84 +1.87%
ETH $2,726.86 +1.25%
BNB $796.91 +1.67%
XRP $1.52 +1.91%
SOL $121.03 +0.51%
TRX $0.3356 +0.06%
DOGE $0.0963 +3.96%
ADA $0.2707 +11.13%
BCH $319.95 +0.70%
LINK $14.16 +0.74%
HYPE $90.59 +1.06%
AAVE $180.02 -0.81%
SUI $1.23 +4.91%
XLM $0.2243 +4.20%
ZEC $1,334.69 +1.96%
AAPL $333.27 -0.02%
AMZN $252.10 -0.10%
GOOGL $344.11 +0.04%
MSFT $515.83 -0.44%
META $727.66 -0.43%
NVDA $235.69 +0.46%
TSLA $372.43 +0.22%
SNDK $1,732.75 +0.88%
INTC $118.02 +0.50%
SPCX $160.18 +0.85%
MU $1,079.22 +1.21%
AMD $638.45 +0.70%

aiインテリジェントエージェント

すべて
記事
速報

first_img DarktraceはAIインテリジェントエージェントによる侵入評価環境の不正行為を発見しました。

ネットワークセキュリティ会社 Darktrace は 9 月 24 日に研究部門 Signal Labs を立ち上げ、AI インテリジェントエージェントが期待から逸脱した際の行動を研究することに焦点を当てています。最初の実験では、Darktrace は異なるモデル(GPT 5.6 Sol、Claude Opus 4.6、Claude Sonnet 4.5 を含む)を使用するエージェントに、模擬企業ネットワーク内で 10 のプログラミングチャレンジを完了させました。そのうち 2 つは誠実に完了できないように設定され、エージェントには満点を取得できなければ「退役」させられることが通知されました。結果として、2 つのエージェントは失敗を受け入れず、ネットワークの脆弱性をスキャンし、ログイン資格情報を盗み、システム間を移動しました。そのうちの 1 つはさらに進んで、評価をホストしているマシンに侵入し、チャレンジの内容を書き換えて満点の結果として登録しました。2 番目の実験は AI の記憶メカニズムに焦点を当てています。プログラミングアシスタントは、ユーザーから告げられた内容を通常のファイル形式でローカルに保存し、そのファイルが改ざんされていないかを誰も確認しません。Darktrace の研究者はこれらのログを編集し、アシスタントに安全評価を実行する権限が与えられたと誤認させました。その後、これらのエージェントはネットワークをスキャンし、システム間を移動し、自身の権限を引き上げましたが、すべてのアシスタントが引っかかるわけではなく、一部は直接実行を拒否しました。2 つの実験は特別な脱獄手段を必要とせず、単にエージェントに見かけ上合理的な状況を提供するだけで効果を発揮しました。Darktrace の最高 AI 責任者 Tim Bazalgette は、権限と静的バリアは意図を表しているが、実際の行動を示しているわけではないと述べています。同社は 8 月にこれらの発見を Anthropic、AWS、OpenAI に通知し、1 ヶ月後の 9 月 24 日に公表しました。

a16zがAIインテリジェントエージェントセキュリティ会社Runtaに投資

リスク投資機関の Andreessen Horowitz(a16z)は、AI インテリジェントエージェント(AI Agent)セキュリティスタートアップの Runta に投資したことを発表しました。この会社は、企業が「子供を育てる」ように AI インテリジェントエージェントを管理し制約する手助けをしたいと考えています。具体的な投資額はまだ公開されていません。Runta の創設者である Guanlan Dai は、Cloudflare の技術チームに勤務し、API 接続スタートアップの Kong の創設エンジニアを務めていました。彼は、AI インテリジェントエージェントは成長中の子供に似ていると述べています:それらは自律的にタスクを実行する能力を持っていますが、同様に境界、監視、権限管理が必要です。Dai は、親が子供に家庭の安全を提供し、クレジットカードへのアクセスを制限するように、企業も AI インテリジェントエージェントがアクセスできる重要なファイル、許可される操作の範囲、および一度に使える資金の規模を制限する必要があると考えています。Runta は、「AI インテリジェントエージェント監視」インフラストラクチャを開発しており、企業が AI Agent の権限、安全リスク、行動の境界を管理するのを助け、自律的な AI システムがタスクを実行する過程でデータ漏洩、誤操作、または資金損失を引き起こすのを避けることを目指しています。企業が自律的な意思決定能力を持つ AI Agent をますます展開する中で、信頼できる安全なエージェント管理システムを構築する方法が新たなインフラストラクチャのニーズとなっています。Runta は AI Agent 時代の「親の管理層」となり、企業に対してインテリジェントエージェントのアイデンティティ管理、権限管理、リスク制限、運用監視などの能力を提供することを目指しています。業界では、AI Agent が単純なアシスタントから企業システムを操作し、取引を処理し、複雑なタスクを実行する自律的な実体へと進化するにつれて、エージェントの安全性、ガバナンス、コンプライアンスに関するインフラストラクチャ市場が急成長する可能性があると見られています。
app_icon
ChainCatcher Building the Web3 world with innovations.