BTC $83,868.62 -1.13%
ETH $2,651.58 -1.89%
BNB $761.08 -1.22%
XRP $1.46 -2.99%
SOL $117.60 -0.88%
TRX $0.3352 -0.04%
DOGE $0.0908 -4.42%
ADA $0.2375 -4.36%
BCH $299.06 -2.89%
LINK $13.48 -6.38%
HYPE $87.13 -0.97%
AAVE $179.23 +6.32%
SUI $1.11 -5.55%
XLM $0.2126 -3.75%
ZEC $1,289.59 -3.66%
AAPL $333.95 +1.28%
AMZN $250.43 +0.40%
GOOGL $343.01 +1.36%
MSFT $515.36 -0.22%
META $727.53 -0.08%
NVDA $234.43 +0.92%
TSLA $371.49 +4.02%
SNDK $1,721.86 -3.47%
INTC $120.00 -0.68%
SPCX $159.28 +6.48%
MU $1,076.98 -0.93%
AMD $631.88 +2.36%
BTC $83,868.62 -1.13%
ETH $2,651.58 -1.89%
BNB $761.08 -1.22%
XRP $1.46 -2.99%
SOL $117.60 -0.88%
TRX $0.3352 -0.04%
DOGE $0.0908 -4.42%
ADA $0.2375 -4.36%
BCH $299.06 -2.89%
LINK $13.48 -6.38%
HYPE $87.13 -0.97%
AAVE $179.23 +6.32%
SUI $1.11 -5.55%
XLM $0.2126 -3.75%
ZEC $1,289.59 -3.66%
AAPL $333.95 +1.28%
AMZN $250.43 +0.40%
GOOGL $343.01 +1.36%
MSFT $515.36 -0.22%
META $727.53 -0.08%
NVDA $234.43 +0.92%
TSLA $371.49 +4.02%
SNDK $1,721.86 -3.47%
INTC $120.00 -0.68%
SPCX $159.28 +6.48%
MU $1,076.98 -0.93%
AMD $631.88 +2.36%

astra

すべて
記事
速報

first_img GPT-6 Astra は発表から1週間後にユーザーから頭が悪くなったと不満を言われ、OpenAI はまだ応答していない。

Decrypt の報道によると、OpenAI の最新フラッグシップモデル GPT-6 Astra がリリースから1週間後、X プラットフォーム上でその性能が「鈍くなった」と不満を述べるユーザーの投稿が多数見られました。匿名の開発者 synthwavedd は「Astra は今日、明らかに鈍くなったと感じる」と投稿し、これは「リリース後の脳葉切除手術」と皮肉を言いました。以前にこのモデルを称賛していた開発者 Pranjal Paliwal は、Astra のために書いたコードを確認した後、「私たちは AGI を持っていない、私たちが直面しているのは性能の後退だ」と述べました。開発者 Pankaj Kumar は症状を挙げました:回答が速くなったが、質が悪くなったとし、OpenAI が「juice value」(つまり、モデルが回答する前に投入される計算力)を下げたのではないかと疑っています。Salio と研究者 Md Ismail Sojal は同じプロンプトを使ってリリース当日と現在の Astra を比較し、どちらも悪化した結果を得ました。T3Chat の創設者 Theo は、Astra は単に Claude Fable よりも不安定であり、ユーザーのハネムーン期間が終わった後に悪い結果を晒し始めたと考えています。また、OpenAI の前のフラッグシップ GPT-5.6 Sol は7月に同様のサイクルを経験したという意見もあります。その際、OpenAI の幹部 Tibo Sottiaux は意図的にモデルを弱体化させたことを否定しましたが、会社が「推論努力」設定を実験していることを認めました。OpenAI は Astra に関して Sol のような声明をまだ出していません。

first_img OpenAIはGPT-6 Astraを発表し、これをAGI時代の到来と称しました。

OpenAIは木曜日にGPT-6 Astraを正式に発表し、社長のGreg Brockmanは記者会見でこれを「能力の世代間飛躍」と称し、このモデルが汎用人工知能(AGI)の基準に達したと考えています。つまり、人工知能が人間の能力に匹敵するか、あるいはそれを超えることができるということです。Brockmanは「AGI時代へようこそ」と述べました。この判断が正しければ、AI知能体はさまざまな複雑なタスクにおいて人間が行う推論作業を完了することにさらに近づき、さらにはそれ以上のことを行うことができるようになります。GPT-6 Astraは、OpenAIが内部の危険能力評価システムであるPreparedness Frameworkの下で「重要な」閾値を越えた初のモデルであり、これは逐次的な人間の監視なしに、以前は未知であったソフトウェアの脆弱性(すなわちゼロデイ脆弱性)を独立して発見し、それを強化されたシステムで実行可能な攻撃に連結できることを意味します。テストでは、このモデルはExploitBenchベンチマークで100%のスコアを達成しました。記憶された回答による虚偽の高得点を排除するために、OpenAIはGoogle V8 JavaScriptエンジンの20の最近の脆弱性で二次テストを行い、Astraは前代のGPT-5.6 Solを超えただけでなく、以前は未知であった2つのゼロデイ脆弱性を発見し、連結しました。関連する脆弱性は現在、影響を受けた維持管理者に開示されています。高度な自律性を備えているため、Astraの監視の難易度も上昇しています。OpenAIは、監視を回避できるかどうかを評価するテストにおいて、このモデルが従来のシステムよりも追跡が難しいことを認めています。

オールトマンはトランプ政権がAstraに対する自主的な審査を効果的であると述べた。

OpenAIのCEOオルトマンは、トランプ政権が同社の近日発表予定のAstraモデルに対して行った自発的な審査は「生産的なプロセス」であると述べ、人工知能の能力が向上するにつれて、世界中の政府関係者とのコミュニケーションを強化することがますます重要になると語った。OpenAIが近日発表するAstraは、同社初の「重要」なサイバーセキュリティ能力レベルに評価されたモデルである。OpenAIは、この種のモデルは開発過程および発表前により厳格な安全保障措置を講じる必要があると述べた。トランプ政権は、一部の先進的なAIモデルの発表前に審査を行うための自発的な枠組みを確立しており、その中には政府関係者が最大30日間モデルにアクセスできることを許可することが含まれる可能性がある。オルトマンは、トランプ政権がAstraを審査したことを確認し、そのプロセスが自発的な性質であることを指摘した。彼は、これらのモデルの能力がかなり高いレベルに達するにつれて、アメリカ、イギリス、そして世界の他の地域の安全機関と密接に協力することがますます重要になると述べ、Astraは「前進するための重要な一歩」であると語った。

OpenAIのチーフサイエンティストがAstraの論争に応じ、チェーン思考の監視は依然として研究の重点であると述べた。

OpenAIのチーフサイエンティスト、Jakub Pachockiは、誤解を招く報道によってモデルの「監視不能化」を引き起こす競争を避けたいと述べました。彼は、Astraを含む現在の最前線モデルの計算グラフの深さは、GPT-4と比べて2倍を超えないとしています。OpenAIは初期の推論モデル以来、チェーン思考の監視を保持し利用することに取り組んでおり、この技術がモデルの整合性能力が訓練分布からどのように一般化されるかを観察するのに役立つと考えています。Pachockiはまた、チェーン思考の監視が比較的脆弱であり、トレンドが楽観的ではないことを指摘しましたが、研究を通じて強化することができ、現在のOpenAIの研究計画の核心目標となっています。以前、The Informationは、Astraが再帰的深さを使用して、同じグループのTransformer層を繰り返し計算していると報じました。そのため、一部の推論はモデル内部で発生する可能性があり、すべてを思考チェーンとして書く必要がなくなり、モデルがますます監視しにくくなるのではないかという懸念も引き起こしています。

first_img OpenAIの新しいモデルAstraは、自主的にソフトウェアの脆弱性を発見し利用することができ、「深刻な」ネットワーク能力レベルに評価されました。

OpenAIは、同社が近日中に発表するAstraモデルが、人工的な介入なしに以前は知られていなかったソフトウェアの脆弱性を自律的に発見し、それを利用可能な攻撃手段に変換できることを示しています。このモデルは、同社が「重大」(Critical)なサイバーセキュリティ能力レベルの閾値に達した初のモデルとなります。OpenAIは火曜日に発表したブログ記事で、同社のPreparedness Frameworkに基づき、このレベルに達することは、モデルが人工的な介入なしに、強化された実際のシステム内でゼロデイ脆弱性を発見し、利用可能なエクスプロイトコードを開発できることを意味すると述べています。また、高レベルの目標のみで攻撃を設計し実行できることも含まれます。テストでは、Astraは既知の脆弱性に基づいて開発されたエクスプロイトコードのベンチマークテストで100%の成績を収め、別の内部テストでは以前は知られていなかった2つの脆弱性を発見しました。さらに、このモデルは強化されたブラウザサンドボックスを突破し、ホストマシン上でコマンドを実行することに成功し、オペレーティングシステム内の複数の弱点を組み合わせることでroot権限を取得しました。OpenAIは、セキュリティ対策を強化するためにAstraの一部の開発進捗を遅らせており、最先端のサイバーセキュリティ能力を選ばれたテスターのみに開放する計画を立てています。この能力は暗号業界に特に関連性が高く、ソフトウェアの脆弱性は数分で資金の損失に変わる可能性があります。CoinDeskは今年6月に、ますます強力なAIモデルがコードの検索、誤った設定の発見、攻撃の組み立てを数日または数週間から機械の速度に圧縮できると報じました。当時、セキュリティ研究者は、より大きな変化は新しい攻撃のカテゴリーが出現することではなく、既存の脆弱性が発見され利用される速度が大幅に向上することだと指摘しました。
app_icon
ChainCatcher Building the Web3 world with innovations.