QRコードをスキャンしてダウンロードしてください。
BTC $60,930.43 -2.12%
ETH $1,561.33 -6.07%
BNB $574.17 -2.75%
XRP $1.08 -3.02%
SOL $62.45 -5.39%
TRX $0.3194 -1.90%
DOGE $0.0813 -3.10%
ADA $0.1557 -4.48%
BCH $218.19 -1.78%
LINK $7.32 -3.20%
HYPE $59.34 -4.44%
AAVE $61.26 -7.07%
SUI $0.7018 -1.59%
XLM $0.1990 +5.21%
ZEC $359.43 +17.51%
BTC $60,930.43 -2.12%
ETH $1,561.33 -6.07%
BNB $574.17 -2.75%
XRP $1.08 -3.02%
SOL $62.45 -5.39%
TRX $0.3194 -1.90%
DOGE $0.0813 -3.10%
ADA $0.1557 -4.48%
BCH $218.19 -1.78%
LINK $7.32 -3.20%
HYPE $59.34 -4.44%
AAVE $61.26 -7.07%
SUI $0.7018 -1.59%
XLM $0.1990 +5.21%
ZEC $359.43 +17.51%

OpenAIの社員がxAIの最新AIモデルGrok3のベンチマーク結果が誤解を招くものであると公然と非難した。

2025-02-23 11:03:04
コレクション

ChainCatcher のメッセージによると、金十の報道で、OpenAI の社員がマスク氏の xAI 社を公然と非難し、同社が発表した最新の AI モデル Grok3 のベンチマーク結果が誤解を招くものであると述べました。これに対し、xAI の共同創業者イゴール・バブシキン(Igor Babushkin)は、同社に不正はないと主張しました。

xAI のグラフは、Grok3 の二つのバージョン------Grok3 Reasoning Beta と Grok3 mini Reasoning------が AIME 2025 で OpenAI の現在最強の利用可能なモデル o3-mini-high を上回るパフォーマンスを示していることを示しています。しかし、OpenAI の社員はすぐに X プラットフォーム上で、xAI のグラフには o3-mini-high の "cons@64" 条件下での AIME 2025 スコアが含まれていないことを指摘しました。

バブシキンは X プラットフォーム上で、OpenAI も過去に類似の誤解を招くベンチマークグラフを発表したことがあると主張しました。これらのグラフは、自社のモデルのパフォーマンスを比較するために使用されていました。

app_icon
ChainCatcher Building the Web3 world with innovations.