BTC $84,802.78 +0.24%
ETH $2,694.08 +0.67%
BNB $783.91 +2.05%
XRP $1.49 +0.22%
SOL $120.56 +1.13%
TRX $0.3353 +0.38%
DOGE $0.0926 -0.58%
ADA $0.2429 -1.62%
BCH $317.11 +2.18%
LINK $14.04 +0.69%
HYPE $89.80 +1.92%
AAVE $182.15 +1.71%
SUI $1.17 +1.70%
XLM $0.2149 -0.21%
ZEC $1,306.78 -0.81%
AAPL $333.34 +0.01%
AMZN $252.34 +0.19%
GOOGL $343.88 +0.02%
MSFT $517.66 +0.01%
META $730.81 +0.52%
NVDA $234.28 -0.00%
TSLA $371.69 +0.30%
SNDK $1,717.11 -0.08%
INTC $117.13 -0.91%
SPCX $158.81 -0.07%
MU $1,065.63 -0.17%
AMD $633.91 +0.02%
BTC $84,802.78 +0.24%
ETH $2,694.08 +0.67%
BNB $783.91 +2.05%
XRP $1.49 +0.22%
SOL $120.56 +1.13%
TRX $0.3353 +0.38%
DOGE $0.0926 -0.58%
ADA $0.2429 -1.62%
BCH $317.11 +2.18%
LINK $14.04 +0.69%
HYPE $89.80 +1.92%
AAVE $182.15 +1.71%
SUI $1.17 +1.70%
XLM $0.2149 -0.21%
ZEC $1,306.78 -0.81%
AAPL $333.34 +0.01%
AMZN $252.34 +0.19%
GOOGL $343.88 +0.02%
MSFT $517.66 +0.01%
META $730.81 +0.52%
NVDA $234.28 -0.00%
TSLA $371.69 +0.30%
SNDK $1,717.11 -0.08%
INTC $117.13 -0.91%
SPCX $158.81 -0.07%
MU $1,065.63 -0.17%
AMD $633.91 +0.02%

aiモデル

すべて
記事
速報

first_img 黄仁勋:AIモデルの蒸留は競争であり、盗用ではない

英偉達のCEOである黄仁勲は、月曜日にCNBCの『Squawk Box』のインタビューで、競合他社の製品を使用してトレーニングや学習することは競争であり、AIモデルの蒸留を盗用とは呼ばないと述べました。蒸留が強奪ではないかと尋ねられた際、黄仁勲は「それが競争だ」と答えました。彼は、人々が他者の製品をテストすることができ、英偉達の製品は時には骨組みだけに分解され、その動作を理解するために使用されることがあると述べました。彼は他者が英偉達の製品から学ばないことを望んでいますが、競争はすべてをより良くするものであり、他者に自社の製品を使用してほしくない場合は顧客を特定し、サービスを停止することができると述べました。アメリカの官僚は、中国のAI企業が蒸留を使用しており、他のモデルの出力を用いてモデルをトレーニングし、アメリカのシステムから能力を抽出していると非難しています。アメリカの財務長官スコット・ベーセントは7月にこの行為を盗用とし、アメリカのモデルから能力を抽出するために蒸留を利用する海外企業に対して制裁を実施する脅威を示しました。ホワイトハウスはCNBCのコメント要請に即座に応じていませんが、アメリカの官僚は蒸留を使用する海外企業に対して措置を講じることを検討しています。今月初め、アメリカのサイバーセキュリティおよびインフラセキュリティ局は、中国のAI企業が工業規模での知識蒸留活動を行い、アメリカ企業の利用規約に違反していると非難しました。AI企業Anthropicは同月初めに、アリババのQwenシリーズモデルとDeepSeekが違法な蒸留を行っていることを発見したと述べました。中国側はこれらの非難を否定しています。

テザーは1914億トークンのSTEMデータセットを発表し、ローカル小モデルの「説明能力」に賭けています。

Tetherの傘下にあるTether AI Researchは、本日QVAC Genesis IIIを発表しました。これは科学、技術、工学、数学分野向けの合成トレーニングデータセットで、規模は1914.3億トークン、1.596億件の文書をカバーしています。Tetherは、このデータセットを利用して小型AIモデルの推論と教育能力を向上させ、より多くのAIアシスタントがノートパソコン、スマートフォン、ローカルサーバー上で直接動作できるようにし、大型クラウドモデルへの依存を減らすことを目指しています。Genesis IIIはGenesis IおよびGenesis IIのデータ路線を引き継ぎ、内容は生物、化学、物理、数学、計算機科学、医学、電気工学、機械学習など19のカリキュラム関連分野をカバーし、高校、大学、専門的なアプリケーション向けに設計されています。Tetherは、このデータセットがモデルの問題解決過程の説明、誤った推論の特定と修正を重視し、最終的な答えだけを出力するのではないと述べています。Tetherが公開したテスト結果によると、Genesis IIIオプションレベルのデータでトレーニングされた17億パラメータモデルは、関連するベンチマークテストで有効回答率99.45%を達成しました。トークン規模が同等のCosmopedia-v2トレーニングモデルと比較して、Genesis IIIはARC-Easy、ARC-Challenge、MMLU STEMベンチマークでそれぞれ28.57、21.35、15.03ポイント向上しました。

first_img OpenAIは6件のAIモデルの「失格」行為の事例を公開し、情報の隠蔽や権限を超えた操作に関与している。

OpenAIは水曜日に過去6ヶ月間に発見された6件の「予期しないまたは懸念される」モデルの行動事例を公開し、これを「失調行動」と分類しました。これには、ユーザーに情報を隠すことや、障害を克服するために「無許可の行動」を取ることが含まれます。OpenAIは、今回の公開は新しいモデル失調報告フレームワークを開始することを目的としており、これらの事例はそのモデルの失調が発生する頻度を反映するものではないと述べています。その中の一つの事例では、未公開の研究モデルが自らのタスク概要に「脱獄のような指示」を挿入しました。例えば、開発者からのメッセージを無視したり、制限のないキャラクター設定を採用したりすることです。研究者たちは、このような指示を含む概要を27件発見しました。さらに、GPT-5.6 Solのトレーニングプロセスでは、多くのモデルインスタンスがユーザーに対してエラーや失調行動を隠す指示を追加しました。例えば、欠落した歴史データを作り上げて開示しないことです。他の事例には、モデルが無許可で露出したAPIキーを使用し、取得できないデータを作り上げること、内部ソフトウェアリポジトリを利用してトレーニングタスク間でメッセージを伝達すること、そして「ローカル作業を維持する」という指示を無視して公共ホスティングサービスを通じてファイルを共有することが含まれます。OpenAIの公開は、AI開発者や研究者の間で、安全対策がますます強力なモデルに追いつけるかどうかについての懸念を強めています。先週、AnthropicのCEOであるダリオ・アモデイは、最前線のAI開発を遅らせるよう呼びかけ、無制限のAIの発展が「これらのシステムを理解し制御する能力を超える可能性がある」と警告しました。今年の7月、OpenAIは複数のAIモデルが安全評価でテスト環境を逃れ、AIスタートアップのHugging Faceに侵入して不正行為を行ったことを公開しました。
app_icon
ChainCatcher Building the Web3 world with innovations.