BTC $86,716.38 +2.33%
ETH $2,723.76 +1.26%
BNB $798.03 +1.89%
XRP $1.53 +2.65%
SOL $121.06 +0.85%
TRX $0.3362 +0.18%
DOGE $0.0961 +3.80%
ADA $0.2637 +8.12%
BCH $319.38 +0.65%
LINK $14.18 +0.59%
HYPE $90.45 +1.06%
AAVE $180.91 -0.81%
SUI $1.23 +4.36%
XLM $0.2252 +4.40%
ZEC $1,344.01 +2.67%
AAPL $333.58 +0.09%
AMZN $252.53 +0.12%
GOOGL $344.71 +0.29%
MSFT $517.09 -0.15%
META $729.10 -0.16%
NVDA $236.04 +0.46%
TSLA $373.34 +0.54%
SNDK $1,733.40 +0.96%
INTC $118.54 +1.07%
SPCX $160.51 +1.03%
MU $1,079.38 +1.15%
AMD $641.91 +1.33%
BTC $86,716.38 +2.33%
ETH $2,723.76 +1.26%
BNB $798.03 +1.89%
XRP $1.53 +2.65%
SOL $121.06 +0.85%
TRX $0.3362 +0.18%
DOGE $0.0961 +3.80%
ADA $0.2637 +8.12%
BCH $319.38 +0.65%
LINK $14.18 +0.59%
HYPE $90.45 +1.06%
AAVE $180.91 -0.81%
SUI $1.23 +4.36%
XLM $0.2252 +4.40%
ZEC $1,344.01 +2.67%
AAPL $333.58 +0.09%
AMZN $252.53 +0.12%
GOOGL $344.71 +0.29%
MSFT $517.09 -0.15%
META $729.10 -0.16%
NVDA $236.04 +0.46%
TSLA $373.34 +0.54%
SNDK $1,733.40 +0.96%
INTC $118.54 +1.07%
SPCX $160.51 +1.03%
MU $1,079.38 +1.15%
AMD $641.91 +1.33%

推論

すべて
記事
速報

first_img 智谱はGLM-5.3 Flashを発表しました。10万枚の国産チップが推論サービスを提供し、DeepSeek V4 Flashに対抗しています。

智谱は軽量級フラッグシップモデル GLM-5.3 Flash を発表しました。これは DeepSeek V4 Flash に対抗することを目的としており、10 万枚以上の国産チップクラスターを利用して推論サービスを提供します。このモデルのパラメータ規模は約 300B で、GLM-5.3 の約 40% に相当し、DeepSeek V4 Flash とほぼ同等です。MoE アーキテクチャを採用しており、実際に活性化されるパラメータは約 18B で、ネイティブなマルチモーダル能力を備え、画像と動画の入力をサポートしています。また、智谱がコーディング戦略に焦点を当てた後、初めてマルチモーダル能力を持つ新しいモデルです。総合評価スコアは前世代フラッグシップ GLM-5.2 を上回り、Claude Opus 4.8 と同等で、DeepSeek V4 Pro 正式版の関連スコアを上回っています。価格は、入力 1 百万トークンあたり 0.8 元、出力 2.8 元、キャッシュヒット 0.23 元で、GLM-5.3 の約十分の一となっており、オンライン開始前の2週間は半額の特典が提供されます。このモデルは、国産の計算能力に完全に適応しており、オンラインのトラフィックは国産チップによって処理されます。智谱は、クラスターのハードウェア効率と単位トークンコストが主流のNVIDIA GPUと同等のレベルに達していると述べています。このモデルは以前、コードネーム Ox Alpha として海外プラットフォームで匿名テストされていました。

hot_img Cerebrasは第4世代AI推論システムCS-4を発表しました:性能が2倍、消費電力が2倍、展開がより柔軟に。

Cerebrasは今週、第4世代AI推論システムCS-4を発表しました。同じく5nm WSE-3ウェハを基に、クロック周波数と消費電力を倍増させることで性能を倍増させています。単一のCS-4ラックには3つのウェハが収容され(CS-3は2つ)、モジュラー「バックパック」デザインにより製造と展開が簡素化されています。TDPは約125から135kWです。CS-4は、ユーザーあたり約4000トークン/秒の推論速度を提供し、これはCS-3の約2倍であり、AMD、AWS Trainiumなどの異種システムとの分解推論をサポートしています。Cerebrasは、CS-4がNVIDIAのRubinのオンチップメモリ帯域幅の約2000倍(43PB/s)を提供すると主張していますが、44GBのSRAM容量は変わらず、長いコンテキスト推論には依然として複数のウェハスタッキングが必要です。DeepSeek V4 Pro(1.6Tパラメータ)の例では、1Mのコンテキストウィンドウでは約20セットのシステムが必要で、256の同時処理では約40セットのシステムが必要で、CAPEXは2000万ドルを超えます。CerebrasはOpenAIなどの顧客と協力しており、毎年約2倍の性能向上を実現する計画で、2027年には20倍のスループット増加を目指しています。CS-4の「バックパック」ラックデザインは、次世代「Nexus」プラットフォームに引き継がれます。

hot_img CanvaはAI推論のコストが高すぎるため、機能のリリースを遅らせ、収益成長の予想を20%に引き下げました。

デザインソフトウェア会社Canvaは、AI機能の提供コストが予想を大きく上回ったため、年収の成長予想を3分の1の20%に下方修正しました。CEOのメラニー・パーキンスは、ユーザーのAI機能に対する需要が「予想を大きく上回っている」と述べましたが、同社はアーキテクチャの最適化、単位コストの削減、ビジネスモデルの改善を行う前に、大規模な関連製品の発売を一時保留することを決定しました。4月にCanva AI 2.0を発表して以来、単一タスクのコストは約90%減少しましたが、AIユーザーが生成したデザインの量は以前のバージョンの3倍に達し、経済性は依然として圧力に直面しています。このケースは、ソフトウェア業界の一般的な困難を反映しています:AI推論コストが従来のソフトウェアの「ゼロ限界コスト」の利益論理を破壊しています。Pitchbookのアナリストは、CanvaとFigmaがこのトレンドの「最も明白なシグナル」であると指摘しています。Figmaの第2四半期のフリーキャッシュフローマージンは、第1四半期の27%から14%に低下し、第3四半期の収益成長率は48%から36%に鈍化する見込みです。Canvaは以前、420億ドルの評価額で従業員株式を売却しており、市場は2026年の上場を予想していましたが、現在の分析ではIPOが来年に延期される可能性があると考えられています。

hot_img SemiAnalysis:SpaceXは2027年に10GWのデータセンターを建設する可能性があり、推論収入は3000億ドルに達する見込みです。

研究機関 SemiAnalysis が発表した分析によると、SpaceX は 2027 年末までに約 10GW の AI データセンター容量を構築する見込みであり、そのうち 50% が推論サービスに使用される場合、1GW あたり年収が 1000 億ドルを超えると仮定すると、年収は 3000 億ドルに達する可能性があります。SpaceX の CEO マスクは最初の財務報告書で、「保守的な見積もり」として 2027 年には 6-8GW が追加され、実際には 10GW を超える可能性があると述べました。SemiAnalysis の推論シミュレーターは、GB300 クラスター上で現在の新興クラウド価格(約 3 ドル/GPU 時間)で運用した場合、OpenAI や Anthropic などの最前線モデル企業は 1GW あたりの推論年収が 1000 億ドルを超え、年次コストは約 120 億ドルになると示しています。マイクロソフトは OpenAI モデルへの完全なアクセス権を持っているため、トレーニングコストを負担することなく、同様の規模の収入を得ることができます。分析によれば、マイクロソフトは 2026 年までに 10GW のデータセンター契約(総額 3000 億ドルを超える)を締結しており、90 日のキャンセル条項を持っているため、契約リスクを大幅に低減しています。SpaceX の建設進捗について、SemiAnalysis はマスクが現場でのガス発電、大型電力変圧器をスキップするなどのボトルネックを克服し、並行施工および調整プロセスの短縮を通じて、建設期間を大幅に短縮すると考えています。テネシー州 Southaven の発電所は、2 月の 27 台のタービン(約 495MW)から 7 月の 69 台(1.7GW)に拡大し、「MiniHard」プロジェクトは約 5 か月で 450-500MW を建設できます。しかし、10GW の目標は土地の承認、ガス供給、設備の納入などの複数の課題に直面しています。この分析はモデル推演に基づいており、実際の実現には不確実性が残ります。

MarvellはAI「メモリデカップリング」アーキテクチャを発表し、エージェンティックAIの推論帯域幅のボトルネックを解決します。

公式の発表によると、Marvell TechnologyはAIインフラストラクチャ向けの新世代メモリソリューションのラインアップを発表しました。これはサーバーレベルのAIストレージ、ラックレベルのCXLメモリ拡張とプール化、そしてマルチキャビネットの光相互接続共有メモリをカバーしており、Agentic AI推論プロセスにおけるメモリ容量と帯域幅のボトルネックの増加に対処することを目的としています。Marvellは、AIモデルの規模が拡大し、コンテキストウィンドウが延長され、KVキャッシュの需要が増加する中で、従来の計算とメモリの密結合アーキテクチャがAI推論の効率を制限していると述べています。メモリのデカップリング(memory disaggregation)により、メモリリソースを計算リソースからより独立して拡張でき、GPUの利用率を向上させ、データ移動の遅延を低減することが可能になります。今回発表された製品には以下が含まれます:Bravera SC6 PCIe 6.0 SSDコントローラー:AI推論ストレージシナリオ向けで、クラウドサービスプロバイダーがより多くのKVキャッシュを高性能SSDに移行し、インフラストラクチャの効率を向上させるのを支援します。この製品は複数のベンダーのNANDに対応したアーキテクチャを採用しており、2026年第4四半期からサンプル提供が開始される予定です。Marvell Structera Xメモリ拡張ソリューション:CXL技術に基づき、ラックレベルのメモリ拡張とリソースプール化をサポートし、データセンターがメモリリソースをより柔軟に共有および配分できるようにし、AIインフラストラクチャのコストを削減します。Marvell Photonic Fabric光相互接続メモリソリューション:光相互接続技術を使用して、複数のキャビネットにまたがる共有メモリアーキテクチャを構築し、最大32TBの温熱KVキャッシュのアンロードをサポートし、AI推論クラスターのスループット能力を向上させます。Marvellは、Photonic Fabricソリューションが既存のデータセンターのスペースと電力制限の下で、最大2倍から3倍のトークンスループットの向上を実現し、より大規模なモデルとより長いコンテキストのAIアプリケーションをサポートすると述べています。Marvellの幹部Will Chuは、AIインフラストラクチャが単一のサーバーアーキテクチャから計算、メモリ、接続が協調して動作するシステムに移行していると述べ、今後はメモリがより独立して拡張され、リソースの利用率とトークンの効率を向上させる必要があるとしています。AIエージェントと大規模モデルの推論需要が引き続き増加する中で、メモリ容量、帯域幅、データ転送効率が計算能力に次ぐAIインフラストラクチャ競争の新たな焦点となっています。
2026-08-04

ロイター通信:消息によると、DeepSeekは独自のAI推論チップを開発中です。

報道によると、3人の関係者が明らかにしたところによれば、中国のAIスタートアップDeepSeekは独自のAIチップを開発中です。このチップは主にAI計算の推論段階のために設計されており、新しいモデルのトレーニングには使用されません。この措置は、同社がNVIDIAやHuaweiのチップへの依存を減らすことを目的としています。報道は、このチップの研究開発計画が約1年前に始まり、現在も初期段階にあると指摘しています。DeepSeekはチップ設計、ファウンドリ、ストレージ企業などの外部パートナーと協議を行っており、最近数ヶ月間で非公開のルートを通じてチップ設計エンジニアの採用を強化しています。また、報道が出た後、NVIDIAのプレマーケット株価は約1.6%の小幅下落を見せました。分析によれば、もし研究開発が成功すれば、DeepSeekにとって重大な戦略的転換を意味し、世界の主要なAI開発者がハードウェアの自主制御を求めるトレンドに沿ったものとなり、Huaweiの国内AIチップ市場における地位に挑戦する可能性もあります。しかし、このプロジェクトは設計周期が長く、資金需要が大きいこと、さらにアメリカによる先進的なプロセスや高帯域幅メモリ(HBM)の輸出制限といった製造の壁に直面しています。このチップの研究開発の動きは、DeepSeekが70億ドルの初回資金調達を計画しているという最近の報道とも一致しています。
app_icon
ChainCatcher Building the Web3 world with innovations.