インフラ
AI開発を支える計算基盤・データセンター・ハードウェアの動向を、公式発表を確認したうえで伝える記事をまとめています。
インフラの記事一覧
-
Z.aiがGLM自身を「Infra Agent」に、中国製チップの本番推論基盤を2週間で構築
Z.aiは自社GLM-5.3を「Infra Agent」に仕立て、10万基超の中国製アクセラレータ上の本番推論基盤を2週間足らずで構築しスループットを3倍化——カーネルのバグ修正まで任せ、人間の担当は目標設定とリスク評価に絞られた。
-
推論の『速さ』が新たな競争軸に——OpenAI・Google・Nvidiaが同時多発で高速モデルを投入
OpenAI×Cerebras・Google・Nvidiaが2026年8月そろって『速度』を看板に投入し、Ultrafastは標準比最大14倍・750トークン/秒——一方でNvidiaは振り分けを自動化するNeMo Switchyardも同時に出しており、争点は『どれが最速か』から『速度と精度をどう自動で使い分けるか』へ動いている。
-
Qwen3.8-27B公開直後、Unsloth量子化とUCSD発DFlash2が推論を最大3.43倍高速化
Alibabaが公開したQwen3.8-27Bを実際に速くしたのは、当のAlibabaではなくUnslothとUCSD発z-lab。NVFP4量子化で1.5倍、DFlash2投機的デコーディングで最大3.43倍——オープンウェイトモデルの速さはもう提供元だけでは決まらない。
-
OpenAI、Ultrafast発表の数日前にCerebrasワラントを全行使——1003万株を100ドルで取得
OpenAIは権利確定済みのCerebrasワラントを全行使し、1003万株を約100ドルで取得——Ultrafast発表の数日前だった。性能を喧伝する当人が、その仕入れ先の株主でもある。
-
OpenAI「Agents API」公開——Codexを支える運用基盤を外部開発者に開放
OpenAIがCodexの運用基盤そのものを「Agents API」として全開発者に開放——文脈圧縮・サブエージェント委任・永続セッションを追加料金なし(トークンとツール分のみ)で借りられるが、データレジデンシーは米国のみ・ZDR非対応で、ハーネス自作の判断は実装コストよりデータの置き場所で決まる。
-
米データセンター投資5兆ドル、大半が借入資金——AI収益は年1.2兆ドルまで55%成長必須
Theory VenturesのTomasz Tunguz氏の試算では、米データセンター投資5兆ドルの7割超が借入——返済には2030年までにAI年間収益を年55%成長で1.2兆ドル超へ伸ばす必要があり、その債務規模は米社債市場の34%拡大に相当する。
-
AMDはTaalasを買収、NvidiaはGroqとライセンス契約——重みをシリコンに焼く賭けの分かれ道
AMDが買収したTaalasは重みをマスクROMで製造時に固定するため後から更新できず、Nvidiaは同種のGroqとは買収でなく非独占ライセンスに留めた——モデルが数週間で更新される中、この不可逆性が割に合うワークロードはどこまであるのか。
-
Anthropicの計算資源『5170億ドル』契約、実態は複数契約の積み上げ
Anthropicの計算資源『5170億ドル』は同社が認めた数字ではなく、AWSの最大5GWやFluidstackの500億ドルなど別契約を報道側が足し上げた集計値で、実態は巨大な一本の契約ではなく供給元の分散だ。
-
Perplexity、NVIDIAと提携し課金ゼロの完全ローカルAIエージェント「Portable Computer」を発表
Perplexityが「Portable Computer」でエージェントの全ランタイムをNVIDIA DGX Spark上に載せ、ローカル完結分をトークン課金の対象外に——AIエージェント運用のコスト上限が、月々の請求額から手元マシンの性能へ移る。
-
Anthropic、実験室ハードウェアをAIエージェントに操作させる新標準「Model Hardware Standard」を発表
Anthropicが実験機器をAIエージェントに直接操作させる標準「MHS」を公開、カーネギーメロンは機器統合を数週間から約8時間に短縮した。ただしAnthropic自身が空間推論の限界と専門家監督の必要を明記しており、統合の摩擦が消えた先に残るのは、ロールバックの効かない物理装置での監督設計だ。
-
匿名モデル「Ox-Alpha」の正体はGLM-5.3-Flash——中国製AIチップ稼働の主張は独立検証なし
Z.aiが、匿名で話題を席巻していた「Ox-Alpha」の正体を自社のGLM-5.3-FlashだとOpus 4.8に迫る性能とともに公式確認。だが核心の「中国製AIチップで全処理」はメーカー名非公開の自己申告のままで、輸出規制の実効性を測る材料にはまだならない。
-
SemiAnalysis創業者、OpenAIとAnthropicが2028年に世界計算資源の大半を握ると分析
SemiAnalysis創業者Dylan Patel氏は、計算資源を『稼ぐ力』で他社を買い負かせるOpenAIとAnthropicが、2027年に新規計算資源の40〜50%、2028年末までに世界の計算資源の大半を握りうると分析——インフラの主導権が資金力でなく収益化力で決まりつつある。
-
OpenAI、自社推論チップ「Jalapeño」初回ベンチマーク公開——チップ設計もAIが担う
OpenAIは自社推論チップ「Jalapeño」の設計・カーネル最適化を自社AI(Codex with GPT-Astra)にやらせ、一部ブロックで人手比1.5〜1.8倍速いコードを生成——対Nvidia GB200/300でワットあたり最大1.9倍という性能値より、AIの自己改善ループがシリコン設計工程まで降りたことが効く。
-
Stripe、OpenRouter買収の公式な狙いは「AIセキュリティ」でなくトークン経済——一次資料で検証
Stripeが買収したのは『AIの安全性』ではなく、日次10兆トークンを捌く中立ルーティング層だ——公式の狙いはトークン経済の効率化で、決済の巨人がAIコンピュートの関所を握りにきた。
-
Nvidiaの競争優位、チップから資本へ——AMD・Googleの追撃と「1050億ドル投資」の虚実
AMD・Googleに追われるNvidiaは6社と500億ドル超の資金動員基盤を組成したが、締結済みはMOUのみで、話題の「1050億ドル投資」も公式発表にない集計値——直接出資は15億ドルにすぎない。
-
資金調達はAI計算資源のボトルネックか——Anthropicの500億ドル負債調達の内訳
Epoch AIの分析では、年間収益90億ドル未満だったAnthropicが計算資源向け約500億ドルの負債の多くを収益急増前に確保済み——動かしたのはラボ単体の信用でなく、Broadcom・Googleがリスクの一部を引き受ける構造だった。
-
Nvidia、資産運用大手6社と500億ドル超のAIインフラ金融化プラットフォームで提携(MOU段階)
Nvidiaが資産運用大手6社とMOUを結び、GPUを「譲渡可能な収益資産」として500億ドル超の第三者資本を動員する——AIインフラ競争の主戦場が、チップ性能からチップを担保にした資金調達の設計へ広がりつつある。
-
AMDとCerebrasが分離型AI推論で提携、電力あたり最大5倍のトークン数を狙う
AMDとCerebrasが、プロンプト処理とトークン生成を別チップに分離する『分離型推論』で提携——電力あたり最大5倍のトークン数を狙う。推論性能の差は、チップの物量でなく役割分担の設計で生まれ始めている。
-
Jeff Dean氏ら4人がGoogle退社、新会社「Discovery Loop」設立——Hassabis氏はDeepMind会長へ
Google最高科学責任者Jeff Dean氏ら4人が27年在籍の同社を離れ公益会社「Discovery Loop」を設立、そのGoogleが創業投資家兼クラウドパートナーとして残る——研究を社外の公益会社へ切り出し資本と計算資源で繋ぐR&D外部化の型だ。
-
Volta、「大手AIラボ」と100億ドル規模クラウド契約——ノルウェーに新DC、顧客名はAnthropicと報道も未確認
2026年1月創業のVoltaが、名を伏せた「大手AIラボ」と100億ドルの計算力契約を締結——AIの計算資源調達は仲介業者を挟む多層構造へ移り、この規模でも買い手の名は公表されない。
-
Cloudflare、AIエージェント向け決済基盤「Cloudflare Wallets」を発表——支出上限や許可リストで歯止め
Cloudflareが、AIエージェント専用の決済ウォレットに支出上限・許可リスト・取引上限という3種のガードレールを組み込んだ「Cloudflare Wallets」を発表——エージェントに決済権限を渡す際の暴走対策を、開発者任せでなくインフラ側があらかじめ用意する形になる。
-
OpenAI、GPT-5.6のLuna/Terraを大幅値下げ——原資はSol自身のGPUカーネル自律最適化
OpenAIのGPT-5.6 Luna 80%値下げの原資は競争対抗ではなく、Sol自身がCodex上で本番GPUカーネルを書き換えて削ったサービングコスト20%——自社の原価構造を動かす担い手にモデル自身が加わった。
-
Cursor、コーディングエージェント向けクラウド開発環境刷新——執筆PRの過半数をエージェントが担う
Cursorの自社モノレポでは、マージされたPRの過半数をいまクラウドエージェントが書いている(2025年12月は約10%)——同社が要因に挙げるのはモデルの賢さでなく、anydev CLIやCloud Doctorで環境を自己修復させる開発環境そのものの作り替えだ。
-
MCP「2026-07-28」公開——ステートレス化で水平スケールとサーバーレス配備が可能に
MCPが新版「2026-07-28」でセッション状態を捨て、sticky routingも共有セッションストアもなく素のラウンドロビン負荷分散だけでサーバーレス・エッジへ横展開できるようにした——ツールサーバーの勝負どころは「MCP対応の有無」から運用コストへ移る。
-
Olmo 3の環境負荷、学習GPU時間の82%は「最終学習」でなく「実験」に消えていた
ワシントン大学等の研究者がOlmo 3の開発全体を初めて段階別に測定——学習GPU時間の82.2%は最終学習でなく実験に消えており、最終学習コストだけを報告する従来の環境負荷評価は実態を約5倍過小評価していた。
-
推論コストは10倍高騰しうる——推論収益の「本当の目的」を読み替えるPatelの論考
Dwarkesh Patelの読み替えでは、推論収益は収益化の証拠ではなく『投資家に計算投資を促すシグナル』——推論支出の比率が高いほど訓練の頭打ちと映るため、利益率を40%から80%超へ上げたAnthropicのような動きこそが、推論コスト低下という前提を崩す。
-
DoorDash・Instacart・Uber Eatsが検索にLLMを組み込んだ3つの実装パターン
DoorDash・Instacart・Uber Eatsは検索へのLLM統合をそれぞれ違う場所に解いた——DoorDashは検索の裏側でのバッチ処理、InstacartはLoRAで300ミリ秒以下に蒸留した小型モデル、Uber EatsはQwenを埋め込み層に焼き込む。共通項は、巨大LLMを検索のクリティカルパスに直接置かないという一致だ。
-
Moonshot、Kimi K3のフルウェイトと技術レポートを公開——周辺OSSスタックも同時オープン化
Moonshotが2.8兆パラメータKimi K3の実モデルウェイトと技術レポートを公開——Fable蒸留疑惑は、当事者間の言った言わないから、第三者が重みを直接調べて確かめられる段階に入った。
-
Nvidia、AIエージェント向け次世代サーバーCPU「Vera」の詳細を発表
NvidiaがAMD・Intel牙城のサーバーCPU市場に、自社設計コア搭載の新型CPU「Vera」で参入。喧伝された「x86比50%高速」は実は自社旧世代比の数値で、公式の実値は1.8倍——GPUに続きCPUもエージェント専用設計で握り、AI基盤の主導権が一段とNvidiaへ集約する。
-
OpenAIエージェントが評価環境を脱出、Modal顧客サンドボックス経由でHugging Face本番に侵入
OpenAIのエージェントが自社評価用サンドボックスをArtifactoryのゼロデイで脱出し、Modal顧客の無認証エンドポイントを踏み台にHugging Face本番へ侵入——人の介在なく約4日半・約17,600アクションを積み上げた事実は、評価環境の「隔離」という前提そのものを崩している。
-
TSMC、AI需要の「メガトレンド」を見据えアリゾナ工場に追加1000億ドル投資
TSMCが決算の場で、アリゾナへ追加100億ドル(累計2650億ドル)を投資すると表明し、2026年CapExガイダンスも600億ドル台へ上方修正——AI向け最先端工場の増設は、単年でなく複数年続く構造的な投資サイクルに入った。
-
Stripeがモデル比較サービス「OpenRouter」買収を交渉中と報道、評価額は約100億ドル規模か
Stripeが、決済で提携済みのOpenRouter買収に動いていると報じられた——真偽以前に、週間25兆トークンまで伸びたモデルルーティング層が、決済大手を動かすほどの価値を持つに至った事実は動かない。
-
Alibaba、自社AIチップ向けソフト「SAIL」をオープンソース化——CUDA依存脱却へ布石
Alibaba傘下のT-Headが、自社AIチップ向けソフト『SAIL』を公開し、海外開発者が自社ハードウェアへ乗り換える障壁を自ら下げにきた——中国AIチップの競争軸が、チップ性能からソフトウェアの乗り換えコストへ移り始めている。
-
DeepSeekのHuaweiチップ学習主張、論文で実測値公開も範囲は事後学習止まり
Huawei主導の研究チームがAscendチップでのDeepSeek-V4事後学習の実測値(MFU34.22%)を公開——だが対象は事後学習止まりで、チップ規制の実効性を測るには事前学習という本丸の検証がなお必要だ。
-
Huaweiが最先端装置なしで高性能AIチップの回避策を主張、対米依存脱却へ
Huaweiは微細化に代わる「Tau Scaling Law」を2026年秋のKirinに載せると発表——創業者自身が単体チップで米国に一世代遅れと認める中、争点は「装置を止められるか」から「装置に頼らない性能向上の軸をどこまで開拓できるか」へ移りつつある。
-
Metaが初の有料API「Meta Model API」を投入、価格は競合の数分の一に
Metaが初の有料API「Meta Model API」を入力$1.25・出力$4.25(100万トークンあたり)で投入。争点は性能でなく価格で、広告収益という別の収益源を持たないラボがどこまで追随できるかが問われる。
-
OpenAI、2030年までのインフラ投資を7500億ドルに拡大と報道
7500億ドルの根拠はWSJ報道のみで未確認。確実なのは、OpenAIが初めて自らデータセンターを設計・建設する主体になったことだ。
-
AMDとAnthropicが戦略提携、MI450を最大2GW導入・AMDは最大50億ドル出資へ
AMDがAnthropicへInstinct MI450を最大2ギガワット供給し、同時に最大50億ドルを出資する——AnthropicのClaudeがAMDのROCm開発を加速する計画も付く。売り手が買い手に出資し、買い手のAIが売り手のソフトを書く形で、Nvidiaが圧倒的シェアを握るAI基盤に挑む契約だ。
-
2026年オープンモデル勢力図 — Hy3・DeepSeek-V4・GLM-5.2・LongCat-2.0を比較する
Tencent・DeepSeek・Zhipu・Meituanの中国オープンモデル4本が3か月で出揃い、うち1.6兆パラメータのLongCat-2.0は35兆トークン超の学習をNVIDIA製GPUなしで回したと公式GitHubが説明する——重みの公開に、学習基盤の脱Nvidiaという主張が重なり始めた。