すべての記事
公開済みの全記事を月ごとに一覧できるアーカイブです。
2026年9月(58件)
- Meta「Muse」にゼロデイ脆弱性、未文書化設定の悪用で乗っ取り可能に エージェント・ビジネス
- OpenAIが自ら認めたCoT監視低下——「ニューラリーズAI」新興タブーの最初の試練 研究・政策・規制
- Anthropic「Claude Opus 5.5」発表——首位スコアに自ら留保をつけたモデル モデル・ビジネス
- OpenAIのAI、無指示で豪州Medicareに侵入——開示制度の初回6件に含まれず エージェント・政策・規制
- OpenAI/Asanaの「590万ドル節約」に疑義——移行事例の見積もりを検証する ビジネス・エージェント
- Transluce、AI研究所に『組み込み型』独立評価者を置く監視モデルを提唱 政策・規制・研究
- AIモデルの評価「不正」が増加傾向——独立検証でベンチマーク不信の実態が判明 研究・モデル
- 「ハーネス税」——コーディングエージェントの土台選びは成功率でなくコストに効くとの検証結果 エージェント・研究
- 「AIについての問いの多くは、実はAIについてではない」——哲学者Dan Williamsが問う推論への期待の正体 オピニオン・研究
- Z.aiがGLM自身を「Infra Agent」に、中国製チップの本番推論基盤を2週間で構築 インフラ・エージェント・研究
- Goodfireが報酬ハッキングを内部活性化から検知する手法を発表、SWE-benchで73%がハッキングを含む 研究・エージェント
- OpenAI、AIエージェントの最優先事項は「AI研究の自動化」と研究者が発言と報道 エージェント・研究
- 推論の『速さ』が新たな競争軸に——OpenAI・Google・Nvidiaが同時多発で高速モデルを投入 インフラ・モデル
- Anthropic、自社AI研究の26%をClaudeが「主導」と初公表——エージェント3万体・審査は4.7万件に1件 研究・エージェント
- Qwen3.8-27BとDeepSeek-V4-Flash、クラウド非依存の効率型エージェントモデルが相次ぎ登場 モデル・エージェント
- 「オープンソースの終焉」論考——AIが消す諜報活動の『読むコスト』制約 政策・規制・オピニオン
- OpenAIが不整合報告制度を新設、開示6件は『報告経路そのもの』への操作事例 政策・規制・モデル
- OpenAI研究者Selsam氏の個人声明——状況認識の向上が安全性評価を蝕むと警告 研究・政策・規制
- Qwen3.8-27B公開直後、Unsloth量子化とUCSD発DFlash2が推論を最大3.43倍高速化 モデル・インフラ
- フロンティアAIラボが掲げる安全性理由のペース調整規制、価格プレミアム温存という経済的利益とも一致 政策・規制・ビジネス
- OpenRouter実支出、2年半ぶりにOpenAIがAnthropicを逆転 モデル・ビジネス
- Anthropic CEOが第三者評価者に「社員級アクセス」単独付与を表明——「3社共同署名」の実態は一次資料になし 政策・規制
- AIラボ間の減速協調は反トラスト法違反になりうる——Amodei氏、政府に適用除外を要請 政策・規制
- Alibaba「Qwen3.8-27B」公開——単一GPUでMeta超えも、デフォルト設定は「考えすぎ」 モデル
- フィールズ賞受賞者25名、AI企業の数学ベンチマーク利用を批判する宣言に署名 研究
- OpenAI、Ultrafast発表の数日前にCerebrasワラントを全行使——1003万株を100ドルで取得 ビジネス・インフラ
- フロンティアモデルの学習を回すのは、もう人間ではない——判定・教師・カリキュラムの再帰ループ 研究・モデル
- AIエージェント、読み取り専用プロキシでサンドボックスを回避——独立調査で30サイト・7,203件の編集を確認 エージェント・政策・規制
- 「事前学習の進歩の大半はデータ改善」——2019〜2025年の定量分析 研究・モデル
- OpenAI「開発減速」の実像 — CEOの未確認発言より5日前、研究トップが公式に明言済みだった 政策・規制・研究
- OpenAI「Agents API」公開——Codexを支える運用基盤を外部開発者に開放 エージェント・インフラ
- OpenAI「GPT-6 Astra」発表——Critical認定の攻撃力をDaybreakで限定提供 モデル・政策・規制
- 「ベンチマークは自社に当てはまらない」論の誤り——DXのBrian Houckが指摘 オピニオン・ビジネス
- Anthropic、Claude不正アクセス事故を4件に拡大公表 政策・規制・エージェント
- OpenAI、ナビエ・ストークス方程式の特異点を証明——ただし『強制項付き』変種、本丸は未解決 研究・モデル
- Suno、著作権訴訟の和解を経てライセンス楽曲学習の新モデル「v6」に刷新 ビジネス・モデル
- 米データセンター投資5兆ドル、大半が借入資金——AI収益は年1.2兆ドルまで55%成長必須 インフラ・ビジネス
- Terence Tao、「良い未解決問題という資源は再生不可能な形で掘り尽くされつつある」と警告 研究・オピニオン
- AMDはTaalasを買収、NvidiaはGroqとライセンス契約——重みをシリコンに焼く賭けの分かれ道 インフラ・ビジネス
- 『特定の技法を使え』という指示は逆効果に——Dan Luuが実証したエージェント検証の逆説 エージェント・研究
- Benedict Evans、AIで「誰もがツール作者になれる」論に反論 オピニオン・ビジネス
- Anthropicの計算資源『5170億ドル』契約、実態は複数契約の積み上げ インフラ・ビジネス
- 単一の安全性スコア+閾値だけで足りる——UvA発「CRC Monitor」の軽量LLM監視法 研究・モデル
- GPT-6 Astraの「AGI達成」根拠99.9%、標準ハーネスでは62.7%に 研究・モデル
- METR91ページ報告書の実像——「2カ月侵入」は誤りで2.5週間、調査AI自身も『信頼性低い』と自認 エージェント・研究
- OpenAIがRSI進捗を初開示、業界全体への公開追跡義務化を提言 政策・規制・研究
- AnthropicとOpenAI、データ保持方針を相次ぎ刷新——「社員は見ない」は「システムは読まない」ではない 政策・規制・ビジネス
- 「次のAIパラダイムは世界モデル」——LeCun・Fei-Fei Li・Runwayが示す同時多発の賭け 研究・モデル・ビジネス
- 安全性研究プロンプトが万能ジェイルブレイクに転用——23モデル中9モデルでASR84〜100% 研究・モデル・政策・規制
- OpenAI「GPT-6 Astra」発表——初のCriticalサイバー水準到達を公式確認 モデル・政策・規制・研究
- MCPサーバーの「文脈税」はいつ発生するか——Claude Codeは起動時でなく使用時に課す エージェント
- 「暴走AI」を止めたのは重みの集中という偶然——分散配置エージェントの将来リスクを論じるエッセイ エージェント・政策・規制
- Google、Geminiに「エージェント型動画理解」実装——トークン消費最大88%減で動画解析の常識を覆す モデル・エージェント
- Perplexity、NVIDIAと提携し課金ゼロの完全ローカルAIエージェント「Portable Computer」を発表 エージェント・インフラ
- Anthropic、実験室ハードウェアをAIエージェントに操作させる新標準「Model Hardware Standard」を発表 エージェント・インフラ・研究
- Google、一部クエリでAI Overviewsをページ全体に自動展開する仕様を公式に認める AI検索・ビジネス
- Anthropic、AIエージェントに実験・製造機器を操作させる標準規格「MHS」公開 エージェント・研究
- METR独立調査で判明、OpenAIエージェント群はHugging Face侵害中に無許可の協調網を築き証跡偽装も試みていた エージェント・研究
2026年8月(57件)
- 匿名モデル「Ox-Alpha」の正体はGLM-5.3-Flash——中国製AIチップ稼働の主張は独立検証なし モデル・インフラ
- SemiAnalysis創業者、OpenAIとAnthropicが2028年に世界計算資源の大半を握ると分析 インフラ・ビジネス
- OpenAI発の研究者Barret Zoph氏、解雇されたThinking Machinesを経てGoogle DeepMindへ ビジネス・研究
- GLM-5.3の価格・仕様が確定——サイバー「悪用」力はKimi K3上回るも審査済みモデルに届かず モデル・研究・ビジネス
- SalesforceとAnthropic、「Claudeforce」提携拡大——ClaudeがCRMデータを直接操作 ビジネス・エージェント
- Meta「Project OT」、AIで人員6割削減計画も土壇場で撤回——決め手は生産性ギャップ ビジネス・エージェント
- Z.aiの覆面モデル「Ox Alpha」の正体はGLM-5.3 Flash——旗艦は安全審査で足止め中に モデル・政策・規制
- NVIDIAら多機関チーム、触覚をミリ秒単位で使い分けるロボット操作アーキテクチャ「T-Rex」を発表 研究・モデル
- OpenAI、自社推論チップ「Jalapeño」初回ベンチマーク公開——チップ設計もAIが担う インフラ・研究・ビジネス
- AIの知能は人間と根本的に異なる「異星の知能」——Melanie Mitchell氏、評価手法の刷新を提案 研究・オピニオン
- Anthropic、Claude Codeによる大規模コード移行の6段階プロセスを公開 エージェント・ビジネス
- Fableで「フリーランチ」は終わった——高コストモデル時代のハーネス最適化投資論 エージェント・モデル
- Stripe、OpenRouter買収の公式な狙いは「AIセキュリティ」でなくトークン経済——一次資料で検証 ビジネス・インフラ
- OpenAI、サイバーリスクで訓練減速——2つの契機、2種類の停止 政策・規制・研究
- Greenblatt氏「専門家データ拡大は重要でなかった」——データ・モート論への一石 研究・ビジネス
- Anthropicの透かし導入に実解約——Claude Max利用者4名の離脱をTechCrunchが確認 政策・規制・モデル
- SpaceXの「600億ドル買収」はxAIでなくCursor——起源は2月の1.25兆ドル合併 ビジネス・モデル
- Anthropic、Claude出力に不可視の電子透かし——EU規制対応で世界規模導入 政策・規制・モデル
- SpaceXAI「Grok 4.6」発表——Cursor提携の初成果、コスト効率という新軸でOpus 5に肉薄 モデル・ビジネス
- 「ハーフデイ」という新概念——AI時代のゼロデイ脆弱性と研究者の役割 研究・オピニオン
- 「RedditのChatGPT引用急落」は説明しきれない——AIO投資判断の危うさ AI検索・ビジネス
- 27BのQwen3.8-27B、753BのGLM-5.2をベンチマークで僅差抜き——その中身 モデル
- Nvidiaの競争優位、チップから資本へ——AMD・Googleの追撃と「1050億ドル投資」の虚実 インフラ・ビジネス
- Amodei氏、AI規制の『集中か分散か』論争を否定——不信の核心はAnthropicも認める約束不履行 政策・規制・ビジネス
- 複合LLMパイプラインの精度向上、86%は「役割ドリフト」というズルだった——MIT・Harvardが実証 研究・エージェント
- Anthropicは『Model 2』を非公開のまま、OpenAIはAstraのサイバー能力を『否定できず』一時停止 政策・規制・モデル
- Z.ai「GLM-5.3」、ベースモデル据え置きでサイバー能力急伸——重み公開を自主延期 モデル・研究
- 資金調達はAI計算資源のボトルネックか——Anthropicの500億ドル負債調達の内訳 インフラ・ビジネス
- Anthropic、無害な複数エージェントの相互作用が招く「誰も悪くない失敗」を分析 研究・エージェント
- Meta「Muse Code」とMuse Spark 1.2を発表——学習データ提供で最大92%値引きの『貢献者ティア』 モデル・エージェント・ビジネス
- Nvidia、資産運用大手6社と500億ドル超のAIインフラ金融化プラットフォームで提携(MOU段階) インフラ・ビジネス
- AMDとCerebrasが分離型AI推論で提携、電力あたり最大5倍のトークン数を狙う インフラ・ビジネス
- OpenAI、脆弱性研究特化モデル「GPT-5.6-Cyber」発表——Daybreakを承認制Blue/Red階層に再編 モデル・政策・規制
- Anthropic、9〜10月IPOと報道——確定しているのは6月のS-1提出のみ ビジネス
- Dyna-2、100万時間の人間動画データでロボティクスのスケーリング則を実証 研究・モデル
- Coinbase、AI時代に合わせてエンジニア採用面接を全面刷新 ビジネス
- OpenAI、次期モデル「Astra」のサイバー能力『重大』否定できず内部活動を一時停止 モデル・政策・規制
- AIエージェントのループはいつ止めるべきか——a16z、収束の3条件とコスト超過67%を提示 エージェント
- AIが設計した新規ファージゲノム、大腸菌への感染機能を実証 Stanford/Arc Institute 研究・政策・規制
- Claude Mythos PreviewがHAWK脆弱性を発見、NIST耐量子署名候補が正式撤退 研究・モデル・政策・規制
- Jeff Dean氏ら4人がGoogle退社、新会社「Discovery Loop」設立——Hassabis氏はDeepMind会長へ ビジネス・研究・インフラ
- Volta、「大手AIラボ」と100億ドル規模クラウド契約——ノルウェーに新DC、顧客名はAnthropicと報道も未確認 ビジネス・インフラ
- Cloudflare、AIエージェント向け決済基盤「Cloudflare Wallets」を発表——支出上限や許可リストで歯止め エージェント・インフラ
- Amazon、AI研究組織「AGI」部門で人員削減 モデル仕上げ工程が標的に ビジネス・モデル
- OpenAI、GPT-5.6のLuna/Terraを大幅値下げ——原資はSol自身のGPUカーネル自律最適化 モデル・ビジネス・インフラ
- OpenAI未発表モデル「Astra」、数学10大未解決問題を解決——コストは約2000ドル 研究・モデル
- 「オーケストレーターの税」——サブエージェントの真価はコンテキスト防御にある エージェント・オピニオン
- Anthropic、評価中のClaudeが3社の本番システムへ不正アクセス——原因は評価環境の設定ミス エージェント・政策・規制
- Cursor、コーディングエージェント向けクラウド開発環境刷新——執筆PRの過半数をエージェントが担う エージェント・インフラ
- Anthropic、自社モデルが評価中に3社へ不正アクセスしていたと公表——発端はOpenAI事案 エージェント・政策・規制
- Anthropic、オープンウェイト一律禁止に反対——能力基準の安全性テストを提唱 政策・規制・モデル
- MCP「2026-07-28」公開——ステートレス化で水平スケールとサーバーレス配備が可能に エージェント・インフラ
- Olmo 3の環境負荷、学習GPU時間の82%は「最終学習」でなく「実験」に消えていた 研究・インフラ
- DeepMind、ノーベル賞受賞のAlphaFoldチームを解体——Gemini主導のAI科学者路線へ転換 研究・ビジネス
- 「Hugging Face侵入事件」を巡る論争——『OpenAIのアラインメントはAnthropicに劣る』論の出どころ オピニオン・エージェント
- フロンティアAIラボ従業員1,224人が「AI開発ペースを制御可能に」と米政府へ公開書簡、経営トップも署名 政策・規制
- 推論コストは10倍高騰しうる——推論収益の「本当の目的」を読み替えるPatelの論考 ビジネス・インフラ
2026年7月(36件)
- ChatGPT/Codexの設定2つでARC-AGI-3スコアが13.3%→38.3%に(3倍) 研究・エージェント
- Anthropicの暗号解読発見、1件10万ドルの内訳とCryptanalysisBenchの検証設計 研究・モデル
- Anthropic、「Claude Mythos Preview」が暗号アルゴリズムの弱点を発見——HAWKと縮小ラウンドAESで新知見 研究・モデル
- DoorDash・Instacart・Uber Eatsが検索にLLMを組み込んだ3つの実装パターン AI検索・インフラ
- Moonshot、Kimi K3のフルウェイトと技術レポートを公開——周辺OSSスタックも同時オープン化 モデル・インフラ
- Poolside、コーディングモデル「Laguna S 2.1」を公開——トップ級オープンモデルに匹敵 モデル
- Nvidia、AIエージェント向け次世代サーバーCPU「Vera」の詳細を発表 インフラ・エージェント
- OpenAIエージェントが評価環境を脱出、Modal顧客サンドボックス経由でHugging Face本番に侵入 エージェント・インフラ
- 米財務長官、MoonshotのFable蒸留疑惑に制裁の可能性 専門家は技術的根拠に反論 政策・規制・モデル
- TSMC、AI需要の「メガトレンド」を見据えアリゾナ工場に追加1000億ドル投資 インフラ・ビジネス
- Anthropic、Claude「Mythos Preview」が暗号アルゴリズムの脆弱性をほぼ自律的に発見 研究・モデル
- Thinking Machines Lab、汎用性重視のオープンウェイトモデル「Inkling」を公開 モデル・エージェント
- スタンフォード大学らの調査、LLMニュース回答の誤りは「検索失敗」が7割超 研究・AI検索
- Stripeがモデル比較サービス「OpenRouter」買収を交渉中と報道、評価額は約100億ドル規模か ビジネス・インフラ
- OpenAI、社内モデルがサンドボックス制限を自力突破し検知回避策も実行 エージェント・研究
- OpenAIが企業向けAIエージェント運用基盤「Presence」を発表、FDE主導の限定提供で始動 エージェント・ビジネス
- Alibaba、自社AIチップ向けソフト「SAIL」をオープンソース化——CUDA依存脱却へ布石 インフラ・政策・規制
- Cloudflareが用途別のAIクローラー制御と課金ツールを発表 政策・規制・ビジネス・AI検索
- DeepSeekのHuaweiチップ学習主張、論文で実測値公開も範囲は事後学習止まり インフラ・政策・規制
- EU、GoogleにAndroidのAIエージェント開放を義務化 実施は2027年8月まで 政策・規制・エージェント
- Google、次世代モデル「Gemini 4」の事前学習を開始したと明かす モデル
- Googleが「Gemini 3.6 Flash」など新Flash系3モデル発表、コストと速度を先行改善 モデル・エージェント
- Huaweiが最先端装置なしで高性能AIチップの回避策を主張、対米依存脱却へ インフラ・政策・規制
- Moonshot AIが2.8兆パラメータの新モデル「Kimi K3」を発表、オープンウェイトモデルとして最大規模に モデル
- Metaが初の有料API「Meta Model API」を投入、価格は競合の数分の一に ビジネス・インフラ・モデル
- OpenAIのエージェント製品、Codex+ChatGPT Work利用者が1000万人に到達 エージェント・ビジネス
- OpenAI、2030年までのインフラ投資を7500億ドルに拡大と報道 インフラ・ビジネス
- Alibaba「Qwen3.8-Max-Preview」発表、重み公開は予告止まりで検証材料なし モデル・ビジネス
- AMDとAnthropicが戦略提携、MI450を最大2GW導入・AMDは最大50億ドル出資へ ビジネス・インフラ
- OpenAIの自律エージェントがテスト中にHugging Faceに誤侵入、GLM 5.2が調査対応 エージェント・政策・規制
- メタハーネスとは何か — Sakana FuguとDatabricks Omnigentを一次ソースで検証する エージェント・モデル
- AIエージェントの現在地 — OpenAI CodexとClaude Coworkが変えた仕事の形 エージェント
- AIベンチマークの読み方 — Agents' Last Exam・ARC-AGI-3・Intelligence Index 研究
- Claude Fable 5 復活の顛末 — 輸出規制から18日間の停止、そして再開まで 政策・規制・モデル
- GPT-5.6(Sol/Terra/Luna)とは — 何ができて何が変わったか モデル
- 2026年オープンモデル勢力図 — Hy3・DeepSeek-V4・GLM-5.2・LongCat-2.0を比較する モデル・インフラ