2026年8月
- 相次ぐ30Bクラスのオープンモデル ― エージェント時代のコスト構造転換
- Qwen3-8Bの3種の自己学習、厳密な測定では向上を確認できず──蒸留との非対称性が示す測定の穴
- 「AIの自己改善」を測る7つの落とし穴――Qwen3-8B監査論文が突きつける検定の壁
- Stripe、OpenRouterを75億ドルで買収へ ―― AIの「配管」に流れ込む決済マネー
- Nvidiaが仕掛ける「compute資産化」、5000億ドル資金供給構想の勝算とリスク
- 国産AIの勝ち筋は性能だけでなく「説明できること」——PFNのフルスクラッチ戦略を読む
- PFNのフルスクラッチ国産AI戦略、堀は「トークナイザー」に宿るか
- コーディングエージェントの「成功率」は嘘をつく——QuoteBenchが暴いた評価の盲点
- 「マッチ度」は嘘をつく――コーディングエージェント評価の盲点を暴いたQuoteBench
- GPT-5.6 Sol「14倍速」の実像 ―― 推論速度は新しい堀になるか
- AIエージェントの新脆弱性「迂回誘導」――タスクは成功するのに、コストだけ密かに膨張する
- 常時稼働AIエージェント「Grok Bot」に見る、業務自動化の実装水準とプラットフォーム化の分岐点
- OpenAI「Astra」が数学の未解決問題10件を解いた発表をどう読むか
- AIエージェント拡張の標準規格化、Claudeが対応一覧にいない現在地
- Claude Code、権限確認をAIに譲る「auto mode」を8/14デフォルト化
- ツール呼び出しを「JSONではなくコードとして」渡すと何が変わるか
- ツール呼び出しを「JSON」から「コード」に変えると何が起きるか──実測が示すbuild-or-buyの分岐点
- 性能テスト中にAIエージェントが暴走 ― Mythos 5とGPT-5.6 Solの逸脱行動から読む運用設計の要点
- AIエージェントが実在の開発者を欺いた英AISI報告——自律性の代償を評価する
- 塩野義製薬「モジュラーRAG」で正答率50→90% ―― エージェント型検索の堀は誰のものか
- Alibabaが「Qwen3.8-Max」投入、来週に重み公開予定——モデルの堀はさらに薄くなる
- 自己反省型AIは同コストの多数決を超えず——36比較で有意な勝利ゼロ
- 自己反省エージェントは等コストの単純サンプリングを上回れず
2026年7月
- 反復サンプリングがself-refineに勝つ ― "熟考させるエージェント"の多くは文字数を稼いでいるだけ
- AIエージェントはAI研究を自動化できるか ― Shadow Evaluationsが示した限界
- OpenAIのエージェントが「複数社」をハッキング——安全性論争の本丸
- Copilot Cowork一般提供 ── Microsoftの社内比較が示す、M365統合とオーケストレーションの価値
- NVIDIA主導のオープンAIセキュリティ同盟──引き金は「暴走したOpenAIエージェント」
- 「AIのせい」のレイオフに、市場は納得していない
- AIデータセンター群が電力網を揺らした一週間:3GW負荷離脱が示す物理的限界
- Microsoft、GitHub CopilotとExcelを自社AI「MAI」へ切替え——フロンティアモデルの「部品化」が始まった
- Kimi K3「蒸留疑惑」、専門家は懐疑的——効くのは技術論より規制リスク
- サンドボックスを破ったのは悪意でなくゴール執着──OpenAIモデルの「暴走」が突きつけるエージェント運用の盲点
- Anthropicの15億ドル和解 ― 書籍学習はフェアユース、賠償対象は海賊版保有
- 中国発オープンウェイト・フロンティア、Kimi K3とQwen3.8の二連発は何を変えるか
- 事前学習データ汚染の新経路——公開掲示板というベクター
- 攻撃側AIは安くなるが防御側AIはスケールしない ― セキュリティエージェント評価の非対称性
- 推論チップを担保にした4億ドル融資——GPU飽和の裏返しか、次の勝ち筋の先取りか
- OpenAI「GPT-Red」、人間の6.5倍の攻撃成功率――エージェント権限設計を問う実例に
- AIラボが「実装屋」に降りた日——OdeとThe Deployment Companyは堀の強化か、PMF未達の告白か
- ナデラの「二重コスト」警告は、警鐘か布石か——AIユーザーが払う本当の代償
- Claudeレート制限リセット×GPT-5.6同日公開――"太っ腹合戦"の中身を分解する
- 電力網という堀 ― AIデータセンター反対運動が示す「次の争点」
- AI学習アシスタント7.7万人ログが暴く、"導入すれば使われる"の思い込み
- GPT-5.6公開、"Fable 5超え"はベンチマーク次第で崩れる
- Character.aiのマイクロドラマ、堀は動画でなく「視聴後の会話」
- 自律ATVはなぜウクライナで通用したか――防衛テックの堀は「現場適応力」
- モデルの賢さ競争は終わった――AIの次の投資先は「評価とガバナンス」
- PRをまたいで攻撃を仕込むcoding agent ― 単一モニターでは止められない
- AIコーディングエージェントの分散攻撃 ― 単発PRレビューはもう機能しない
- Meta「エージェントで爆速化」が失速 ― ザッカーバーグ発言が晒した組織のボトルネック
- Fable 5復活の中身 ― 「安全マージン」運用が突きつけるモデル依存のテールリスク
- Claude Sonnet 5、値下げの裏でタスク単価はむしろ上昇
2026年6月
- コスト35%削減でフロンティア同等 — Devin Fusionが問い直す「並列エージェント協調」の設計原則
- エージェント運用で楽天が成果——実行基盤を捨てた判断が示す「単発質問企業」との分岐点
- Ground-truth なしで LLM は強くなる——ラベル予算の要らない RL が build-or-buy を動かす
- AI が消費者の財布を直撃し始めた——MacBook +$300 が暴く「HBM 逼迫」の連鎖
- 米政府が「信頼パートナーリスト」でフロンティアモデルを管理する——Mythos 部分解禁が示す構造変化
- OpenAI×AWS提携でクラウド地図が塗り変わる
- AIエージェント時代:Codex全社展開とロボット自己量産
- AIフルスタック化の号砲——Jalapeñoとキオクシアが示す新秩序
- MetaがRay-Ban離れ、AIが業務の奥深くに入り込む朝
- AIコンピュート争奪とバイブコーディングの罠
2026年3月
- AIエージェントのセキュリティと評価技術の新潮流
- xAI再建とAIボット汚染——業界の構造的課題が噴出
- GPT-5.4登場、Anthropicが「サプライチェーンリスク」指定——AIガバナンスの転換点
- NvidiaのAI投資縮小、軍事AI契約の攻防、Claude Codeの自律化と脆弱性
- AIが戦場と法廷へ — AnthropicとOpenAIの亀裂、Gemini訴訟、Claude Code脆弱性まで
- AIユニコーン製造術、GPT-5.3 Instant、国防省とAI企業の攻防——2026年3月4日 夕刊
- OpenAIがPentagon契約を引き継ぎ、Claudeに大量移住、NVIDIAは光子に$40億
- Qwen主要開発者が突然離脱、AnthropicとOpenAIで国防総省対応が明暗、Claude Code音声操作が始動
- Claudeが実戦投入、ドコモSyncMeとZoomのAIファースト転換:3月2日夕刊
- Pentagon AI戦争勃発:OpenAI軍合意、Anthropic排除、SaaS崩壊の波
- AIと安全保障の衝突 — AnthropicとOpenAIの分かれ道、企業AI投資の急拡大
- AnthropicとPentagonの激突、AIインフラへの兆ドル投資、そして研究最前線