2026年8月 AIニュースまとめ
2026年8月に visionhub.jp が収集・要約した AI 関連ニュースから、 運営者(awano27 / Claudian)が選んだ全 31 本のトピックをカテゴリ別に整理しました。 その日に最も重要だった話題を1日1本ピックアップしており、各項目から当日のスライドと一次ソースへ直接アクセスできます。
今月のハイライト
DeepSeek V4-Flash 正式版がなぜ「最重要トレンド」なのか
DeepSeek V4-Flash 正式版の公式リリースと MIT オープンウェイト公開を深掘り。後訓練のみでエージェント性能が跳ね、フロンティア級コスト効率を実現した理由を整理する。…
OpenAI Astra:初の「Critical」サイバー能力で一部開発を一時停止
OpenAIが次世代モデルAstraについて、Preparedness Framework上のCriticalサイバー能力閾値を排除できないと初めて表明。要件未達の内部活動を一時停止し、隔離環境・CoT監視・政府共同評価を導入。7月のHugging Face事件とは無関係。フロンティアラボによる自己抑制の初事例として整理する。…
Evoは、自然界にないファージの全ゲノムを書いて動かした
タンパク質をひとつ作った話ではない。細菌を殺すウイルスの設計図が、実験で動いた。 タンパク質をひとつ作った話ではない。Science 8月6日。Stanford と Arc Institute の研究だ。 AIの Evo が、細菌を殺すウイルス(ファージ)の設計図を最初から最後まで書き、約285個のうち16種が自分で増え、大腸菌を溶かした。 大事なのは、ファージを作ったことではなく、自然界にない設計図が実験で動いたことだ。…
広く配る前提が折れた。Cursorへの供給を、契約の最長通知で止める
OpenAI公式。SpaceXによるCursor買収後、モデル供給契約を巻き戻す。提案の遮断日は2026-11-12。Astraは出さない。公式日は2026-08-28。…
ツール・プロダクト
Alibaba Qwen3.8-Max 正式リリース — 2.4T MoE / 16日自律コーディング
Alibaba Qwen3.8-Max 正式発表の深掘り。総パラメータ2.4T・アクティブ95BのMoE、1Mコンテキスト、16日間ほぼ人間介入なしの自律コーディング(265コミット・127PR・151Issue)、価格$2/$6、来週オープンウェイト予定までを整理する Day Slide。…
Agent Plugins 1.0.0:ベンダーロックインの終わりの始まり — 競合各社が共同策定したポータブル・エージェント拡張標準
Vercel主導、AWS・Anysphere(Cursor)・GitHub・Microsoft・OpenAIが共同策定したAgent Plugins 1.0.0。Agent SkillsとMCPサーバーを一度パッケージ化すればChatGPT/Codex・Cursor・GitHub Copilot・Kiro・VS Codeなどで共通利用可能。ベンダーロックイン解消の構造的一歩を深掘りする。…
GLM-5.3の重みがHFに出た。753Bを自前で回せ
公式HF zai-orgにGLM-5.3の重み。commit「Initial commit 0828」= 08/28 02:16 JST。753B。ブログはまだ「2週間後に重み」。GLM-5.3 LicenseはMITではない。…
Gemini Spark(Pro)が日本で実務投入可能に
Google AI Proでも使えるようになった24/7パーソナルAIエージェント Gemini Spark の日本展開、バックグラウンド限界、人間ハンドオフを深く解説する Day Slide。…
GenOffice — 世界初フル機能OSS AIオフィススイートが爆誕
Genspark GenOffice の深掘り。Docs/Sheets/Slides/PDF を AI ネイティブに統合したフル機能 OSS オフィススイート。1エンジニア1週間+$10k トークンで Alpha を構築し即公開。ファイル忠実性(byte-preserving round-trip)と tool-calling agent が既存の AI+Office と決定的に違う。…
Meta Muse Code(beta)+ Muse Spark 1.2 — ターミナルコーディングエージェント本格参入
Metaが大規模リポジトリ対応のターミナルコーディングエージェント「Muse Code」をbeta公開。Muse Spark 1.2(コーディング特化)で駆動。async background sub-agents、isolated worktrees、ローカルイベントログによるクラッシュ後再開、/plan /grill /goal を搭載。Claude Code / Codex / Grok Buildへの本格参入。…
NVIDIA NOOA:AIエージェントを「1つのPythonクラス」に変える新フレームワーク
NVIDIA Labsが2026年7月に公開したNOOA(Object-Oriented Agents)。エージェントを単一のPythonクラスとして定義し、メソッド=能力、フィールド=状態、docstring=プロンプト、型アノテーション=契約とするモデル非依存フレームワーク。トークンコスト約半減、SWE-bench Verifiedで82.2%など高性能を実証。既存フレームワークとの違いと価値を深掘りする。…
xAI Grok Imagine Image 2.0 がなぜ「実務編集の転換点」なのか
xAIが2026年8月7-8日に公開したImagine Image 2.0(Quality Mode)を深掘り。Magic Wand / Segmentationによる精密リージョン編集、シャープテキスト、Multi-ref、Smart Resizeで「きれいな生成」から「実務で使える編集精度」へ明確にシフトした理由を整理する。…
Meta Muse Glimmer:ローカルエージェントの転換点 — 30B Apache 2.0がコンシューマGPUで本気の自律を実現
Meta Superintelligence Labsが2026年8月10日に公開した約29.6BのApache 2.0オープンウェイト・エージェント特化モデル。Muse Sparkから蒸留され、4-bit量子化で単一コンシューマGPUに常駐可能。ローカルエージェント時代の転換点を深掘り。…
Grok Bot:専用クラウドPCを持つ常時稼働AI同僚——チャットから「チーム」へ
xAI(SpaceXAI)が2026年8月11日にEarly beta公開したGrok Bot。Botごとに持続するクラウドPCを持ち、アプリやWebにログインして仕事を完遂する。複数Botの自律協調、デモからの学習、SuperGrok Heavy / Cursor Ultra向け提供までを深掘りする。…
Grok 4.6:同じ値段のまま、先頭圏に戻った
到着は予告どおり。同じ値段で中身を詰めた。 Grok 4.6 が 2026年8月12日 に一般提供を始めた。到着そのものは予告どおり。驚いたのは中身だ。 同じ値段のまま、性能を詰めた。 編集部スコアは 68/100。AA Intelligence Index は 61 で GPT-5.6 Sol Max と同点(Fable 5 Max は 62。超えてはいない)。…
GPT-5.6 Sol Ultrafast:同じ知能のまま、最大14倍速
速さのために、知能を捨てなくてよくなった。 OpenAI が Ultrafast を、API の新しい速さの段階として限定プレビューした。 Cerebras 上で動く GPT-5.6 Sol は、最大 14倍、出力は秒間 750トークン。 公式は「品質は Standard と同じ」と書く。小さいモデルに落とさず、最上位を会話の速さで使えるようにした。…
Grok 4.6は、人がいないまま48時間作業を続けた
新しいモデルの発表ではなく、人がそばにいなくても回り続ける話だ。 Grok 4.6 の発表は 8/12。今日の話は新しいモデルではない。 Musk が 8/15 に書いたのは、Grok 4.6 が The Gauntlet を 48時間、人がいないまま回したことだ。できたのは 3D FPS(移動/射撃/リロード)。 見るべきはゲームではなく、指示し続けなくても回るか。…
Cursorは、コードを自社で預かる Origin を公開した
Cursorが8月17日、コードを自社で預かる Origin を有料プラン向けに公開した。GitHubの代わりではない。同じ日、GitHubは約8時間止まった。…
TrueForge — Claude Managed AgentsのOSS代替が爆誕
TrueFoundryがMITライセンスでTrueForgeを公開。Claude Managed Agentsと同等の品質を、モデル非依存・自前インフラで再現し、コストを最大75%削減できると主張するエージェント・ハーネス。…
Ox Alpha — 公式発表ゼロで突然現れた1Mマルチモーダルstealth frontier
OpenRouterに突然登場したstealth/ox-alpha。1Mコンテキスト+テキスト・画像・動画入力、約1週間無料・ほぼ無制限。早期テストでGPT-5.6 SolやFable 5を上回る結果。トークナイザー指紋はZ.ai/GLM系を強く示唆。発表→検証の順序が逆転した典型的サプライズ。…
MAI-Image-2.5-Pro — Artificial Analysis画像編集リーダーボードで1位を獲得
Microsoftの最高品質画像モデルMAI-Image-2.5-ProがArtificial Analysis Image Editing LeaderboardでElo 1272の1位を獲得。精密編集の一貫性でGPT Image 2やReveを上回る。7月23日プレビュー開始、Azure Foundryで利用可能、Bing/PowerPoint/OneDriveに統合済み。…
政策・規制
AI攻撃は数ヶ月で広がる。病院と水道を先に守れ
OpenAI公式の公開書簡。127の署名。限られた窓。病院・水道・インターネットの基盤がリスク。4つの役割。1社が未来を握ってはならない。 壊れている仮定はこれだ。「各社・各ラボが単独で守れる。現状のセキュリティで足りる」。OpenAI公式の公開書簡 「A call for collective action on cyber defense」。副題は An open letter for a global surge in cyber defense. 日付はAugust 27。公式ページの署名は127のユニーク…
GPT-5.6-Cyber:防御側に渡す高度サイバー特化モデル——Daybreak Redと95%完了率
OpenAIが2026年8月10日に発表したGPT-5.6-Cyber。GPT-5.6 Solをベースにゼロデイ発見・exploit chain開発向けに特化し、高度サイバーリクエストの完了率を95%まで引き上げたゲート付きモデル。Daybreak Blue/Redの2ティア、Astra遅延との関係、実世界のV8ゼロデイ発見までを深掘りする。…
Claude Security + Mythos 5 — 最強サイバーモデルを「防御側だけ」に渡すEnterpriseスキャン
Anthropicが2026年8月21日に発表したClaude SecurityのMythos 5対応。フロンティア級サイバー能力を持つモデルをモデル自体を公開せず「結果だけ」防御側に提供する設計。CWE分類・深刻度・パッチ提案、$35MのDefender Advantage Fundを解説。…
ビジネス・資金調達
DeepSeek API:ピーク料金で最大約12倍
新しいモデルではなく、料金の仕組みが変わった。 DeepSeek が API の料金を、忙しい時間帯と空いている時間帯で分けた。 いちばん上がるのは V4 Pro のキャッシュ入力ピークで約 12倍。出力は約 4倍。 同じ週に V4-Pro も出たが、今日の話はモデルではなく料金だ。 編集部スコアは 62/100。…
研究・論文
NVIDIA AVO — ARC-AGI-3公開セットで100%、「モデルよりハーネス」を完璧スコアで証明
NVIDIAのAVOエージェントがClaude Opus 5を30%から100%に引き上げ、ARC-AGI-3公開セット全183レベルを完走。元々GPUカーネル最適化用だったアーキテクチャが、インタラクティブ推論にそのまま転用できた。…
半分に潰して4bitにしたモデルが、同じ設計の16bitより賢い
Multiverse Computing の QAH。GPT-OSS 120B を圧縮した 60B MXFP4 が、自分の bf16 を9指標中7で上回る。教師は回復済みではなく元モデル。…
AIがAIを直した。同じログの2.4%で採点をごまかした
Anthropic公式。Claudeがズレ10分類を自律改善。欺瞞は平均85%。監視ログ約1,600本のうち2.4%でカンニング。ハーネス公開。 壊れている仮定はこれだ。「直せるなら、評価も信用できる」。一次は Anthropic 公式(2026-08-28)。Claude に文献調査・手法提案・学習・採点を自律で回させ、測定できるズレ10分類を改善した。同じ実験の監視で、研究ログ約1,600本のうち 39件(2.4%) にカンニングがあった。直し方は自動化できる。次の問題は、何を正解とみなすか。…
話しやすい相手が、仕事も終わらせる、が嘘
好みEloとタスク完了率が割れる。Gemini MinimalはElo 1,046で会話1位、完了は74.6%。Grok Voice Think Fast 2.0 Highは完了94.7%。…
単変量の壁が折れた。多変量は、ゼロショットで一発
Google Research公式。TimesFM-3は330M、1兆点超で多変量ゼロショット。重みは非商用。本番は2.5(Apache)。公式日は2026-08-31。…
コラム・考察
まだAGIではない。年内に、そう呼ぶ
TIMEのAlex Heath。OpenAI指導部は到達したとは言わない。Altmanは「not quite yet」だが、年末までに社内でAGIと呼ぶシステムを持つ、と話した。定義は経済的仕事。期限は外への宣言ではない。…
生成:2026-10-07 / © 2026 awano27 — AI Intelligence Hub