ONE-BOARD SUMMARY
1枚で見る「Claude Fable 5.1 / Mythos 5.1」
🔍 クリックで拡大
Fable 5.1 は知能の世代交代ではなく、運用面の更新だ。表値(入出力単価)は Fable 5 と同じまま、キャッシュ読出を 75% 下げ、長時間タスクで人間を呼ばずに走り続ける耐性を上げた。一言で言えば 「新しい天才」より「同じ表値で長く走れる同僚」である。
- Fable と Mythos は同じ重み。違いはセーフガードのみ。Fable は一般公開、Mythos は Glasswing 等の信頼済み組織限定
- 公開の流れは、朝に Bedrock の識別子リーク → 午後に Anthropic と AWS が同時公開
- ただし「その同僚を雇える口座」は、キャッシュの厚い API と Claude Code のサブスクで分かれた(06 参照)
CONFIRMED SPECS
確定仕様:ID・コンテキスト・thinking・価格・公開範囲
| 項目 | 内容 |
|---|---|
| モデル ID | claude-fable-5-1 |
| Bedrock | anthropic.claude-fable-5-1(us. / global. プレフィックスあり) |
| コンテキスト / 最大出力 | 1M / 128K |
| Thinking | Adaptive thinking 常時ON。effort で深さだけ変える |
| デフォルト effort | Claude Code は high、claude.ai / Cowork は medium |
| Knowledge cutoff | 2026年6月末 |
| 入出力 | $10 / $50 per MTok(Fable 5 と同額) |
| キャッシュ読出 | $0.25 / MTok(Fable 5 の $1.00 から 75% 安) |
| キャッシュ書込 | 5分 $12.50、1時間 $20(据え置き) |
| Fable vs Mythos | 同じ重み、セーフガードだけ違う |
| 公開範囲 | Fable は一般公開。Mythos は Glasswing 等の信頼済み限定 |
| 指定 | Covered Model。EFS(ZDR++)は今秋段階導入。適格顧客は暫定 ZDR |
読み方:表の中で「変わった」のはキャッシュ読出だけ。入出力・キャッシュ書込は据え置きで、値下げは「読み返しが厚い仕事」にしか効かない。
BREAKING CHANGES
破壊的変更が3つ——既存ハーネスはそのまま挿さらない
- tool_choice: any / 特定ツール強制は 400——ツール呼び出しを強制するハーネスは、リクエスト自体が失敗する
- Fable 5.1 の thinking block は旧モデルが読めない——モデルをまたいで thinking block を再利用している構成は壊れる
- 過去ターンや system / tools を編集すると thinking が無効化される——履歴を書き換える設計(要約・圧縮・ツール差し替え)は、append-only に作り直す必要がある
移行前のチェックリストは 09 にまとめた。要点は「tool_choice を使っていないか」「thinking block をモデルまたぎで再利用していないか」「履歴を append-only にできるか」の3点だ。
WHAT ACTUALLY CHANGED
何が本当に変わったか——コーディングの点数差ではなく、この4点
1. 長時間放置耐性途中で人間を呼ぶ頻度が下がる
- 行き詰まりを自分で言う
- 証明が崩れたら戻って直す
2. effort 効率Low / Medium で Fable 5 と同等以上、かつ安い
- これが公式の意図。製品は max ではなく medium
- claude.ai / Cowork の既定が medium なのはこのため
3. キャッシュ単価読み返しが厚い仕事だけ安くなる
- 単発は $10 / $50 のまま
- キャッシュ 90% 超のハーネスで初めて 25〜45% 安が出る
4. 誤検知の削減サイバー誤検知は従来より減少
- 自前コードの脆弱性発見は可、エクスプロイト作成は不可
- 途中で Opus に落ちる頻度も減ったが、ゼロではない
BENCHMARKS — WHERE TO LOOK
ベンチ:本命は Science と Automation、CursorBench は +3pt
| ベンチ | Fable 5.1 | Fable 5 | Opus 5 | GPT-5.6 Sol |
|---|---|---|---|---|
| Terminal-Bench-Science 0.1 | 52.6% | 24.7% | 29.0% | 22.4% |
| Terminal-Bench 4.0 | 55.8% (Mythos 60.9%) | 42.0% | 52.3% | 37.3% |
| CursorBench 3.2 | 73.4% | 70.5% | 70.0% | 67.2% |
| AutomationBench | 31.4% | 17.1% | 26.9% | 19.6% |
| GDPval-AA v2 | 1853 | 1723 | 1824 | 1711 |
- 本命は Science と Automation。調査→仮説→実験→検証を何時間も続ける仕事が跳ねている
- CursorBench は +3pt 程度。短時間実装で「天才になった」感じは出にくい
- Mythos が TB 4.0 で +5.1pt あるのは、公開版 Fable の点が能力の上限ではない、という意味
独立計測(Artificial Analysis)の補正
- Intelligence Index は max で 66(最高)。ただし max の1タスクは $3.76 で、Fable 5 max より約 20% 高い
- 理由は出力トークン約 1.7倍。キャッシュ値下げを思考が食う
- xhigh なら 65点 / $2.72。まだ Opus 5 max(63点 / $2.34)より高い
- Fable 5.1 medium ≈ Sol max——コスト対知能の実務ライン
38時間無人ランの一次ソースは Block の Willem Avé。ラベルアーティファクトを見つけ、6本の実験を夜に投げ、朝に結果を持って戻った。X 上で Ramp に誤帰属されている投稿が多いので注意——Ramp の証言は文章品質についてのもの。
科学デモ(金星地形図、タンパク質バインダー約 50% ヒット、GPU カーネル最大 2.5倍)は「AI が科学者になった」ではなく、ツール付き長時間エージェントの成果物という位置づけが正確だ。
THE COST FAULT LINE
コストの裂け目:安くなる場所と、高く感じる場所
公式の「典型 25% 安 / エージェント最大 45% 安」は本物だが、条件付きだ。どこで課金されるかで結論が反転する:
| 場所 | 実際 |
|---|---|
| キャッシュがトークンの大半を占める API / Amp 型 | 安い。Amp は typical thread の 90% 以上がキャッシュ読出で、ultra が約 35% 安 |
| 単発チャット・キャッシュなし | ほぼ同額。$10 / $50 のまま |
| Claude Code サブスクのデフォルト(high) | 高く感じる。思考が 2〜5倍長く、Fable が Fable を増殖させる |
| max effort のベンチ | 1タスクあたり Fable 5 より高い |
発表当日、公式は 5時間枠と週次枠をリセットし、一部は 9/13 まで週次 50% ブースト。これは製品の値下げではなく、その場しのぎだ。25% / 45% は「トークン課金の場所」限定で、Pro は従来どおり Fable がサブスク内に入らないという確認も出ている。
X 実測の枠消費(代表値)
- high×3 + med×2 を 18〜20分 → 週次 12% + 5時間枠 40%
- $200 Max、プロンプト1本を1時間超 → セッション枠のほぼ全部 + 週次 Fable 枠の約半分
- 24 サブエージェントの高負荷 → 50% ブースト込みで 5時間枠が約 30分で尽きた
- 一方、キャッシュ 1,890万の 45分ベンチは 5時間枠 7% で済んだ
結論:死ぬのは「考えが長い + 自己増殖」。キャッシュが効く計測では枠は持つ。
DAY-ONE REACTIONS ON X
初日の体感:パートナー・短時間品質・サブスク勢の3層で割れた
層1:パートナー / 早期アクセス強い
- Every:「Fable 級の知能、Opus 級の価格感、Sonnet 級の速さ」
- Cognition:Devin の Opus 5 トラフィックを当日移すと明言
- Amp:途中指示を捨てなくなり、文章が人間に近い
- Alex Albert:「曖昧な数文を渡すと、自分が埋める穴を埋める」
層2:短時間の品質割れる
- フロントエンドとデモは本当に上がったという声が多い(アニメーション、HTML 一括、3D シーン)
- 短時間コーディングと日本語短編は「Fable 5 max と大差ない」「Fable 5 の方が流れが良い」
- 後者は n=1 なので仮説止まり。公式の「文章が自然」は英語の業務文寄りと見た方が安全
層3:サブスク勢主戦場は能力ではなく枠
- 自動継続が壊れている報告もある
- 同じプロンプトが Claude Code では Opus 4.8 に落ち、Cursor では落ちない、という面差
周辺情報システムプロンプト流出・パレート前線
- システムプロンプトは発表約 55分後に流出(27万文字超)。中核は「ユーザーは見ていない。許可を取るな。破壊的操作以外は進め」
- CursorBench のパレート前線には Grok 4.6 と Fable 5.1 が残った、という投資家側の投稿も。Astra / Grok 4.7 / Fable 5.2 待ちの仮拠点という読みが妥当
ENTERPRISE ONLY
企業側でだけ重要な話:Covered Model と EFS
Fable 5.1 は Covered Model に指定され、同日に Enterprise Frontier Safeguards(EFS)が発表された。EFS は「ZDR(ゼロデータ保持)のままエージェントを監視する」という矛盾を解く試みだ。
- データは顧客クラウド、鍵も顧客——監視用の活動データは顧客自身のクラウドアカウントに、顧客の暗号鍵の下で保存
- Anthropic 社員は中身を見ない——自動監視が危険パターンの旗だけ顧客に上げる
- 今秋まで暫定 ZDR——適格顧客には EFS 準備完了まで Fable 5 / 5.1 で ZDR を提供
Covered Model 指定とセットで、規制業種はモデル比較より先に「EFS の可否」で決まる。医療・金融・法務でフロンティアモデルを本番投入するなら、ベンチの点数より先にここを確認することになる。
HOW TO USE IT
使い分け:Fable を既定にしない
| 仕事 | 推奨 |
|---|---|
| 日常の実装・レビュー | Opus 5。Fable を既定にしない |
| 曖昧な長時間調査、一晩放置、根本原因 | Fable 5.1 medium |
| 朝まで1件だけ | high。max は検証用 |
| 機械的なサブタスク | Opus / Sonnet / Haiku のサブエージェント。Fable の自己増殖は止める |
| キャッシュ 90% 超の自前ハーネス | 乗り換え価値あり。公式の 25〜45% 安はここで出る |
| 単発チャット | IQ 飽和。Fable に替える理由は薄い |
| 日本語の長文 | 業務文と創作を分けて A/B する |
移行前に確認すること
- tool_choice: any を使っていないか
- thinking block をモデルまたぎで再利用していないか
- 履歴を append-only にできるか
- 自分の仕事でキャッシュヒット率が十分か
空・雨・傘
事実・解釈・示唆——そして、まだ確定していないこと
空(事実)何が起きたか
- 2026-09-01、Fable 5.1 一般公開・Mythos 5.1 限定提供(同じ重み)
- $10 / $50 据え置き、キャッシュ読出 $0.25(75% 安)
- 1M / 128K、Adaptive thinking 常時ON、cutoff 2026年6月末
- 破壊的変更3件(tool_choice / thinking block / 履歴編集)
- TB-Science 52.6%、AutomationBench 31.4%、CursorBench 73.4%
- Covered Model 指定、EFS 今秋、適格顧客は暫定 ZDR
雨(解釈)何を意味するか
- IQ の世代交代ではなく運用モデル。短時間実装では差が出にくい
- 値下げはキャッシュの厚い API でしか出ない。Code サブスクの既定 high は枠を溶かす
- 初日の評価の割れ方は、設計意図(長時間同僚)と課金モデルの不一致で説明できる
- Mythos の +5.1pt は、公開版が能力の上限ではないことを示す
傘(示唆)どう動くか
- 日常実装は Opus 5、一晩放置の調査は Fable 5.1 medium
- サブスクでは effort を medium に、Fable の自己増殖を止める
- 自前ハーネスは tool_choice / thinking block / append-only / キャッシュ率を先に確認
- 同じ課題を medium / high / Opus 5 / Sol max の4本で走らせ、介入回数と枠の減りだけ見る
- 規制業種は EFS の可否を先に確認
まだ確定していないこと
- サブスク枠へのキャッシュ割引の換算係数(公式は「減算される」としか言っていない)
- 自動継続バグの再現条件
- 日本語創作の劣位(サンプル不足)
- 38時間ランの再現性(パートナー1件)
- 9月中の Astra 等でパレートが動く可能性
THE BOTTOM LINE
Fable 5.1 は新しい天才ではない。同じ表値で長く走れる同僚である。安くなるのはキャッシュの厚い API、高くなるのは Code サブスクのデフォルト high。見るべき数字は CursorBench ではなく、Science / Automation と、自分のハーネスでの枠の半減期。
2026-09-02 — AI Intelligence Hub / Day Slide
出典:Anthropic / AWS 公式発表(2026-09-01)、Artificial Analysis 独立計測、Block(Willem Avé)・Every・Cognition・Amp・Alex Albert の投稿、X 上の実測報告(代表値)。Anthropic — Enterprise Frontier Safeguards