Fable級のOpusと、半額のSol
Opus 5.5 は $4/$20。AA総合 58 で首位。Sol は $2/$10、知能は 5.6 Sol とほぼ横ばい。
2026-09-22、Anthropicが Claude Opus 5.5 を出し、約90分後に OpenAI が GPT-6 Sol と GPT-6 Luna を出した。Opus 5.5 は公式に「多くの仕事で Fable 5.1 級」で、普通の使い方では Opus 5 より約40%安い。Sol / Luna は GPT-5.6 の promo 単価から半額。難しい仕事の上限は Opus、大量に処理するときの単価は GPT-6 側だ。
Opus 5.5 は $4/$20。AA総合 58 で首位。Sol は $2/$10、知能は 5.6 Sol とほぼ横ばい。
OpusはAPI・Claude.ai・Claude Code・主要クラウド。Sol/LunaはAPI・ChatGPT Work・Codex。通常Chatは未投入。
Claude Codeなら Opus 5.5 medium。Codexなら Sol。Lunaをコーディングの本命にしない。同じ仕事で手直し回数を見る。
読み分け: 公式・docs/news 編集の整理 副次・未確認 /末尾の数字から根拠へ移動できる。
Anthropicは、難しい仕事の上限を Opus 5.5 で使える価格帯まで下げた。OpenAIは同クラスの Sol / Luna を半額にした。選ぶ単位はモデル名だけではない。モデルと effort の組み合わせだ。
Anthropicは Claude 5.5 系列の先頭として Opus 5.5 を出した。公式の説明は「多くの仕事で Fable 5.1 級、普通の使い方では Opus 5 より約40%安い」。モデルIDは claude-opus-5-5。コンテキスト 1M、最大出力 128K。thinking はオフにできない(thinking: disabled は 400)。既定 effort は製品側で medium。Sonnet 5.5 / Haiku 5.5 は数週間以内。[1]
OpenAIは先に出ていた GPT-6 Astra(9/3、$10/$50)の下に、Sol と Luna を足した。公式は「Astra の訓練手法を安いモデルに載せる」。モデルIDは gpt-6-sol / gpt-6-luna。コンテキスト 1.05M。GPT-6 Terra は発表なし。[2]
本号のスライド日は 2026-09-23。一次は両社とも 2026-09-22。前号 09/22 は Grok 4.7。取り違えない。
値下げは性能の大幅向上の対価で、日常は最上位1本。この前提が、同日の2発表で書き換わる。
最先端を使うには最上位をいつも払い、中位の値下げには知能の大幅な向上が伴う、という前提だ。
難しい仕事は Fable / Astra。日常は Opus 5 か GPT-5.6 Sol。安くするなら性能を諦める。最強を常時使う。
難しい仕事の大半は Opus 5.5 medium で足りる。大量処理なら Sol。Lunaは範囲が決まった補助作業向け。Astra / Fable は詰まったときの予備。値下げの中心は Sol / Luna で、知能はほぼ横ばい。[3]
list価格は公式。総合点は Artificial Analysis。ベンダーの%は出典を列に残す。
| モデル | 入力 | 出力 | キャッシュ読取 |
|---|---|---|---|
| Opus 5.5 | $4 | $20 | $0.20 |
| Opus 5 | $5 | $25 | $0.50 |
| GPT-6 Sol | $2 | $10 | $0.20 |
| GPT-6 Luna | $0.10 | $0.50 | $0.01 |
| GPT-6 Astra | $10 | $50 | $1.00 |
| Fable 5.1 | $10 | $50 | $0.25 |
Opus Fast mode は $8/$40。GPT-6 は入力 272k超でリクエスト全体が 2×入力・1.5×出力。Batch / Flex は半額、Fast は2倍。Opus は 1M まで同一単価。[1][2]
| 指標 | Opus 5.5 | Astra | Fable 5.1 |
|---|---|---|---|
| Terminal-Bench 4.0 | 66.4% | 57.9% | 55.8% |
| FrontierCode v1.1 | 54.4% | 53.3% | 50.3% |
| GDPval-AA Elo | 1846 | 1542 | 1735 |
| AutomationBench | 40.0% | 41.4% | 31.4% |
| TB-Science 0.1 | 58.7% | 64.6% | 52.6% |
科学と一部自動化は Astra が残す。全面で超えたわけではない。[1]
| モデル | Intelligence Index | 1タスク費用 | 出力トークン/タスク |
|---|---|---|---|
| Opus 5.5 max | 58 | $5.98 | 約119k |
| Opus 5.5 medium | 51 | $1.34 | 約26k |
| Astra max | 53 | $3.26 | 約27k |
| Sol max | 48 | $1.06 | 約31k |
| Luna max | 37 | $0.07 | 約51k |
Opus max はトークンが多い。実務で並べるなら Opus medium(51点 / $1.34)と Sol max(48点 / $1.06)。Sol / Luna の総合点は 5.6 とほぼ同じ水準。Coding Agent Index は Sol +2、Luna −2。[3][4]
「Sol が Opus に勝つ」図の相手は、多くが Opus 5。新 Opus 5.5 との直接比較ではない。本文の主数字にしない。
開発者向けの入口は開いている。通常の ChatGPT Chat で Sol を待たない。
Claude API(claude-opus-5-5)、Claude.ai(Pro / Max / Team / Enterprise)、Claude Code(既定)、AWS / GCP / Microsoft Foundry。5時間枠の引き上げと、好きな時に使えるリセット。thinking オフ不可。[1]
API(gpt-6-sol / gpt-6-luna)、ChatGPT Work、Codex。Plus〜Edu。Free / Go はデスクトップで Luna のみ。通常の Chat には未投入。 Terra なし。キャッシュは effort / ツール変更後も再利用できる、と公式。[2]
見る単位は順位ではない。確認まで終わった仕事1件ごとの手直しと費用だ。
Anthropic公式も「default で他社 max を超えることが多い」と書く。Claude Code 作者の Boris Cherny も普段は medium。Simon Willison は Opus max が思考で 128k 上限に当たり無回答、と記録している。max は最初の比較条件にしない。[1][8]
Luna をコーディングエージェントの本命にする(ts-bench で 5.6 Luna から劣化)。OpenAI発表図を「Sol が Opus 5.5 に勝つ」根拠にする。通常 ChatGPT で Sol を探す。thinking オフ、effort をセッション先頭で雑に切替。
同じ完成条件の仕事を、Opus 5.5 medium と Sol(同じ effort)で1本ずつ。手直し回数・確認時間・$ を1行ログ。
半日時点のXは感想が多い。本文に残すのは公式と、同じ仕事を試した検証だけだ。
| 誰 | 要約 | 扱い |
|---|---|---|
| @claudeai / @ClaudeDevs | Opus 5.5発表。丸ごと渡せ。think carefully は不要 | 公式一次 |
| @OpenAI / @sama | Sol / Luna 半額。token より task が安い | 公式一次 |
| @MLBear2 | 性能は Opus、半額は Sol。Terra 消えた? | JP整理一次 |
| @gosrum | ts-bench:Opus medium 完走。Luna は 5.6 より劣化 | 独立検証 |
| @danshipper / @every | 日常は Sol、長い自律開発の上限は Opus | 実務検証 |
| @browser_use | ブラウザ長タスクは Sol / Luna が安い | 自社ベンチ・利害あり |
| @simonw | Luna は製品機能向き。Opus max は罠 | 実務一次 |
| @AGIOyaZ / @byethankyou2 | Model × Effort。1本選ぶなら Opus。量は Sol | JP整理 |
| @aiagentota | 夜間は枠停止が本体。リセット券とキャッシュが先 | 運用一次 |
公式は「仕事を丸ごと渡し、完了条件を書け」。X上の反復は「モデル × effort」「失敗コストで振る」。視覚デモは Opus 寄り、ブラウザベンチは Sol 寄り。混ぜない。[5][7]
一次は公式と AA。Xは使い方の一次であって、順位の一次ではない。
「全面SOTA」。OpenAI図の旧 Opus 5 比較を 5.5 比較として使うこと。Luna DeepSWE $0.20 奇跡話を独立指標として扱うこと(AA の Coding Agent は Luna −2)。いいね数。
Browser Use は自社製品。実 GUI では Astra 残置の個人実測あり。Cursor上の Opus は弱いが Claude Code では別物、は一報告。Luna 劣化は仕様か提供バグか未確定。
編集ルール:本文の主数字は Anthropic / OpenAI の list 価格と AA Index。ベンダーハーネスの%は出典を列に残す。
消費者向けアプリを待たず、Claude Code と Work / Codex だけで判断する。
同じ仕事を Opus medium と Sol で1本。手直しと$を1行。リセット券があるなら今日使う。
全仕事を Opus max。Luna を実装エージェントの既定に。09/22号(Grok 4.7)と取り違える。
市場予測はしない。導入の境界だけ切る。
claude-opus-5-5
gpt-6-sol
gpt-6-luna
次に見るのは順位ではない。確認まで終わる仕事1件の手直しだ。max は最初に置かない。Luna はまだ本命にしない。
一次は両社公式と Artificial Analysis。Xは使い方の一次。いいね数は指標にしない。
datePublished 2026-09-22。Fable級、40%安、キャッシュ $0.20、Fast $8/$40、提供面。
datePublished 2026-09-22。半額、$2/$10 と $0.10/$0.50、Work / Codex / API、Chat未投入。
Intelligence Index 58。medium 51 / $1.34。トークン量と Pareto。
半額で総合点はほぼ水平。Sol Coding Agent +2、Luna −2。
Opus 5.5 medium 完走。Sol 順当。Luna は 5.6 から劣化。