MEDIUM VS SONNET 5 MAX前世代の最高点を、約9分の1で
Sonnet 5.5のMedium(40.7点・$0.59)が、Sonnet 5の最高点(Max・38.2点・$5.09)を超えた。費用は11.5%。公式の「最高点を約10分の1の費用で超える」とも整合する。[1]
CLAUDE SONNET 5.5 × COST PER TASK × EFFORT
独立計測(Artificial Analysis)では、Sonnet 5.5はMediumで前世代の最高点を超え、費用は約9分の1で済んだ。ところが努力量を上げるほど前世代との差は縮み、xhighでほぼ並び、Maxでは逆転する。Maxの出力トークンは、前世代とOpus 5.5のどちらの約1.6倍。単価が同じでも、請求は「どの努力量で、何トークン使ったか」で決まる。最初はMedium。上げる前に、Opusの低い努力量と自分のタスクで比べる。
一次情報:公式発表 [1] / システムカード [2] / 公式ドキュメント [3] / 独立計測 AA [7]
対象ニュース:2026/09/28発表 / 調査・確認:2026/09/29。公式の主張・独立計測・コミュニティの声を混ぜない。
単価は前世代と同じ。1タスクの費用は、努力量を上げるほど前世代との差が縮み、Maxで逆転する。
同じ約56点なら、Opus 5.5のxhighのほうが安い。
01 / COST CHANGE VS SONNET 5 — SAME EFFORT NAME
AA Intelligence Index・1タスク平均。左=安い、右=高い。
02 / SAME SCORE, DIFFERENT BILL — AA
Index 56.0Index 56.0Maxでは出力が約1.6倍、読取が約1.8倍。半額の単価が消える。
Terminal-Bench 4.0の4.2点差は、標準誤差の約1.2倍。
最初はMedium。上げる前に、Opusの低い努力量と並べる。
努力量と比較基準を添える。
同じ名前でも中身が再調整済み。
仕様と検証手段があるならSonnet。
判断が続く仕事はOpus。
thinkingの無効化・強制tool_choice・
履歴の編集は、そのままでは動かない。
本号による図解。数値は公式発表・システムカード・AAの掲載値、および本号の計算(費用変化率・埋めた割合など)です。AAの値は更新され得ます。文字と図はHTML内に収録しています。共有用1枚ボード:images/0929/cover.jpg(編集概念図)。
読み分け:公式発表・公式資料はAnthropicの主張と仕様。独立計測はArtificial Analysis(AA)の値。コミュニティの声はHNの個人投稿で、未検証。本号の解説・提案は計算と業務への応用案です。本号でモデルの実機ベンチマークは行っていません。
PRIMARY SOURCES & EDITORIAL NOTES