Opus 5.5をeffort別に比較:mediumは10.4秒で全673モデル中8位
Claude Opus 5.5のeffort別性能・待ち時間・単価を比較し、mediumを常用しhigh以上へ切り替える判断基準を整理します。
Claude Opus 5.5の普段使いは、mediumを基準にするのがいちばん無理がありません。lowは軽い作業向け、mediumはメインの実務向け、high以上は詰まった問題にだけ使う。この3段階に分けると、賢さと待ち時間の交換条件が見やすくなります。
迷うとしたら、「最初からhighにしておけば安心なのではないか」と「mediumで待ち時間を抑えたほうが作業は進む」のどちらを取るかだと思います。Artificial Analysisの2026年9月26日時点のデータを見ると、Opus 5.5はlowからmediumへ上げたときに知能指数が最も大きく伸びます。一方、mediumより上は待ち時間の増え方が急です。
Claude Opus 5.5は価格が下がり、既定effortも変わった
Claude Opus 5.5は2026年9月22日に公開されました。API価格は入力100万トークンあたり4ドル、出力100万トークンあたり20ドルです。キャッシュ読み取りは0.20ドルで、コンテキストは100万トークン、最大出力は12.8万トークンです。Anthropicは、Opus 5より約4割安い価格で、Fable 5.1級の性能だと説明しています。
実務上、Opus 5からの差として先に確認したいのは、既定effortがhighからmediumになったことです。effortを指定しなければ、Opus 5.5はOpus 5以前より1段低いmediumで動きます。性能が落ちたという意味ではなく、同じ会話でも初期設定の計算量が変わったという話です。既定値だけを見て「前より浅くなった」と判断すると、比較を取り違えます。
Anthropicの公式ベンチマークでは、Terminal-Bench 4.0が66.4%で、Fable 5.1の55.8%、GPT-6 Astraの57.9%を上回っています。ただしTerminal-Bench Scienceは58.7%対64.6%、AutomationBenchは40.0%対41.4%で、Astraが上です。Opus 5.5がすべての仕事で勝つというデータではありません。
Claude Opus 5.5はlowからmediumで知能指数が8.9伸びる
Artificial Analysisの知能指数は、Opus 5.5のlowが42.3、mediumが51.2、highが53.6、xhighが56.0、maxが57.6でした。lowからmediumは8.9ポイント上がりますが、その後はhighまで2.4、xhighまで2.4、maxまで1.6ポイントです。最初の1段に、性能向上の大部分が集まっています。
同じ単価でeffortを選べるとはいえ、得られる差は均等ではありません。mediumからhighへ上げると知能指数は2.4しか増えず、xhighとmaxではさらに待ち時間が伸びます。ここを常用設定にすると、難しい問題への保険を毎回買うような使い方になりやすいです。
| Opus 5.5のeffort | 知能指数 | 最初のトークンまで | 出力速度 | API単価(入力/出力) |
|---|---|---|---|---|
| low | 42.3 | 3.3秒 | 76 t/s | $4 / $20 |
| medium | 51.2 | 10.4秒 | 76 t/s | $4 / $20 |
| high | 53.6 | 18.8秒 | 79 t/s | $4 / $20 |
| xhigh | 56.0 | 64.8秒 | 85 t/s | $4 / $20 |
| max | 57.6 | 232.9秒 | 99 t/s | $4 / $20 |
数値の出典はArtificial Analysisです。待ち時間は入力約1,000トークン時の中央値で、推論モデルでは考えている時間を含みます。チャットで送信してから最初の返答が出るまでの体感に近い数字です。
Claude Opus 5.5はmedium以降で待ち時間が急に伸びる

出典: Artificial Analysis(2026-09-26 時点)のデータから作図
mediumは10.4秒です。Artificial Analysisの全673モデル中8位で、知能指数は51.2。なお、この673はeffort違いを別々に数えた件数で、Opus 5.5自身のhigh以上も上位に含まれています。Fable 5.1のhighも知能指数51.2ですが、FableのAPI単価は入力10ドル、出力50ドルで、Opus 5.5の2.5倍です。待ち時間はFable 5.1 highが8.8秒なのでmediumより短いものの、単価との交換になります。
Opus 5.5のhighは18.8秒で知能指数53.6、xhighは64.8秒で56.0、maxは232.9秒で57.6です。maxは返答を待つだけで約4分かかる中央値なので、雑談や軽い修正に置く設定ではありません。最大の知能指数が必要な一回の調査や、解けない実装上の詰まりに使う段階です。
知能指数40〜53のモデルと比べるとClaude Opus 5.5 mediumの位置が分かる
Opus 5.5 mediumと同じ知能指数帯には、速さや価格で優位なモデルもあります。GPT-6 Astra mediumは知能指数49.6で、最初のトークンまで4.9秒です。ただし入力10ドル、出力50ドルで、Opus 5.5 mediumより高価です。Astra high以上は知能指数50.9〜52.7まで上がりますが、待ち時間は21.2秒、65.1秒、211.4秒となります。
GPT-6 Solは入力2ドル、出力10ドルで、Opus 5.5の半額です。Sol highは知能指数42.8、最初のトークンまで13.0秒、xhighは44.1で37.6秒でした。知能指数51.2のmediumと同じ帯ではありませんが、ChatGPT契約者が普段の作業を安く回す選択肢としては合理性があります。なお、OpenAIが示す「Sol xhighがOpus 5のmaxを上回り、1タスクあたり約9%の費用」という比較は、Opus 5.5ではなくOpus 5が相手です。
Grok 4.7 highは知能指数46.3、最初のトークンまで3.6秒で、入力2ドル、出力6ドルです。Muse Spark 1.3 maxは知能指数48.1、19.7秒、入力1.25ドル、出力4.25ドルでした。Gemini 3.8 Flash highは知能指数40.9、8.8秒、入力0.75ドル、出力3.75ドルで、出力速度も278 t/sあります。Geminiの契約を持っているなら、軽い普段使いをFlashに寄せる判断は数字で説明できます。なお、この価格は2026年12月31日までで、2027年1月1日から倍額になる案内です。
| モデル・設定 | 知能指数 | 最初のトークンまで | 入力/出力 $/1M |
|---|---|---|---|
| Claude Opus 5.5 medium | 51.2 | 10.4秒 | $4 / $20 |
| Claude Fable 5.1 high | 51.2 | 8.8秒 | $10 / $50 |
| GPT-6 Astra medium | 49.6 | 4.9秒 | $10 / $50 |
| Muse Spark 1.3 max | 48.1 | 19.7秒 | $1.25 / $4.25 |
| GPT-6 Sol max | 47.5 | 97.0秒 | $2 / $10 |
| Grok 4.7 high | 46.3 | 3.6秒 | $2 / $6 |
| Gemini 3.8 Flash high | 40.9 | 8.8秒 | $0.75 / $3.75 |

出典: Artificial Analysis(2026-09-26 時点)のデータから作図。左上ほど「賢くて待たない」
この表は、Artificial Analysisで速度が計測されているモデルだけを比較しています。未計測の行は除外しました。知能指数が同じでも、料金と待ち時間は揃いません。逆に、安くて速いモデルは、Opus 5.5 mediumと同じ知能指数帯にいるとは限りません。
Claude Opus 5.5のmediumより上は詰まりを抜くために使う
Opus 5.5のhigh、xhigh、maxは、同じ契約の中にある上限です。Artificial Analysisの総合上位3つは、Opus 5.5 maxの57.6、xhighの56.0、highの53.6で占められています。mediumでも全673モデル中8位ですが、さらに上を使える場所が同じ会話の中に残っています。
公式ドキュメントでは、Opus 5.5は会話の途中でeffortを変更してもプロンプトキャッシュが保たれると説明されています。条件は、会話の途中に「ここからeffortを変える」という目印を挟む方式で変えることです(APIではベータ)。会話全体の設定値そのものを書き換える方式では、キャッシュは最初からやり直しになります。サービス側の契約画面での操作とAPIの挙動を同一視せず、利用環境の対応状況は確認してください。
私の使い分けは、簡単なセッションをlow、少し難しいメインの作業をmediumに置く形です。この記事の準備中も、同じ会話のまま/effortをlowからmediumへ上げて作業を続けました。最初からmaxに固定するより、作業の流れを保ったまま必要な場面だけ計算量を足せるほうが、実務では扱いやすいと感じています。
Claude Opus 5.5はmaxにすると使うトークンが約6.8倍になる
単価の表だけを見ると、effortを上げても料金は変わらないように見えます。4ドル/20ドルは100万トークンあたりの単価で、effortが変えるのは「使うトークンの量」のほうだからです。Artificial Analysisの無料Data APIにはこの量が含まれていないため、各モデルのページ(例:Opus 5.5 medium)の要約欄から、知能指数の評価1タスクあたりの費用と、評価全体で使った出力トークン数を拾いました(2026-09-26 時点、知能指数はページ上の整数表示)。
| Opus 5.5のeffort | 知能指数 | 1タスクあたりの費用 | 評価で使った出力トークン |
|---|---|---|---|
| low | 42 | $0.55 | 20M |
| medium | 51 | $1.34 | 38M |
| high | 54 | $1.82 | 53M |
| xhigh | 56 | $3.46 | 100M |
| max | 58 | $5.98 | 260M |
mediumからmaxへ上げると、出力トークンは約6.8倍(38M→260M)、1タスクあたりの費用は約4.5倍($1.34→$5.98)になります。知能指数の差は7です。一方、lowからmediumは費用が約2.4倍で知能指数が9上がります。ここがいちばん割のよい一段です。
出力トークンが増えるということは、会話のコンテキストを早く埋め、サブスクリプションの利用枠も早く減るということです。「同じ価格だからmaxを常用しても無料」ではありません。mediumの$1.34は、同じ知能指数51のFable 5.1 high($3.91)の約3分の1でもあります。
他社も公平に見ておくと、GPT-6 Astra mediumは19Mという少ないトークンで知能指数50に届いており、トークン効率ではこの帯でいちばん優秀です。GPT-6 Solのmediumは$0.25、Lunaのlowは$0.0045と、費用の安さは桁が違います。
契約先ごとにClaude Opus 5.5の最適な使い方は違う
Claude ProやMaxでOpus 5.5を主に使うなら、mediumを標準にして、軽い依頼だけlow、詰まったときだけhigh以上へ上げる運用が最も納得しやすいです。lowからmediumの知能指数差が8.9あり、待ち時間は3.3秒から10.4秒に増えるだけだからです。ここは毎回払ってもよい待ち時間だと思います。
ChatGPT契約者は、GPT-6 Solを普段使いに回し、難しいコードや長い会話の継続性をOpus 5.5 mediumに任せる分担が現実的です。SolはAPI単価が半分で、OpenAIの契約内でも使えます。Astra mediumは待ち時間4.9秒と速く、知能指数49.6も十分に高いので、ChatGPTの中で賢さと速さを両立したいときの候補になります。単価はOpus 5.5の2.5倍なので、APIで大量に回す用途では差が出ます。
Gemini契約者は、Gemini 3.8 Flash highを速く安い普段用として使い、Opus 5.5を難しい実装や判断の軸に置く組み合わせが考えられます。Flash highはOpus 5.5 mediumより知能指数が低い一方、出力速度278 t/sと単価の低さがあります。すべてを一つのモデルに集約する必要はありません。
同じClaude契約の中で性能の天井まで触れることがOpus 5.5の最大の強みです。ただし、天井を常用することが強みなのではありません。mediumで全673モデル中8位の位置を確保し、必要なときだけ同じ会話のままxhighやmaxへ移れる。この段差の使い方に、契約価値があります。
参考リンク
- Anthropic: Claude Opus 5.5
- Artificial Analysis
- Claude Docs: Effort
- OpenAI: Introducing GPT-6 Sol and Luna
- Claude Codeのeffort新オプション
- Claude Fable 5.1のeffort別カーブ
- Claude Opus 5とSolのeffort比較
この記事を書いた人
HW系エンジニアとして20年以上、10,000件を超える顧客訪問と2,000件を超える単独ソリューション実績。AIツールを使った個人開発やIoT農園など、Raspberry Piを使ったオートメーション化なども実践中です!エンジニア専門結婚相談所も運営中、ClaudeCodeで解決できない心の課題も解決いたします!
関連記事
Sonnet 5.5 xhighは買いか、Claude Opus 5.5 mediumが得か
Claude Sonnet 5.5のeffort別実測と公式指針を整理。Sonnet 5からの破壊的変更、Opus 5.5との費用差、mediumの使いどころを解説します。
effort を途中で変えるとキャッシュはどうなる? Fable 5.1 と Opus 5 で実測した
Fable 5.1 の値下げはキャッシュ読みだけ。Claude Code が TTL を決める仕組み、キャッシュを壊す操作と壊さない操作、effort 切替時の再書き込みを Fable 5.1 と Opus 5 の usage で実測しました。
Anthropicリーク2連発:Claude MythosとClaude Code流出で見えたKAIROS、BUDDY、Undercover Modeの正体
Anthropicの2週間で2回のリークを整理。Claude Mythosの位置づけ、Claude Code流出の中身、KAIROS/BUDDY/Undercover Modeの意味を分けて読む。
Claude Code の /effort 完全ガイド|low〜maxの使い分けと『コストが増える本当の理由』
Claude Code の /effort(low〜max・ultracode・auto)は「賢さ」ではなく「トークンの気前よさ」のレバー。モデル別の推奨スタートと、Opus 4.8 でコストが増えた気がする原因を『トークナイザ』と『effort』の2軸に切り分ける考え方を、公式一次情報と v2.1.156 の実機確認で解説します。
AI年表で詳しく見る
📅Claude Opus 5.5
Claude Opus 5.5——Fable 5.1 級の性能を Opus 5 より4割安く、既定 effort は medium
META-MARK × AI
ローカルAIを動かすGPU、ちゃんと選べていますか?
VRAM・性能・コスパをMetaScoreで数値化。AIアプリ別の推奨ハードウェア要件も確認できます。
PR広告:開発環境・キャリアまわりのサービス