チャエン

株式会社デジライズ 代表取締役

チャエン

Claude Opus 5.5が公開されました。AnthropicのClaude 5.5ファミリーの1本目で、ほとんどの仕事でClaude Fable 5.1と同水準の性能を、Opus 5より40%安い実行コストで実現するモデルです(Anthropic公式発表より)。

触ってみた感じがかなりよく、4つあるClaude Codeのアカウントも、Opus 5.5をメインにしていこうと思っています。

この記事では、料金・性能・effort(考える深さ)の選び方を公式発表と第三者評価で整理し、Opus 5.5・Fable 5.1・GPT-6 Astra・Gemini 3.8 Flashの4モデルに同じお題を解かせた実機比較をお見せします。先に結論を言うと、effortはまず既定のmediumから使い、効果を確かめた仕事だけ上げるのがおすすめです。


今なら、生成AIの基礎知識から社内導入の6ステップ・定着のポイントまでを1冊にまとめた「はじめての生成AI社内導入ガイド」を無料で配布中!何から始めればいいか分からない方でも、これ1冊で導入の流れがつかめます。

Claude Opus 5.5とは|Claude 5.5世代の1本目

Claude Opus 5.5とは|Claude 5.5世代の1本目

Claude Opus 5.5は、Opus 5の後継にあたるモデルです。米国時間2026年9月22日(日本時間9月23日)に公開されました。ClaudeアプリやClaude Codeのほか、Claude API(モデルIDは claude-opus-5-5)、Amazon Bedrock、Google Cloud、Microsoft Foundryで使えます(Anthropic公式発表より)。

翌9月24日には、MicrosoftもOpus 5.5とGPT-6 SolをMicrosoft Copilot(Word・Excel・PowerPoint・Chat・Cowork・Copilot Studio)に展開し始めたと発表しています(Microsoft 365公式Xより)。

押さえておきたいのは次の3つです。

ポイント中身
性能ほとんどの仕事でFable 5.1と同水準。公式ベンチマーク9項目中7つで1位
料金API単価は入出力とも2割引き。既定設定の典型的な作業なら、動かすコストはOpus 5より40%減
落とし穴既定のeffortがhighからmediumに変わった。maxに上げても点が上がるとは限らない

(出典:Anthropic「Claude Opus 5.5」Claude Docs「What’s new in Claude Opus 5.5」

料金|API単価は2割引き、キャッシュは6割引き

料金|API単価は2割引き、キャッシュは6割引き

APIの料金は、Opus 5から入出力とも2割下がりました。

項目(100万トークンあたり)Opus 5.5Opus 5変化
入力$4$5−20%
出力$20$25−20%
キャッシュ読み込み$0.20$0.50−60%
キャッシュ書き込み$5$6.25−20%

(出典:Anthropic「Claude Opus 5.5」

一番大きく下がったのはキャッシュ読み込みです。会話やコードベースのように、一度読ませて積み上がった部分を読み直すときの料金で、エージェントやコーディング作業ではコストの大半をここが占めます(Anthropic公式発表より)。Claude Codeで長い作業を回す人ほど、表の数字以上に効いてきます。

「40%安い」と「単価20%引き」は別の数字

冒頭の「Opus 5より40%安い」は、単価の話ではありません。次の2つが重なった結果です。

  1. 単価が下がる — 入出力とも20%引き
  2. 1つの仕事で使うトークン数が減る — 同じ仕事を、より少ないトークンで終える

この40%は「既定の設定で、典型的な作業をした場合」という条件つきの数字です(Anthropic公式発表より)。effortを上げて使えば前提から外れるので、そのまま自分の請求額に当てはめないようにしてください。生成速度も、Opus 5より30%以上向上しています。

サブスクで使っている人への変更

Claudeのサブスクで使っている人にも変更があります。

  • 5時間の利用上限を引き上げ — Pro・Max・Team・シート制のEnterpriseが対象
  • レート制限のリセットを1回付与 — 好きなタイミングで使える

(出典:Anthropic「Claude Opus 5.5」

リセットは私も早速使いました。Claude Codeで使っていて、利用枠の消費ペースは前より穏やかになったように感じています(あくまで個人の感覚です)。

APIで使う人向けには、ほかに2つの選択肢があります。

使い方中身
Fast mode(Claude Code・Claude Platform)最大2.5倍速。入力$8/出力$40
バッチ処理通常の半額。入力$2/出力$10

(出典:Anthropic「Claude Opus 5.5」Claude Docs「What’s new in Claude Opus 5.5」

前のモデルのClaude Opus 5で何ができたのか、どう使われてきたのかは、以下の記事にまとめています。

Claude Opus 5とは?Fable 5に迫る性能を半額で提供する新主力モデルを解説

Claude Opus 5とは?Fable 5に迫る性能を半額で提供する新主力モデルを解説

「Claude Codeのような開発エージェントを、チームで使いこなせる状態にしたい」といった情報収集段階でのご相談も大歓迎です。導入の流れや具体的な支援内容をまとめた資料を以下よりご覧いただけますので、ぜひお気軽にご活用ください。

性能|公式ベンチ9項目中7つで1位

性能|公式ベンチ9項目中7つで1位

Anthropicが公開したベンチマークでは、比較対象のFable 5.1・Opus 5・GPT-6 Astraに対して、Opus 5.5が9項目中7つで最高点でした。

項目何を測るかOpus 5.5Fable 5.1Opus 5GPT-6 Astra
Terminal-Bench 4.0コマンドライン作業66.4%55.8%52.3%57.9%
FrontierCode v1.1コード変更がマージされるか54.4%50.3%48.0%53.3%
CursorBench 4.0実際のCursor作業57.8%51.8%46.6%
GDPval-AA v2.144職種の実務(Elo)1846173517081542
AutomationBench複数アプリをまたぐ業務フロー40.0%31.4%26.9%41.4%
Humanity’s Last Exam(ツールあり)分野横断の推論67.7%65.6%63.6%57.2%
Terminal-Bench-Science 0.1科学研究58.7%52.6%29.0%64.6%
OSWorld 2.0パソコン操作81.8%80.7%74.0%
Chartography(ツールあり)図表の読み取り89.0%88.4%83.4%

(出典:Anthropic「Claude Opus 5.5」。Opus 5.5は特記がなければmax effortでの値。Terminal-Bench 4.0はOpus 5.5がxhigh、GPT-6 AstraはhighでOpenAIの公表値。「—」は公式の表に掲載なし)

負けた2項目も見ておきます。複数のアプリをまたいで業務フローを進めるAutomationBenchと、科学研究のTerminal-Bench-Scienceは、GPT-6 Astraのほうが上でした。全項目で勝っているわけではありません。

それでも、コマンドライン作業やコード変更、実務タスクなど、エージェント系のベンチマークの多くで最高値を記録しています。もともと長時間のエージェント型コーディング向けに作られたモデルなので、大規模な開発やコードのリファクタリングにはおすすめできそうです。

ただしFrontierCodeのように僅差の項目もあり、Anthropic自身も「この水準になると、ベンチマークの差は実際の差を以前ほど正確に表さない」と注意しています。

第三者の総合指数でも首位

第三者の評価機関Artificial Analysisの総合指数(Intelligence Index)では、Opus 5.5(max effort)が58で首位でした。GPT-6 Astra(max)は53で、差は5ポイントです(Artificial Analysis同比較ページより)。

上の表はAnthropicの自社測定、総合指数は第三者の測定です。どちらもmaxなど高いeffortでの数字で、ふだん使う既定のmediumでの測定値ではありません。

比較相手のGPT-6 Astraがどんなモデルかは、以下の記事で解説しています。

GPT-6 Astraとは?「賢い回答」からPC作業の代行へ。仕様・料金・使える範囲を一次ソースで整理

GPT-6 Astraとは?「賢い回答」からPC作業の代行へ。仕様・料金・使える範囲を一次ソースで整理

落とし穴|effortはまず既定のmediumから

落とし穴|effortはまず既定のmediumから

今回一番大きな変更は、effortの既定値です。Opus 5はhighでしたが、Opus 5.5はmediumになりました。effortを指定しないリクエストはmediumで動きます。考える機能(thinking)は常にオンで、オフにはできません(Claude Docs「What’s new in Claude Opus 5.5」より)。

「既定が下がったなら、自分でmaxに上げればいい」と考えたくなりますが、公式の数字を見るとそうはなりません。

ベンチマーク既定のmediumでの結果
FrontierCode54.6%。maxの54.4%をわずかに上回り、GPT-6 Astraの最高点(53.3%)をタスクあたり約5分の1のコストで上回る
Terminal-Bench 4.0Opus 5のmaxを約5分の1のコストで上回り、GPT-6 Astraに約40%のコストで並ぶ
CursorBench52.5%。Fable 5.1(max)の51.8%、Opus 5(max)の46.6%を上回る
GDPval-AAGPT-6 Astraのmaxを約5分の1のコストで上回る

(出典:Anthropic「Claude Opus 5.5」

FrontierCodeでは、mediumのほうがmaxよりスコアが高いという結果です。何も考えずにmaxを選ぶと、コストだけ増えてスコアは上がらない場面があります。

公式ドキュメントの使い分け

Opus 5.5向けのプロンプトの手引きには、effortについて次のように書かれています(Claude Docs「Prompting Claude Opus 5.5」より)。

  1. mediumから始め、自分の用途で複数の段階を試す。Opus 5の設定をそのまま持ち越さない
  2. 同じeffort名でも、Opus 5.5は1ターンあたりより多く考える。特にxhighとmaxで顕著
  3. xhighとmaxは、品質が上がることを測って確かめた仕事にだけ使う
  4. mediumでも、コーディングや知識労働ではOpus 5のhighに並ぶか上回る

これを踏まえた使い分けの目安です。

場面effort
ふだんの仕事・迷ったときmedium(既定のまま)
長時間の大規模な開発で、上げた効果を自分の用途で測れたxhigh・max
答えがほぼ決まっている単純作業lowなど下の段階も試してみる

実はこのあとの実機比較では、Claudeの2モデルをxhighで走らせています。その結果が「強い設定が得になるとは限らない」ことの実例になりました。

実演①|4モデルに同じお題を1回ずつ解かせた

実演①|4モデルに同じお題を1回ずつ解かせた

ここからは、Opus 5.5・Fable 5.1・GPT-6 Astra・Gemini 3.8 Flashの4モデルに、同じお題を解かせた結果です。まず条件を並べます。

  1. お題は3つ — ①マリオ風の横スクロールゲームを作る(同じ自動操作でプレイ)②日本語の要約 ③財務(決算)レポート
  2. 全モデル同じプロンプトで、各1回だけ — 作り直しはしていない
  3. 動かし方が違う — Claudeの2モデルはClaude Code経由でeffortはxhigh、GPT-6 AstraとGemini 3.8 FlashはAPIから直接high

(出典:チャエンのX投稿(2026年9月23日)

1回ずつの試行なので、この結果だけで優劣を決めることはできません。「こういう傾向が出た」という記録として見てください。

4モデルに同じお題を1回ずつ解かせた様子(出典:チャエンのX投稿

お題ごとの結果

お題Opus 5.5Fable 5.1GPT-6 AstraGemini 3.8 Flash
①ゲーム作り作り込みが一番。1面を一瞬でクリア途中で止まり、ゴールできず一応クリアはできたゲームとしては不十分
②日本語の要約OK。「売り越し」のような難しい語の言い換えがうまいOKOKOK
③決算レポート悪くない悪くない悪くない十分使える

ゲーム作りは、Opus 5.5が一番よくできていました。要約はどれも問題なく、「売り越し」のような難しい語をちゃんと言い換えられていたのがOpus 5.5です。仕事で使う文章でも、この言い換えの上手さは効いてきます。

決算レポートはどのモデルも悪くなく、Gemini 3.8 Flashでも十分でした。Opus 5.5やFable 5.1は単価が高いので、このくらいの作業ならFlashで済ませるのも手です。

かかった時間と費用

3つのお題の合計です。費用は各社の公式単価での試算です。

モデル合計時間費用(試算)
Opus 5.5約44分6.23ドル
Fable 5.1約34分7.88ドル
GPT-6 Astra約19分2.53ドル
Gemini 3.8 Flash約3分0.25ドル

(出典:チャエンのX投稿(2026年9月23日)

Claudeの2モデルはClaude Code経由のxhigh、ほかの2つはAPI直のhighなので、時間も費用も同じ条件での比較ではありません。

xhighで「考えすぎた」

Opus 5.5の約44分には理由があります。1回目は12.8万トークン考えたところで、1行もコードを書けずに止まり、完成までに約30分かかりました。

強い設定にしたら考えすぎた、という実例です。前の章で見た「まず既定のmediumから」「xhighとmaxは効果を測れた仕事にだけ」という公式の説明と、ちょうど重なる結果になりました。

Opus 5.5を試すときは、まず既定のmediumのまま使ってみてください。

今だけ12大特典を無料プレゼント中。ClaudeやChatGPTの実践テクニックをまとめた限定コンテンツを、LINE登録だけでお届けしています。

実演②|3Dゲームも解説アニメもコードで作れる

実演②|3Dゲームも解説アニメもコードで作れる

比較とは別に、Opus 5.5で作ったものを2つ紹介します。どちらも画像や音の素材を用意せず、コードだけで作っています。

3Dゲーム

よくあるゲーム広告の、薪を運んでくるタイプのゲームをイメージして作りました。

  1. 内容 — 吹雪の峠にある避難小屋で、炉の火を朝まで守りながら、道に迷った旅人を迎え入れる
  2. ファイル — HTMLファイル1本、約134KB
  3. 素材 — 画像素材はゼロ。炎も雪も効果音もコードで生成
  4. 遊ぶ時間 — 一夜が約6分
Opus 5.5で作った3Dゲーム(出典:チャエンのX投稿

かなりリアルな3Dの雰囲気が出ていて、GPT-6 Astra級だと感じました。3Dのコーディング性能は大きく上がった印象です。作ったゲームはClaudeのArtifactsで公開しています。

解説アニメ

海外で話題になっていた「全フレームをJavaScriptで描画するアニメ」を、Claude Code × Opus 5.5で日本語版にしてみました。

  1. テーマ — 特殊相対性理論。ふたごのパラドックスを約46秒で解説
  2. 表現 — 紙の切り貼り風の絵も、BGMも効果音もJavaScriptで生成
  3. 指示 — 参考にしたツイートのURLと、簡単な指示だけ
  4. 作り方 — canvasで1,395フレームを描いてmp4にし、レンダリングは約2分
Claude Code × Opus 5.5で作った解説アニメ(出典:チャエンのX投稿

研修の教材や教育コンテンツ、サービスの説明動画にも使えると考えています。

Claude Codeをこれから使い始める方は、基本の使い方を以下の記事にまとめています。

Claude Codeとは?Web版やCoworkとの使い分けから使い方・料金を徹底解説

Claude Codeとは?Web版やCoworkとの使い分けから使い方・料金を徹底解説

使いこなしのコツ|プロンプトの書き方と用途別の使い分け

使いこなしのコツ|プロンプトの書き方と用途別の使い分け

モデルが賢くなった分、プロンプトは凝ったものより、シンプルに書くのがおすすめです。動画でお伝えしたポイントは次の3つです。

  1. 大事なことは最初の1行にまとめる — 何をしてほしいかを冒頭で言い切る
  2. シンプルに書く — 前置きや条件を盛りすぎない
  3. 専門用語を減らす — 難しい言葉は平易な言葉に置き換える

もう1つ、Opus 5で使っていたeffortやプロンプトの設定は、そのまま持ち越さないほうが安全です。同じeffort名でもOpus 5.5のほうが多く考えるので、まず既定のmediumで結果を見てから調整してください。

用途別の使い分け

実機比較の結果も踏まえて、用途ごとの目安を表にしました。

やりたいことおすすめ
ふだんの仕事・どれを使うか迷ったときClaude Opus 5.5(effortはmedium)
長時間の大規模な開発・リファクタリングClaude Opus 5.5。上げた効果を測れたらxhigh・max
日本語の要約・難しい語の言い換えClaude Opus 5.5
決算レポートの整理など、簡単な作業を安く速くGemini 3.8 Flash

Gemini 3.8 Flashの強みと、安いモデルを上位モデルと組み合わせる使い方は、以下の記事で解説しています。

Gemini 3.8 Flashの有意義な使い方|AIが書いた文章の「添削役」に回すと効く、安くて速いモデルの活かし方

Gemini 3.8 Flashの有意義な使い方|AIが書いた文章の「添削役」に回すと効く、安くて速いモデルの活かし方

ここまで読んで「Opus 5.5を自社のシステムや業務フローに組み込みたい」と感じた方へ。法人向けAI研修の導入社数No.1*の弊社デジライズが、AIコンサルティング&開発のサービス資料を無料でお送りしています。既製のAIサービスでは要件が満たせず、自社に合わせたシステム構築や環境の検討が必要な場合の進め方をまとめています。

※出典:株式会社東京商工リサーチ「法人向けリスキリングサービスに関する調査」(2026年5月/調査期間:2026年3月26日〜4月17日/調査方法:デスクリサーチおよびヒアリング/2026年3月末時点)

まとめ

まとめ

Claude Opus 5.5のポイントをまとめます。

  1. 性能 — ほとんどの仕事でFable 5.1と同水準。公式ベンチマーク9項目中7つで1位、第三者の総合指数でも首位
  2. 料金 — API単価は2割引き、キャッシュ読み込みは6割引き。既定設定の典型的な作業なら、動かすコストはOpus 5より40%減
  3. effort — 既定がmediumに変わった。maxに上げても点が上がるとは限らず、xhighとmaxは効果を測れた仕事にだけ使う
  4. 実機比較 — ゲームの作り込みと日本語の言い換えはOpus 5.5が一番。簡単な作業ならGemini 3.8 Flashでも十分

私も、Claude CodeではOpus 5.5をメインにしていこうと思っています。迷ったらOpus 5.5を選び、effortはmediumのまま、ぜひあなたの仕事でもガンガン使ってみてください。

この記事の著者 / 編集者

チャエン

株式会社デジライズ 代表取締役

チャエン

法⼈向けのAI研修、及び企業向けChatGPTを開発する株式会社デジライズをはじめ、他数社の代表取締役。一般社団法人生成AI活用普及協会評議員を務めながら、GMO AI & Web3株式会社など他数社の顧問も兼任。NewsPicksプロピッカーも兼任。Twitterはフォロワー16万⼈。⽇本初AIツール検索サイト「AI Database」やAIとの英会話ができる「AI英会話」など複数のAIサービスも開発。ABEMAやTBSテレビなどメディア出演も多数。