Claude Opus 5.5: ベンチマーク、価格、そして新機能

claude-opus-5-5

AnthropicはClaude Opus 5.5をリリースし、新しいClaude 5.5ファミリーの最初のモデルを発表しました。

このアップデートは、要求の高い作業をど真ん中で狙ったものです。大規模なコーディングプロジェクト、長時間稼働するAIエージェント、研究、データ分析、そして専門的な知識タスク。Anthropicによると、Opus 5.5は多くのワークロードでClaude Fable 5.1相当のパフォーマンスに到達し、従来のOpus 5よりも大幅に低コストで稼働できるとしています。

開発者にとっての主な改善点は、ベンチマークのスコアが高いだけではありません。Claude Opus 5.5は、トークンコストの低減、1,000,000トークンのコンテキストウィンドウ、最大128K出力トークン、適応的な思考、そしてより高速なオプションモードも提供します。

変更点はこちら。

Claude Opus 5.5を一目で見る

指標 Claude Opus 5.5
リリース日 2026年9月22日
APIモデルID claude-opus-5-5
コンテキストウィンドウ 1Mトークン
最大出力 128Kトークン
バッチAPI 最大出力 300Kトークン、ベータ
入力価格 $4 / 1M tokens
出力価格 $20 / 1M tokens
キャッシュ読み取り $0.20 / 1M tokens
思考 適応的、常時オン
デフォルトの工数 Medium
知識カットオフ 2026年6月
入力 テキストと画像
出力 テキスト

AnthropicはClaude Opus 5.5を最新のOpusモデルとして挙げ、長時間稼働するエージェントによるコーディングと知識業務に向けて位置づけています。

Claude Opus 5.5で新しくなったこと

1. 長く複雑なコーディング課題でのパフォーマンス向上

今回のリリースでAnthropicが狙っている分野の中でも、最も分かりやすいのがコーディングです。

単発のコーディング質問だけに注力するのではなく、Opus 5.5は、多数のファイル、ツール、判断、そして繰り返しの手順が絡む可能性のあるタスクのために設計されています。

Anthropicは、初期テスターがこのモデルを使って200,000行のコードベースを3時間未満で監査し修正したと報告しています。同じ例でOpus 5では20時間超だったとのこと。さらにAnthropicは、HAProxyのC-to-Rust書き換えでもモデルをテストしており、Opus 5.5はFable 5.1よりも速く、報告されたコストも低く完了したとしています。

terminal-coding
そのため、このアップデートは特に次のようなワークフローに関係が深くなります。

  • 大規模なコードベースの移行
  • リポジトリ全体のリファクタリング
  • 複数ファイルにまたがるデバッグ
  • 自動化されたコードレビュー
  • 長時間稼働するコーディングエージェント
  • ソフトウェアの保守とテスト

結局のところ大きな変化は、単に「コーディングの回答が良くなった」という話ではありません。Claudeが、長い手順の間も整合性を保ちながら工学(エンジニアリング)の作業により実用的に寄ってきたのです。

Claude Opus 5.5ベンチマーク

Anthropicは、コーディング、ビジネスのワークフロー、推論、知識業務、そしてコンピュータ利用に関するベンチマーク結果を公開しています。

ベンチマーク Opus 5.5 Opus 5 GPT-6 Astra
Terminal-Bench 4.0 66.4% 52.3% 57.9%
FrontierCode v1.1 54.4% 48.0% 53.3%
GDPval-AA v2.1 1846 1708 1542
AutomationBench 40.0% 26.9% 41.4%
Humanity’s Last Exam 67.7% 63.6% 57.2%
Terminal-Bench-Science 0.1 58.7% 29.0% 64.6%

これらの数値は、個々のベンチマーク結果には文脈が必要な理由を示しています。Opus 5.5は、Anthropicが公開しているTerminal-Bench、FrontierCode、GDPval-AA、Humanity’s Last Examの結果でGPT-6 Astraをリードしています。とはいえ、同じ表のAutomationBenchとTerminal-Bench-ScienceではGPT-6 Astraのほうが高いスコアを出しています。

opus-5-5-iweaver
Anthropic自身も、ベンチマークにおける小さな差は、ユーザーが現実の仕事で体験する内容を予測するのに役立ちにくくなっていると警告しています。そのため「どのモデルが総合的に勝つか」を問うより、コーディング、研究、エージェントによる自動化、ドキュメント分析といった特定のワークロード単位でモデルを比較するほうが合理的です。

Claude Opus 5.5の料金

料金は、最も重要なアップグレードの一つかもしれません。

Claude Opus 5.5の費用は以下の通りです。

  • 入力:1,000,000トークンあたり$4
  • 出力:1,000,000トークンあたり$20
  • 5分キャッシュ書き込み:1,000,000トークンあたり$5
  • キャッシュ読み取り:1,000,000トークンあたり$0.20

比較すると、Claude Opus 5は入力が1,000,000トークンあたり$5、出力が1,000,000トークンあたり$25です。Opus 5のキャッシュ読み取りは、1,000,000トークンあたり$0.50かかります。

モデル 入力 出力
Claude Opus 5.5 $4 / 1M $20 / 1M
Claude Opus 5 $5 / 1M $25 / 1M

つまり、トークンの単価は実質20%低くなります。Anthropicによれば、Opus 5.5はタスク完了に必要なトークン数も少なめになりやすいため、典型的なワークロードでは総コストの削減が約**40%**に達する可能性があります。

これは、ツールを繰り返し呼び出し、大きなコンテキストを読み込み、長時間にわたって実行されるエージェントにとって特に重要です。

1Mコンテキストウィンドウと128K出力

Claude Opus 5.5は、最近のClaudeモデルで導入された大容量のコンテキスト機能を維持しています。

1,000,000トークンのコンテキストウィンドウに対応し、標準的なリクエストでは最大128K出力トークンが利用できます。バッチAPIでもβ版として最大300K出力トークンに対応しています。

より大きなコンテキストウィンドウは、次のような作業で役立ちます。

  • 大規模なコードリポジトリ
  • 研究コレクション
  • 長文レポート
  • 複数ドキュメント
  • 契約書や財務資料
  • エージェントの長い履歴

ドキュメント中心のワークフローでは、iWeaver AI Summarizer のようなツールも、PDFやドキュメント、動画、その他のソース資料の大きな集合を、深い分析の前に構造化された要約や要点へ変換するのに役立ちます。

Claude Opus 5.5のFast Mode

待ち時間(レイテンシー)をより重視するユーザーも Fast Mode を利用できます。

Anthropicによれば、Fast ModeではClaude CodeおよびClaude Platform上でOpus 5.5を最大2.5倍の標準速度で実行できます。

トレードオフは価格です。

  • 入力:$8 / 1M tokens
  • 出力:$40 / 1M tokens

つまり、標準のAPIトークン価格の2倍なので、Fast Modeが最も理にかなうのは、コスト最小化よりも応答速度が重要な場合です。

Claude Opus 5.5 vs Opus 5:実際に何が変わった?

今回のアップグレードは、単なるバージョン番号の更新以上の意味があります。

Opus 5と比べてOpus 5.5では、以下が提供されます。

領域 変更点
コーディング 長時間稼働・複数ファイルのタスクでより強力
エージェントのワークフロー 長いタスク全体で効率が向上
入力価格 $5 → $4(100万トークンあたり)
出力価格 $25 → $20(100万トークンあたり)
キャッシュ読み取り $0.50 → $0.20(100万トークンあたり)
コンテキスト 1Mトークンのまま
最大出力 128Kのまま
思考 適応的な思考が常にオン

既存のOpus 5アプリケーションから移行する開発者は、Opus 5.5がいくつかの挙動変更も導入している点に注意してください。たとえば、思考は無効化できなくなり、ツール利用の一部の挙動も変わりました。Anthropicは、生産環境のアプリケーションで単にモデルIDを置き換える前に、移行ドキュメントを確認することを推奨しています。

Claude Opus 5.5はどこで利用できますか?

Claude Opus 5.5は、次を使ってClaude Platform経由で利用可能です: claude-opus-5-5

Anthropicはまた、Amazon Bedrock、Google Cloud、Microsoft Foundry、AWS上のClaude Platformでのサポートも挙げています。一般向けの利用は、対応しているClaudeの有料プラン全体で利用できます。

iWeaverでClaude Opus 5.5を試す

APIのセットアップをせずに、iWeaverでClaude Opus 5.5を試すこともできます。iWeaverでは無料の毎日クレジットが提供されるため、必要性を判断する前に、ドキュメント分析、リサーチ、執筆、要約、そしてその他の知識ワークフローのような実際のタスクでモデルを検証できます。

APIキー、請求(ビリング)、開発環境の管理をせずにClaude Opus 5.5を体験したい方にとって、これは手軽に始められる方法です。

Claude Opus 5.5は使う価値がありますか?

Claude Opus 5.5が特に魅力的なのは、作業内容に 複雑で長時間 かかるタスクが含まれる場合です。

短い質問や軽量な生成であれば、Opusクラスのモデルを使う必要はまだないかもしれません。しかし大規模なコーディングプロジェクト、ドキュメント量が多い調査、ビジネス分析、自律型エージェント、そしてミスや繰り返しのやり直しがコストに直結するワークフローでは、より強いパフォーマンスと低いトークンコストの組み合わせが大きな意味を持ちます。さらに今回のリリースは、フロンティアモデル間の競争状況も変えます。Claude Opus 5.5は、Anthropicの最上位のFableモデルと、より安価なSonnetクラスの選択肢の間に位置しつつ、高度なコーディングやエージェントのワークロードでGPT-6 Astraのようなモデルと直接競合します。

そのため、次の比較が特に面白くなります:Claude Opus 5.5 vs GPT-6。