重要なポイント
- Opus 4.5 は新しいコーディングの王様です: SWE ベンチ検証で 80.9% のスコアを獲得し、GPT-5.1 と Gemini 3 Pro の両方を上回ります。
- Haiku 4.5 はその重量を超えています: 「小型」モデルは、前世代の Sonnet 4 のコーディング パフォーマンスに匹敵するようになりました。
- 価格戦争: Opus 4.5 は、100 万投入トークンあたり 5 ドルという積極的な価格設定がされており、競合他社を大幅に下回っています。
- ハイブリッド推論: どちらのモデルも、複雑なタスクに対する新しい「切り替え可能な」推論機能を備えています。
OpenAI と Google が 11 月のリリースで場から酸素をすべて吸い取ったかのように思われたとき、Anthropic は大規模なカウンターパンチで反撃しました。 Claude Opus 4.5 および Claude Haiku 4.5 のリリースは、単なる反復的なアップデートではありません。それは開発者市場の中心における計算されたストライキです。
ここ数週間、会話は GPT-5 の推論と Gemini 3 のエコシステム統合によって占められてきました。しかし、Anthropic はその中心となる哲学、つまり本格的な作業に向けて最も有能で信頼性が高く、操作可能なモデルを構築することを堅持してきました。これらの新しいリリースにより、コーディングと複雑なエージェント ワークフローに関しては、Claude が依然として優れたモデルであることを強く主張しています。
クロード作品 4.5 を理解する
2025 年 11 月 24 日にリリースされた Opus 4.5 は、Anthropic の新しいフラッグシップです。これは、最も要求の厳しいタスク向けに設計された、ラインナップの中で最も「スマート」なモデルとして、オリジナルの Opus に代わるものです。
仕様
- コンテキスト ウィンドウ: 200,000 トークン
- 価格: 100 万入力トークンあたり 5 ドル / 100 万出力トークンあたり 25 ドル
- 主な機能: ハイブリッド推論 (即時応答と拡張「思考」モードを切り替える)
ベンチマーク
ここでの見出しの数字は SWE ベンチ検証で 80.9% です。 AI 評価の雑草に詳しくない人にとって、SWE ベンチは、現実世界のソフトウェア エンジニアリングの問題を解決する AI の能力をテストするためのゴールド スタンダードです。
- クロード オーパス 4.5: 80.9%
- GPT-5.1: ~78% (推定)
- Gemini 3 Pro: ~76% (推定)
これは誤差の範囲での勝利ではありません。これは、LLM にとって現時点で商業的に最も価値のある領域、つまりコードの記述において決定的なリードとなります。
クロード俳句を理解する 4.5
Opus が見出しを賑わす一方で、Haiku 4.5 (10 月 15 日に静かにリリースされ、現在は完全に展開されています) は企業にとってより重要なモデルかもしれません。
なぜそれが重要なのか
Haiku は常に「速くて安い」モデルでした。しかし、Haiku 4.5 は、「速く、安く、そして * スマート」になることで方程式を変えます。 Anthropic は、わずか数か月前に最先端のモデルであった Sonnet 4 のコーディング パフォーマンスに匹敵すると主張しています。
経済学
- 価格: 入力トークン 100 万件あたり 1 ドル / 出力トークン 100 万件あたり 5 ドル
- 使用例: これは、「エージェント」ワークフロー用のエンジンです。ログの分析、サポート チケットの優先順位付け、単体テストの作成など、何千ものサブタスクを実行する必要があるシステムがある場合、Haiku 4.5 を使用すると、品質を犠牲にすることなく経済的に実行可能になります。
比較: クロード vs. GPT-5 vs. Gemini 3
2025 年後半の AI の状況は、3 頭のレースになります。それらをまとめると次のようになります。
| 特集 | クロード作品4.5 | GPT-5.1 | ジェミニ 3 プロ |
|---|---|---|---|
| 主な強み | コーディングとエージェント制御 | 一般推論とマルチモダリティ | Google エコシステムの統合 |
| コーディング ベンチマーク | 80.9% | ~78% | ~76% |
| 価格設定 (インプット/アウトプット) | $5 / $25 | ~$15 / $75 | ~$10 / $50 |
| コンテキスト ウィンドウ | 200k | 128k | 128k |
評決: 消費者向けチャットボットを構築している場合、「個性」という点では GPT-5 がまだ優位性を持っている可能性があります。 Google Workspace を深く理解している場合は、Gemini 3 を選択するのは簡単です。しかし、ソフトウェア、エージェント、または複雑なデータ パイプラインを構築している場合、現時点で客観的に見て、Claude Opus 4.5 がその仕事に最適なツールであり、大幅に安価です。
業界への影響
「ハイブリッド推論」の台頭
Opus 4.5 の最も興味深い機能の 1 つは、「推論」のオンとオフを切り替える機能です。 「思考」の一時停止を強制する OpenAI の o1 モデルとは異なり、Claude は開発者に選択を許可します。この柔軟性は、単純なクエリについては低レイテンシーを必要とするが、複雑なクエリについては深く考える必要があるアプリケーションにとって非常に重要です。
企業の安全
Anthropic は、「Constitutional AI」ブランディングに力を入れ続けています。 Opus 4.5 には、エンタープライズ グレードのセキュリティ機能と「AI Safety Level 2」認定が付属しています。銀行、医療提供者、政府機関にとって、多くの場合、この安全第一のアプローチが決定要因となります。
次は何ですか?
Opus 4.5 のリリースにより、Anthropic の 2025 年のラインナップが完成しました。ここでの問題は、OpenAI と Google がどのように対応するかということです。業界では、コーディングのギャップを埋めるために、2026 年初頭に「GPT-5.5」または「Gemini 3 Ultra」が登場する可能性があります。
しかし今のところ、ボールは彼らのコートにあります。 Anthropic は、勝つために最大の誇大宣伝マシンは必要ないことを証明しました。必要なのは最高のコードだけです。
結論
Claude Opus 4.5 は、集中的なエンジニアリングのマスタークラスです。 Anthropic は、コーディング機能、エージェントの信頼性、コスト効率を優先することで、開発者コミュニティが求めていたものを正確に提供してきました。 GPT-5 の競争相手としてふさわしいだけではありません。多くのユースケースでは、これが優れた選択肢です。
出典 (3)
- anthropic.com Anthropic Opus 4.5 Announcement
- anthropic.com Anthropic Haiku 4.5 Announcement
- aboutamazon.com AWS Bedrock News
🦋 Bluesky での議論
Bluesky で議論する