Anthropicが9月22日に公開した「Claude Opus 5.5」は、前モデルOpus 5より性能を上げながら、一般的な利用で約4割安く動くモデルだ。API単価は入力100万トークン4ドル、出力20ドルと2割下がり、出力速度も30%以上速くなった。上位モデル並みの賢さを、より安く日常業務へ回せるようにした一手と言える。

Claude Opus 5.5の価格──単価2割減、実際の負担は4割減

公式発表によると、Opus 5.5の料金は入力100万トークンあたり4ドル、出力が20ドル。Opus 5の5ドル・25ドルからそれぞれ2割下がった。さらに、同じ指示文を繰り返し読み込む際に使うキャッシュ読み出しは0.50ドルから0.20ドルへ6割引き下げられている。Anthropicは、これらを合わせると典型的なワークロードでOpus 5より40%安く動くと説明している。(Anthropic)

ここで押さえておきたいのは、「単価2割減」と「実質4割減」が別の数字だという点だ。4割はキャッシュ割引や処理効率の改善を重ねた結果だ。実際の削減幅は使い方次第で変わる。

Opus 5との違い──ベンチマークは上位モデルFable 5.1超え

性能面の伸びも大きい。ターミナル操作を伴う開発作業を測るTerminal-Bench 4.0では、Opus 5の52.3%に対してOpus 5.5は66.4%を記録し、上位モデルのFable 5.1(55.8%)も上回った。実務タスクを評価するGDPval-AAでも1846と、Opus 5の1708、Fable 5.1の1735を超えている。(Anthropic)

MacRumorsは、Opus 5.5がほとんどの作業でFable 5.1と同等の水準にあり、エージェント型のコーディングやコンピューター操作、画像認識などでは上回ると伝えている。(MacRumors)つまり「一段下のモデルを安くした」のではなく、「上位級の性能を安い価格帯へ降ろしてきた」と見るのが正確だ。

Grok 4.7との比較──安さのxAI、深さのAnthropic

同じ週にはxAIもGrok 4.7を公開している。価格は入力2ドル・出力6ドルとOpus 5.5の半額以下で、文脈長は50万トークン。一方、Terminal-Bench 4.0は38.0%でOpus 5.5とは開きがある。(MarkTechPost)

大量の軽い処理を安く回したいならGrok、長時間かかる複雑な作業を任せたいならOpus 5.5という棲み分けだ。「どれが一番賢いか」より、「どの仕事にどのモデルを当てるか」を考える段階に入ったと言える。

「減速」を訴えた直後の新モデルという文脈

今回の発表には、もう一つ注目点がある。Yahoo Financeは、ダリオ・アモデイCEOがAI開発のペースを落とすべきだとするエッセイを公表した後、最初に出たモデルがOpus 5.5だったと報じている。Anthropicは広範なアライメント試験や外部評価を経たことを強調しているという。(Yahoo Finance)

公式ページでも約2,000の行動シナリオでの安全性改善が挙げられている。減速を唱えた企業として、安全性を前面に出すのは必然と言える。

Claude Opus 5.5で何が変わるか──選ぶ理由は「安くなった上位級」

Opus 5.5はPro・Max・Team・Enterpriseの各プランで利用でき、個人は同じ月額のまま賢いモデルに乗り換えられる。

結論として、Opus 5.5の本当の意味は「賢くなった」ことより「上位級の賢さが普段使いの価格に降りてきた」ことにある。高性能モデルは高いという前提が崩れ始めた以上、利用者が見るべきは最高スコアではなく、自分の業務1件あたりのコストだ。

あわせて読みたい:ChatGPTのシェアが半年で70%→50%に──GeminiとClaudeが奪った20ポイントの正体

参照ソース(噂の出どころ)

Introducing Claude Opus 5.5(Anthropic) 26/09/22

Anthropic Launches Claude Opus 5.5 With Fable-Level Performance at a Lower Price(MacRumors) 26/09/22

Anthropic launches Opus 5.5, its first model since CEO Amodei called for AI slowdown(Yahoo Finance) 26/09/23

SpaceXAI Releases Grok 4.7(MarkTechPost) 26/09/21

コメントを残す

Trending