AI

Claude Opus 5はFable 5の半額で、コーディング性能差はわずか0.5%

Adrian Kessler

Claude Opus 5は自身のミスを検出し、回答が不十分な場合は書き直し、多段階の科学・コーディングタスクを最初から最後まで処理する。価格はAnthropicの最強モデルFable 5の半分だ。コーディングベンチマークではOpus 5はFable 5と0.5%以内の性能差にとどまり、OSWorld 2.0のコンピュータ操作テストでは、フラッグシップモデルを実際に上回り、コストは3分の1である。

Opus 5を従来モデルと構造的に異ならせるのは「エフォートトグル」だ。APIリクエストごとに低・中・高の設定を付与できる。日常的な文書レビューを行う法務チームは低設定で運用し、複雑な分散システムをデバッグするソフトウェアエンジニアリングのワークフローは高設定に切り替えられる。モデル自体を変更することなく、タスクに費やす計算リソースを調整し、それに応じてユーザーの支払額が変わる仕組みだ。

価格は入力トークン100万あたり5ドル、出力トークン100万あたり25ドルで、これはOpus 5の直接の前身であるOpus 4.8と同じレートである。AnthropicのフラッグシップモデルFable 5は、その約2倍のコストだ。Opus 5は現在、Claude Maxサブスクリプションのデフォルトモデルとなっており、APIエンドポイントclaude-opus-5から利用可能だ。高速モードはベーストークン価格の2倍で推論速度が2.5倍になり、レイテンシがコストよりも重視されるリアルタイムパイプライン向けである。

限界は確かに存在し、Anthropicはそれを明確にしている。Opus 5は、同社のセキュリティ特化モデルMythos 5にはサイバーセキュリティタスクで依然として劣り、またAnthropicが安全性の理由からハードルと定義するデュアルユース生物学では進展が見られない。自律的で数カ月に及ぶ生物学研究プロジェクトには、引き続きFable 5が推奨される。0.5%のコーディング性能差は、ベンチマークの範囲外にある複雑で自由度の高い問題では、実際にはさらに広がる可能性がある。

今回のリリースは、業界全体での矢継ぎ早の発表を背景としている。OpenAIは7月9日にGPT-5.6を3段階で投入し、Googleは7月21日にGemini 3.6 Flashをリリース、出力トークンコストを17%削減した。各波が基準値を引き上げる一方で、企業が従来のモデルを評価し導入するまでの時間は圧縮されている。

Opus 5は本日より、Claude API、Claude.ai、Claude Code、Claude Coworkを通じて利用可能で、価格は入力トークン100万あたり5ドル、出力トークン100万あたり25ドルである。Anthropicによれば、エフォートトグルはすべてのAPIユーザーとClaude Maxサブスクライバーに即時提供される。

Opus 5は、Anthropicにとって60日間で4つ目のモデルリリースとなる。コストパフォーマンスのフロンティアが急速に移動する現在、エンタープライズバイヤーにとって新たな問題が生じている。それは、評価をいつ止めて、実際に出荷すべきかを見極めることだ。

タグ: , , , , ,

ディスカッション

0件のコメントがあります。