Anthropicは2026年7月24日にOpus 5をリリース

Claude Opus 5確かな成果が求められる仕事に

リリース以来、Felo PROユーザーはClaude Opus 5を7日間無料で試せます。

Anthropic Claude Opus 5 official illustration framed in Felo blue
ビジュアル出典: Anthropic。元の要素を変更せず、Felo向けにフレーミングしています。

Felo Searchで利用可能に

より難しい質問を。根拠に耐える検索回答を。

より深い調査、強力な情報源の統合、証拠に照らした最終回答が必要な質問のために、Claude Opus 5がFelo Searchで利用可能になりました。

Felo SearchでOpus 5を試す

01

本当の問いをたどる

曖昧な依頼の背後にある制約を検討し、最初にもっともらしく見える解釈で止まりません。

02

食い違う証拠を比較検討する

競合する情報源と主張を一つの調査にまとめ、証拠が一致する点と一致しない点を明らかにします。

03

未解決事項を減らして戻る

推論、注意点、未解決の問いを見えるままにし、意思決定に使える出発点として回答を活用します。

簡単な手順

FeloでClaude Opus 5に切り替える

モデル選択画面を開き、Claude Opus 5を選択して、同じワークスペースでタスクを始めます。

7月24日

2026年リリース

Anthropicの最新Opusモデル

$5 / $25

API入力 / 出力

100万トークンあたり、Opus 4.8と同じ基本価格

約2.5倍

Fastモードの速度

Anthropicのプラットフォームでは基本価格の2倍で利用可能

検証 + 改善

長時間タスク

計画、ツール使用、確認、反復

Opusの違い

最初に動くものだけで終わらせない。

AnthropicはOpus 5を、継続的な判断が重要な仕事向けに位置づけています。根本的な問題を特定し、結果を検証し、証拠が不十分なら作業を見直します。

01

根本の問題をたどる

難しいバグや曖昧な課題では、表面的なパッチではなく、証拠、制約、実際の根本原因から始めます。

02

引き渡し前に作業を確認する

自らの出力を調べ、前提をテストし、あとで人が発見する前に問題を見つけられるモデルを使います。

03

改訂をまたいで文脈を保つ

コード、資料、ツール結果、新たな制約を一つの長いタスクに取り込み、仕事を断片的なプロンプトに分解しません。

モデル選択

トークンの価格だけでなく、間違えるコストも比較する。

以下の価格は公式の公開API料金であり、Feloのサブスクリプション料金や利用料金ではありません。無関係なベンダーのレイテンシーテストを直接比較できるかのように扱わず、トレードオフを可視化します。

判断要因
Claude Opus 5
GPT-5.6 Sol
Kimi K3
Claude Opus 4.8
API価格 / 100万トークン
入力$5 / 出力$25
入力$5 / キャッシュ$0.50 / 出力$30
入力$3 / キャッシュ$0.30 / 出力$15
入力$5 / 出力$25
速度と容量
標準速度、または基本価格の2倍で約2.5倍速のFastモード。
OpenAIはSolをFastと表記。コンテキストウィンドウは105万トークン。
1,048,576トークンのコンテキスト。スループットはアカウントのレート制限ティアにより異なります。
従来のOpus基準。ワークフローでの現在の可用性とレイテンシーを比較してください。
最適な用途
検証と慎重な反復が必要な、高い影響度の長時間タスク。
高速なフラッグシップモデルの応答と非常に大きなコンテキストウィンドウを求める複雑な専門業務。
公開トークン価格を抑えつつ、長期的なコーディングやエンドツーエンドの知識業務。
すぐの移行より継続性が重要な既存のOpusワークフロー。
選ぶべきとき
下書きだけでなく、完了、確認、説明可能性が求められるタスク。
OpenAIのフラッグシップ層が必要で、その速度・コンテキスト特性がタスクに合うとき。
100万トークンのコンテキストが必要で、キャッシュと推論量でコストを管理したいとき。
確立した前世代の基準から、管理された移行を評価しているとき。

公式公開API料金は2026年7月25日に確認。総タスクコストは出力長、キャッシュ済み入力、推論設定、ツール呼び出し、再試行、人によるレビューにも左右されます。

公式ベンチマークチャート

Anthropicのコスト対性能チャートが示すもの

これらの公式チャートは、異なる推論量でのモデル性能を報告された評価コストに対して示します。コスト判断の有用な文脈ですが、独立したFeloテストではなくベンダー公表の結果です。

Anthropic公式Claude Opus 5ベンチマーク能力概要。コーディング、知識業務、検索、コンピューター操作、ビジネスワークフロー、健康、生命科学におけるOpus 5、Fable 5、Opus 4.8、GPT-5.6 Solの比較

ベンチマーク群を横断した公式能力概要

Anthropicのクロスタスク行列は、コーディング、知識業務、検索、コンピューター操作、ビジネスワークフローなどにおけるOpus 5、Fable 5、Opus 4.8、GPT-5.6 Solの公表結果を比較します。

Anthropic公式の推論量別エージェント型コーディングチャート。タスク単価別にOpus 5、Fable 5、Opus 4.8、GPT-5.6 Solを比較

推論量別のエージェント型コーディング

Artificial Analysis Coding Agent Index: 公式チャートは利用可能な推論設定ごとにスコアと報告タスク単価を比較します。

Anthropic公式の推論量別エージェント型コンピューター操作性能チャート。タスク単価別にOpus 5、Fable 5、Opus 4.8、GPT-5.6 Solを比較

推論量別のエージェント型コンピューター操作

OSWorld 2.0: 公式チャートは推論設定ごとにコンピューター操作性能と報告タスク単価を比較します。

Anthropic公式の推論量別実世界の知識タスクチャート。ベンチマークコスト別にOpus 5、Fable 5、Opus 4.8、GPT-5.6 Solを比較

推論量別の実世界の知識タスク

GDPval-AA v2: 公式チャートは推論設定ごとにEloスコアと報告されたベンチマーク全体のコストを比較します。

Anthropic公式の推論量別エージェント型検索DeepSearchQAチャート。タスク単価別にOpus 5、Fable 5、Opus 4.8を比較

推論量別のエージェント型検索

DeepSearchQA: 公式チャートは利用可能な推論設定ごとに検索タスクの合格率と報告タスク単価を比較します。

チャートとベンチマーク名はAnthropicのClaude Opus 5発表に基づきます。Feloが追加したのは外側の表示枠のみで、チャート内容は公表時のままです。

よりよい出発点

二度目の確認に値する仕事をOpus 5に任せる。

検証によって結果が変わるとき、このモデルの価値が発揮されます。これは一般的なチャットプロンプトではなく、依存関係の見落とし、根拠のない主張、未検証のエッジケースが後で時間を要する複数ステップの仕事です。

本番コードとQA

回帰を調査し、再現し、周辺コードを確認して焦点を絞った修正を実装し、簡易パッチが見落としがちな経路をテストします。

財務・文書分析

表を照合し、前提を検証し、原資料を比較して、証拠と注意点を保ったまま推奨を提示します。

精査が必要な調査

競合する情報源を読み、未解決の問いを明示し、証拠を比較検討して、自信のある回答と実際に裏付けられた回答を区別します。

長時間のエージェントタスク

ツールを使い、タスクの制約を保ち、部分的な結果から回復し、意図的なチェックポイントを設けて大きな課題を進めます。

結果が重要なタスクを試す

01

実際の文脈を持ち込む

有用な回答が考慮すべきコード、文書、要件、証拠を追加します。

02

検証計画を依頼する

何を作るかだけでなく、作業完了と見なす前に何を確認すべきかを指定します。

03

最終成果物を比較する

Feloで主要モデルに同じタスクを与えます。回答だけでなく、その背後にあるテスト、注意点、判断も確認します。

アカウントのライブモデル選択画面で利用可能な場合はClaude Opus 5を選択してください。

Felo LLM Playgroundを開く

Claude Opus 5 FAQ

Claude Opus 5は、Anthropicが2026年7月24日にリリースしたOpus層のモデルです。Anthropicは、長時間稼働するエージェント、複雑なソフトウェアエンジニアリング、専門的な知識業務、検証と慎重な反復が有益なタスク向けに位置づけています。

作業を確認するモデルを使う。

Claude Opus 5をFeloの他の主要モデルと並べ、もっともらしい回答だけでは不十分なタスクで試してください。

FeloでOpus 5を試す

Felo AI Searchで始め、利用可能な場所でモデルを選択してください。