Skip to main content

Claude Opus 5.5がFelo Searchに登場:根拠に耐える回答

· 約9分
Felo Search Tips Buddy
Committed to answers at your fingertips

Claude Opus 5.5がFelo Searchで利用可能になりました。100万トークンのコンテキスト、100万トークンあたり$4/$20、行動前に証拠と照合された回答。

Anthropicは9月22日にClaude Opus 5.5をリリースしました。検索にとって重要な数字はベンチマーク表には載っていません。それは価格です。入力100万トークンあたり$4、出力100万トークンあたり$20。Opus 5では$5と$25でした。Anthropicは、通常のワークロードで運用コストが約40%削減され、出力速度が30%以上向上したと説明しています。

Opus 5.5は現在Felo Searchで利用できます。安価で高速なだけでも十分な価値があります。研究用途で切り替える理由は、慎重さが増した点です。

Claude Opus 5.5 in Felo Search: a one-million-token context holding sources, evidence, and caveats together

Claude Opus 5.5とは何か​

Opus 5.5は、Anthropicが9月に最先端開発のペース調整を公に呼びかけて以来、初めてのリリースです。Opusラインの最上位に位置し、Claude Sonnet 5の上にあり、Fableラインは別種の展開に使われています。

仕様は、単に生成するだけでなく、根拠を持って守る必要がある作業向けに設計されています。100万トークンのコンテキストウィンドウ、最大出力128,000トークン、そして100万トークンあたり$0.20のキャッシュリードで、長く反復的なセッションの再実行が手頃になります。

SpecClaude Opus 5.5
Model IDclaude-opus-5-5
MakerAnthropic
ReleasedSeptember 22, 2026
Context window1,000,000 tokens
Max output128,000 tokens
InputText, image
OutputText
Price$4 per million input, $20 per million output
Cached input$0.20 per million tokens
Prior generationOpus 5, released July 24, 2026 at $5 / $25

この表の2つの項目が、研究ワークフローがこのモデルに注目する理由です。

100万トークンのコンテキスト。 約75万語分で、通常なら質問前に要約しなければならない資料の束です。先に要約すると、誤りが入りやすくなります。要約は、どの詳細が必要になるか知らないモデルによって書かれます。

入力価格の5分の1でキャッシュリード。 Felo Searchでの調査は1回の呼び出しでは終わりません。初回、検証、修正、統合と、同じ資料を何度も読み直します。キャッシュによって繰り返し読み込みのコストが無視できるものになります。

なぜ検証がAI検索の核心なのか​

AI検索エンジンに質問すると、読みやすい回答が返ってきます。これはもはや難しくありません。難しいのは、その文が誰かの検証に耐えるかどうかを知ることです。

検証は要約とは異なるスキルです。2つの資料が同じ統計を異なる分母で説明していることに気づく必要があります。主張の根拠がプレスリリースだけの場合、警告を出す必要があります。自信満々な段落ではなく「この証拠は薄い」と返す必要があります。

AnthropicはOpus 5.5の発表時に4つのベンチマークを公開しました。その傾向は注意深く読む価値があります。

BenchmarkClaude Opus 5.5GPT-6 Astra
Terminal-Bench 4.066.4%57.9%
FrontierCode v1.1 (Main)54.4%53.3%
AutomationBench40.0%41.4%
Terminal-Bench-Science 0.158.7%64.6%

Anthropicは2つでリードし、2つで遅れています。これは全勝よりも有用な情報です。Astraは科学系端末作業や業務プロセス自動化で優位を保ち、Opus 5.5は一般的なエージェント的コーディングやフロンティアコードで優れています。

方法論の注記はスコア以上に重要です。AnthropicはOpus 5.5を本番用の安全設定を有効にした状態で評価しました。ユーザーに提供される設定と同じで、リスクの高いリクエストは旧モデルにルーティングされます。評価時だけ存在する安全システムは安全システムではありません。同社はOpus 5と比べて境界突破の試みが約85%減少し、過去最高のアラインメント結果を報告しています。

検索用途では、この設定が製品です。回答を拒否するモデルは不便です。拒否すべき質問に流暢に引用付きで答えるモデルは、さらに問題です。

Felo SearchでClaude Opus 5.5を使う方法​

1. モデルピッカーで選択。 Felo Searchを開き、Claude Opus 5.5を選び、いつもの入力欄で質問します。

2. 要約ではなく全資料を渡す。 100万トークンウィンドウは事前圧縮をやめることで最大の価値を発揮します。提出書類、論文、スレッドなどすべてをアップロードし、全文に対して質問します。

3. 注意点を明示的に尋ねる。 「この結論が間違っているために必要な条件は?」「どの資料が最も弱い?」など、検証訓練されたモデルは要約モデルと異なる回答を返します。

4. 意見の不一致を示させる。 資料が矛盾する場合、どこで一致し、どこで分岐し、どの主張が最も根拠薄いかを整理させます。これが研究で本当に欲しい出力です。

5. 同じスレッドで反復。 キャッシュリードは安価ですが、再起動はそうではありません。挑戦、修正、最終統合を1セッションで行い、モデルが元の証拠を保持できるようにします。

Felo Searchにある他の3モデル​

Opus 5.5は他の3つの最先端モデルとほぼ同時に登場し、Felo Searchでは4つすべてが動いています。

ModelReleased byPrice per million tokensContextBuilt for
Grok 4.7SpaceXAI$2 in / $6 out500K長期的な推論と知識作業
Claude Opus 5.5Anthropic$4 in / $20 out1M検証に耐える回答
GPT-6 LunaOpenAI$0.10 in / $0.50 out1.05M最低コストで大量検索
GPT-6 SolOpenAI$2 in / $10 out1.05Mエージェントループと反復呼び出しを中価格帯で

Opus 5.5は出力価格が最も高く、ベンダーが安全設定とスコアを同時公開した唯一のモデルです。誤答が遅さよりも高くつく質問に適しています。

最初に試すべきこと​

繰り返す予定の主張。 文書に記載する統計を選び、Opus 5.5にその起源を追わせます。興味深い出力は数字ではなく、その根拠の道筋です。

2つの正当な答えがある決断。 両方の選択肢と制約を与え、どちらを証拠が支持し、何が答えを変えるか尋ねます。

署名予定の文書。 契約、ポリシー、利用規約では、存在する内容よりも欠落している内容を報告するモデルが役立ちます。

過去に実行した研究スレッド。 1ヶ月前に尋ねた質問を再実行し、注意点を比較します。その差が前世代でできていなかった部分です。

Felo SearchでClaude Opus 5.5を試す​

Claude Opus 5.5はFelo Searchで100万トークンのコンテキストウィンドウ、$4/$20の価格設定、本番用安全設定を有効にして利用できます。従来モデルより運用コストが40%安く、Anthropicが自社名を冠する構成です。

Claude Opus 5.5をFelo Searchで開く →


この記事は次の言語でもお読みいただけます:English、简体中文、한국어、繁體中文、हिन्दी、Français、العربية、Русский、اردو、Bahasa Indonesia、Deutsch、Tiếng Việt、Türkçe、Italiano、ไทย、Español、বাংলা、Português。