GPT-6.1 Sol API:低コストでAstraに近い性能
OpenAI GPT-6.1 Solは、コーディング、コンピュータ利用、プロフェッショナルな作業において、1.05Mのコンテキストウィンドウとともに、100万トークンあたり$2/$10でAstraに近い性能を実現します。
OpenAIの最新Solモデルは、最も賢いモデルを目指していません。1日中使い続けられる価格を目指しています。
GPT-6.1 Solは、フラッグシップのGPT-6 Astraと軽量なGPT-6 Lunaの中間に位置します。OpenAIのモデルページでは、**「複雑な作業において、低コストでAstraに近い性能」**と一文で説明されています。エージェント型のコーディングツール、コンピュータ利用エージェント、ドキュメント中心のワークフローを構築するチームにとって、このバランスが重要です。
本ガイドでは、GPT-6.1 Solの仕様、価格、GPT-6 SolやAstraとの違い、Felo API Platform経由での呼び出し方法を解説します。

GPT-6.1 Solとは
GPT-6.1 Solは、複雑なコーディング、コンピュータ利用、プロフェッショナルな作業のために設計された推論モデルです。GPT-6ファミリーの中でバランス型の選択肢として位置づけられ、Lunaより高性能、Astraより低価格、多くの本番ワークロードでフラッグシップを必要としない十分な強さを持ちます。
モデルページでは、SolとAstraを自分のタスクで比較し、品質差が価格差に見合うか判断するよう案内しています。実用的な指針であり、モデルの目的を反映しています。Solはコスト管理のためのレバーであり、ベンチマークのためのトロフィーではありません。
Feloのモデルページも同様の立場をプラットフォーム側からまとめています。GPT-6.1 Solは「GPT-6 Solのアップグレードであり、フラッグシップGPT-6 Astraの下に位置づけられる」と説明されています。エージェント型コーディング、コンピュータ利用、ドキュメント中心のプロフェッショナル作業、多段階ワークフロー自動化をこなし、これらのタスクでAstraに近い成果をはるかに低コストで実現します。GPT-6 Solと比較して、事実誤認が減り、明示的な制約への遵守も向上しています。
GPT-6.1 Solは、タスクが難しく、長く、繰り返し発生し、かつ請求額を予測可能に保ちたいときに選ぶモデルです。
GPT-6.1 Solの主な仕様
OpenAIはモデルページで全仕様を公開しています。ここでは要点をまとめます。
| 仕様 | GPT-6.1 Sol |
|---|---|
| モデルID | gpt-6.1-sol |
| デフォルトスナップショット | gpt-6.1-sol |
| コンテキストウィンドウ | 1,050,000トークン |
| 最大入力トークン数 | 922,000 |
| 最大出力トークン数 | 128,000 |
| ナレッジカットオフ | 2026年4月30日 |
| 入力モダリティ | テキスト、画像 |
| 出力モダリティ | テキスト |
| 非対応モダリティ | 音声、動画 |
| 推論トークン対応 | あり |
| 推論努力 | low、medium(デフォルト)、high、xhigh、max |
| 非対応推論努力 | none、minimal |
| データレジデンシ | 米国およびEU |
見逃せないポイントが2つあります。
まず、推論努力は無効化できません。GPT-6.1 Solはnoneやminimalをサポートしません。これらの設定が可能なモデルから移行する場合、OpenAIはlowから始めて代表的なタスクで結果を比較することを推奨しています。
次に、ツール呼び出しにはResponses APIが必要です。GPT-6.1 Solはツールを使わないリクエストにはChat Completionsをサポートしますが、関数呼び出し、ファイル検索、ウェブブラウズ、コンピュータ操作を含むワークフローはResponsesへ移行が必要です。これはSol固有の制限ではなく、OpenAIがプラットフォーム全体で進めている方向性です。
GPT-6.1 Solの価格:$2/$10で何ができるか
OpenAIのGPT-6.1 Sol標準価格は入力100万トークンあたり$2、出力100万トークンあたり$10です。全トークンテーブルにはキャッシュ価格も含まれ、長時間稼働するエージェントでは計算が変わります。
| 指標 | 100万トークンあたりの価格 |
|---|---|
| 入力 | $2.00 |
| キャッシュ入力 | $0.10 |
| キャッシュ書き込み | $2.50 |
| 出力 | $10.00 |
この表の下にはいくつかのルールがあります:
- キャッシュ入力は非キャッシュの5%のコスト。OpenAIはGPT-6.1 Solのキャッシュリードを0.05倍で価格設定しており、ほとんどのGPT-5.6以降モデルの0.1倍より安くなっています。毎回大きなシステムプロンプトやリポジトリコンテキストを再利用するエージェントにとって大きな割引です。
- キャッシュ書き込みは非キャッシュ入力の1.25倍。プレフィックスをキャッシュに書き込むのに100万トークンあたり$2.50、読み出しは$0.10です。
- 長いコンテキストは高コスト。入力トークンが272Kを超えるプロンプトは、リクエスト全体で入力・キャッシュ2倍、出力1.5倍で課金されます。この場合、入力$4、キャッシュ入力$0.20、キャッシュ書き込み$5、出力$15/100万トークンとなります。
- BatchとFlexは50%割引。非同期処理が許容できる場合、実質的なレートは入力$1、出力$5/100万トークンに下がります。
- FastモードはStandardの2倍。低レイテンシのための追加料金であり、知能が上がるわけではありません。
- リージョナル処理は10%上乗せ。利用可能な場合に適用されます。
キャッシュリードの割引が隠れた目玉です。同じ100,000トークンのリポジトリコンテキストを20回再利用するコーディングエージェントは、キャッシュ入力で100万トークンあたり$0.10、非キャッシュ入力なら$2.00です。長いセッションではこの差が大きくなります。
比較として、GPT-6 Astraは入力$10、出力$50/100万トークンです。GPT-6.1 Solは両方で1/5の価格です。GPT-6 Lunaはさらに安く、入力$0.10、出力$0.50ですが、SolのようなAstraに近い性能はありません。

GPT-6でSolが使える新機能
GPT-6.1 Solは、Astra世代でOpenAIが導入したGPT-6プラットフォーム機能を継承しています。エージェント型ワークロードで特に重要なものを紹介します。
非同期ツール呼び出し
通常、関数呼び出しはアプリケーションが結果を返すまでモデルを一時停止させます。非同期ツール呼び出しでは、ツール定義にasync: trueを設定すると、モデルは作業を継続します。推論、他ツールの呼び出し、独立したリクエスト部分への回答などを、アプリケーションがバックグラウンドで遅いジョブを実行している間に進めます。
アプリケーションはツールの実行と保留中の作業管理を担当します。ジョブが完了したら、元のcall_idを使って後のResponsesリクエストで出力を返します。OpenAIのドキュメントでは、遅い検索を早めに開始し、データ到着時に答えを補完する方法と説明されています。
Solには自然な適用先です。コーディングエージェントは長いテストスイートを開始し、他のファイルをレビューし、テスト結果が出たらそれを組み込めます。
ミッドターン・ステアリング
ミッドターン・ステアリングでは、モデルが作業中にユーザーが修正や新しい要件を送信できます。Responses APIへのWebSocket接続を通じて、サーバーは完了済みの作業を保持し、アップデートを継続に反映します。
重要な注意点:ステアリングは既に送信済みの出力を書き換えたり、過去のアクションを取り消したり、開始済みのツールをキャンセルしたりしません。作業の「次の行き先」を変えるだけです。ステアリングで元の応答が中断された場合、その応答はincomplete_details.reason: "steered"で終了し、新しい応答がアップデートを運びます。
会話中に推論努力を変更
configuration_update入力アイテムを追加することで、会話中に推論努力を上げ下げできます。更新後の努力は、次の更新で上書きされるまで有効です。OpenAIは、リクエストレベルのreasoning.effortは変更せず、プロンプトプレフィックスをキャッシュ可能に保つことを推奨しています。
この組み合わせ――安価なキャッシュリードと調整可能な推論――が、混在ワークロードでSolを経済的にします。定型のフォローアップにはlow、難しいタスクにはxhighに切り替え、会話を書き換える必要がありません。
マルチエージェント(ベータ)
マルチエージェントは、GPT-6.1 SolおよびすべてのGPT-5.6モデルでベータ機能として利用可能です。ルートエージェントがサブエージェントを並列で生成し、それぞれ独立したコンテキストで作業し、最終的に結果を統合します。
OpenAIのドキュメントでは、大規模コードベースの別々の部分調査、提案の比較、情報源の並列調査、複数の障害原因の同時調査など、独立したワークストリームに分割できるタスクに推奨されています。デフォルトのmax_concurrent_subagentsは3です。
トレードオフはトークン消費です。エージェント数が増えるとトークンも増えます。並列速度や集中したコンテキストがトークン経済より重要な場合に効果を発揮します。
コンパクションと永続推論
長時間稼働するエージェントは、やがてコンテキストウィンドウを使い切ります。コンパクションは、後続ターンに必要な状態を保持しつつ、コンテキストサイズを縮小します。Responsesリクエストでcontext_managementにcompact_thresholdを設定すると、サーバーはしきい値を超えた時点で暗号化されたコンパクションアイテムを返します。
GPT-6.1 Solはreasoning.context: "all_turns"もサポートし、互換性のある推論アイテムを前ターンから次のサンプルへ引き継げます。永続推論は不透明で、APIはモデルの生推論テキストを返しませんが、長いセッションでもモデルに連続性を持たせます。
WebSocketモード
WebSocketモードはResponses APIへの永続接続を維持し、各ターンで新しい入力アイテムだけを送信します。OpenAIは、20回以上のツール呼び出しを伴うロールアウトで最大約40%のエンドツーエンド高速化を報告しています。エージェント型コーディングやコンピュータ利用を主軸とするモデルにとって、直接的なレイテンシ短縮です。
GPT-6.1 Sol vs GPT-6 Sol vs Astra vs Luna
GPT-6ファミリーは4つの階層になりました。選択は主に必要な品質とワークフローの頻度で決まります。
| モデル | 位置づけ | 入力/出力(100万あたり) | 最適な用途 |
|---|---|---|---|
| GPT-6 Astra | 最高知能 | $10 / $50 | 高度な推論、コーディング、プロフェッショナル作業 |
| GPT-6.1 Sol | 低コストでAstraに近い | $2 / $10 | 複雑なコーディング、コンピュータ利用、ドキュメント中心作業 |
| GPT-6 Sol | 旧Sol階層 | $2 / $10 | アップグレード前の既存Solワークロード |
| GPT-6 Luna | 最速・最安 | $0.10 / $0.50 | 集中型・大量タスク |
GPT-6.1 SolとGPT-6 Solは同じ価格ですが、別モデルです。Feloのページでは、GPT-6.1 Solは事実誤認が減り、明示的な制約への遵守も向上したアップグレードと説明されています。キャッシュリードレートも半減し、100万トークンあたり$0.10(従来は$0.20)です。すでに本番でGPT-6 Solを使っている場合、同じ価格で品質とキャッシュ効率が向上します。
OpenAIのモデル選択ガイドは、推論努力とタスクタイプの対応を示しています:
- GPT-6.1 Sol(medium) — 複雑な技術作業や、修正を前提とした協調成果物
- GPT-6.1 Sol(extra high) — 洗練された成果物、連携するビジュアルシステム、矛盾する証拠からの意思決定
- Astra(low) — 事実とニュアンスを維持する簡潔な執筆やコンテンツ適応
- Astra(medium) — 広範なコンテキスト、信頼性の高い対話、完全な成果が必要な野心的プロジェクト
- Astra(extra high) — 厳密な要件を持つ高度な分析や複雑な成果物
- Luna(low) — 細かな編集、範囲が明確な問題解決、単純なデータ抽出
- Luna(extra high) — 複数アプリ間の現状把握、作業の優先順位付け、明確な制約下での問題解決
OpenAI Codexの実践ルール:Solはコスト重視の繰り返し・長時間作業(コード・アプリ・ドキュメント)に使い、Astraは最も要求が高い作業に残し、Lunaは明確で繰り返し可能なタスクに使います。
Felo API Platform経由でGPT-6.1 Solを呼び出す方法
Felo API PlatformはGPT-6.1 Solを互換エンドポイントで提供しているため、既存SDKのベースURLを変更するだけで利用できます。
利用可能なエンドポイント:
- Chat Completions:
POST https://openapi.felo.ai/api/v1/chat/completions - Responses:
POST https://openapi.felo.ai/api/v1/responses - Messages(Anthropic互換):
POST https://openapi.felo.ai/api/v1/messages
ステップ1:APIキーを取得
Felo API Platformのアカウントからキーを作成し、エクスポートします。
export FELO_API_KEY="YOUR_API_KEY"
ステップ2:最初のリクエストを送信
curl https://openapi.felo.ai/api/v1/chat/completions \
-H "Authorization: Bearer $FELO_API_KEY" \
-H "Content-Type: application/json" \
-d '{
"model": "gpt-6.1-sol",
"messages": [
{"role": "user", "content": "Explain the tradeoff between reasoning effort and cost."}
]
}'
ステップ3:互換SDKを利用
任意のOpenAI互換SDKのbaseURLをhttps://openapi.felo.ai/api/v1に設定します。Claude系クライアントはAnthropic互換のhttps://openapi.felo.ai/apiを利用します。
import OpenAI from "openai";
const client = new OpenAI({
apiKey: process.env.FELO_API_KEY,
baseURL: "https://openapi.felo.ai/api/v1",
});
const response = await client.responses.create({
model: "gpt-6.1-sol",
reasoning: { effort: "medium" },
input: "Review this pull request for correctness, security, and missing tests.",
});
console.log(response.output_text);
ステップ4:必要に応じてストリーミングを有効化
stream: trueを追加すると、モデルの進行に応じてサーバー送信イベントを受け取れます。
Feloのモデルページでは、GPT-6.1 Solは入力100万トークンあたり$2.00、出力100万トークンあたり$10.00と記載されており、ローンチ価格は公式APIレートの最大50%割引となる場合があります。最終コストはモデル、入出力比率、キャッシュ利用、プランによって異なります。キャッシュリードはGPT-6 Solの半額で課金されます。
このモデルは推論、ツール、JSON出力、ストリーミング、ビジョンにも対応し、コードを書く前にプロンプトを試せるPlaygroundも用意されています。
GPT-6.1 Solの最適なユースケース
OpenAIのガイダンスは、コストが重要な複雑プロジェクトを指しています。具体的なパターンをいくつか紹介します。
大規模エージェント型コーディング
リポジトリを読み、変更を提案し、テストを実行し、反復するコーディングエージェントはSolのためのワークロードです。1.05Mのコンテキストウィンドウで大規模コードベースを保持し、キャッシュリード割引でリポジトリコンテキスト再利用が有利になり、非同期ツール呼び出しでテスト中も生産性を維持します。
OpenAI Codexのガイダンスは、コスト重視の繰り返し・長時間作業にはSol、最も要求が高いタスクにはAstraを推奨しています。
コンピュータ利用・ワークフロー自動化
GPT-6.1 SolはResponsesツール群(computer_use、hosted_shell、apply_patch、mcp、tool_searchなど)に対応しています。これにより、ソフトウェア操作、フォーム入力、システム間データ移動、多段階ビジネスプロセス自動化を行うエージェントに適しています。
Feloのモデルページでも、コンピュータ利用と多段階ワークフロー自動化が主な用途とされています。
ドキュメント中心のプロフェッショナル作業
Solはテキストと画像を受け付けるため、スキャン文書、チャート、スクリーンショット、スライドデッキにも対応します。OpenAIのモデル選択ガイドでは、財務結果から取締役会向けプレゼン資料を作成する、製品概要からウェブサイトを作成する、といった例が挙げられています。いずれも大きな入力、複数回の修正、「最上級」ではないが「安かろう悪かろう」でもない品質基準が求められます。
並列ワークストリームによる調査・分析
マルチエージェントベータを有効にすると、Solは調査タスクを独立したワークストリームに分割し、並列実行し、結果を統合できます。ベンダー提案の比較、プルリクエストの多角的レビュー、複数の障害仮説の同時検証などが好例です。
大量バッチ処理
BatchとFlex価格でSolのレートは入力$1、出力$5/100万トークンに下がります。夜間の文書処理、大量要約、大規模抽出など、出力を後でレビューする用途では、この価格が経済性を大きく変えます。
移行チェックリスト:GPT-6 SolからGPT-6.1 Solへ
OpenAIは、gpt-6-solからgpt-6.1-solへの切り替え前に移行ガイダンスの確認を推奨しています。要点をまとめます。
- モデルIDを設定。
modelをgpt-6.1-solに変更します。 - 推論努力を修正。GPT-6.1 Solは
noneやminimalをサポートしません。noneはlowに置き換え、minimalはlowからテストします。 - ツール呼び出しをResponsesへ移行。ツールを使わないリクエストはChat Completionsで動作します。関数呼び出し、ウェブ検索、ファイル検索、コンピュータ利用、MCPワークフローはResponses APIが必要です。
- 非対応パラメータを削除。推論努力が
noneでない場合、temperature、top_p、top_logprobsを削除します。Chat Completionsではlogprobsも削除。Responsesではmessage.output_text.logprobsをincludeから削除します。 - プロンプトキャッシュ設定を更新。GPT-5.5以前から移行する場合、
prompt_cache_retentionをprompt_cache_options.ttl("30m")に置き換えます。 - 推論努力変更は
configuration_updateで。ターンごとに努力を調整する場合、リクエストレベルのreasoning.effortではなくconfiguration_updateアイテムを使い、プロンプトプレフィックスのキャッシュ性を維持します。 - データレジデンシを確認。GPT-6.1 Solは米国とEUのデータレジデンシに対応。EUデータレジデンシではFastモードは利用できません。
- Astraと比較テスト。代表的なタスクで両モデルを実行し、品質、レイテンシ、総コスト(推論トークンも出力トークンとして課金)を比較します。
制限事項と提供状況
GPT-6.1 SolはAstraの完全な代替ではなく、現時点で全ての環境で利用できるわけではありません。
能力の限界。 OpenAIはSolをAstraの下に位置づけています。最も高度な推論や重要度の高い成果物には、Astraが推奨モデルです。Solは複雑作業向けのコスト効率モデルであり、最高品質モデルではありません。
ファインチューニング不可。 GPT-6.1 Solはファインチューニングや予測出力に非対応です。埋め込み、画像生成、動画、音声、文字起こし、翻訳、モデレーションエンドポイントにも非対応です。テキスト・画像入力、テキスト出力の推論モデルです。
音声・動画入力不可。 入力モダリティはテキストと画像のみです。
推論は無効化不可。 noneとminimal努力は非対応のため、全リクエストで推論オーバーヘッドが発生します。
ロールアウト進行中。 OpenAIのローンチ対象は、CodexのPlus、Pro、Business、Enterprise、Eduプラン(デスクトップ・CLI)、ChatGPT Work(Web・モバイル)です。Enterprise/Eduでは管理者が有効化するまでモデルはオフです。FreeとGoプランはローンチ時点で対象外です。
Fastモードの注意点。 StandardとFastモードはローンチ時に利用可能ですが、FastはStandardの2倍のコストで、EUデータレジデンシでは利用できません。Ultrafast対応は今後追加予定です。
レート制限あり。 標準レート制限は、Tier 1で500 RPM・500,000 TPMから、Tier 5で15,000 RPM・40,000,000 TPMまでです。
FAQ
GPT-6.1 Solとは?
GPT-6.1 Solは、OpenAIのバランス型GPT-6モデルで、フラッグシップのGPT-6 Astraと軽量なGPT-6 Lunaの中間に位置します。OpenAIは、複雑なコーディング、コンピュータ利用、プロフェッショナル作業において、低コストでAstraに近い性能を提供すると説明しています。
GPT-6.1 Solの価格は?
OpenAIは、GPT-6.1 Solを入力100万トークンあたり$2、出力100万トークンあたり$10で提供しています。キャッシュ入力は100万トークンあたり$0.10、キャッシュ書き込みは$2.50です。入力トークンが272Kを超えるプロンプトは長コンテキストレートで課金されます。
GPT-6.1 Solのコンテキストウィンドウは?
GPT-6.1 Solは1,050,000トークンのコンテキストウィンドウ、最大入力922,000トークン、最大出力128,000トークンです。
GPT-6.1 Solはツール呼び出しに対応していますか?
はい。ただしツール呼び出しにはResponses APIが必要です。ツールを使わないリクエストにはChat Completionsが対応します。
GPT-6.1 Solで推論を無効化できますか?
できません。GPT-6.1 Solはlow、medium、high、xhigh、maxの推論努力に対応し、noneやminimalは非対応です。
GPT-6.1 SolとGPT-6 Solの違いは?
GPT-6.1 SolはGPT-6 Solのアップグレードで、Feloのモデルページによると事実誤認が減り、明示的な制約への遵守も向上しています。両者は同じトークン価格ですが、GPT-6.1 Solはキャッシュ入力レートが半額($0.10/100万トークン)です。
GPT-6.1 SolはFelo API Platformで利用できますか?
はい。Felo API Platformは、Chat Completions、Responses、Anthropic互換MessagesエンドポイントでGPT-6.1 Solを提供しています。ローンチ価格は公式APIレートの最大50%割引となる場合があり、キャッシュリードはGPT-6 Solの半額です。
まとめ
GPT-6.1 Solは、実用的な課題へのOpenAIの回答です。最高のモデルは全タスクで使うには高価すぎ、最安モデルは十分な品質を持ちません。SolはAstraに近い性能、1.05Mのコンテキストウィンドウ、5%のキャッシュリードレート、Astraの1/5の価格でその中間を実現します。
コーディングエージェント、コンピュータ利用ワークフロー、ドキュメント中心の自動化を構築するチームにとって、まず試すべきモデルです。自分のタスクでAstraと比較し、推論トークンの使用量を確認し、コストと品質のバランスで判断してください。
Felo API Platform PlaygroundでGPT-6.1 Solを試すか、Felo APIキーで直接呼び出せます。
参考文献
- GPT-6.1 Solモデルページ — OpenAI
- GPT-6の利用 — OpenAI
- モデル選択 — OpenAI
- API価格 — OpenAI
- CodexとChatGPTモデル提供状況 — OpenAI
- 非同期ツール呼び出し — OpenAI
- ミッドターン・ステアリング — OpenAI
- 推論モデル — OpenAI
- プロンプトキャッシュ — OpenAI
- コンパクション — OpenAI
- マルチエージェント — OpenAI
- WebSocketモード — OpenAI
- Fastモード — OpenAI
- データレジデンシ — OpenAI
- GPT-6.1 Sol — Felo API Platform
この記事は次の言語でもお読みいただけます:English、简体中文、한국어、繁體中文、हिन्दी、Français、العربية、Русский、اردو、Bahasa Indonesia、Deutsch、Tiếng Việt、Türkçe、Italiano、ไทย、Español、বাংলা、Português。