GPT-6.1 Sol API:近乎 Astra 的效能,成本更低
OpenAI GPT-6.1 Sol 以每百萬 token $2/$10 的價格,1.05M 上下文視窗,帶來接近 Astra 的程式、電腦操作與專業工作效能。
OpenAI 最新的 Sol 模型不追求成為最聰明的模型,而是讓你能負擔得起全天候運行。
GPT-6.1 Sol 介於旗艦款 GPT-6 Astra 與輕量級 GPT-6 Luna 之間。OpenAI 官方模型頁一句話形容它:「以較低成本達到近乎 Astra 的複雜工作效能。」 對於打造智能程式工具、電腦操作代理人、文件密集型流程的團隊,這種取捨正是重點。
本指南整理 GPT-6.1 Sol 的功能、價格、與 GPT-6 Sol 和 Astra 的差異,以及如何透過 Felo API 平台串接。

GPT-6.1 Sol 是什麼
GPT-6.1 Sol 為複雜程式、電腦操作、專業工作設計的推理模型。OpenAI 將它定位為 GPT-6 家族的平衡選擇:比 Luna 更強,價格低於 Astra,效能足以讓許多生產工作無需用到旗艦款。
模型頁直接建議使用方式:在自己的任務上比較 Sol 與 Astra,再決定品質差異是否值得價差。這種建議很實用,也反映模型定位。Sol 是控管成本的工具,不是炫耀指標。
Felo 的模型頁從平台角度也有相同定位。GPT-6.1 Sol 是「GPT-6 Sol 的升級版,仍低於旗艦 GPT-6 Astra。」它能處理智能程式、電腦操作、文件密集型專業工作、多步驟流程自動化,這些任務上接近 Astra 效能但成本低很多。與 GPT-6 Sol 相比,Felo 指出事實錯誤更少,對明確限制的遵守更好。
當任務困難、冗長且需重複執行,帳單又必須可預期時,GPT-6.1 Sol 就是首選。
GPT-6.1 Sol 主要規格
OpenAI 在模型頁公布完整規格,以下為重點摘要。
| 規格 | GPT-6.1 Sol |
|---|---|
| Model ID | gpt-6.1-sol |
| 預設快照 | gpt-6.1-sol |
| 上下文視窗 | 1,050,000 tokens |
| 最大輸入 tokens | 922,000 |
| 最大輸出 tokens | 128,000 |
| 知識截止日 | 2026 年 4 月 30 日 |
| 輸入型態 | 文字、圖片 |
| 輸出型態 | 文字 |
| 不支援型態 | 音訊、影片 |
| 支援推理 token | 是 |
| 推理強度 | low、medium(預設)、high、xhigh、max |
| 不支援推理強度 | none、minimal |
| 資料駐留地 | 美國與歐盟 |
有兩個細節比數字更重要。
首先,推理強度無法關閉。GPT-6.1 Sol 不支援 none 或 minimal。若從允許這些設定的模型遷移,OpenAI 建議先用 low,並在代表性任務上比較結果。
其次,工具呼叫需用 Responses API。GPT-6.1 Sol 支援無工具的 Chat Completions,但只要流程涉及函式呼叫、檔案搜尋、網頁瀏覽、電腦操作,都必須改用 Responses。這不只 Sol 限制,而是 OpenAI 平台整體的方向。
GPT-6.1 Sol 價格:$2/$10 能買到什麼
OpenAI 對 GPT-6.1 Sol 的標準定價為每百萬輸入 token $2,輸出 token $10。完整 token 表還包含快取價格,這會影響長時程代理人的成本結構。
| 指標 | 每百萬 token 價格 |
|---|---|
| 輸入 | $2.00 |
| 快取輸入 | $0.10 |
| 快取寫入 | $2.50 |
| 輸出 | $10.00 |
這張表下有幾個規則:
- **快取輸入只要原價 5%。**OpenAI 將 GPT-6.1 Sol 的快取讀取定價為 0.05 倍,GPT-5.6 及以後多數模型則為 0.1 倍。對每回合都重用大型系統提示或倉庫上下文的代理人,這是很大的折扣。
- **快取寫入為原價 1.25 倍。**寫入快取每百萬 token $2.50,之後讀取每百萬 $0.10。
- **長上下文更貴。**輸入 token 超過 272K,整個請求的輸入與快取費率變 2 倍,輸出 1.5 倍。此時輸入 $4,快取輸入 $0.20,快取寫入 $5,輸出 $15。
- **Batch 與 Flex 便宜 50%。**能接受非同步處理的工作,輸入 $1、輸出 $5。
- **Fast 模式價格為標準 2 倍。**這是為了降低延遲,不是提升智能。
- **區域處理加價 10%。**有提供時適用。
快取讀取折扣是隱藏重點。重用同一 10 萬 token 倉庫上下文 20 回合,快取只需 $0.10/百萬 token,原本新輸入要 $2.00。長時段下,差異很快累積。
比較來看,GPT-6 Astra 每百萬 token 輸入 $10、輸出 $50。GPT-6.1 Sol 價格僅 Astra 的五分之一。GPT-6 Luna 更便宜,輸入 $0.10、輸出 $0.50,但放棄了 Sol 近乎 Astra 的能力。

GPT-6 新功能,Sol 能用哪些
GPT-6.1 Sol 承襲 Astra 世代引入的 GPT-6 平台功能,部分特別適合智能代理人工作。
非同步工具呼叫
一般函式呼叫會讓模型暫停,等應用程式回傳結果。啟用 async tool calling,工具定義加上 async: true,模型可繼續推理、呼叫其他工具、或處理請求獨立部分,應用程式則在背景執行慢的工作。
應用程式仍需執行工具並管理未完成工作。工作結束後,用原本的 call_id 在後續 Responses 請求回傳結果。OpenAI 文件建議這種方式可提早啟動慢查詢,等資料到再補答案。
Sol 很適合這種用法。程式代理人可同時啟動長測試,繼續檢查其他檔案,等測試結果回來再整合。
回合中引導
Mid-turn steering 允許用戶在模型運作中途發送修正或新需求。透過 WebSocket 連線至 Responses API,伺服器保留已完成部分,將更新納入後續回應。
注意:引導不會改寫已輸出的內容、不會撤銷已執行動作、也不會取消已啟動的工具。它只改變後續方向,不影響已完成部分。若引導中斷原回應,原回應會標記 incomplete_details.reason: "steered",新回應則帶入更新。
對話中調整推理強度
可在對話中用 configuration_update 輸入項目調高或調低推理強度。更新後的強度持續有效,直到下次再更新。OpenAI 建議請求層級的 reasoning.effort 不要變動,讓提示前綴能快取。
這種組合——便宜的快取讀取與可調推理——讓 Sol 很適合混合型工作。例行追問用 low,遇到困難時切換 xhigh,不用重寫對話。
多代理人(beta)
多代理人功能在 GPT-6.1 Sol 與所有 GPT-5.6 模型開放 beta。主代理人可產生多個子代理人並行工作,各自有獨立上下文,最後整合結果。
OpenAI 文件建議用於可拆分成獨立工作流的任務:如分頭探索大型程式庫、比較提案、平行查找資料來源、同時調查多個失敗原因。預設 max_concurrent_subagents 為 3。
但需注意 token 用量。代理人越多,token 消耗越多,適合需要平行速度與專注上下文時。
壓縮與持續推理
長時程代理人最終會填滿上下文視窗。壓縮功能能縮小上下文,同時保留後續回合所需狀態。可在 Responses 請求設 context_management 與 compact_threshold 啟用伺服器端壓縮,token 數超過門檻時伺服器會回傳加密壓縮項目。
GPT-6.1 Sol 也支援 reasoning.context: "all_turns",讓前幾回合的相容推理項目延續到下次取樣。持續推理內容不會直接回傳——API 不會給出模型原始推理文字——但能讓模型在長對話中保持連貫。
WebSocket 模式
WebSocket 模式可與 Responses API 保持持久連線,每回合只傳新輸入項目。OpenAI 報告,20 次以上工具呼叫的流程,端到端速度可提升約40%。對以智能程式、電腦操作為主的模型,這直接降低延遲。
GPT-6.1 Sol vs GPT-6 Sol vs Astra vs Luna
GPT-6 家族現有四個等級。選擇主要看所需品質與流程執行頻率。
| 模型 | 定位 | 每百萬輸入/輸出 | 最適合 |
|---|---|---|---|
| GPT-6 Astra | 最高智能 | $10 / $50 | 高要求推理、程式、專業工作 |
| GPT-6.1 Sol | 近 Astra 但成本低 | $2 / $10 | 複雜程式、電腦操作、文件密集工作 |
| GPT-6 Sol | 舊 Sol 等級 | $2 / $10 | 升級前的 Sol 工作 |
| GPT-6 Luna | 最快且最省 | $0.10 / $0.50 | 集中、高量任務 |
GPT-6.1 Sol 與 GPT-6 Sol 價格相同,但非同一模型。Felo 頁面形容 GPT-6.1 Sol 為升級版,事實錯誤更少,對明確限制遵守更好。快取讀取費率也減半:每百萬 token $0.10,原本 $0.20。若已在生產用 GPT-6 Sol,升級後品質與快取經濟性都提升,價格不變。
OpenAI 的模型選擇指南將推理強度對應任務類型:
- GPT-6.1 Sol(medium)——複雜技術工作、需協作修訂的交付物。
- GPT-6.1 Sol(xhigh)——精緻交付物、連結視覺系統、需整合衝突證據的決策。
- Astra(low)——精簡寫作、內容改寫,需保留事實與細節。
- Astra(medium)——需廣泛上下文、可靠互動、完整結果的企劃。
- Astra(xhigh)——高要求分析、複雜交付物、嚴格規格。
- Luna(low)——細部編輯、明確範圍問題解決、簡單資料擷取。
- Luna(xhigh)——多應用程式間找當前上下文、工作排序、明確限制下解題。
OpenAI Codex 指南的實用原則:Sol 適合重複、長時程的程式、應用、文件工作且成本重要時。Astra 留給最嚴苛的任務。Luna 用於明確、可重複的任務。
如何透過 Felo API 平台串接 GPT-6.1 Sol
Felo API 平台提供 GPT-6.1 Sol 兼容端點,可沿用現有 SDK,只需更改 base URL。
模型可用於:
- Chat Completions:
POST https://openapi.felo.ai/api/v1/chat/completions - Responses:
POST https://openapi.felo.ai/api/v1/responses - Messages(Anthropic 兼容):
POST https://openapi.felo.ai/api/v1/messages
步驟 1:取得 API 金鑰
從 Felo API 平台帳號建立金鑰並匯出:
export FELO_API_KEY="YOUR_API_KEY"
步驟 2:發送第一個請求
curl https://openapi.felo.ai/api/v1/chat/completions \
-H "Authorization: Bearer $FELO_API_KEY" \
-H "Content-Type: application/json" \
-d '{
"model": "gpt-6.1-sol",
"messages": [
{"role": "user", "content": "Explain the tradeoff between reasoning effort and cost."}
]
}'
步驟 3:使用兼容 SDK
將任何 OpenAI 兼容 SDK 指向 https://openapi.felo.ai/api/v1。Claude 風格用戶端則用 Anthropic 兼容 base URL https://openapi.felo.ai/api。
import OpenAI from "openai";
const client = new OpenAI({
apiKey: process.env.FELO_API_KEY,
baseURL: "https://openapi.felo.ai/api/v1",
});
const response = await client.responses.create({
model: "gpt-6.1-sol",
reasoning: { effort: "medium" },
input: "Review this pull request for correctness, security, and missing tests.",
});
console.log(response.output_text);
步驟 4:需要時啟用串流
加上 stream: true,即可在模型運作時收到伺服器推送事件。
Felo 模型頁標示 GPT-6.1 Sol 每百萬輸入 token $2.00,輸出 $10.00,上市期間價格可能比官方 API 低 50%。實際費用依模型、輸入/輸出比例、快取使用、方案而定。快取讀取費率為 GPT-6 Sol 的一半。
平台支援推理、工具、JSON 輸出、串流、視覺等功能,並提供 Playground 測試提示詞。
GPT-6.1 Sol 最佳應用場景
OpenAI 指南建議用於成本重要的複雜專案,以下幾種模式特別適合。
大規模智能程式
讀取程式庫、提出修改、執行測試、反覆迭代的程式代理人,正是 Sol 的目標工作。1.05M 上下文視窗可容納大型程式庫,快取讀取折扣鼓勵重用倉庫上下文,非同步工具呼叫讓代理人測試時仍能處理其他任務。
OpenAI Codex 指南建議,成本重要時用 Sol 處理重複、長時程的程式與應用,Astra 留給最困難的任務。
電腦操作與流程自動化
GPT-6.1 Sol 支援完整 Responses 工具組,包括 computer_use、hosted_shell、apply_patch、mcp、tool_search。適合操作軟體、填寫表單、系統間搬移資料、或自動化多步驟商業流程的代理人。
Felo 模型頁將電腦操作與多步驟流程自動化列為主要應用。
文件密集型專業工作
Sol 可處理文字與圖片,涵蓋掃描文件、圖表、截圖、簡報。OpenAI 模型選擇指南舉兩例:根據財報製作董事會簡報、根據產品簡報製作網站。這類任務輸入大、需多次修訂,品質要求高於「便宜快速」,但不必追求「極致」。
平行研究與分析
啟用多代理人 beta,Sol 能將研究任務拆成獨立流程並行執行,最後整合結果。比較廠商提案、從三個角度審查 pull request、同時調查多個失敗假設都很適合。
大量批次處理
Batch 與 Flex 價格將 Sol 降至每百萬 token 輸入 $1、輸出 $5。用於夜間文件處理、批次摘要、大規模擷取且需人工複查時,這種價格讓許多任務變得可行。
遷移檢查表:從 GPT-6 Sol 移轉到 GPT-6.1 Sol
OpenAI 建議切換 gpt-6-sol 到 gpt-6.1-sol 前,先檢查官方遷移指南。重點如下:
- 設定模型 ID。 將
model改為gpt-6.1-sol。 - 修正推理強度。 GPT-6.1 Sol 不支援
none或minimal。將none改為low,minimal遷移時先用low測試。 - 工具呼叫改用 Responses。 無工具請求可用 Chat Completions。任何函式呼叫、網頁搜尋、檔案搜尋、電腦操作、MCP 流程需用 Responses API。
- 移除不支援參數。 推理強度非
none時,移除temperature、top_p、top_logprobs。Chat Completions 也移除logprobs,Responses 移除message.output_text.logprobs。 - 更新提示快取設定。 從 GPT-5.5 或更早遷移,將
prompt_cache_retention改為prompt_cache_options.ttl: "30m"。 - 用
configuration_update調整推理。 若應用需在回合間調整強度,請用configuration_update,不要改請求層級reasoning.effort,以利快取提示前綴。 - 檢查資料駐留地。 GPT-6.1 Sol 支援美國與歐盟資料駐留。EU 資料駐留下無法用 Fast 模式。
- 與 Astra 比較測試。 在代表性任務上同時測試兩模型,評估品質、延遲、總成本(含推理 token,計入輸出 token)。
限制與供應情況
GPT-6.1 Sol 不是 Astra 的萬用替代品,目前也尚未全面開放。
能力限制。 OpenAI 將 Sol 定位於 Astra 之下。最高要求推理、最重要交付物仍建議用 Astra。Sol 適合複雜工作但非極致品質。
無微調。 GPT-6.1 Sol 不支援微調或預測輸出,也不支援嵌入、圖像生成、影片、語音、轉錄、翻譯、審查端點。它是文字/圖片輸入、文字輸出的推理模型。
無音訊或影片輸入。 僅支援文字與圖片。
推理無法關閉。 不支援 none、minimal,每個請求都會產生推理負擔。
尚在逐步開放。 OpenAI 上市涵蓋 Plus、Pro、Business、Enterprise、Edu 方案,Codex 桌面與 CLI、ChatGPT Work(網頁與行動)。Enterprise 與 Edu 需管理員啟用預設關閉。Free 與 Go 方案上市不開放。
Fast 模式有限制。 上市即有 Standard 與 Fast,Fast 價格為標準 2 倍,EU 資料駐留下無法用。Ultrafast 支援未來開放。
有速率限制。 標準速率 Tier 1 為 500 RPM、500,000 TPM,Tier 5 為 15,000 RPM、40,000,000 TPM。
常見問答
GPT-6.1 Sol 是什麼?
GPT-6.1 Sol 是 OpenAI 的平衡型 GPT-6 模型,介於旗艦 GPT-6 Astra 與輕量 GPT-6 Luna 之間。OpenAI 形容它以較低成本提供複雜程式、電腦操作、專業工作近乎 Astra 的效能。
GPT-6.1 Sol 價格多少?
OpenAI 標示 GPT-6.1 Sol 每百萬輸入 token $2,輸出 token $10。快取輸入 $0.10,快取寫入 $2.50。輸入 token 超過 272K,長上下文費率更高。
GPT-6.1 Sol 上下文視窗多大?
GPT-6.1 Sol 有 1,050,000 token 上下文視窗,最大輸入 922,000 token,最大輸出 128,000 token。
GPT-6.1 Sol 支援工具呼叫嗎?
支援,但需用 Responses API。無工具請求可用 Chat Completions。
可以關閉 GPT-6.1 Sol 的推理嗎?
無法。GPT-6.1 Sol 支援 low、medium、high、xhigh、max 推理強度,不支援 none 或 minimal。
GPT-6.1 Sol 與 GPT-6 Sol 差異?
GPT-6.1 Sol 是 GPT-6 Sol 的升級版,Felo 模型頁指出事實錯誤更少,對明確限制遵守更好。兩者 headline token 價格相同,但 GPT-6.1 Sol 快取輸入費率減半至 $0.10。
GPT-6.1 Sol 可在 Felo API 平台用嗎?
可以。Felo API 平台提供 GPT-6.1 Sol 的 Chat Completions、Responses、Anthropic 兼容 Messages 端點。上市價格可能比官方 API 低 50%,快取讀取費率為 GPT-6 Sol 一半。
重點整理
GPT-6.1 Sol 回應一個實際問題:最好的模型太貴,最便宜的模型不夠好。Sol 以近 Astra 能力、1.05M 上下文視窗、5% 快取讀取費率、Astra 五分之一價格,取得平衡。
對於打造程式代理人、電腦操作流程、文件密集自動化的團隊,這是首選測試模型。可在自己任務上與 Astra 比較,觀察推理 token 用量,讓成本與品質取捨決定。
可在 Felo API 平台 Playground 試用 GPT-6.1 Sol,或用 Felo API 金鑰直接串接。
參考來源
- GPT-6.1 Sol 模型頁 — OpenAI
- 使用 GPT-6 — OpenAI
- 模型選擇 — OpenAI
- API 價格 — OpenAI
- Codex 與 ChatGPT 模型供應 — OpenAI
- 非同步工具呼叫 — OpenAI
- 回合中引導 — OpenAI
- 推理模型 — OpenAI
- 提示快取 — OpenAI
- 壓縮 — OpenAI
- 多代理人 — OpenAI
- WebSocket 模式 — OpenAI
- Fast 模式 — OpenAI
- 資料駐留地 — OpenAI
- GPT-6.1 Sol — Felo API 平台
本文也提供以下語言版本:English、简体中文、日本語、한국어、हिन्दी、Français、العربية、Русский、اردو、Bahasa Indonesia、Deutsch、Tiếng Việt、Türkçe、Italiano、ไทย、Español、বাংলা、Português。