Skip to main content

GPT-6.1 Sol API:近乎 Astra 的效能,成本更低

· 閱讀時間約 17 分鐘
Felo Search Tips Buddy
Committed to answers at your fingertips

OpenAI GPT-6.1 Sol 以每百萬 token $2/$10 的價格,1.05M 上下文視窗,帶來接近 Astra 的程式、電腦操作與專業工作效能。

OpenAI 最新的 Sol 模型不追求成為最聰明的模型,而是讓你能負擔得起全天候運行。

GPT-6.1 Sol 介於旗艦款 GPT-6 Astra 與輕量級 GPT-6 Luna 之間。OpenAI 官方模型頁一句話形容它:「以較低成本達到近乎 Astra 的複雜工作效能。」 對於打造智能程式工具、電腦操作代理人、文件密集型流程的團隊,這種取捨正是重點。

本指南整理 GPT-6.1 Sol 的功能、價格、與 GPT-6 Sol 和 Astra 的差異,以及如何透過 Felo API 平台串接。

GPT-6.1 Sol 定位:近乎 Astra 效能但成本更低,輸入每百萬 token $2,輸出 $10,1.05M 上下文視窗,最大輸出 128K


GPT-6.1 Sol 是什麼​

GPT-6.1 Sol 為複雜程式、電腦操作、專業工作設計的推理模型。OpenAI 將它定位為 GPT-6 家族的平衡選擇:比 Luna 更強,價格低於 Astra,效能足以讓許多生產工作無需用到旗艦款。

模型頁直接建議使用方式:在自己的任務上比較 Sol 與 Astra,再決定品質差異是否值得價差。這種建議很實用,也反映模型定位。Sol 是控管成本的工具,不是炫耀指標。

Felo 的模型頁從平台角度也有相同定位。GPT-6.1 Sol 是「GPT-6 Sol 的升級版,仍低於旗艦 GPT-6 Astra。」它能處理智能程式、電腦操作、文件密集型專業工作、多步驟流程自動化,這些任務上接近 Astra 效能但成本低很多。與 GPT-6 Sol 相比,Felo 指出事實錯誤更少,對明確限制的遵守更好。

當任務困難、冗長且需重複執行,帳單又必須可預期時,GPT-6.1 Sol 就是首選。


GPT-6.1 Sol 主要規格​

OpenAI 在模型頁公布完整規格,以下為重點摘要。

規格GPT-6.1 Sol
Model IDgpt-6.1-sol
預設快照gpt-6.1-sol
上下文視窗1,050,000 tokens
最大輸入 tokens922,000
最大輸出 tokens128,000
知識截止日2026 年 4 月 30 日
輸入型態文字、圖片
輸出型態文字
不支援型態音訊、影片
支援推理 token是
推理強度low、medium(預設)、high、xhigh、max
不支援推理強度none、minimal
資料駐留地美國與歐盟

有兩個細節比數字更重要。

首先,推理強度無法關閉。GPT-6.1 Sol 不支援 none 或 minimal。若從允許這些設定的模型遷移,OpenAI 建議先用 low,並在代表性任務上比較結果。

其次,工具呼叫需用 Responses API。GPT-6.1 Sol 支援無工具的 Chat Completions,但只要流程涉及函式呼叫、檔案搜尋、網頁瀏覽、電腦操作,都必須改用 Responses。這不只 Sol 限制,而是 OpenAI 平台整體的方向。


GPT-6.1 Sol 價格:$2/$10 能買到什麼​

OpenAI 對 GPT-6.1 Sol 的標準定價為每百萬輸入 token $2,輸出 token $10。完整 token 表還包含快取價格,這會影響長時程代理人的成本結構。

指標每百萬 token 價格
輸入$2.00
快取輸入$0.10
快取寫入$2.50
輸出$10.00

這張表下有幾個規則:

  • **快取輸入只要原價 5%。**OpenAI 將 GPT-6.1 Sol 的快取讀取定價為 0.05 倍,GPT-5.6 及以後多數模型則為 0.1 倍。對每回合都重用大型系統提示或倉庫上下文的代理人,這是很大的折扣。
  • **快取寫入為原價 1.25 倍。**寫入快取每百萬 token $2.50,之後讀取每百萬 $0.10。
  • **長上下文更貴。**輸入 token 超過 272K,整個請求的輸入與快取費率變 2 倍,輸出 1.5 倍。此時輸入 $4,快取輸入 $0.20,快取寫入 $5,輸出 $15。
  • **Batch 與 Flex 便宜 50%。**能接受非同步處理的工作,輸入 $1、輸出 $5。
  • **Fast 模式價格為標準 2 倍。**這是為了降低延遲,不是提升智能。
  • **區域處理加價 10%。**有提供時適用。

快取讀取折扣是隱藏重點。重用同一 10 萬 token 倉庫上下文 20 回合,快取只需 $0.10/百萬 token,原本新輸入要 $2.00。長時段下,差異很快累積。

比較來看,GPT-6 Astra 每百萬 token 輸入 $10、輸出 $50。GPT-6.1 Sol 價格僅 Astra 的五分之一。GPT-6 Luna 更便宜,輸入 $0.10、輸出 $0.50,但放棄了 Sol 近乎 Astra 的能力。

GPT-6 家族每百萬 token 價格比較:Astra 輸入 $10 輸出 $50,GPT-6.1 Sol 輸入 $2 輸出 $10,GPT-6 Sol 輸入 $2 輸出 $10,Luna 輸入 $0.10 輸出 $0.50


GPT-6 新功能,Sol 能用哪些​

GPT-6.1 Sol 承襲 Astra 世代引入的 GPT-6 平台功能,部分特別適合智能代理人工作。

非同步工具呼叫​

一般函式呼叫會讓模型暫停,等應用程式回傳結果。啟用 async tool calling,工具定義加上 async: true,模型可繼續推理、呼叫其他工具、或處理請求獨立部分,應用程式則在背景執行慢的工作。

應用程式仍需執行工具並管理未完成工作。工作結束後,用原本的 call_id 在後續 Responses 請求回傳結果。OpenAI 文件建議這種方式可提早啟動慢查詢,等資料到再補答案。

Sol 很適合這種用法。程式代理人可同時啟動長測試,繼續檢查其他檔案,等測試結果回來再整合。

回合中引導​

Mid-turn steering 允許用戶在模型運作中途發送修正或新需求。透過 WebSocket 連線至 Responses API,伺服器保留已完成部分,將更新納入後續回應。

注意:引導不會改寫已輸出的內容、不會撤銷已執行動作、也不會取消已啟動的工具。它只改變後續方向,不影響已完成部分。若引導中斷原回應,原回應會標記 incomplete_details.reason: "steered",新回應則帶入更新。

對話中調整推理強度​

可在對話中用 configuration_update 輸入項目調高或調低推理強度。更新後的強度持續有效,直到下次再更新。OpenAI 建議請求層級的 reasoning.effort 不要變動,讓提示前綴能快取。

這種組合——便宜的快取讀取與可調推理——讓 Sol 很適合混合型工作。例行追問用 low,遇到困難時切換 xhigh,不用重寫對話。

多代理人(beta)​

多代理人功能在 GPT-6.1 Sol 與所有 GPT-5.6 模型開放 beta。主代理人可產生多個子代理人並行工作,各自有獨立上下文,最後整合結果。

OpenAI 文件建議用於可拆分成獨立工作流的任務:如分頭探索大型程式庫、比較提案、平行查找資料來源、同時調查多個失敗原因。預設 max_concurrent_subagents 為 3。

但需注意 token 用量。代理人越多,token 消耗越多,適合需要平行速度與專注上下文時。

壓縮與持續推理​

長時程代理人最終會填滿上下文視窗。壓縮功能能縮小上下文,同時保留後續回合所需狀態。可在 Responses 請求設 context_management 與 compact_threshold 啟用伺服器端壓縮,token 數超過門檻時伺服器會回傳加密壓縮項目。

GPT-6.1 Sol 也支援 reasoning.context: "all_turns",讓前幾回合的相容推理項目延續到下次取樣。持續推理內容不會直接回傳——API 不會給出模型原始推理文字——但能讓模型在長對話中保持連貫。

WebSocket 模式​

WebSocket 模式可與 Responses API 保持持久連線,每回合只傳新輸入項目。OpenAI 報告,20 次以上工具呼叫的流程,端到端速度可提升約40%。對以智能程式、電腦操作為主的模型,這直接降低延遲。


GPT-6.1 Sol vs GPT-6 Sol vs Astra vs Luna​

GPT-6 家族現有四個等級。選擇主要看所需品質與流程執行頻率。

模型定位每百萬輸入/輸出最適合
GPT-6 Astra最高智能$10 / $50高要求推理、程式、專業工作
GPT-6.1 Sol近 Astra 但成本低$2 / $10複雜程式、電腦操作、文件密集工作
GPT-6 Sol舊 Sol 等級$2 / $10升級前的 Sol 工作
GPT-6 Luna最快且最省$0.10 / $0.50集中、高量任務

GPT-6.1 Sol 與 GPT-6 Sol 價格相同,但非同一模型。Felo 頁面形容 GPT-6.1 Sol 為升級版,事實錯誤更少,對明確限制遵守更好。快取讀取費率也減半:每百萬 token $0.10,原本 $0.20。若已在生產用 GPT-6 Sol,升級後品質與快取經濟性都提升,價格不變。

OpenAI 的模型選擇指南將推理強度對應任務類型:

  • GPT-6.1 Sol(medium)——複雜技術工作、需協作修訂的交付物。
  • GPT-6.1 Sol(xhigh)——精緻交付物、連結視覺系統、需整合衝突證據的決策。
  • Astra(low)——精簡寫作、內容改寫,需保留事實與細節。
  • Astra(medium)——需廣泛上下文、可靠互動、完整結果的企劃。
  • Astra(xhigh)——高要求分析、複雜交付物、嚴格規格。
  • Luna(low)——細部編輯、明確範圍問題解決、簡單資料擷取。
  • Luna(xhigh)——多應用程式間找當前上下文、工作排序、明確限制下解題。

OpenAI Codex 指南的實用原則:Sol 適合重複、長時程的程式、應用、文件工作且成本重要時。Astra 留給最嚴苛的任務。Luna 用於明確、可重複的任務。


如何透過 Felo API 平台串接 GPT-6.1 Sol​

Felo API 平台提供 GPT-6.1 Sol 兼容端點,可沿用現有 SDK,只需更改 base URL。

模型可用於:

  • Chat Completions: POST https://openapi.felo.ai/api/v1/chat/completions
  • Responses: POST https://openapi.felo.ai/api/v1/responses
  • Messages(Anthropic 兼容): POST https://openapi.felo.ai/api/v1/messages

步驟 1:取得 API 金鑰​

從 Felo API 平台帳號建立金鑰並匯出:

export FELO_API_KEY="YOUR_API_KEY"

步驟 2:發送第一個請求​

curl https://openapi.felo.ai/api/v1/chat/completions \
-H "Authorization: Bearer $FELO_API_KEY" \
-H "Content-Type: application/json" \
-d '{
"model": "gpt-6.1-sol",
"messages": [
{"role": "user", "content": "Explain the tradeoff between reasoning effort and cost."}
]
}'

步驟 3:使用兼容 SDK​

將任何 OpenAI 兼容 SDK 指向 https://openapi.felo.ai/api/v1。Claude 風格用戶端則用 Anthropic 兼容 base URL https://openapi.felo.ai/api。

import OpenAI from "openai";

const client = new OpenAI({
apiKey: process.env.FELO_API_KEY,
baseURL: "https://openapi.felo.ai/api/v1",
});

const response = await client.responses.create({
model: "gpt-6.1-sol",
reasoning: { effort: "medium" },
input: "Review this pull request for correctness, security, and missing tests.",
});

console.log(response.output_text);

步驟 4:需要時啟用串流​

加上 stream: true,即可在模型運作時收到伺服器推送事件。

Felo 模型頁標示 GPT-6.1 Sol 每百萬輸入 token $2.00,輸出 $10.00,上市期間價格可能比官方 API 低 50%。實際費用依模型、輸入/輸出比例、快取使用、方案而定。快取讀取費率為 GPT-6 Sol 的一半。

平台支援推理、工具、JSON 輸出、串流、視覺等功能,並提供 Playground 測試提示詞。


GPT-6.1 Sol 最佳應用場景​

OpenAI 指南建議用於成本重要的複雜專案,以下幾種模式特別適合。

大規模智能程式​

讀取程式庫、提出修改、執行測試、反覆迭代的程式代理人,正是 Sol 的目標工作。1.05M 上下文視窗可容納大型程式庫,快取讀取折扣鼓勵重用倉庫上下文,非同步工具呼叫讓代理人測試時仍能處理其他任務。

OpenAI Codex 指南建議,成本重要時用 Sol 處理重複、長時程的程式與應用,Astra 留給最困難的任務。

電腦操作與流程自動化​

GPT-6.1 Sol 支援完整 Responses 工具組,包括 computer_use、hosted_shell、apply_patch、mcp、tool_search。適合操作軟體、填寫表單、系統間搬移資料、或自動化多步驟商業流程的代理人。

Felo 模型頁將電腦操作與多步驟流程自動化列為主要應用。

文件密集型專業工作​

Sol 可處理文字與圖片,涵蓋掃描文件、圖表、截圖、簡報。OpenAI 模型選擇指南舉兩例:根據財報製作董事會簡報、根據產品簡報製作網站。這類任務輸入大、需多次修訂,品質要求高於「便宜快速」,但不必追求「極致」。

平行研究與分析​

啟用多代理人 beta,Sol 能將研究任務拆成獨立流程並行執行,最後整合結果。比較廠商提案、從三個角度審查 pull request、同時調查多個失敗假設都很適合。

大量批次處理​

Batch 與 Flex 價格將 Sol 降至每百萬 token 輸入 $1、輸出 $5。用於夜間文件處理、批次摘要、大規模擷取且需人工複查時,這種價格讓許多任務變得可行。


遷移檢查表:從 GPT-6 Sol 移轉到 GPT-6.1 Sol​

OpenAI 建議切換 gpt-6-sol 到 gpt-6.1-sol 前,先檢查官方遷移指南。重點如下:

  1. 設定模型 ID。 將 model 改為 gpt-6.1-sol。
  2. 修正推理強度。 GPT-6.1 Sol 不支援 none 或 minimal。將 none 改為 low,minimal 遷移時先用 low 測試。
  3. 工具呼叫改用 Responses。 無工具請求可用 Chat Completions。任何函式呼叫、網頁搜尋、檔案搜尋、電腦操作、MCP 流程需用 Responses API。
  4. 移除不支援參數。 推理強度非 none 時,移除 temperature、top_p、top_logprobs。Chat Completions 也移除 logprobs,Responses 移除 message.output_text.logprobs。
  5. 更新提示快取設定。 從 GPT-5.5 或更早遷移,將 prompt_cache_retention 改為 prompt_cache_options.ttl: "30m"。
  6. 用 configuration_update 調整推理。 若應用需在回合間調整強度,請用 configuration_update,不要改請求層級 reasoning.effort,以利快取提示前綴。
  7. 檢查資料駐留地。 GPT-6.1 Sol 支援美國與歐盟資料駐留。EU 資料駐留下無法用 Fast 模式。
  8. 與 Astra 比較測試。 在代表性任務上同時測試兩模型,評估品質、延遲、總成本(含推理 token,計入輸出 token)。

限制與供應情況​

GPT-6.1 Sol 不是 Astra 的萬用替代品,目前也尚未全面開放。

能力限制。 OpenAI 將 Sol 定位於 Astra 之下。最高要求推理、最重要交付物仍建議用 Astra。Sol 適合複雜工作但非極致品質。

無微調。 GPT-6.1 Sol 不支援微調或預測輸出,也不支援嵌入、圖像生成、影片、語音、轉錄、翻譯、審查端點。它是文字/圖片輸入、文字輸出的推理模型。

無音訊或影片輸入。 僅支援文字與圖片。

推理無法關閉。 不支援 none、minimal,每個請求都會產生推理負擔。

尚在逐步開放。 OpenAI 上市涵蓋 Plus、Pro、Business、Enterprise、Edu 方案,Codex 桌面與 CLI、ChatGPT Work(網頁與行動)。Enterprise 與 Edu 需管理員啟用預設關閉。Free 與 Go 方案上市不開放。

Fast 模式有限制。 上市即有 Standard 與 Fast,Fast 價格為標準 2 倍,EU 資料駐留下無法用。Ultrafast 支援未來開放。

有速率限制。 標準速率 Tier 1 為 500 RPM、500,000 TPM,Tier 5 為 15,000 RPM、40,000,000 TPM。


常見問答​

GPT-6.1 Sol 是什麼?​

GPT-6.1 Sol 是 OpenAI 的平衡型 GPT-6 模型,介於旗艦 GPT-6 Astra 與輕量 GPT-6 Luna 之間。OpenAI 形容它以較低成本提供複雜程式、電腦操作、專業工作近乎 Astra 的效能。

GPT-6.1 Sol 價格多少?​

OpenAI 標示 GPT-6.1 Sol 每百萬輸入 token $2,輸出 token $10。快取輸入 $0.10,快取寫入 $2.50。輸入 token 超過 272K,長上下文費率更高。

GPT-6.1 Sol 上下文視窗多大?​

GPT-6.1 Sol 有 1,050,000 token 上下文視窗,最大輸入 922,000 token,最大輸出 128,000 token。

GPT-6.1 Sol 支援工具呼叫嗎?​

支援,但需用 Responses API。無工具請求可用 Chat Completions。

可以關閉 GPT-6.1 Sol 的推理嗎?​

無法。GPT-6.1 Sol 支援 low、medium、high、xhigh、max 推理強度,不支援 none 或 minimal。

GPT-6.1 Sol 與 GPT-6 Sol 差異?​

GPT-6.1 Sol 是 GPT-6 Sol 的升級版,Felo 模型頁指出事實錯誤更少,對明確限制遵守更好。兩者 headline token 價格相同,但 GPT-6.1 Sol 快取輸入費率減半至 $0.10。

GPT-6.1 Sol 可在 Felo API 平台用嗎?​

可以。Felo API 平台提供 GPT-6.1 Sol 的 Chat Completions、Responses、Anthropic 兼容 Messages 端點。上市價格可能比官方 API 低 50%,快取讀取費率為 GPT-6 Sol 一半。


重點整理​

GPT-6.1 Sol 回應一個實際問題:最好的模型太貴,最便宜的模型不夠好。Sol 以近 Astra 能力、1.05M 上下文視窗、5% 快取讀取費率、Astra 五分之一價格,取得平衡。

對於打造程式代理人、電腦操作流程、文件密集自動化的團隊,這是首選測試模型。可在自己任務上與 Astra 比較,觀察推理 token 用量,讓成本與品質取捨決定。

可在 Felo API 平台 Playground 試用 GPT-6.1 Sol,或用 Felo API 金鑰直接串接。


參考來源​


本文也提供以下語言版本:English、简体中文、日本語、한국어、हिन्दी、Français、العربية、Русский、اردو、Bahasa Indonesia、Deutsch、Tiếng Việt、Türkçe、Italiano、ไทย、Español、বাংলা、Português。