GPT-6.1 Sol API: Hiệu Năng Gần Astra Với Chi Phí Thấp Hơn
OpenAI GPT-6.1 Sol mang lại hiệu năng gần như Astra cho lập trình, sử dụng máy tính và công việc chuyên nghiệp với giá $2/$10 cho mỗi triệu token cùng cửa sổ ngữ cảnh 1,05M.
Mẫu Sol mới nhất của OpenAI không cố trở thành mô hình thông minh nhất. Nó hướng đến việc bạn có thể sử dụng liên tục mà không lo chi phí.
GPT-6.1 Sol nằm giữa GPT-6 Astra cao cấp và GPT-6 Luna nhẹ. Trang mô hình của OpenAI mô tả ngắn gọn: "Hiệu năng gần Astra cho công việc phức tạp với chi phí thấp hơn." Đối với các nhóm xây dựng công cụ lập trình tự động, agent sử dụng máy tính và quy trình xử lý tài liệu lớn, sự đánh đổi này chính là mục tiêu.
Hướng dẫn này trình bày GPT-6.1 Sol cung cấp gì, giá cả, điểm khác biệt với GPT-6 Sol và Astra, cùng cách gọi qua Nền tảng Felo API.

GPT-6.1 Sol là gì
GPT-6.1 Sol là mô hình suy luận thiết kế cho lập trình phức tạp, sử dụng máy tính và công việc chuyên môn. OpenAI định vị nó là lựa chọn cân bằng trong dòng GPT-6: mạnh hơn Luna, rẻ hơn Astra, và đủ tốt để nhiều tác vụ sản xuất không cần dùng mẫu cao cấp.
Trang mô hình hướng dẫn rõ ràng: so sánh Sol với Astra trên chính tác vụ của bạn, rồi quyết định chất lượng có xứng với giá không. Đó là chỉ dẫn thực tế, phản ánh mục đích của mô hình. Sol là công cụ kiểm soát chi phí, không phải thành tích benchmark.
Trang mô hình của Felo tóm tắt vị trí tương tự từ phía nền tảng. GPT-6.1 Sol là "bản nâng cấp của GPT-6 Sol, vẫn xếp dưới GPT-6 Astra." Nó xử lý lập trình agent, sử dụng máy tính, công việc tài liệu lớn và tự động hóa quy trình nhiều bước, đạt kết quả gần Astra với chi phí thấp hơn nhiều. So với GPT-6 Sol, Felo ghi nhận ít lỗi thực tế hơn và tuân thủ hạn chế rõ ràng hơn.
GPT-6.1 Sol là mô hình bạn chọn khi tác vụ khó, dài, lặp lại — và hóa đơn cần ổn định.
Thông số GPT-6.1 Sol
OpenAI công bố đầy đủ thông số trên trang mô hình. Dưới đây là bản tóm tắt.
| Thông số | GPT-6.1 Sol |
|---|---|
| Model ID | gpt-6.1-sol |
| Default snapshot | gpt-6.1-sol |
| Context window | 1.050.000 token |
| Maximum input tokens | 922.000 |
| Maximum output tokens | 128.000 |
| Knowledge cutoff | 30/04/2026 |
| Input modalities | Văn bản, hình ảnh |
| Output modalities | Văn bản |
| Unsupported modalities | Âm thanh, video |
| Reasoning token support | Có |
| Reasoning effort | low, medium (mặc định), high, xhigh, max |
| Unsupported reasoning effort | none, minimal |
| Data residency | Mỹ và EU |
Hai chi tiết quan trọng hơn các con số chính.
Thứ nhất, không thể tắt suy luận. GPT-6.1 Sol không hỗ trợ none hoặc minimal. Nếu bạn chuyển từ mô hình cho phép các thiết lập này, OpenAI khuyến nghị bắt đầu với low và so sánh kết quả trên tác vụ đại diện.
Thứ hai, gọi công cụ cần dùng Responses API. GPT-6.1 Sol hỗ trợ Chat Completions cho yêu cầu không dùng công cụ, nhưng mọi quy trình gọi hàm, tìm kiếm file, duyệt web hoặc điều khiển máy tính đều cần chuyển sang Responses. Đây không phải hạn chế riêng Sol — mà là hướng phát triển của toàn nền tảng OpenAI.
Giá GPT-6.1 Sol: $2/$10 mang lại gì
Giá chuẩn của OpenAI cho GPT-6.1 Sol là $2 cho mỗi triệu token đầu vào và $10 cho mỗi triệu token đầu ra. Bảng token đầy đủ có giá cache, thay đổi tính toán cho agent chạy lâu.
| Chỉ số | Giá mỗi 1M token |
|---|---|
| Đầu vào | $2.00 |
| Đầu vào cache | $0.10 |
| Ghi cache | $2.50 |
| Đầu ra | $10.00 |
Một số quy tắc áp dụng:
- Đầu vào cache chỉ tốn 5% giá gốc. OpenAI tính giá đọc cache GPT-6.1 Sol là 0.05x, so với 0.1x ở hầu hết mẫu GPT-5.6 trở lên. Đây là ưu đãi lớn cho agent tái sử dụng prompt hệ thống hoặc ngữ cảnh repo lớn mỗi lượt.
- Ghi cache tốn 1,25x giá đầu vào chưa cache. Bạn trả $2.50 cho mỗi triệu token ghi vào cache, sau đó $0.10 cho mỗi triệu đọc lại.
- Ngữ cảnh dài tốn nhiều hơn. Prompt trên 272K token đầu vào bị tính 2x giá đầu vào và cache, 1.5x đầu ra cho toàn bộ yêu cầu. Khi đó, đầu vào $4, cache $0.20, ghi cache $5, đầu ra $15 mỗi triệu token.
- Batch và Flex rẻ hơn 50%. Nếu workload chịu xử lý bất đồng bộ, giá thực tế còn $1 đầu vào và $5 đầu ra mỗi triệu token.
- Chế độ Fast tốn gấp đôi Standard. Bạn trả cho độ trễ thấp hơn, không phải trí thông minh cao hơn.
- Xử lý khu vực cộng thêm 10% nếu có.
Giảm giá đọc cache là điểm nổi bật. Agent lập trình tái sử dụng cùng ngữ cảnh repo 100.000 token qua 20 lượt chỉ trả $0.10 mỗi triệu token cache thay vì $2.00 mỗi triệu token đầu vào mới. Qua phiên dài, chênh lệch này tăng nhanh.
So sánh, GPT-6 Astra niêm yết $10 đầu vào và $50 đầu ra mỗi triệu token. GPT-6.1 Sol chỉ bằng 1/5 giá ở cả hai chiều. GPT-6 Luna còn rẻ hơn với $0.10 đầu vào và $0.50 đầu ra, nhưng không có năng lực gần Astra như Sol.

Tính năng mới của GPT-6 Sol có thể dùng
GPT-6.1 Sol kế thừa các tính năng nền tảng GPT-6 mà OpenAI giới thiệu cùng Astra. Một số tính năng quan trọng cho workload agent.
Gọi công cụ bất đồng bộ
Thông thường, gọi hàm sẽ tạm dừng mô hình cho đến khi ứng dụng trả kết quả. Với gọi công cụ async, bạn đặt async: true trong định nghĩa công cụ và mô hình tiếp tục làm việc — suy luận, gọi công cụ khác, hoặc trả lời phần độc lập — trong khi ứng dụng xử lý tác vụ nền.
Ứng dụng vẫn thực thi công cụ và quản lý công việc chờ. Khi xong, bạn trả kết quả trong yêu cầu Responses tiếp theo với call_id gốc. Tài liệu OpenAI mô tả đây là cách khởi động truy vấn chậm sớm và bổ sung kết quả khi dữ liệu có.
Với Sol, điều này phù hợp tự nhiên. Agent lập trình có thể chạy bộ test dài, tiếp tục review file khác, rồi tổng hợp kết quả test khi có.
Điều chỉnh giữa lượt
Điều chỉnh giữa lượt cho phép người dùng gửi chỉnh sửa hoặc yêu cầu mới khi mô hình vẫn đang xử lý. Qua kết nối WebSocket tới Responses API, server giữ lại phần đã hoàn thành và bổ sung cập nhật vào phần tiếp theo.
Lưu ý quan trọng: steering không ghi đè đầu ra đã gửi, không hoàn tác hành động trước, không hủy công cụ đã chạy. Nó chỉ thay đổi hướng xử lý tiếp theo. Nếu steering ngắt phản hồi gốc, phản hồi đó kết thúc với incomplete_details.reason: "steered" và phản hồi mới mang cập nhật.
Thay đổi mức suy luận trong hội thoại
Bạn có thể tăng hoặc giảm mức suy luận trong hội thoại bằng cách thêm mục configuration_update. Mức mới áp dụng cho đến khi có cập nhật khác. OpenAI khuyến nghị giữ nguyên reasoning.effort ở cấp yêu cầu để tiền tố prompt vẫn cache được.
Kết hợp này — đọc cache rẻ cộng với suy luận điều chỉnh — giúp Sol kinh tế cho workload hỗn hợp. Dùng low cho các lượt thường, chuyển sang xhigh khi tác vụ khó mà không cần viết lại hội thoại.
Multi-agent (beta)
Multi-agent có ở chế độ beta với GPT-6.1 Sol và tất cả mẫu GPT-5.6. Agent gốc có thể sinh subagent chạy song song, mỗi agent có ngữ cảnh riêng, rồi tổng hợp kết quả thành đáp án cuối.
Tài liệu OpenAI khuyến nghị dùng cho tác vụ chia thành luồng độc lập: khám phá các phần khác nhau của codebase lớn, so sánh đề xuất, nghiên cứu nguồn song song, hoặc điều tra nhiều nguyên nhân lỗi cùng lúc. Mặc định max_concurrent_subagents là 3.
Đánh đổi là số token. Nhiều agent dùng nhiều token hơn, nên multi-agent hiệu quả khi tốc độ song song và ngữ cảnh tập trung quan trọng hơn tiết kiệm token.
Nén và lưu trạng thái suy luận
Agent chạy lâu sẽ đầy cửa sổ ngữ cảnh. Nén giúp giảm kích thước ngữ cảnh mà vẫn giữ trạng thái cho lượt sau. Bạn bật nén phía server bằng context_management với compact_threshold trong yêu cầu Responses; server trả về mục nén mã hóa khi số token vượt ngưỡng.
GPT-6.1 Sol cũng hỗ trợ reasoning.context: "all_turns", cho phép mục suy luận tương thích từ lượt trước chuyển sang lượt sau. Suy luận lưu giữ không công khai — API không trả văn bản suy luận thô — nhưng giúp mô hình duy trì mạch hội thoại dài.
Chế độ WebSocket
Chế độ WebSocket giữ kết nối liên tục tới Responses API và chỉ gửi mục mới mỗi lượt. OpenAI báo cáo tăng tốc thực thi tổng thể tới khoảng 40% cho quy trình có 20+ lần gọi công cụ. Với mô hình tập trung vào lập trình agent và sử dụng máy tính, đây là lợi thế về độ trễ.
So sánh GPT-6.1 Sol, GPT-6 Sol, Astra, Luna
Gia đình GPT-6 hiện có bốn cấp. Việc chọn chủ yếu dựa vào chất lượng cần thiết và tần suất workflow.
| Mô hình | Định vị | Đầu vào / Đầu ra mỗi 1M | Phù hợp nhất |
|---|---|---|---|
| GPT-6 Astra | Trí tuệ cao nhất | $10 / $50 | Suy luận, lập trình, công việc chuyên sâu |
| GPT-6.1 Sol | Gần Astra, giá thấp | $2 / $10 | Lập trình phức tạp, sử dụng máy tính, tài liệu lớn |
| GPT-6 Sol | Sol thế hệ trước | $2 / $10 | Workload Sol cũ trước nâng cấp |
| GPT-6 Luna | Nhanh nhất, tiết kiệm nhất | $0.10 / $0.50 | Tác vụ tập trung, khối lượng lớn |
GPT-6.1 Sol và GPT-6 Sol cùng giá niêm yết, nhưng không giống nhau. Trang Felo mô tả GPT-6.1 Sol là bản nâng cấp với ít lỗi thực tế hơn, tuân thủ hạn chế rõ ràng hơn. Giá đọc cache cũng giảm một nửa: $0.10 thay vì $0.20 mỗi triệu token. Nếu bạn đã chạy GPT-6 Sol sản xuất, nâng cấp sẽ cải thiện cả chất lượng lẫn kinh tế cache với cùng giá.
Hướng dẫn chọn mô hình của OpenAI liên hệ mức suy luận với loại tác vụ:
- GPT-6.1 Sol mức trung bình — công việc kỹ thuật phức tạp, sản phẩm phối hợp cần chỉnh sửa.
- GPT-6.1 Sol mức rất cao — sản phẩm hoàn thiện, hệ thống hình ảnh liên kết, quyết định dựa trên dữ liệu mâu thuẫn.
- Astra mức thấp — viết ngắn gọn, chuyển thể nội dung giữ nguyên ý và dữ kiện.
- Astra mức trung bình — dự án tham vọng cần ngữ cảnh rộng, tương tác tin cậy, kết quả đầy đủ.
- Astra mức rất cao — phân tích chuyên sâu, sản phẩm phức tạp yêu cầu khắt khe.
- Luna mức thấp — chỉnh sửa chi tiết, giải quyết vấn đề phạm vi rõ, trích xuất dữ liệu đơn giản.
- Luna mức rất cao — tìm ngữ cảnh hiện tại qua nhiều ứng dụng, ưu tiên công việc, giải quyết vấn đề ràng buộc rõ.
Quy tắc thực tế từ hướng dẫn Codex của OpenAI: dùng Sol cho công việc lặp lại, kéo dài trên code, ứng dụng, tài liệu khi chi phí quan trọng. Giữ Astra cho tác vụ đòi hỏi nhất. Dùng Luna cho tác vụ rõ ràng, lặp lại.
Cách gọi GPT-6.1 Sol qua Nền tảng Felo API
Nền tảng Felo API cung cấp GPT-6.1 Sol qua các endpoint tương thích, bạn chỉ cần giữ SDK hiện tại và đổi base URL.
Mô hình có tại:
- Chat Completions:
POST https://openapi.felo.ai/api/v1/chat/completions - Responses:
POST https://openapi.felo.ai/api/v1/responses - Messages (tương thích Anthropic):
POST https://openapi.felo.ai/api/v1/messages
Bước 1: Lấy API key
Tạo key từ tài khoản Felo API Platform và xuất ra:
export FELO_API_KEY="YOUR_API_KEY"
Bước 2: Gửi yêu cầu đầu tiên
curl https://openapi.felo.ai/api/v1/chat/completions \
-H "Authorization: Bearer $FELO_API_KEY" \
-H "Content-Type: application/json" \
-d '{
"model": "gpt-6.1-sol",
"messages": [
{"role": "user", "content": "Explain the tradeoff between reasoning effort and cost."}
]
}'
Bước 3: Dùng SDK tương thích
Chỉ cần trỏ SDK tương thích OpenAI tới https://openapi.felo.ai/api/v1. Với client kiểu Claude, dùng base URL tương thích Anthropic https://openapi.felo.ai/api.
import OpenAI from "openai";
const client = new OpenAI({
apiKey: process.env.FELO_API_KEY,
baseURL: "https://openapi.felo.ai/api/v1",
});
const response = await client.responses.create({
model: "gpt-6.1-sol",
reasoning: { effort: "medium" },
input: "Review this pull request for correctness, security, and missing tests.",
});
console.log(response.output_text);
Bước 4: Bật streaming khi cần
Thêm stream: true để nhận sự kiện server gửi khi mô hình xử lý.
Trang mô hình Felo niêm yết GPT-6.1 Sol $2.00 mỗi triệu token đầu vào, $10.00 mỗi triệu token đầu ra, với giá khởi động có thể thấp hơn tối đa 50% so với API nhà cung cấp chính thức. Chi phí cuối cùng phụ thuộc mô hình, tỷ lệ đầu vào/ra, sử dụng cache và gói dịch vụ. Đọc cache tính giá bằng một nửa GPT-6 Sol.
Nền tảng cũng hỗ trợ suy luận, công cụ, xuất JSON, streaming, vision cho mô hình này, và có Playground để thử prompt trước khi viết code.
Trường hợp sử dụng tốt nhất cho GPT-6.1 Sol
Hướng dẫn của OpenAI nhấn mạnh dự án phức tạp khi chi phí quan trọng. Một số mẫu cụ thể nổi bật.
Agent lập trình quy mô lớn
Agent lập trình đọc repo, đề xuất thay đổi, chạy test, lặp lại chính là workload Sol thiết kế. Cửa sổ ngữ cảnh 1,05M chứa codebase lớn, giảm giá đọc cache khuyến khích tái sử dụng ngữ cảnh repo, gọi công cụ async giữ agent hoạt động khi test chạy.
Hướng dẫn Codex của OpenAI khuyên dùng Sol cho công việc lặp lại, kéo dài trên code và ứng dụng khi chi phí quan trọng, Astra cho tác vụ đòi hỏi nhất.
Sử dụng máy tính và tự động hóa quy trình
GPT-6.1 Sol hỗ trợ đầy đủ công cụ Responses như computer_use, hosted_shell, apply_patch, mcp, tool_search. Điều này phù hợp cho agent vận hành phần mềm, điền form, chuyển dữ liệu giữa hệ thống, hoặc tự động hóa quy trình kinh doanh nhiều bước.
Trang mô hình Felo liệt kê sử dụng máy tính và tự động hóa workflow nhiều bước là trường hợp chính.
Công việc chuyên môn nhiều tài liệu
Sol nhận văn bản và hình ảnh, bao gồm tài liệu scan, biểu đồ, ảnh chụp màn hình, slide. Hướng dẫn chọn mô hình của OpenAI nêu hai ví dụ: xây dựng báo cáo hội đồng từ kết quả tài chính, xây dựng website từ brief sản phẩm. Cả hai đều đầu vào lớn, nhiều lần chỉnh sửa, yêu cầu chất lượng dưới "tốt nhất" nhưng trên "rẻ và nhanh".
Nghiên cứu, phân tích song song
Bật multi-agent beta, Sol chia tác vụ nghiên cứu thành luồng độc lập, chạy đồng thời, tổng hợp kết quả. So sánh đề xuất nhà cung cấp, review pull request từ ba góc độ, điều tra nhiều giả thuyết lỗi đều phù hợp.
Xử lý batch khối lượng lớn
Giá Batch và Flex giảm còn $1 đầu vào, $5 đầu ra mỗi triệu token. Với xử lý tài liệu ban đêm, tóm tắt hàng loạt, trích xuất quy mô lớn có kiểm duyệt đầu ra, mức giá này mở rộng khả năng kinh tế.
Checklist chuyển từ GPT-6 Sol sang GPT-6.1 Sol
OpenAI khuyến nghị đọc hướng dẫn chuyển đổi trước khi đổi từ gpt-6-sol sang gpt-6.1-sol. Dưới đây là tóm tắt.
- Đặt model ID. Đổi
modelthànhgpt-6.1-sol. - Sửa mức suy luận. GPT-6.1 Sol không hỗ trợ
nonehoặcminimal. Thaynonebằnglow, kiểm thử chuyểnminimaltừlow. - Chuyển gọi công cụ sang Responses. Chat Completions dùng cho yêu cầu không có công cụ. Mọi gọi hàm, tìm kiếm web, file, sử dụng máy tính, workflow MCP cần Responses API.
- Xóa tham số không hỗ trợ. Khi suy luận không phải
none, bỏtemperature,top_p,top_logprobs. Với Chat Completions, bỏ thêmlogprobs. Với Responses, bỏmessage.output_text.logprobskhỏiinclude. - Cập nhật cấu hình cache prompt. Nếu chuyển từ GPT-5.5 trở về trước, thay
prompt_cache_retentionbằngprompt_cache_options.ttllà"30m". - Dùng
configuration_updateđể đổi suy luận. Nếu app thay đổi effort giữa lượt, dùng mụcconfiguration_updatethay vì đổireasoning.effortcấp yêu cầu, để tiền tố prompt vẫn cache được. - Kiểm tra nơi lưu dữ liệu. GPT-6.1 Sol hỗ trợ lưu dữ liệu Mỹ và EU. Chế độ Fast không có với lưu dữ liệu EU.
- Kiểm thử với Astra. Chạy cả hai mô hình trên tác vụ đại diện, so sánh chất lượng, độ trễ, tổng chi phí — kể cả token suy luận (tính như token đầu ra).
Giới hạn và khả dụng
GPT-6.1 Sol không thay thế Astra cho mọi trường hợp, và chưa có mặt ở mọi nơi.
Giới hạn năng lực. OpenAI xếp Sol dưới Astra. Với suy luận đòi hỏi nhất, sản phẩm quan trọng nhất, Astra vẫn là mô hình khuyến nghị. Sol là lựa chọn kinh tế cho công việc phức tạp, không phải chất lượng tối đa.
Không fine-tuning. GPT-6.1 Sol không hỗ trợ fine-tuning hoặc dự đoán đầu ra. Không hỗ trợ embedding, tạo ảnh, video, giọng nói, phiên âm, dịch, hoặc endpoint kiểm duyệt. Đây là mô hình nhận văn bản, hình ảnh, trả văn bản.
Không nhận âm thanh, video. Modal input chỉ có văn bản, hình ảnh.
Không tắt suy luận. Không hỗ trợ effort none, minimal, mọi yêu cầu đều có chi phí suy luận.
Chưa triển khai toàn bộ. Đợt ra mắt của OpenAI gồm các gói Plus, Pro, Business, Enterprise, Edu trong Codex trên desktop, CLI, và ChatGPT Work trên web, di động. Với Enterprise, Edu, mô hình mặc định tắt, admin phải bật. Gói Free, Go chưa có.
Chế độ Fast có lưu ý. Standard, Fast có ngay khi ra mắt, nhưng Fast giá gấp đôi Standard, không có với lưu dữ liệu EU. Hỗ trợ Ultrafast cho GPT-6.1 Sol sẽ có sau.
Giới hạn tốc độ. Giới hạn chuẩn từ 500 RPM, 500.000 TPM ở Tier 1 đến 15.000 RPM, 40.000.000 TPM ở Tier 5.
FAQ
GPT-6.1 Sol là gì?
GPT-6.1 Sol là mô hình GPT-6 cân bằng của OpenAI, nằm giữa GPT-6 Astra cao cấp và GPT-6 Luna nhẹ. OpenAI mô tả nó mang lại hiệu năng gần Astra cho lập trình phức tạp, sử dụng máy tính, công việc chuyên môn với chi phí thấp.
GPT-6.1 Sol giá bao nhiêu?
OpenAI niêm yết GPT-6.1 Sol $2 mỗi triệu token đầu vào, $10 mỗi triệu token đầu ra. Đầu vào cache $0.10 mỗi triệu token, ghi cache $2.50 mỗi triệu token. Prompt trên 272K token đầu vào bị tính giá cao hơn.
Cửa sổ ngữ cảnh của GPT-6.1 Sol là bao nhiêu?
GPT-6.1 Sol có cửa sổ ngữ cảnh 1.050.000 token, tối đa 922.000 token đầu vào, tối đa 128.000 token đầu ra.
GPT-6.1 Sol có hỗ trợ gọi công cụ không?
Có, nhưng gọi công cụ cần dùng Responses API. Chat Completions chỉ hỗ trợ yêu cầu không có công cụ.
Có thể tắt suy luận trên GPT-6.1 Sol không?
Không. GPT-6.1 Sol hỗ trợ effort low, medium, high, xhigh, max. Không hỗ trợ none, minimal.
GPT-6.1 Sol khác gì GPT-6 Sol?
GPT-6.1 Sol là bản nâng cấp GPT-6 Sol với ít lỗi thực tế hơn, tuân thủ hạn chế rõ ràng hơn (theo trang Felo). Hai mẫu cùng giá token, nhưng GPT-6.1 Sol giảm giá đọc cache còn $0.10 mỗi triệu token.
GPT-6.1 Sol có trên Nền tảng Felo API không?
Có. Nền tảng Felo API cung cấp GPT-6.1 Sol qua Chat Completions, Responses, endpoint Messages tương thích Anthropic. Giá khởi động có thể thấp hơn tối đa 50% so với API nhà cung cấp chính thức, đọc cache tính giá bằng một nửa GPT-6 Sol.
Kết luận
GPT-6.1 Sol là câu trả lời của OpenAI cho bài toán thực tế: mô hình tốt nhất thường quá đắt để chạy mọi tác vụ, mô hình rẻ nhất lại không đủ tốt. Sol cân bằng với năng lực gần Astra, cửa sổ ngữ cảnh 1,05M, giá đọc cache 5%, giá chỉ bằng 1/5 Astra.
Với nhóm xây dựng agent lập trình, workflow sử dụng máy tính, tự động hóa tài liệu lớn, đây là mô hình nên thử đầu tiên. So sánh với Astra trên tác vụ của bạn, theo dõi token suy luận, để sự đánh đổi chi phí-chất lượng quyết định.
Bạn có thể thử GPT-6.1 Sol trong Felo API Platform Playground hoặc gọi trực tiếp bằng API key Felo.
Nguồn
- GPT-6.1 Sol model page — OpenAI
- Using GPT-6 — OpenAI
- Model selection — OpenAI
- API pricing — OpenAI
- Codex and ChatGPT model availability — OpenAI
- Async tool calling — OpenAI
- Mid-turn steering — OpenAI
- Reasoning models — OpenAI
- Prompt caching — OpenAI
- Compaction — OpenAI
- Multi-agent — OpenAI
- WebSocket mode — OpenAI
- Fast mode — OpenAI
- Data residency — OpenAI
- GPT-6.1 Sol — Felo API Platform
Bài viết này cũng có sẵn bằng English, 简体中文, 日本語, 한국어, 繁體中文, हिन्दी, Français, العربية, Русский, اردو, Bahasa Indonesia, Deutsch, Türkçe, Italiano, ไทย, Español, বাংলা and Português.