OX Alpha API: Dùng Thử Miễn Phí Mô Hình Stealth 1 Triệu Token Ngay Hôm Nay
Felo API hiện đã hỗ trợ OX Alpha, một mô hình reasoning tiên phong với ngữ cảnh 1 triệu token. Miễn phí mỗi triệu token trong thời gian giới hạn. Dùng thử ngay.
Hai ngày trước, một mô hình tiên phong xuất hiện mà không ai nhận là của mình. Nó có cửa sổ ngữ cảnh lên tới một triệu token, thông số kỹ thuật hàng đầu, và nhãn "Stealth" thay cho tên nhà sản xuất. Giới quan sát ngành gọi đó là thú vị; các lập trình viên cho rằng đáng để thử nghiệm.
Hôm nay, chính mô hình đó đã có mặt dưới dạng API, và hiện đang miễn phí mỗi triệu token, ít nhất là trong thời gian này.
Bạn không cần lời mời đặc biệt hay ngân sách AI lớn. Chỉ cần mở trang mô hình, hoặc thực hiện một lệnh gọi API với khóa API.
OX Alpha Là Gì?
OX Alpha là một mô hình reasoning được xây dựng cho các tác vụ dài hạn: lập trình hiệu quả, chuỗi tác vụ agent liên tục, và quy trình sản xuất chuyên nghiệp. Nó xuất hiện vào ngày 20 tháng 8 dưới nhãn "Stealth", không gắn tên nhà sản xuất, nên không ai có thể xác nhận ai đã xây dựng nó. Nhiều giả thuyết được đưa ra: một phòng lab Trung Quốc, một mô hình mã nguồn mở được đổi tên, hay một nhóm nhỏ với cụm máy rất lớn. Nhưng chưa có gì được xác thực.
Những gì đã xác thực thì tự nói lên tất cả:
| Tính năng | Chi tiết |
|---|---|
| Cửa sổ ngữ cảnh | 1.048.576 token (toàn bộ mã nguồn hoặc một chồng nghiên cứu trong một lần xử lý) |
| Đầu ra tối đa | 128K token trong một phản hồi |
| Đầu vào | Văn bản, hình ảnh, và video (đầu ra là văn bản) |
| Reasoning | Các phiên reasoning rõ ràng, tối ưu cho tác vụ dài hạn |
| Sử dụng công cụ | Gọi hàm cho quy trình agent |
| Chế độ xuất | Gọi công cụ, chế độ JSON, và streaming |

Một mô hình có thể xử lý một triệu token cùng lúc không chỉ đơn thuần là tự động hoàn thành lớn hơn. Nó giữ toàn bộ dự án của bạn trong "đầu": đoạn mã bạn viết tháng trước, các bài báo bạn đang so sánh, hay trace lỗi từ lần crash hôm qua. Sau đó, nó reasoning trên tất cả chỉ trong một lần xử lý.
Có hai lưu ý cần nói rõ. Sự phấn khích về benchmark của OX Alpha là có thật nhưng chưa được kiểm chứng: một tuyên bố lan truyền về chiến thắng DeepSWE chỉ dựa trên bài test 10 câu hỏi, và thứ hạng nội bộ trên Kingbench chỉ là số liệu của một lập trình viên, không phải bảng xếp hạng xác thực. Nhà sản xuất vẫn ẩn danh. Nếu bạn chọn mô hình cho hệ thống sản xuất, hãy xem benchmark như tin đồn và xác minh bằng chính khối lượng công việc của bạn.
Nền Tảng Felo API: Một Khóa, Mọi Mô Hình
OX Alpha được cung cấp qua Nền tảng Felo API, một cổng thống nhất tương thích với các chuẩn API mà công cụ của bạn đã sử dụng. Chỉ cần trỏ SDK OpenAI của bạn tới một base URL, hoặc client Anthropic tới một URL khác, nền tảng sẽ tự động định tuyến tới mô hình bạn yêu cầu.
- Giao diện tương thích OpenAI:
POST https://openapi.felo.ai/api/v1/chat/completions. Đặt base URL của SDK OpenAI thànhhttps://openapi.felo.ai/api/v1và sử dụng như bình thường. - Giao diện tương thích Anthropic:
POST https://openapi.felo.ai/api/v1/messages. Client kiểu Claude đặt base URL làhttps://openapi.felo.ai/api. - Giao diện Responses tại
.../api/v1/responsescho các client agent và workflow.
Bên cạnh OX Alpha, nền tảng còn hỗ trợ các mô hình Claude, DeepSeek, GPT, và Grok. Nghĩa là bạn chỉ cần một tài khoản, một khóa API, một dashboard, và không cần chuyển đổi giữa các nhà cung cấp. Riêng với OX Alpha, bạn có trang mô hình riêng với đầy đủ thông số, giá trực tiếp, và hướng dẫn khởi động nhanh.
Cách Dùng Thử OX Alpha Miễn Phí Chỉ Trong Chưa Đầy Một Phút
Cách nhanh nhất chỉ mất khoảng 30 giây, và bạn không cần viết dòng code nào:
- Mở https://openapi.felo.ai/models/stealth/ox-alpha, trang công khai của mô hình trên Nền tảng Felo API.
- Nhấn Open Playground để mở chat tại playground.felo.ai.
- Thử mô hình với câu hỏi của bạn.
Khi muốn tích hợp vào code của mình, hãy tạo khóa API từ tài khoản Felo API Platform, sau đó đặt biến môi trường và bắt đầu:
export FELO_API_KEY="YOUR_API_KEY"
Một yêu cầu tối giản, phiên bản cURL:
curl -N https://openapi.felo.ai/api/v1/chat/completions \
-H "Authorization: Bearer $FELO_API_KEY" \
-H "Content-Type: application/json" \
-d '{
"model": "ox-alpha",
"stream": true,
"messages": [{"role": "user", "content": "Hello"}]
}'
Với SDK OpenAI, chỉ cần thay đổi ba dòng:
from openai import OpenAI
client = OpenAI(base_url="https://openapi.felo.ai/api/v1", api_key=FELO_API_KEY)
reply = client.chat.completions.create(model="ox-alpha", messages=[{"role": "user", "content": "Why is my test flaky?"}])
ID mô hình này là chuỗi dùng ở mọi nơi trên nền tảng: ox-alpha.

Mô Hình Này Phù Hợp Với Gì
Thẻ mô hình trên nền tảng ghi rõ "tốt nhất cho": lập trình dài hạn, reasoning phức tạp, quy trình agent, và tác vụ đa phương tiện. Ba ví dụ thực tế:
Câu hỏi lập trình tổng hợp. Dán log crash, test fixture bị lỗi, và các pull request đã chỉnh sửa file gây lỗi vào một yêu cầu, rồi hỏi thực sự vấn đề là gì. Cửa sổ một triệu token giữ toàn bộ câu chuyện thay vì chỉ những gì hộp tóm tắt còn nhớ.
Chuỗi agentic. OX Alpha hỗ trợ gọi hàm và stream các lệnh công cụ, rất phù hợp cho agent nhiều bước. Các agent xây dựng trên Claude Code hoặc Codex có thể gọi nó qua giao diện tương thích Anthropic và OpenAI của nền tảng mà không cần tích hợp riêng.
Luồng đa phương tiện. Một ngữ cảnh chứa hình ảnh, đoạn video, và bản đặc tả viết tay. Hỏi mô hình để đối chiếu chúng: ảnh chụp màn hình nói một đằng, đặc tả nói một nẻo, và đầu ra sẽ giải quyết mâu thuẫn.
Vì mô hình có khả năng reasoning, nền tảng khuyến nghị bạn nên giữ lại metadata reasoning trả về khi tiếp tục hội thoại, và header tùy chọn X-Request-Id có thể giúp tăng tốc xử lý sự cố.
Cùng Một Mô Hình, Hai Cách Tiếp Cận
OX Alpha giờ cũng có thể truy cập trực tiếp trên trình duyệt. Felo Search đã liệt kê nó trong bộ chọn mô hình (felo.ai/search, hoặc truy cập nhanh tại đây: felo.ai/search?search_model=ox-alpha) cho các tác vụ hỏi đáp. API bạn đang đọc chính là mô hình này dành cho các công việc cần code: pipeline, agent, batch job, và bên trong sản phẩm của bạn.
Sự phân chia này rất đáng lưu ý. Nếu câu hỏi là của bạn và câu trả lời dành cho màn hình, hộp tìm kiếm là con đường nhanh nhất. Nếu tác vụ chạy theo lịch, ký code, hoặc đóng gói trong sản phẩm, API là nơi phù hợp.
Đọc Kỹ, Dùng Tự Tin
Thái độ đúng với mô hình này là hoài nghi với các tuyên bố, và tò mò về chi phí. Trong giai đoạn ra mắt, OX Alpha API được niêm yết miễn phí mỗi triệu token cho cả đầu vào và đầu ra. Điều này giúp bạn kiểm chứng trực tiếp với chi phí cực thấp. Nhìn chung, giá ra mắt trên nền tảng là lúc dễ thử các mô hình mới nhất mà không cần duyệt ngân sách.
Đó cũng là cách đánh giá mô hình bí ẩn một cách công bằng: mang đến câu hỏi khó nhất mà bạn đã biết đáp án, và xem nó trả lời ra sao. Nếu nó theo kịp, việc thiếu logo nhà cung cấp không còn quan trọng.
Dùng Thử OX Alpha Trước Khi Hết Miễn Phí
Một mô hình stealth với ngữ cảnh một triệu token vừa xuất hiện cách đây hai ngày. Giờ chỉ còn cách bạn một model ID và một khóa API. Và hiện tại, nó hoàn toàn miễn phí. Cửa sổ ra mắt sẽ đóng lại bất cứ lúc nào.
Nếu bạn chỉ muốn thử trên trình duyệt, playground đã sẵn sàng. Nếu muốn dùng trong sản xuất, các endpoint và hướng dẫn khởi động nhanh đã được trích dẫn đầy đủ ở trên.
Trải nghiệm OX Alpha miễn phí trên Felo API →
FAQ
ID mô hình OX Alpha là gì?
ox-alpha. Đây là chuỗi dùng trong playground, cURL, mọi SDK, và trong thư mục models tại openapi.felo.ai/models/stealth/ox-alpha.
Tôi có cần tài khoản OpenAI hoặc Anthropic riêng không?
Không. Nền tảng cung cấp giao diện tương thích OpenAI và Anthropic, nên các SDK và công cụ agent hiện có sẽ hoạt động với endpoint Felo chỉ với một khóa API Felo. Bạn chỉ cần client, không cần tài khoản riêng.
OX Alpha thực sự miễn phí chứ?
Trang mô hình niêm yết giá miễn phí mỗi triệu token cho cả đầu vào và đầu ra trong giai đoạn ra mắt. Giá ra mắt sẽ thay đổi khi hết thời gian, nên hãy kiểm tra trang mô hình trước khi sử dụng.
Tôi có nên tin vào các benchmark đó không?
Hãy xem chúng như tin đồn từ một người lạ nói rất hay. Mẫu thử nhỏ, bảng xếp hạng chưa kiểm chứng, và nhà sản xuất ẩn danh. Cách kiểm chứng rẻ nhất là tự đặt câu hỏi của bạn, và hiện tại bạn có thể làm điều đó miễn phí.
Lưu ý: các tuyên bố về benchmark được đề cập ở đây chỉ là sơ bộ và chưa kiểm chứng. Giá hiển thị phản ánh niêm yết ra mắt của nền tảng và có thể thay đổi; hãy xác minh giá hiện tại trên trang mô hình.
Bài viết này cũng có sẵn bằng English, 简体中文, 日本語, 한국어, 繁體中文, हिन्दी, Français, العربية, Русский, اردو, Bahasa Indonesia, Deutsch, Türkçe, Italiano, ไทย, Español, বাংলা and Português.