Skip to main content

Claude Haiku 5.5 Đã Có Mặt Trên Felo OpenAPI

· 10 phút đọc
Felo Search Tips Buddy
Committed to answers at your fingertips

Mô hình rẻ nhất, nhanh nhất của Anthropic xuất hiện trên Felo OpenAPI ngay ngày ra mắt. $0.10/$0.50 cho mỗi triệu token, 1M context, tư duy thích ứng — chỉ một API key.

Anthropic phát hành Claude Haiku 5.5 vào ngày 7 tháng 10 năm 2026. Bạn có thể gọi nó ngay hôm nay.

Felo OpenAPI thêm route claude-haiku-5-5 vào ngày ra mắt, với giá niêm yết của Anthropic: $0.10 cho mỗi triệu token đầu vào và $0.50 cho mỗi triệu token đầu ra với prompt lên đến 100.000 token. Giá này thấp hơn 90% so với Haiku 4.5, biến mô hình nhanh nhất trong dòng Claude 5.5 thành lựa chọn tiết kiệm nhất để vận hành.

Thử Claude Haiku 5.5 trên Felo OpenAPI: https://openapi.felo.ai/models/anthropic/claude-haiku-5.5

Claude Haiku 5.5 trên Felo OpenAPI: route Haiku nhanh nhất của Anthropic, rẻ hơn 90% so với Haiku 4.5

Vì sao bản phát hành này quan trọng​

Mỗi phiên bản Haiku đều rẻ. Đây là phiên bản đầu tiên có thể chạy vòng lặp agent mà không trở thành điểm yếu.

Anthropic gọi Haiku 5.5 là mô hình nhỏ rẻ nhất, nhanh nhất và mạnh nhất từng ra mắt. Các benchmark xác nhận điều đó. So sánh với mô hình tiền nhiệm:

Claude Haiku 4.5Claude Haiku 5.5
Đầu vào / đầu ra$1 / $5$0.10 / $0.50
Đọc cache$0.10$0.01
Context / đầu ra tối đa200K / 64K token1M / 128K token
Kiểm soát effort—5 mức, mặc định medium
OSWorld 2.1 (sử dụng máy tính)15.7%72.4%
Terminal-Bench 4.00.0%39.2%
GDPval-AA v2.17351620
Humanity's Last Exam (không công cụ)10.2%45.9%

Giá cho mỗi triệu token, với prompt lên đến 100.000 token. Số liệu benchmark do Anthropic báo cáo.

Năng lực tăng mạnh hơn mức giảm giá. Trên OSWorld 2.1, benchmark sử dụng máy tính, Haiku 5.5 đạt 72.4% trong khi Haiku 4.5 chỉ đạt 15.7%. Terminal-Bench 4.0 tăng từ 0.0% lên 39.2%. Công việc từng cần mô hình tầm trung với giá cao gấp 20 lần giờ đã phù hợp với dòng Haiku.

Giải thích giá​

Haiku 5.5 khác biệt với các mô hình Claude còn lại ở một điểm: giá dựa trên độ dài prompt.

  • Prompt dưới 100.000 token: $0.10 đầu vào, $0.50 đầu ra, $0.01 đọc cache — cho mỗi triệu token.
  • Prompt trên 100.000 token: $0.50 đầu vào, $2.50 đầu ra, $0.05 đọc cache.

Các mô hình Claude khác tính giá một mức cho toàn bộ cửa sổ context. Haiku 5.5 là ngoại lệ, nên mọi ngân sách token cần tính lại.

Phần lớn khối lượng công việc không vượt qua giới hạn này. Anthropic cho biết 90% request Haiku 4.5 nằm dưới 100.000 token, nên hưởng trọn mức giảm giá 90%. Vì Haiku 5.5 dùng tokenizer mới của dòng Claude — cùng một đoạn text sẽ tính khoảng 30% token nhiều hơn so với Haiku 4.5 — Anthropic ước tính mức giảm chi phí trung bình khoảng 75% thay vì 90%.

Số cần nhấn mạnh là $0.01 đọc cache. Vòng lặp agent tiêu tốn phần lớn ngân sách đầu vào để đọc lại context đã gửi; với một cent cho mỗi triệu token, duy trì cuộc trò chuyện dài gần như không tốn gì.

Giá Claude Haiku 5.5: $0.10 cho mỗi triệu token đầu vào với prompt tối đa 100.000 token, giảm 90% so với Haiku 4.5

Những thay đổi khác​

Tư duy thích ứng, thêm điều chỉnh effort. Haiku 5.5 là phiên bản Haiku đầu tiên nhận tham số effort. Tư duy thích ứng với nhiệm vụ theo mặc định, và năm mức effort — low, medium, high, xhigh, max, mặc định medium — cho phép cân bằng chi phí và tốc độ với chất lượng phản hồi. Ở mức effort thấp, mô hình bỏ qua tư duy với yêu cầu đơn giản.

Context 1M token, đầu ra tối đa 128K. Cửa sổ context gấp năm lần Haiku 4.5 và trần đầu ra gấp đôi. Một cửa sổ chứa khoảng 555.000 từ, vượt quá hầu hết codebase, transcript hoặc bộ tài liệu cần suy luận trong một lần gọi.

Tokenizer mới. Haiku 5.5 dùng tokenizer giống Claude 4.7 và các mô hình sau đó. Request và response giữ nguyên cấu trúc, nhưng số token tăng với cùng một đoạn text, nên giới hạn max_tokens và ước tính chi phí từng tối ưu cho Haiku 4.5 cần điều chỉnh lại.

Dùng trình duyệt và từ chối quyết đoán hơn. Mô hình hỗ trợ bộ công cụ dùng trình duyệt bên cạnh máy tính, và bộ phân loại an toàn có thể từ chối yêu cầu hoàn toàn — lên kế hoạch cho stop_reason là "refusal" trong client.

Năm thay đổi lớn trước khi di chuyển​

Haiku 5.5 không chỉ đơn giản thay đổi model ID cho code đang chạy trên Haiku 4.5. Hướng dẫn di chuyển của Anthropic liệt kê các thay đổi; đây là năm điểm phá vỡ request cũ.

  1. Ngân sách tư duy thủ công bị từ chối. thinking: {"type": "enabled", "budget_tokens": N} trả về 400. Dùng tư duy thích ứng và điều chỉnh độ sâu bằng effort. Text tư duy mặc định bị loại bỏ, nên đặt thinking.display là "summarized" nếu bạn stream.
  2. Tham số sampling bị từ chối. Bỏ hoàn toàn temperature, top_p, và top_k. Giá trị không mặc định trả về 400 — kể cả top_p: 1.
  3. Assistant prefill bị từ chối. Kết thúc messages bằng lượt user. Để xuất ra có cấu trúc, dùng structured outputs hoặc công cụ phân loại với trường enum thay vì prefill.
  4. Sử dụng máy tính chuyển sang toolset. Thay computer_20250124 bằng computer_toolset_20260801 trên Claude API và Google Cloud.
  5. Thinking block gắn với tài khoản và chỉ thêm mới. Thinking block chỉ hợp lệ trong tài khoản tạo ra và khi mọi thứ trước nó không thay đổi. Giữ cuộc trò chuyện chỉ thêm mới khi gửi thinking block lại.

Một thay đổi nữa diễn ra âm thầm: token tư duy tính vào max_tokens, và response có thể bắt đầu bằng thinking block trước bất kỳ text nào. Chọn block nội dung theo trường type, không theo vị trí, và dành đủ max_tokens cho tư duy.

Hướng dẫn di chuyển đầy đủ nằm ở tài liệu Anthropic.

Gọi Haiku 5.5 trên Felo OpenAPI​

Route đã hoạt động. Đây là toàn bộ tích hợp.

curl https://openapi.felo.ai/api/v1/chat/completions \
-H "Authorization: Bearer $FELO_API_KEY" \
-H "Content-Type: application/json" \
-d '{
"model": "claude-haiku-5-5",
"messages": [
{"role": "user", "content": "Classify this support ticket and extract the order ID."}
]
}'

Felo OpenAPI cung cấp ba surface tương thích, nên bạn giữ nguyên client đang dùng:

SurfaceMethodURL
Chat CompletionsPOSThttps://openapi.felo.ai/api/v1/chat/completions
ResponsesPOSThttps://openapi.felo.ai/api/v1/responses
Messages (tương thích Anthropic)POSThttps://openapi.felo.ai/api/v1/messages

Vì endpoint Messages tương thích Anthropic, client kiểu Claude chỉ cần trỏ base URL về https://openapi.felo.ai/api. SDK bên thứ ba hoạt động tương tự — đặt baseURL là https://openapi.felo.ai/api/v1 và giữ nguyên code hiện tại.

Thêm "stream": true để nhận server-sent events. Route hỗ trợ reasoning, gọi tool, xuất JSON, streaming và vision — giống các mô hình khác trong catalog.

Nếu bạn đã trả phí Felo Pro, bạn đã có quyền truy cập​

Felo Pro bao gồm quyền truy cập API cho các mô hình Felo OpenAPI. Nếu bạn đăng ký, không cần tài khoản thứ hai để gọi Haiku 5.5: tạo API key, trỏ agent về endpoint, và credit Felo hiện tại thanh toán các lần gọi. Một key dùng cho toàn bộ lineup — Haiku 5.5, Sonnet 5.5, Opus 5.5, GPT-6, Grok 4.7 và các mô hình khác.

Hai điểm cần lưu ý:

  • Credit Felo Pro là một pool. Tìm kiếm, agent nghiên cứu, slide, hình ảnh và gọi API đều dùng chung số dư. Gọi mô hình tính theo token, nên dùng API nhiều sẽ tiêu credit nhanh hơn vài lần tìm kiếm mỗi ngày.
  • API tool tách biệt. Gọi mô hình nằm trong quyền Pro; harness tool như Web Fetch, X Search và tạo PPT dùng credit Felo API Platform.

Chưa dùng Pro? Mỗi tài khoản Felo nhận 200 credit miễn phí mỗi ngày, đủ để chạy request thực tế với Haiku 5.5 trước khi quyết định.

Haiku 5.5 phù hợp với công việc nào​

Claude Haiku 5.5 phù hợp với: phân loại khối lượng lớn, trích xuất, và subagent giữa Sonnet 5.5 và Opus 5.5

Haiku 5.5 là route nên chọn khi công việc đơn giản nhưng khối lượng lớn.

  • Subagent và compaction — Anthropic hướng đến tóm tắt, compaction và subagent. Chạy Opus 5.5 hoặc Sonnet 5.5 cho suy luận khó và để Haiku 5.5 xử lý vòng lặp xung quanh với giá chỉ bằng một phần mười.
  • Phân loại, routing, trích xuất khối lượng lớn — chi phí theo token quyết định tính năng có triển khai hay không. Với $0.10 cho mỗi triệu token đầu vào và $0.50 cho mỗi triệu token đầu ra, chi phí cho một lần phân loại không còn là vấn đề ngân sách.
  • Bot hỗ trợ và UX nhạy cảm với độ trễ — route nhanh nhất lineup, thêm điều chỉnh effort để giảm tối đa thời gian phản hồi.
  • Xử lý tài liệu dài — cửa sổ 1M token với giá Haiku cho phép transcript, bộ hợp đồng hoặc log file lớn nằm gọn trong một lần gọi mà không cần hệ thống truy xuất.

Nếu cần trần năng lực suy luận cao nhất, Opus 5.5 vẫn là flagship và cũng có mặt trên Felo OpenAPI. Sonnet 5.5 giữ vai trò cân bằng cho phần lớn workload sản xuất. Haiku 5.5 là mô hình đặt ở mọi nơi ngân sách từng nói không.

Thử ngay​

Haiku 5.5 đã hoạt động trên Felo OpenAPI hôm nay, với giá niêm yết của Anthropic, dùng chính key bạn đang có.

Bắt đầu ở Playground để thử prompt mà không cần viết code, sau đó lấy API key và trỏ agent về endpoint — subagent, phân loại, bot hỗ trợ chỉ cách một model ID để giảm chi phí 90%.

→ Thử Claude Haiku 5.5 trên Felo OpenAPI

→ Tạo API key của bạn


Bài viết này cũng có sẵn bằng English, 简体中文, 日本語, 한국어, 繁體中文, हिन्दी, Français, العربية, Русский, اردو, Bahasa Indonesia, Deutsch, Türkçe, Italiano, ไทย, Español, বাংলা and Português.