Claude Haiku 5.5 เปิดให้ใช้งานแล้วบน Felo OpenAPI
โมเดลที่ถูกและเร็วที่สุดของ Anthropic เปิดตัวบน Felo OpenAPI ในวันแรก ราคา $0.10/$0.50 ต่อหนึ่งล้านโทเคน, คอนเท็กซ์ 1M, การคิดแบบปรับได้ — ใช้คีย์ API เดียว
Anthropic เปิดตัว Claude Haiku 5.5 เมื่อวันที่ 7 ตุลาคม 2026 สามารถเรียกใช้งานได้ทันที
Felo OpenAPI เพิ่มเส้นทาง claude-haiku-5-5 ในวันเปิดตัว โดยใช้ราคาตามที่ Anthropic กำหนด: $0.10 ต่อหนึ่งล้านโทเคนอินพุต และ $0.50 ต่อหนึ่งล้านโทเคนเอาต์พุต สำหรับพรอมต์สูงสุด 100,000 โทเคน ราคานี้ถูกกว่า Haiku 4.5 ถึง 90% ทำให้โมเดลที่เร็วที่สุดในตระกูล Claude 5.5 กลายเป็นตัวเลือกที่ประหยัดที่สุด
ทดลองใช้ Claude Haiku 5.5 บน Felo OpenAPI: https://openapi.felo.ai/models/anthropic/claude-haiku-5.5

เหตุผลที่การเปิดตัวนี้สำคัญ
Haiku ทุกรุ่นมีราคาถูก รุ่นนี้สามารถรัน agent loop โดยไม่เป็นจุดอ่อน
Anthropic ระบุว่า Haiku 5.5 เป็นโมเดลขนาดเล็กที่ถูก เร็ว และมีความสามารถสูงสุดที่เคยเปิดตัว ผลการทดสอบยืนยันข้ออ้างนี้ เปรียบเทียบกับรุ่นก่อนหน้า:
| Claude Haiku 4.5 | Claude Haiku 5.5 | |
|---|---|---|
| อินพุต / เอาต์พุต | $1 / $5 | $0.10 / $0.50 |
| อ่านแคช | $0.10 | $0.01 |
| คอนเท็กซ์ / เอาต์พุตสูงสุด | 200K / 64K โทเคน | 1M / 128K โทเคน |
| ควบคุมความพยายาม | — | 5 ระดับ, ค่าเริ่มต้น medium |
| OSWorld 2.1 (ใช้งานคอมพิวเตอร์) | 15.7% | 72.4% |
| Terminal-Bench 4.0 | 0.0% | 39.2% |
| GDPval-AA v2.1 | 735 | 1620 |
| Humanity's Last Exam (ไม่มีเครื่องมือ) | 10.2% | 45.9% |
ราคาต่อหนึ่งล้านโทเคน สำหรับพรอมต์สูงสุด 100,000 โทเคน ตัวเลข benchmark ตามที่ Anthropic รายงาน
ความสามารถเพิ่มขึ้นมากกว่าการลดราคา ใน OSWorld 2.1 ซึ่งเป็น benchmark การใช้คอมพิวเตอร์ Haiku 5.5 ได้คะแนน 72.4% ขณะที่ Haiku 4.5 ได้ 15.7% Terminal-Bench 4.0 เพิ่มจาก 0.0% เป็น 39.2% งานที่เคยต้องใช้โมเดลระดับกลางราคาแพงกว่า 20 เท่า ตอนนี้รันบน Haiku ได้
อธิบายราคา
Haiku 5.5 แตกต่างจากตระกูล Claude รุ่นอื่นตรงที่คิดราคาตามความยาวพรอมต์
- พรอมต์ไม่เกิน 100,000 โทเคน: $0.10 อินพุต, $0.50 เอาต์พุต, $0.01 อ่านแคช — ต่อหนึ่งล้านโทเคน
- พรอมต์เกิน 100,000 โทเคน: $0.50 อินพุต, $2.50 เอาต์พุต, $0.05 อ่านแคช
Claude รุ่นอื่นคิดราคาเดียวตลอดหน้าต่างคอนเท็กซ์ Haiku 5.5 เป็นข้อยกเว้น ดังนั้นการวางงบโทเคนควรคำนวณใหม่
สำหรับงานส่วนใหญ่ ขอบเขตนี้ไม่เกิดปัญหา Anthropic ระบุว่า 90% ของคำขอ Haiku 4.5 อยู่ต่ำกว่า 100,000 โทเคน จึงได้รับส่วนลดเต็ม 90% และเนื่องจาก Haiku 5.5 ใช้ tokenizer ใหม่ของตระกูลเดียวกัน — ข้อความเดียวกันนับโทเคนมากขึ้นประมาณ 30% เมื่อเทียบกับ Haiku 4.5 — Anthropic ประเมินว่าค่าใช้จ่ายเฉลี่ยลดลงประมาณ 75% ไม่ใช่ 90% เต็ม
ตัวเลขที่ควรเน้นคือ $0.01 อ่านแคช Agent loop ใช้งบอินพุตส่วนใหญ่ไปกับการอ่านคอนเท็กซ์ซ้ำที่เคยส่งแล้ว ที่ราคาเซ็นต์เดียวต่อหนึ่งล้านโทเคน การรักษาบทสนทนายาวมีค่าใช้จ่ายต่ำมาก

มีอะไรเปลี่ยนแปลงอีก
การคิดแบบปรับได้ พร้อมตัวปรับความพยายาม Haiku 5.5 เป็น Haiku รุ่นแรกที่รับพารามิเตอร์ effort การคิดปรับตามงานโดยอัตโนมัติ และมี 5 ระดับ — low, medium, high, xhigh, max โดย medium เป็นค่าเริ่มต้น — สามารถแลกคุณภาพกับต้นทุนและความเร็ว ระดับ effort ต่ำ โมเดลข้ามการคิดในคำขอที่ง่าย
คอนเท็กซ์ 1M โทเคน, เอาต์พุตสูงสุด 128K หน้าต่างคอนเท็กซ์ใหญ่กว่า Haiku 4.5 ถึง 5 เท่า และเพดานเอาต์พุตเพิ่มเป็นสองเท่า หน้าต่างเดียวรองรับข้อความประมาณ 555,000 คำ มากกว่าฐานโค้ด, ทรานสคริปต์ หรือชุดเอกสารที่ต้องการวิเคราะห์ในคำขอเดียว
Tokenizer ใหม่ Haiku 5.5 ใช้ tokenizer เดียวกับ Claude 4.7 และรุ่นหลัง คำขอและคำตอบมีรูปแบบเหมือนเดิม แต่จำนวนโทเคนสูงขึ้นสำหรับข้อความเดียวกัน ดังนั้นขีดจำกัด max_tokens และประมาณการค่าใช้จ่ายที่ปรับกับ Haiku 4.5 ต้องปรับใหม่
ใช้งาน browser และปฏิเสธคำขอเด็ดขาด โมเดลรองรับเครื่องมือ browser-use พร้อมกับ computer use และตัวจัดประเภทความปลอดภัยสามารถปฏิเสธคำขอทันที — เตรียมรับ stop_reason เป็น "refusal" ใน client
5 การเปลี่ยนแปลงสำคัญก่อนย้ายมาใช้
Haiku 5.5 ไม่ใช่แค่เปลี่ยน model ID สำหรับโค้ดที่รันบน Haiku 4.5 คู่มือการย้ายของ Anthropic ระบุการเปลี่ยนแปลงเหล่านี้ นี่คือ 5 ข้อที่ทำให้คำขอเดิมใช้ไม่ได้
- งบการคิดแบบ manual ถูกปฏิเสธ
thinking: {"type": "enabled", "budget_tokens": N}ส่งกลับ 400 ใช้การคิดแบบ adaptive และปรับความลึกด้วยeffortข้อความการคิดถูกละไว้เป็นค่าเริ่มต้น หากต้องการ stream ให้ตั้งthinking.displayเป็น"summarized" - พารามิเตอร์ sampling ถูกปฏิเสธ ละ
temperature,top_p, และtop_kทั้งหมด ค่าใดที่ไม่ใช่ค่าเริ่มต้นส่งกลับ 400 — รวมถึงtop_p: 1 - Assistant prefill ถูกปฏิเสธ จบ
messagesด้วย user turn สำหรับ output แบบมีโครงสร้าง ใช้ structured outputs หรือเครื่องมือ classification ที่มี enum field แทน prefill - Computer use ย้ายไป toolset แทนที่
computer_20250124ด้วยcomputer_toolset_20260801บน Claude API และ Google Cloud - Thinking block ผูกกับบัญชีและเพิ่มได้เท่านั้น Thinking block ใช้งานได้เฉพาะในบัญชีที่สร้าง และเฉพาะเมื่อทุกอย่างก่อนหน้านั้นไม่เปลี่ยน ส่ง thinking block กลับต้องรักษาบทสนทนาแบบ append-only
อีกข้อเปลี่ยนแปลงแบบเงียบ: thinking token นับรวมใน max_tokens และคำตอบสามารถเริ่มด้วย thinking block ก่อนข้อความใดๆ เลือก content block ด้วย field type ไม่ใช่ตำแหน่ง และให้ max_tokens มีพื้นที่สำหรับการคิด
คู่มือการย้ายฉบับเต็มอยู่ที่ เอกสารของ Anthropic
เรียกใช้ Haiku 5.5 บน Felo OpenAPI
เส้นทางเปิดใช้งานแล้ว นี่คือการเชื่อมต่อทั้งหมด
curl https://openapi.felo.ai/api/v1/chat/completions \
-H "Authorization: Bearer $FELO_API_KEY" \
-H "Content-Type: application/json" \
-d '{
"model": "claude-haiku-5-5",
"messages": [
{"role": "user", "content": "Classify this support ticket and extract the order ID."}
]
}'
Felo OpenAPI มีสาม surface ที่เข้ากันได้ สามารถใช้ client เดิมที่มีอยู่:
| Surface | Method | URL |
|---|---|---|
| Chat Completions | POST | https://openapi.felo.ai/api/v1/chat/completions |
| Responses | POST | https://openapi.felo.ai/api/v1/responses |
| Messages (Anthropic-compatible) | POST | https://openapi.felo.ai/api/v1/messages |
เนื่องจาก endpoint Messages เข้ากันกับ Anthropic client แบบ Claude แค่เปลี่ยน base URL เป็น https://openapi.felo.ai/api SDK ของ third-party ใช้งานเหมือนกัน — ตั้ง baseURL เป็น https://openapi.felo.ai/api/v1 และใช้โค้ดเดิม
เพิ่ม "stream": true เพื่อรับ server-sent events เส้นทางนี้รองรับ reasoning, tool calling, JSON output, streaming และ vision — surface เดียวกับโมเดลอื่นในแคตตาล็อก
หากสมัคร Felo Pro อยู่แล้ว สามารถใช้งานได้ทันที
Felo Pro รวมการเข้าถึง API ของ Felo OpenAPI หากสมัครสมาชิก ไม่ต้องสร้างบัญชีใหม่เพื่อเรียก Haiku 5.5 สร้าง API key ชี้ agent ไปที่ endpoint และเครดิต Felo ที่มีอยู่ครอบคลุมทุกคำขอ คีย์เดียวใช้กับทุกโมเดล — Haiku 5.5, Sonnet 5.5, Opus 5.5, GPT-6, Grok 4.7 และอื่นๆ
สองเรื่องที่ควรแยกให้ชัด:
- เครดิต Felo Pro ใช้ร่วมกัน Search, agent วิจัย, สไลด์, รูปภาพ และ API call ใช้เครดิตจากยอดเดียว การเรียกโมเดลคิดตามโทเคน ดังนั้นการใช้ API หนักจะใช้เครดิตเร็วกว่าการค้นหาวันละไม่กี่ครั้ง
- API เครื่องมือแยกต่างหาก การเรียกโมเดลครอบคลุมโดย Pro เครื่องมืออย่าง Web Fetch, X Search และสร้าง PPT ใช้เครดิต Felo API Platform
ยังไม่ได้สมัคร Pro? ทุกบัญชี Felo ได้รับ เครดิตฟรี 200 ต่อวัน เพียงพอสำหรับคำขอจริงกับ Haiku 5.5 ก่อนตัดสินใจ
ตำแหน่งของ Haiku 5.5

Haiku 5.5 เหมาะกับงานที่ไม่ซับซ้อนแต่มีปริมาณสูง
- Subagent และ compaction — Anthropic ชี้ไปที่งานสรุป, ย่อ, และ subagent โดยตรง รัน Opus 5.5 หรือ Sonnet 5.5 กับงาน reasoning ที่ยาก แล้วให้ Haiku 5.5 จัดการ loop รอบข้างในราคาหนึ่งในสิบ
- งาน classification, routing, extraction ปริมาณสูง — ราคาต่อโทเคนตัดสินว่าฟีเจอร์เหล่านี้จะเปิดใช้งานหรือไม่ ที่ $0.10 ต่อหนึ่งล้านโทเคนอินพุต และ $0.50 ต่อหนึ่งล้านโทเคนเอาต์พุต ต้นทุนการ classification เพิ่มอีกหนึ่งครั้งไม่เป็นปัญหางบประมาณ
- บอทซัพพอร์ตและ UX ที่ต้องการความเร็ว — เส้นทางที่เร็วที่สุดในกลุ่ม พร้อม effort dial สำหรับลดเวลาตอบสนอง
- งานเอกสารยาว — หน้าต่าง 1M โทเคนในราคาของ Haiku รองรับ transcript, ชุดสัญญา หรือ log file ทั้งหมดในคำขอเดียวโดยไม่ต้องดึงข้อมูล
หากต้องการ reasoning ระดับสูงสุด Opus 5.5 ยังเป็นเรือธงและอยู่บน Felo OpenAPI เช่นกัน Sonnet 5.5 เป็นจุดสมดุลสำหรับงาน production ส่วนใหญ่ Haiku 5.5 คือโมเดลที่ใช้ในทุกที่ที่งบประมาณเคยเป็นข้อจำกัด
ทดลองใช้งานได้ทันที
Haiku 5.5 เปิดให้ใช้งานบน Felo OpenAPI แล้ว ในราคาตาม Anthropic ใช้คีย์ที่มีอยู่
เริ่มที่ Playground เพื่อทดสอบพรอมต์โดยไม่ต้องเขียนโค้ด จากนั้นสร้าง API key และชี้ agent ไปที่ endpoint — subagent, classifier และบอทซัพพอร์ตเปลี่ยน model ID ก็ลดต้นทุนลง 90%
→ ทดลองใช้ Claude Haiku 5.5 บน Felo OpenAPI
บทความนี้มีให้อ่านในภาษาต่อไปนี้ด้วย: English, 简体中文, 日本語, 한국어, 繁體中文, हिन्दी, Français, العربية, Русский, اردو, Bahasa Indonesia, Deutsch, Tiếng Việt, Türkçe, Italiano, Español, বাংলা and Português