Claude Haiku 5.5 अब Felo OpenAPI पर उपलब्ध
Anthropic का सबसे सस्ता, सबसे तेज़ मॉडल लॉन्च के दिन Felo OpenAPI पर आया। $0.10/$0.50 प्रति मिलियन टोकन, 1M कॉन्टेक्स्ट, अनुकूल सोच — एक API कुंजी।
Anthropic ने Claude Haiku 5.5 को 7 अक्टूबर, 2026 को जारी किया। आप इसे आज कॉल कर सकते हैं।
Felo OpenAPI ने लॉन्च के दिन claude-haiku-5-5 रूट जोड़ा, Anthropic की सूची कीमत पर: $0.10 प्रति मिलियन इनपुट टोकन और $0.50 प्रति मिलियन आउटपुट टोकन, 100,000 टोकन तक के प्रॉम्प्ट के लिए। यह Haiku 4.5 से 90% सस्ता है, जिससे Claude 5.5 परिवार का सबसे तेज़ मॉडल चलाने में सबसे कम खर्च आता है।
Felo OpenAPI पर Claude Haiku 5.5 आज़माएं: https://openapi.felo.ai/models/anthropic/claude-haiku-5.5

यह रिलीज़ क्यों महत्वपूर्ण है
हर Haiku सस्ता रहा है। यह पहला ऐसा मॉडल है जो एजेंट लूप चला सकता है और कमजोर कड़ी नहीं बनता।
Anthropic ने Haiku 5.5 को अब तक का सबसे सस्ता, सबसे तेज़ और सबसे सक्षम छोटा मॉडल बताया है। बेंचमार्क इस दावे को मजबूत बनाते हैं। तुलना करें:
| Claude Haiku 4.5 | Claude Haiku 5.5 | |
|---|---|---|
| इनपुट / आउटपुट | $1 / $5 | $0.10 / $0.50 |
| कैश रीड | $0.10 | $0.01 |
| कॉन्टेक्स्ट / अधिकतम आउटपुट | 200K / 64K टोकन | 1M / 128K टोकन |
| प्रयास नियंत्रण | — | 5 स्तर, डिफ़ॉल्ट मीडियम |
| OSWorld 2.1 (कंप्यूटर उपयोग) | 15.7% | 72.4% |
| Terminal-Bench 4.0 | 0.0% | 39.2% |
| GDPval-AA v2.1 | 735 | 1620 |
| Humanity's Last Exam (कोई टूल नहीं) | 10.2% | 45.9% |
प्रति मिलियन टोकन की कीमतें, 100,000 टोकन तक के प्रॉम्प्ट के लिए। बेंचमार्क आंकड़े Anthropic द्वारा रिपोर्ट किए गए।
क्षमता में वृद्धि कीमत में कटौती से बड़ी है। OSWorld 2.1 पर, Haiku 5.5 ने 72.4% स्कोर किया, जबकि Haiku 4.5 ने 15.7%। Terminal-Bench 4.0 0.0% से 39.2% तक गया। पहले जो काम मिड-टियर मॉडल पर 20 गुना कीमत में होता था, अब Haiku लाइन पर फिट हो जाता है।
कीमत कैसे काम करती है
Haiku 5.5 Claude परिवार के बाकी मॉडल से एक तरह से अलग है: इसकी कीमत प्रॉम्प्ट की लंबाई पर निर्भर करती है।
- 100,000 टोकन तक के प्रॉम्प्ट: $0.10 इनपुट, $0.50 आउटपुट, $0.01 कैश रीड — प्रति मिलियन टोकन।
- 100,000 टोकन से अधिक के प्रॉम्प्ट: $0.50 इनपुट, $2.50 आउटपुट, $0.05 कैश रीड।
बाकी सभी Claude मॉडल पूरे कॉन्टेक्स्ट विंडो पर एक ही दर लेते हैं। Haiku 5.5 अपवाद है, इसलिए टोकन में बजट बनाते समय फिर से गणना करें।
अधिकांश कामों में यह सीमा नहीं आती। Anthropic के अनुसार, Haiku 4.5 की 90% रिक्वेस्ट 100,000 टोकन से कम रहती हैं, इसलिए वे पूरी 90% कटौती पाते हैं। Haiku 5.5 परिवार का नया टोकनाइज़र इस्तेमाल करता है — वही टेक्स्ट Haiku 4.5 की तुलना में लगभग 30% अधिक टोकन बनाता है — इसलिए औसत लागत में कमी लगभग 75% है, पूरी 90% नहीं।
$0.01 कैश रीड सबसे महत्वपूर्ण संख्या है। एजेंट लूप अपना अधिकांश इनपुट बजट उसी कॉन्टेक्स्ट को फिर से पढ़ने में खर्च करते हैं; प्रति मिलियन टोकन एक सेंट में लंबी बातचीत चालू रखना लगभग मुफ्त है।

और क्या बदला
अनुकूल सोच, अब प्रयास डायल के साथ। Haiku 5.5 पहला Haiku है जो effort पैरामीटर स्वीकार करता है। सोच डिफ़ॉल्ट रूप से कार्य के अनुसार बदलती है, और पांच प्रयास स्तर — low, medium, high, xhigh, max, डिफ़ॉल्ट medium — लागत और गति को प्रतिक्रिया गुणवत्ता के साथ बदलने देते हैं। कम प्रयास पर, मॉडल साधारण अनुरोधों पर सोच को पूरी तरह छोड़ देता है।
1M टोकन कॉन्टेक्स्ट, 128K अधिकतम आउटपुट। Haiku 4.5 की तुलना में पांच गुना बड़ा कॉन्टेक्स्ट विंडो और दोगुना आउटपुट सीमा। एक विंडो में लगभग 555,000 शब्द आते हैं, जो अधिकांश कोडबेस, ट्रांसक्रिप्ट या दस्तावेज़ सेट के लिए पर्याप्त है।
नया टोकनाइज़र। Haiku 5.5 Claude 4.7 और बाद के मॉडल जैसा ही टोकनाइज़र इस्तेमाल करता है। अनुरोध और उत्तर का रूप वही रहता है, लेकिन उपयोग की गिनती वही टेक्स्ट पर अधिक होती है, इसलिए Haiku 4.5 पर ट्यून किए गए max_tokens सीमा और लागत अनुमान फिर से सेट करें।
ब्राउज़र उपयोग और कड़े इनकार। मॉडल ब्राउज़र-यूज़ टूलसेट को कंप्यूटर उपयोग के साथ सपोर्ट करता है, और इसके सुरक्षा क्लासिफायर अनुरोध को पूरी तरह अस्वीकार कर सकते हैं — अपने क्लाइंट में "refusal" के stop_reason की योजना बनाएं।
माइग्रेट करने से पहले पांच ब्रेकिंग बदलाव
Haiku 5.5 Haiku 4.5 पर चल रहे कोड के लिए सिर्फ मॉडल ID बदलने से काम नहीं करता। Anthropic की माइग्रेशन गाइड बदलावों की सूची देती है; ये पांच मौजूदा अनुरोधों को प्रभावित करते हैं।
- मैनुअल सोच बजट अस्वीकार किए जाते हैं।
thinking: {"type": "enabled", "budget_tokens": N}400 लौटाता है। अनुकूल सोच इस्तेमाल करें और गहराईeffortसे नियंत्रित करें। सोच का टेक्स्ट अब डिफ़ॉल्ट रूप से नहीं आता, इसलिए यदि आप स्ट्रीम करते हैं तोthinking.displayको"summarized"सेट करें। - सैंपलिंग पैरामीटर अस्वीकार किए जाते हैं।
temperature,top_p, औरtop_kपूरी तरह छोड़ दें। कोई भी गैर-डिफ़ॉल्ट मान 400 लौटाता है —top_p: 1भी। - असिस्टेंट प्रीफिल अस्वीकार किया जाता है।
messagesको यूज़र टर्न पर समाप्त करें। संरचित आउटपुट के लिए प्रीफिल ट्रिक्स की बजाय संरचित आउटपुट या क्लासिफिकेशन टूल्स के enum फील्ड इस्तेमाल करें। - कंप्यूटर उपयोग टूलसेट में चला गया। Claude API और Google Cloud पर
computer_20250124की जगहcomputer_toolset_20260801इस्तेमाल करें। - सोच ब्लॉक अकाउंट-बाउंड और केवल जोड़ने योग्य हैं। सोच ब्लॉक केवल उसी अकाउंट में मान्य रहता है जिसने उसे बनाया और जब तक उसके पहले सब कुछ अपरिवर्तित है। बातचीत केवल जोड़ें जब आप सोच ब्लॉक वापस भेजें।
एक बदलाव चुपचाप आता है: सोच टोकन max_tokens में गिने जाते हैं, और उत्तर किसी टेक्स्ट से पहले सोच ब्लॉक से शुरू हो सकता है। कंटेंट ब्लॉक उनके type फील्ड से चुनें, पोजीशन से नहीं, और max_tokens में सोच के लिए जगह रखें।
पूरी माइग्रेशन गाइड Anthropic के docs पर है।
Felo OpenAPI पर Haiku 5.5 कॉल करना
रूट लाइव है। पूरी इंटीग्रेशन यहां है।
curl https://openapi.felo.ai/api/v1/chat/completions \
-H "Authorization: Bearer $FELO_API_KEY" \
-H "Content-Type: application/json" \
-d '{
"model": "claude-haiku-5-5",
"messages": [
{"role": "user", "content": "Classify this support ticket and extract the order ID."}
]
}'
Felo OpenAPI तीन संगत सतहें देता है, जिससे आप वही क्लाइंट इस्तेमाल कर सकते हैं:
| सतह | विधि | URL |
|---|---|---|
| चैट कंप्लीशन | POST | https://openapi.felo.ai/api/v1/chat/completions |
| उत्तर | POST | https://openapi.felo.ai/api/v1/responses |
| संदेश (Anthropic-संगत) | POST | https://openapi.felo.ai/api/v1/messages |
क्योंकि Messages एंडपॉइंट Anthropic-संगत है, Claude-स्टाइल क्लाइंट्स को केवल बेस URL https://openapi.felo.ai/api पर सेट करना होता है। थर्ड-पार्टी SDK भी इसी तरह काम करते हैं — baseURL को https://openapi.felo.ai/api/v1 पर सेट करें और मौजूदा कोड रखें।
सर्वर-सेंट इवेंट्स के लिए "stream": true" जोड़ें। रूट में रीजनिंग, टूल कॉलिंग, JSON आउटपुट, स्ट्रीमिंग और विज़न सपोर्ट है — कैटलॉग की बाकी सतहों जैसा।
अगर आप Felo Pro के लिए भुगतान करते हैं, तो आपको पहले से एक्सेस है
Felo Pro में Felo OpenAPI मॉडल्स के लिए API एक्सेस शामिल है। अगर आप सब्सक्राइब करते हैं, तो Haiku 5.5 कॉल करने के लिए दूसरा अकाउंट नहीं चाहिए: API कुंजी बनाएं, अपने एजेंट को एंडपॉइंट पर पॉइंट करें, और मौजूदा Felo क्रेडिट्स कॉल्स कवर करते हैं। वही कुंजी पूरे लाइनअप में काम करती है — Haiku 5.5, Sonnet 5.5, Opus 5.5, GPT-6, Grok 4.7, और बाकी।
दो बातें ध्यान रखें:
- Felo Pro क्रेडिट्स एक पूल हैं। सर्च, रिसर्च एजेंट्स, स्लाइड्स, इमेजेस, और API कॉल्स सभी एक ही बैलेंस से चलते हैं। मॉडल कॉल्स टोकन के हिसाब से बिल होते हैं, इसलिए भारी API उपयोग कुछ सर्च की तुलना में क्रेडिट्स तेज़ खर्च करता है।
- टूल APIs अलग हैं। मॉडल कॉल्स आपके Pro एक्सेस में कवर हैं; Web Fetch, X Search, और PPT जनरेशन जैसे टूल्स Felo API Platform क्रेडिट्स पर चलते हैं।
अभी Pro पर नहीं हैं? हर Felo अकाउंट को 200 मुफ्त क्रेडिट्स रोज़ मिलते हैं, जिससे आप Haiku 5.5 पर असली अनुरोध चला सकते हैं।
Haiku 5.5 कहाँ फिट बैठता है

Haiku 5.5 तब चुनें जब काम साधारण हो लेकिन वॉल्यूम अधिक हो।
- सबएजेंट्स और संक्षिप्तीकरण — Anthropic सीधे समरी, संक्षिप्तीकरण, और सबएजेंट काम की ओर इशारा करता है। कठिन रीजनिंग के लिए Opus 5.5 या Sonnet 5.5 चलाएं और Haiku 5.5 को लूप पर चलाएं, दसवें हिस्से की कीमत में।
- उच्च-वॉल्यूम क्लासिफिकेशन, रूटिंग, और एक्सट्रैक्शन — प्रति टोकन लागत तय करती है कि ये फीचर्स आएंगे या नहीं। $0.10 प्रति मिलियन इनपुट टोकन और $0.50 प्रति मिलियन आउटपुट टोकन पर, एक और क्लासिफिकेशन की लागत बजट सवाल नहीं बनती।
- सपोर्ट बॉट्स और लेटेंसी-सेंसिटिव UX — लाइनअप में सबसे तेज़ रूट, अब प्रयास डायल के साथ अंतिम मिलीसेकंड घटाने के लिए।
- लंबे दस्तावेज़ों पर काम — Haiku कीमतों पर 1M विंडो का मतलब है पूरे ट्रांसक्रिप्ट, कॉन्ट्रैक्ट सेट, या लॉग फाइल एक कॉल में फिट हो जाते हैं, बिना रिट्रीवल की ज़रूरत।
अगर आपको कठिन रीजनिंग की सबसे ऊँची सीमा चाहिए, Opus 5.5 अभी भी फ्लैगशिप है और Felo OpenAPI पर उपलब्ध है। Sonnet 5.5 अधिकांश प्रोडक्शन कामों के लिए संतुलन बिंदु है। Haiku 5.5 वह मॉडल है जिसे आप वहां लगाते हैं जहां बजट पहले मना करता था।
अभी आज़माएं
Haiku 5.5 आज Felo OpenAPI पर लाइव है, Anthropic की सूची कीमत पर, उसी कुंजी के पीछे जो आपके पास है।
Playground में बिना कोड लिखे प्रॉम्प्ट टेस्ट करें, फिर API कुंजी लें और अपने एजेंट को एंडपॉइंट पर पॉइंट करें — सबएजेंट्स, क्लासिफायर, और सपोर्ट बॉट्स एक मॉडल ID दूर हैं, 90% कम लागत में।
→ Felo OpenAPI पर Claude Haiku 5.5 आज़माएं
यह पोस्ट इन भाषाओं में भी उपलब्ध है: English, 简体中文, 日本語, 한국어, 繁體中文, Français, العربية, Русский, اردو, Bahasa Indonesia, Deutsch, Tiếng Việt, Türkçe, Italiano, ไทย, Español, বাংলা and Português।