Skip to main content

Claude Haiku 5.5 अब Felo OpenAPI पर उपलब्ध

· 10 मिनट पढ़ें
Felo Search Tips Buddy
Committed to answers at your fingertips

Anthropic का सबसे सस्ता, सबसे तेज़ मॉडल लॉन्च के दिन Felo OpenAPI पर आया। $0.10/$0.50 प्रति मिलियन टोकन, 1M कॉन्टेक्स्ट, अनुकूल सोच — एक API कुंजी।

Anthropic ने Claude Haiku 5.5 को 7 अक्टूबर, 2026 को जारी किया। आप इसे आज कॉल कर सकते हैं।

Felo OpenAPI ने लॉन्च के दिन claude-haiku-5-5 रूट जोड़ा, Anthropic की सूची कीमत पर: $0.10 प्रति मिलियन इनपुट टोकन और $0.50 प्रति मिलियन आउटपुट टोकन, 100,000 टोकन तक के प्रॉम्प्ट के लिए। यह Haiku 4.5 से 90% सस्ता है, जिससे Claude 5.5 परिवार का सबसे तेज़ मॉडल चलाने में सबसे कम खर्च आता है।

Felo OpenAPI पर Claude Haiku 5.5 आज़माएं: https://openapi.felo.ai/models/anthropic/claude-haiku-5.5

Claude Haiku 5.5 on Felo OpenAPI: Anthropic का सबसे तेज़ Haiku रूट, Haiku 4.5 से 90% सस्ता

यह रिलीज़ क्यों महत्वपूर्ण है​

हर Haiku सस्ता रहा है। यह पहला ऐसा मॉडल है जो एजेंट लूप चला सकता है और कमजोर कड़ी नहीं बनता।

Anthropic ने Haiku 5.5 को अब तक का सबसे सस्ता, सबसे तेज़ और सबसे सक्षम छोटा मॉडल बताया है। बेंचमार्क इस दावे को मजबूत बनाते हैं। तुलना करें:

Claude Haiku 4.5Claude Haiku 5.5
इनपुट / आउटपुट$1 / $5$0.10 / $0.50
कैश रीड$0.10$0.01
कॉन्टेक्स्ट / अधिकतम आउटपुट200K / 64K टोकन1M / 128K टोकन
प्रयास नियंत्रण—5 स्तर, डिफ़ॉल्ट मीडियम
OSWorld 2.1 (कंप्यूटर उपयोग)15.7%72.4%
Terminal-Bench 4.00.0%39.2%
GDPval-AA v2.17351620
Humanity's Last Exam (कोई टूल नहीं)10.2%45.9%

प्रति मिलियन टोकन की कीमतें, 100,000 टोकन तक के प्रॉम्प्ट के लिए। बेंचमार्क आंकड़े Anthropic द्वारा रिपोर्ट किए गए।

क्षमता में वृद्धि कीमत में कटौती से बड़ी है। OSWorld 2.1 पर, Haiku 5.5 ने 72.4% स्कोर किया, जबकि Haiku 4.5 ने 15.7%। Terminal-Bench 4.0 0.0% से 39.2% तक गया। पहले जो काम मिड-टियर मॉडल पर 20 गुना कीमत में होता था, अब Haiku लाइन पर फिट हो जाता है।

कीमत कैसे काम करती है​

Haiku 5.5 Claude परिवार के बाकी मॉडल से एक तरह से अलग है: इसकी कीमत प्रॉम्प्ट की लंबाई पर निर्भर करती है।

  • 100,000 टोकन तक के प्रॉम्प्ट: $0.10 इनपुट, $0.50 आउटपुट, $0.01 कैश रीड — प्रति मिलियन टोकन।
  • 100,000 टोकन से अधिक के प्रॉम्प्ट: $0.50 इनपुट, $2.50 आउटपुट, $0.05 कैश रीड।

बाकी सभी Claude मॉडल पूरे कॉन्टेक्स्ट विंडो पर एक ही दर लेते हैं। Haiku 5.5 अपवाद है, इसलिए टोकन में बजट बनाते समय फिर से गणना करें।

अधिकांश कामों में यह सीमा नहीं आती। Anthropic के अनुसार, Haiku 4.5 की 90% रिक्वेस्ट 100,000 टोकन से कम रहती हैं, इसलिए वे पूरी 90% कटौती पाते हैं। Haiku 5.5 परिवार का नया टोकनाइज़र इस्तेमाल करता है — वही टेक्स्ट Haiku 4.5 की तुलना में लगभग 30% अधिक टोकन बनाता है — इसलिए औसत लागत में कमी लगभग 75% है, पूरी 90% नहीं।

$0.01 कैश रीड सबसे महत्वपूर्ण संख्या है। एजेंट लूप अपना अधिकांश इनपुट बजट उसी कॉन्टेक्स्ट को फिर से पढ़ने में खर्च करते हैं; प्रति मिलियन टोकन एक सेंट में लंबी बातचीत चालू रखना लगभग मुफ्त है।

Claude Haiku 5.5 कीमत: 100,000 टोकन तक के प्रॉम्प्ट पर $0.10 प्रति मिलियन इनपुट टोकन, और Haiku 4.5 से 90% गिरावट

और क्या बदला​

अनुकूल सोच, अब प्रयास डायल के साथ। Haiku 5.5 पहला Haiku है जो effort पैरामीटर स्वीकार करता है। सोच डिफ़ॉल्ट रूप से कार्य के अनुसार बदलती है, और पांच प्रयास स्तर — low, medium, high, xhigh, max, डिफ़ॉल्ट medium — लागत और गति को प्रतिक्रिया गुणवत्ता के साथ बदलने देते हैं। कम प्रयास पर, मॉडल साधारण अनुरोधों पर सोच को पूरी तरह छोड़ देता है।

1M टोकन कॉन्टेक्स्ट, 128K अधिकतम आउटपुट। Haiku 4.5 की तुलना में पांच गुना बड़ा कॉन्टेक्स्ट विंडो और दोगुना आउटपुट सीमा। एक विंडो में लगभग 555,000 शब्द आते हैं, जो अधिकांश कोडबेस, ट्रांसक्रिप्ट या दस्तावेज़ सेट के लिए पर्याप्त है।

नया टोकनाइज़र। Haiku 5.5 Claude 4.7 और बाद के मॉडल जैसा ही टोकनाइज़र इस्तेमाल करता है। अनुरोध और उत्तर का रूप वही रहता है, लेकिन उपयोग की गिनती वही टेक्स्ट पर अधिक होती है, इसलिए Haiku 4.5 पर ट्यून किए गए max_tokens सीमा और लागत अनुमान फिर से सेट करें।

ब्राउज़र उपयोग और कड़े इनकार। मॉडल ब्राउज़र-यूज़ टूलसेट को कंप्यूटर उपयोग के साथ सपोर्ट करता है, और इसके सुरक्षा क्लासिफायर अनुरोध को पूरी तरह अस्वीकार कर सकते हैं — अपने क्लाइंट में "refusal" के stop_reason की योजना बनाएं।

माइग्रेट करने से पहले पांच ब्रेकिंग बदलाव​

Haiku 5.5 Haiku 4.5 पर चल रहे कोड के लिए सिर्फ मॉडल ID बदलने से काम नहीं करता। Anthropic की माइग्रेशन गाइड बदलावों की सूची देती है; ये पांच मौजूदा अनुरोधों को प्रभावित करते हैं।

  1. मैनुअल सोच बजट अस्वीकार किए जाते हैं। thinking: {"type": "enabled", "budget_tokens": N} 400 लौटाता है। अनुकूल सोच इस्तेमाल करें और गहराई effort से नियंत्रित करें। सोच का टेक्स्ट अब डिफ़ॉल्ट रूप से नहीं आता, इसलिए यदि आप स्ट्रीम करते हैं तो thinking.display को "summarized" सेट करें।
  2. सैंपलिंग पैरामीटर अस्वीकार किए जाते हैं। temperature, top_p, और top_k पूरी तरह छोड़ दें। कोई भी गैर-डिफ़ॉल्ट मान 400 लौटाता है — top_p: 1 भी।
  3. असिस्टेंट प्रीफिल अस्वीकार किया जाता है। messages को यूज़र टर्न पर समाप्त करें। संरचित आउटपुट के लिए प्रीफिल ट्रिक्स की बजाय संरचित आउटपुट या क्लासिफिकेशन टूल्स के enum फील्ड इस्तेमाल करें।
  4. कंप्यूटर उपयोग टूलसेट में चला गया। Claude API और Google Cloud पर computer_20250124 की जगह computer_toolset_20260801 इस्तेमाल करें।
  5. सोच ब्लॉक अकाउंट-बाउंड और केवल जोड़ने योग्य हैं। सोच ब्लॉक केवल उसी अकाउंट में मान्य रहता है जिसने उसे बनाया और जब तक उसके पहले सब कुछ अपरिवर्तित है। बातचीत केवल जोड़ें जब आप सोच ब्लॉक वापस भेजें।

एक बदलाव चुपचाप आता है: सोच टोकन max_tokens में गिने जाते हैं, और उत्तर किसी टेक्स्ट से पहले सोच ब्लॉक से शुरू हो सकता है। कंटेंट ब्लॉक उनके type फील्ड से चुनें, पोजीशन से नहीं, और max_tokens में सोच के लिए जगह रखें।

पूरी माइग्रेशन गाइड Anthropic के docs पर है।

Felo OpenAPI पर Haiku 5.5 कॉल करना​

रूट लाइव है। पूरी इंटीग्रेशन यहां है।

curl https://openapi.felo.ai/api/v1/chat/completions \
-H "Authorization: Bearer $FELO_API_KEY" \
-H "Content-Type: application/json" \
-d '{
"model": "claude-haiku-5-5",
"messages": [
{"role": "user", "content": "Classify this support ticket and extract the order ID."}
]
}'

Felo OpenAPI तीन संगत सतहें देता है, जिससे आप वही क्लाइंट इस्तेमाल कर सकते हैं:

सतहविधिURL
चैट कंप्लीशनPOSThttps://openapi.felo.ai/api/v1/chat/completions
उत्तरPOSThttps://openapi.felo.ai/api/v1/responses
संदेश (Anthropic-संगत)POSThttps://openapi.felo.ai/api/v1/messages

क्योंकि Messages एंडपॉइंट Anthropic-संगत है, Claude-स्टाइल क्लाइंट्स को केवल बेस URL https://openapi.felo.ai/api पर सेट करना होता है। थर्ड-पार्टी SDK भी इसी तरह काम करते हैं — baseURL को https://openapi.felo.ai/api/v1 पर सेट करें और मौजूदा कोड रखें।

सर्वर-सेंट इवेंट्स के लिए "stream": true" जोड़ें। रूट में रीजनिंग, टूल कॉलिंग, JSON आउटपुट, स्ट्रीमिंग और विज़न सपोर्ट है — कैटलॉग की बाकी सतहों जैसा।

अगर आप Felo Pro के लिए भुगतान करते हैं, तो आपको पहले से एक्सेस है​

Felo Pro में Felo OpenAPI मॉडल्स के लिए API एक्सेस शामिल है। अगर आप सब्सक्राइब करते हैं, तो Haiku 5.5 कॉल करने के लिए दूसरा अकाउंट नहीं चाहिए: API कुंजी बनाएं, अपने एजेंट को एंडपॉइंट पर पॉइंट करें, और मौजूदा Felo क्रेडिट्स कॉल्स कवर करते हैं। वही कुंजी पूरे लाइनअप में काम करती है — Haiku 5.5, Sonnet 5.5, Opus 5.5, GPT-6, Grok 4.7, और बाकी।

दो बातें ध्यान रखें:

  • Felo Pro क्रेडिट्स एक पूल हैं। सर्च, रिसर्च एजेंट्स, स्लाइड्स, इमेजेस, और API कॉल्स सभी एक ही बैलेंस से चलते हैं। मॉडल कॉल्स टोकन के हिसाब से बिल होते हैं, इसलिए भारी API उपयोग कुछ सर्च की तुलना में क्रेडिट्स तेज़ खर्च करता है।
  • टूल APIs अलग हैं। मॉडल कॉल्स आपके Pro एक्सेस में कवर हैं; Web Fetch, X Search, और PPT जनरेशन जैसे टूल्स Felo API Platform क्रेडिट्स पर चलते हैं।

अभी Pro पर नहीं हैं? हर Felo अकाउंट को 200 मुफ्त क्रेडिट्स रोज़ मिलते हैं, जिससे आप Haiku 5.5 पर असली अनुरोध चला सकते हैं।

Haiku 5.5 कहाँ फिट बैठता है​

Claude Haiku 5.5 कहाँ फिट बैठता है: Sonnet 5.5 और Opus 5.5 के बीच उच्च-वॉल्यूम क्लासिफिकेशन, एक्सट्रैक्शन, और सबएजेंट काम

Haiku 5.5 तब चुनें जब काम साधारण हो लेकिन वॉल्यूम अधिक हो।

  • सबएजेंट्स और संक्षिप्तीकरण — Anthropic सीधे समरी, संक्षिप्तीकरण, और सबएजेंट काम की ओर इशारा करता है। कठिन रीजनिंग के लिए Opus 5.5 या Sonnet 5.5 चलाएं और Haiku 5.5 को लूप पर चलाएं, दसवें हिस्से की कीमत में।
  • उच्च-वॉल्यूम क्लासिफिकेशन, रूटिंग, और एक्सट्रैक्शन — प्रति टोकन लागत तय करती है कि ये फीचर्स आएंगे या नहीं। $0.10 प्रति मिलियन इनपुट टोकन और $0.50 प्रति मिलियन आउटपुट टोकन पर, एक और क्लासिफिकेशन की लागत बजट सवाल नहीं बनती।
  • सपोर्ट बॉट्स और लेटेंसी-सेंसिटिव UX — लाइनअप में सबसे तेज़ रूट, अब प्रयास डायल के साथ अंतिम मिलीसेकंड घटाने के लिए।
  • लंबे दस्तावेज़ों पर काम — Haiku कीमतों पर 1M विंडो का मतलब है पूरे ट्रांसक्रिप्ट, कॉन्ट्रैक्ट सेट, या लॉग फाइल एक कॉल में फिट हो जाते हैं, बिना रिट्रीवल की ज़रूरत।

अगर आपको कठिन रीजनिंग की सबसे ऊँची सीमा चाहिए, Opus 5.5 अभी भी फ्लैगशिप है और Felo OpenAPI पर उपलब्ध है। Sonnet 5.5 अधिकांश प्रोडक्शन कामों के लिए संतुलन बिंदु है। Haiku 5.5 वह मॉडल है जिसे आप वहां लगाते हैं जहां बजट पहले मना करता था।

अभी आज़माएं​

Haiku 5.5 आज Felo OpenAPI पर लाइव है, Anthropic की सूची कीमत पर, उसी कुंजी के पीछे जो आपके पास है।

Playground में बिना कोड लिखे प्रॉम्प्ट टेस्ट करें, फिर API कुंजी लें और अपने एजेंट को एंडपॉइंट पर पॉइंट करें — सबएजेंट्स, क्लासिफायर, और सपोर्ट बॉट्स एक मॉडल ID दूर हैं, 90% कम लागत में।

→ Felo OpenAPI पर Claude Haiku 5.5 आज़माएं

→ अपनी API कुंजी बनाएं


यह पोस्ट इन भाषाओं में भी उपलब्ध है: English, 简体中文, 日本語, 한국어, 繁體中文, Français, العربية, Русский, اردو, Bahasa Indonesia, Deutsch, Tiếng Việt, Türkçe, Italiano, ไทย, Español, বাংলা and Português।