Skip to main content

Felo OpenAPI पर GPT-6 Astra: 1.05M संदर्भ और एजेंट टूल्स

· 6 मिनट पढ़ें
Felo Search Tips Buddy
Committed to answers at your fingertips

Felo OpenAPI ने GPT-6 Astra को 1.05M संदर्भ विंडो, 128K अधिकतम आउटपुट, और संगत Chat Completions, Responses, और Messages एंडपॉइंट्स के साथ जोड़ा है।

GPT-6 Astra API infographic cover showing 1.05M context, 128K max output, $10 input, and $50 output

लंबे दस्तावेज़, जटिल कोड, और बहु-चरण एजेंट फ्लो टीमों को मॉडल कॉल विभाजित करने के लिए मजबूर करते हैं। Felo OpenAPI GPT-6 Astra प्रदान करता है, जिससे एक मॉडल आईडी इन कार्यभारों को संगत API सतहों के माध्यम से संभाल सकता है।

GPT-6 Astra आज़माएँ: https://openapi.felo.ai/models/openai/gpt-6-astra

GPT-6 Astra किसके लिए बना है

GPT-6 Astra Felo API प्लेटफ़ॉर्म पर प्रमुख GPT-6 स्तर है। OpenAI इसे जटिल तर्क, कोडिंग, कंप्यूटर उपयोग, अनुसंधान, और दस्तावेज़ निर्माण के लिए अपनी सबसे सक्षम मॉडल के रूप में बताता है। Felo मॉडल पृष्ठ में Reasoning, Tools, JSON, Streaming, और Vision क्षमताएँ सूचीबद्ध हैं।

मॉडल आईडी gpt-6-astra का उपयोग करें। संदर्भ विंडो 1,050,000 टोकन है और अधिकतम आउटपुट 128,000 टोकन है। OpenAI ने ज्ञान कटऑफ 30 अप्रैल, 2026 सूचीबद्ध किया है। यह क्षमता एक अनुरोध में विनिर्देश, कोडबेस सारांश, टूल परिभाषाएँ, और वार्तालाप इतिहास को एक कार्य संदर्भ में रखने देती है।

OpenAI ने पाँच तर्क-प्रयास सेटिंग्स सूचीबद्ध की हैं: low, medium, high, xhigh, और max। गुणवत्ता लक्ष्य, विलंबता बजट, और अनुरोध लागत के अनुसार सेटिंग चुनें।

OpenAI की घोषणा के अनुसार GPT-6 Astra Trusted Access Program में उद्यमों के लिए शुरू हुआ है, और Plus, Pro, Business, और Enterprise एक्सेस अगले दिनों में आएगा। Felo OpenAPI उन डेवलपर्स के लिए मॉडल रूट देता है जिन्हें अपने प्लेटफ़ॉर्म के माध्यम से API एक्सेस चाहिए।

तीन प्रोटोकॉल, एक मॉडल आईडी

Felo API प्लेटफ़ॉर्म तीन संगत अनुरोध सतहें प्रदान करता है:

  • Chat Completions: POST https://openapi.felo.ai/api/v1/chat/completions
  • Responses: POST https://openapi.felo.ai/api/v1/responses
  • Messages: POST https://openapi.felo.ai/api/v1/messages

OpenAI-संगत क्लाइंट वाली ऐप अपनी अनुरोध संरचना रख सकती है और model मान को gpt-6-astra में बदल सकती है। Claude-शैली क्लाइंट Anthropic-संगत Messages सतह का उपयोग कर सकते हैं। मॉडल पृष्ठ में Claude Code, Codex, LLM API, और अन्य एजेंट क्लाइंट्स उपयोग के मामलों के रूप में सूचीबद्ध हैं।

बजट में आने वाली कीमतें

वर्तमान Felo मॉडल पृष्ठ में ये दरें सूचीबद्ध हैं:

आइटमदर
इनपुट$10.00 प्रति 1M टोकन
आउटपुट$50.00 प्रति 1M टोकन

पृष्ठ कहता है कि लॉन्च मूल्य निर्धारण आधिकारिक प्रदाता API दरों से 50% तक कम हो सकता है। अंतिम लागत मॉडल, इनपुट/आउटपुट मिश्रण, कैश उपयोग, और सक्रिय योजना पर निर्भर करती है। वर्तमान Felo पृष्ठ में $10.00 / 1M इनपुट टोकन और $50.00 / 1M आउटपुट टोकन सूचीबद्ध हैं। लागत अनुमान में प्रत्येक चर शामिल होता है; मुख्य दर पूरी बिल नहीं है।

OpenAI के मॉडल दस्तावेज़ में मानक दरें $10.00 प्रति 1M इनपुट टोकन, $1.00 प्रति 1M कैश्ड इनपुट टोकन, और $50.00 प्रति 1M आउटपुट टोकन सूचीबद्ध हैं। कैश लेखन 1.25x अनकैश्ड इनपुट दर का उपयोग करता है। 272K इनपुट टोकन से ऊपर के अनुरोधों में पूरी अनुरोध के लिए 2x इनपुट और कैश दरें तथा 1.5x आउटपुट दर लगती है। Batch और Flex मानक दरों के 50% का उपयोग करते हैं; Fast मोड लागू दरों का 2x उपयोग करता है। ये OpenAI संदर्भ दरें हैं, ऊपर दी गई Felo योजना की जगह नहीं लेतीं।

मूल्य स्रोतइनपुटकैश्ड इनपुटआउटपुट
Felo मॉडल पृष्ठ$10.00 / 1Mपृष्ठ कैश्ड-इनपुट और कैश-लेखन दरें सूचीबद्ध करता है$50.00 / 1M
OpenAI मॉडल गाइड$10.00 / 1M$1.00 / 1M$50.00 / 1M

पाँच चरणों में पहली अनुरोध करें

1. API कुंजी बनाएँ

अपने Felo API प्लेटफ़ॉर्म खाते में कुंजी बनाएँ और उसे पर्यावरण चर के रूप में सेट करें:

export FELO_API_KEY="YOUR_API_KEY"

2. एंडपॉइंट सेट करें

Chat Completions के लिए उपयोग करें:

https://openapi.felo.ai/api/v1/chat/completions

3. मॉडल आईडी सेट करें

"model": "gpt-6-astra" को messages ऐरे के साथ पास करें। यह cURL अनुरोध रूट का परीक्षण करता है:

curl https://openapi.felo.ai/api/v1/chat/completions \
-H "Authorization: Bearer $FELO_API_KEY" \
-H "Content-Type: application/json" \
-d '{
"model": "gpt-6-astra",
"messages": [{"role": "user", "content": "Explain this API error."}]
}'

4. टूल्स या संरचित आउटपुट जोड़ें

संगत पैरामीटर में tools, tool_choice, और response_format शामिल हैं। प्रत्येक नियंत्रण के लिए समर्थन चयनित प्रोटोकॉल और मॉडल रूट पर निर्भर करता है। GPT-6 Astra तर्क का समर्थन करता है; जब प्रोटोकॉल और रूट तर्क नियंत्रण दिखाते हैं, तो वार्तालाप जारी रखते समय लौटाए गए तर्क मेटाडेटा को बनाए रखें।

OpenAI ने GPT-6 Astra के लिए ये Responses API टूल्स सूचीबद्ध किए हैं: वेब सर्च, फ़ाइल सर्च, इमेज जेनरेशन, कोड इंटरप्रेटर, होस्टेड शेल, पैच लागू करें, स्किल्स, कंप्यूटर उपयोग, MCP, और टूल सर्च। जब वर्कफ़्लो को ये होस्टेड टूल्स चाहिए, तब Responses एंडपॉइंट का उपयोग करें। Felo की सतहें और सक्षम टूल्स सक्रिय रूट पर निर्भर कर सकते हैं।

5. स्ट्रीमिंग चालू करें

stream को true पर सेट करें ताकि सर्वर-सेंट इवेंट्स मिलें:

{
"model": "gpt-6-astra",
"stream": true,
"messages": [{"role": "user", "content": "Summarize this log."}]
}

एक प्रीफ्लाइट चेकलिस्ट

  • 1.05M संदर्भ विंडो के अनुसार इनपुट लागत का अनुमान लगाएँ।
  • आउटपुट को परियोजना बजट में रखने के लिए max_tokens सेट करें।
  • प्रत्येक अनुरोध अनुमान के लिए इनपुट, आउटपुट, कैश, और योजना डेटा रिकॉर्ड करें।
  • ऐप या एजेंट क्लाइंट जोड़ने से पहले Playground में प्रॉम्प्ट्स का परीक्षण करें।
  • टूल्स, JSON आउटपुट, और स्ट्रीमिंग के लिए प्रतिगमन नमूने रखें।
  • reasoning_effort को समर्थित स्तर पर सेट करें और उसे विलंबता और लागत डेटा के साथ रिकॉर्ड करें।
  • तुलना के लिए OpenAI मूल्य निर्धारण नियमों का उपयोग करें; देय अनुमान के लिए Felo योजना और रूट का उपयोग करें।

मॉडल पृष्ठ से शुरू करें

GPT-6 Astra तर्क, कोडिंग, लंबे-संदर्भ विश्लेषण, और एजेंट कार्य को एक मॉडल प्रविष्टि के पीछे रखता है। Felo OpenAPI टीमों को Chat Completions, Responses, और Messages के माध्यम से माइग्रेशन पथ देता है। मौजूदा क्लाइंट अपनी जगह पर रह सकता है, जबकि अनुरोध सतह कार्यभार के अनुसार बदलती है।

पैरामीटर, कोड नमूने, और Playground प्रविष्टि के लिए GPT-6 Astra मॉडल पृष्ठ खोलें।

स्रोत: Felo API Platform GPT-6 Astra मॉडल पृष्ठ, OpenAI GPT-6 Astra घोषणा, और OpenAI GPT-6 Astra मॉडल गाइड (देखा गया 2026-09-04)। Felo मूल्य निर्धारण 2026-09-04 को फिर से जाँचा गया।