होम/Models/GPT-6 Astra
1M contextMultimodalReasoningResponses API

GPT-6 Astra QuickSilver Pro पर

GPT-6 Astra कठिन end-to-end काम के लिए OpenAI का GPT-6 flagship है — long-horizon agentic coding, deep research, वैज्ञानिक विश्लेषण और document creation — 1M-token context, 128K max output और image input के साथ। QuickSilver Pro $10.00 input / $50.00 output प्रति million tokens लेता है — OpenAI की प्रकाशित list price, बिना किसी QSP markup के — उसी key और balance पर जो बाकी catalog के लिए है।

प्रति 1M tokens: input $10.00 · output $50.00
लेखक:Raullen Chai·अपडेट:

एक नज़र में

Context
1M tokens
Input / 1M
$10.00
Output / 1M
$50.00
Default में सोचता है
हाँ

Long-horizon agentic coding, deep research और document work के लिए OpenAI का flagship, 1M-token context और image input के साथ।

Pricing तुलना ($/1M tokens)

ProviderInputOutputQSP की तुलना में
QuickSilver Pro$10.00$50.00—
OpenAI list price (OpenAI API)$10.00$50.00बराबर

कब इस्तेमाल करें

GPT-6 Astra तब इस्तेमाल करें जब task ही असली मुश्किल हो: बड़े codebase पर कई घंटों के agent runs, ऐसी research जिसमें कई sources पढ़कर उनका मिलान करना हो, वैज्ञानिक और मात्रात्मक विश्लेषण, और लंबे structured documents। यह 1M-token context में text, images और files लेता है, tool calling, JSON Schema output और Chat Completions व Responses दोनों को support करता है, और reasoning — जो इस मॉडल में हमेशा चालू रहती है — हर request पर `reasoning_effort` से tune की जाती है।

कब कोई और model चुनें

Routine chat, extraction और high-volume automation के लिए GPT-5.6 Terra और GPT-5.6 Luna यही काम कीमत के एक छोटे हिस्से पर कर देते हैं, और frontier काम के लिए GPT-5.6 Sol $1.60 / $8.00 पर value वाला चुनाव बना हुआ है। जिस request का prompt 200,000 tokens से ज़्यादा हो, उसका bill OpenAI की long-context rate पर बनता है — $20 input, $75 output और $2 cached input प्रति million — इसलिए जब पूरी window की ज़रूरत न हो तो retrieval या prompt compaction इस्तेमाल करें।

Quickstart (curl)

curl https://api.quicksilverpro.io/v1/chat/completions \
  -H "Authorization: Bearer $QSP_KEY" \
  -H "Content-Type: application/json" \
  -d '{
    "model": "gpt-6-astra",
    "messages": [{"role": "user", "content": "Hello!"}]
  }'

OpenAI-संगत। base_url बदलकर एक लाइन में migration।

FAQ

200,000 prompt tokens तक की requests के लिए इसकी कीमत $10.00 प्रति million input tokens, $50.00 प्रति million output tokens, $1 प्रति million cached-input tokens और $12.50 प्रति million cache-write tokens है — OpenAI की प्रकाशित list rates, बिना किसी markup के। 200,000 prompt tokens से ऊपर पूरी request का bill $20 input, $75 output और $2 cached input प्रति million पर बनता है। Reasoning tokens output tokens के रूप में bill होते हैं।

Reasoning हमेशा चालू रहती है — इस endpoint पर यह अनिवार्य है और बंद नहीं की जा सकती (इसे बंद करने की कोशिश करने वाली request upstream पर reject हो जाती है)। सरल prompts पर यह हल्की रहती है: हमारी testing में एक लाइन के सवाल पर करीब एक दर्जन reasoning tokens खर्च हुए। गहराई और latency व लागत के बीच संतुलन के लिए `reasoning_effort` (low, medium, high, xhigh) इस्तेमाल करें। Reasoning tokens output tokens के रूप में bill होते हैं और दिखने वाले जवाब से पहले आपके `max_tokens` budget में से लिए जाते हैं, इसलिए कठिन समस्याओं पर `max_tokens` खुलकर सेट करें।

हाँ। यह text, image और file input लेता है और 1M-token context में streaming, function calling और JSON Schema structured output को support करता है, `/v1/chat/completions` और `/v1/responses` दोनों पर।

base_url=https://api.quicksilverpro.io/v1 सेट करें, अपनी QSP API key इस्तेमाल करें, और model="gpt-6-astra" सेट करें। आपके मौजूदा OpenAI code में बाकी सब वैसा ही रहता है, और response में usage.cost बताता है कि उस call पर कितना charge हुआ।

GPT-6 Astra OpenAI की सबसे नई flagship generation है, जो सबसे लंबे horizon वाले agentic और research काम के लिए रखी गई है; GPT-5.6 Sol पिछला flagship है और QuickSilver Pro पर $1.60 / $8.00 पर बना हुआ है, अपनी list price से 20% कम। दोनों में 1M-token context और वही OpenAI-compatible surface है, इसलिए इनके बीच switch करना एक लाइन का model बदलाव है।

GPT-6 Astra को double credits के साथ आज़माएँ — $50 तक bonus credits

API Key पाएँ