QuickSilver Pro सिस्टम स्टेटस
सेवाएँ
मॉडल उपलब्धता
deepseek-v4-flashdeepseek-v4.1-flashdeepseek-v4-proqwen3.8-maxqwen3.8-max-primeqwen3.8-omni-flashqwen3.7-maxqwen3.7-plusqwen3.7-flashqwen3.6-plusqwen3.6-35bqwen3.8-27bqwen3.8-flash-nextkimi-k2.6kimi-k2.7-codekimi-k3muse-spark-1.3muse-spark-1.2muse-glimmer-30bglm-5.3glm-5.3-primeglm-5.3-flashglm-5.2nemotron-3-ultranemotron-3.5-lightninggpt-oss-120bgpt-6-astragpt-6-lunagpt-6.1-solgpt-6-solgpt-5.6-lunagpt-5.6-terragpt-5.6-solgrok-4.5grok-4.6grok-4.7minimax-m3mimo-v2.6-promimo-v2.6-flashmimo-v2.5hy4-previewhy3mistral-large-4jev-1.13claude-opus-5-5claude-opus-5claude-fable-5-1claude-fable-5claude-opus-4-8claude-sonnet-5-5claude-sonnet-5claude-haiku-5-5claude-haiku-4-5gemini-3.7-flashgemini-3.8-flashgemini-3.6-flashgemini-3.5-flash-litegemini-3.5-flashgemini-3.1-pro-previewgemini-3-pro-imagegemini-3-flash-previewgemini-3.1-flash-liteflux.2-proflux.1-schnellsdxl-turboflux.2-kleinqwen-image-maxseedream-5.0-proseedream-4bria-fibo-1.5gpt-image-2रोडमैप - हम एक वास्तविक inference कंपनी कैसे बनेंगे
अभी - एक curated catalog पर लॉन्च
लाइवग्राहक आज ही 20% बचा सकते हैं — कम list prices वाले curated catalog पर। संकीर्ण operational surface ही gap को ईमानदार रखती है, और वही interface बिना बदलाव Phase 2 तक चलता है।
Q2 2026 - H100/H200 पर हमारा अपना inference stack
योजनाबद्धDedicated GPU पर self-hosted serving, जिसमें SGLang + continuous batching, EAGLE-3 speculative decoding, DeepGEMM के जरिए FP8 quantization, और SageAttention / ThunderMLA custom kernels शामिल होंगे। उस समय system_fingerprint स्थिर हो जाएगा (सिर्फ stack update होने पर बदलेगा), और repeatable-seed workflows ठीक से काम करेंगे। लक्ष्य: DeepSeek V4 wave की मौजूदा कीमतों से 30-50% नीचे जाना।
H2 2026 - colocated data center + AIDC partnerships
भविष्यRented capacity (Vast.ai) से self-owned या colocated racks की ओर बढ़ना। जहाँ उचित होगा वहाँ AI datacenter operators के साथ साझेदारी करना। लक्ष्य है open-source models के लिए दुनिया का सबसे सस्ता और विश्वसनीय inference stack बनाना - पूरा stack, हमारी engineering।
इस पेज के बारे में
बैकएंड और वेबसाइट की पंक्तियां आपके ब्राउज़र से कनेक्टिविटी जांच दिखाती हैं। API पंक्ति हमारे बैकएंड द्वारा रिपोर्ट की गई सूचीबद्ध मॉडल जांच का सार दिखाती है। Model rows हमारे backend द्वारा हर 3 मिनट में भेजे गए एक वास्तविक 1-token probe को दिखाते हैं। Historical bars हाल की probes के परिणाम दिखाते हैं, जो इस browser के localStorageमें stored होते हैं; device बदलने पर ये साफ हो जाते हैं।
सार्वजनिक uptime tracking शुरू हुई 2026-04-16. यदि आपको contractual SLA और third-party monitored history चाहिए, तो हमसे संपर्क करें।