Системный статус QuickSilver Pro

Статус неизвестен
Проверка...

Сервисы

История за 90 дней · измерения в клиенте
Inference API
api.quicksilverpro.io
Проверка...
·
Бэкенд панели
pay.quicksilverpro.io
Проверка...
·
Сайт
quicksilverpro.io
Проверка...
·

Доступность моделей

Синтетический probe · обновление каждые 3 мин
DeepSeek V4 Flash
deepseek-v4-flash
official 0731 agent model, 1M context, Responses API
Проверка...
·
DeepSeek V4 Pro
deepseek-v4-pro
premium reasoning, 1M context
Проверка...
·
Qwen3.8 Max
qwen3.8-max
Qwen 3.8 flagship, 2.4T MoE, 1M context, autonomous coding
Проверка...
·
Qwen3.7 Max
qwen3.7-max
Qwen 3.7 flagship, 1M context, thinks by default
Проверка...
·
Qwen3.7 Plus
qwen3.7-plus
Qwen 3.7 agent flagship, 1M context, long-horizon coding
Проверка...
·
Qwen3.7 Flash
qwen3.7-flash
fast multimodal agents, vision and tool use, 1M context
Проверка...
·
Qwen3.6 Plus
qwen3.6-plus
1T-MoE flagship, 1M context, thinks by default
Проверка...
·
Qwen3.6-35B-A3B
qwen3.6-35b
262K long-context, MoE, drop-in 3.5 upgrade
Проверка...
·
Kimi K2.6
kimi-k2.6
Opus-class reasoning, 256K context
Проверка...
·
Kimi K2.7 Code
kimi-k2.7-code
Agentic-coding K2, 256K context, coding-tuned K2.6 successor
Проверка...
·
Kimi K3
kimi-k3
2.8T multimodal reasoning flagship, 1M context
Проверка...
·
Muse Spark 1.2
muse-spark-1.2
Coding-focused reasoning model, 1M context
Проверка...
·
Muse Glimmer 30B
muse-glimmer-30b
Compact agentic multimodal model, distilled from Muse Spark
Проверка...
·
GLM 5.3
glm-5.3
Z.ai latest reasoning flagship, 1M context, complex software engineering & long-horizon agents
Проверка...
·
GLM 5.2
glm-5.2
Z.ai reasoning flagship, 1M context, long-horizon agents & coding
Проверка...
·
Nemotron 3.5 Lightning
nemotron-3.5-lightning
30B-A3B open MoE for fast, tool-heavy agents
Проверка...
·
GPT-5.6 Luna
gpt-5.6-luna
OpenAI's fast, cost-efficient GPT-5.6 tier, 1M context
Проверка...
·
GPT-5.6 Terra
gpt-5.6-terra
OpenAI's balanced GPT-5.6 mid-tier, 1M context
Проверка...
·
GPT-5.6 Sol
gpt-5.6-sol
OpenAI's flagship GPT-5.6, complex reasoning & agentic coding, 1M context
Проверка...
·
Grok 4.5
grok-4.5
xAI's smartest model, frontier coding, knowledge work & STEM, 500K context
Проверка...
·
Grok 4.6
grok-4.6
frontier coding, knowledge work and STEM, vision, 500K context
Проверка...
·
MiniMax M3
minimax-m3
MiniMax open-weight frontier model, 1M context, agentic coding
Проверка...
·
MiMo-V2.5
mimo-v2.5
Xiaomi open-weight MiMo-V2.5, cost-efficient coding & agentic, 1M context
Проверка...
·
Hy3
hy3
Tencent Hy3, selectable reasoning & agentic coding, 262K context
Проверка...
·
Claude Opus 5
claude-opus-5
Anthropic flagship for demanding reasoning, coding & long-horizon agentic work, 1M context
Проверка...
·
Claude Fable 5
claude-fable-5
Anthropic Mythos-class flagship, most capable reasoning
Проверка...
·
Claude Opus 4.8
claude-opus-4-8
Anthropic flagship, top-tier reasoning & agentic
Проверка...
·
Claude Opus 4.6
claude-opus-4-6
Anthropic flagship, deep reasoning & coding
Проверка...
·
Claude Sonnet 4.6
claude-sonnet-4-6
balanced Anthropic mid-tier, fast & capable
Проверка...
·
Claude Sonnet 5
claude-sonnet-5
Anthropic's newest Sonnet tier, 1M context
Проверка...
·
Claude Haiku 4.5
claude-haiku-4-5
fast, low-cost Anthropic, high-volume
Проверка...
·
Gemini 3.7 Flash
gemini-3.7-flash
most capable Flash for agents; promotional pricing through 2026-12-31
Проверка...
·
Gemini 3.6 Flash
gemini-3.6-flash
current general-purpose Flash GA, 1M context
Проверка...
·
Gemini 3.5 Flash-Lite
gemini-3.5-flash-lite
current low-cost Flash-Lite GA, 1M context
Проверка...
·
Gemini 3.5 Flash
gemini-3.5-flash
Google's next-gen Flash GA, 1M context, thinking
Проверка...
·
Gemini 3.1 Pro Preview
gemini-3.1-pro-preview
Google's flagship reasoning, 1M context, thinking
Проверка...
·
Gemini 3 Pro Image
gemini-3-pro-image
GA pro-grade image generation
Проверка...
·
Gemini 3 Flash Preview
gemini-3-flash-preview
legacy compatibility; migrate to Gemini 3.6 Flash
Проверка...
·
Gemini 3.1 Flash Lite
gemini-3.1-flash-lite
legacy compatibility; migrate to Gemini 3.5 Flash-Lite
Проверка...
·
FLUX.2 Pro
flux.2-pro
flagship image generation, billed per image
Проверка...
·

Roadmap: как мы становимся настоящей inference-компанией

1

Сейчас - запущены на курируемом каталоге

Live

Клиенты экономят 20% уже сегодня на курируемом каталоге по низким прейскурантным ценам. Узкая операционная поверхность - это и есть то, что удерживает разрыв честным, и тот же интерфейс продолжается в Phase 2 без изменений.

2

Q2 2026 - собственный inference-стек на H100/H200

Запланировано

Self-hosted serving на выделенных GPU с использованием SGLang + continuous batching, EAGLE-3 speculative decoding, FP8 quantization через DeepGEMM и кастомных ядер SageAttention / ThunderMLA. На этом этапе system_fingerprint станет стабильным (он будет меняться только при обновлении стека), а repeatable-seed workflows начнут нормально работать. Цель: быть на 30-50% дешевле текущих цен на DeepSeek V4 wave.

3

H2 2026 - colocated data center + партнерства с AIDC

Будущее

Переход от аренды (Vast.ai) к собственным или colocated стойкам. Там, где это имеет смысл, будем работать с операторами AI-датацентров. Цель - самый дешевый и надежный inference для open-source моделей на планете: весь стек и вся инженерия под нашим контролем.

Об этой странице

Строки сервисов запускают client-side probes из вашего браузера. Строки моделей отражают реальный 1-token probe, который наш backend отправляет каждые 3 минуты. Исторические бары показывают результаты недавних проверок, сохраненных в localStorage; при смене устройства история очищается.

Публичное отслеживание аптайма началось 2026-04-16. Если вам нужен контрактный SLA и история, отслеживаемая третьей стороной, свяжитесь с нами.