QuickSilver Pro vs OpenAI
Для тех нагрузок, где open-source модель уже дает сопоставимое качество, QuickSilver Pro может быть до 30 раз дешевле OpenAI. DeepSeek V4 Flash заменяет GPT-4o-mini примерно на 71% дешевле; V4 Pro заменяет o3-mini с output cost ниже примерно в 2 раза. Для audio и Assistants API разумнее оставаться на OpenAI. Vision у нас есть: 37 из 71 моделей принимают изображения на вход. Эта страница честно показывает, где премия OpenAI оправдана, а где нет.
Кратко
| Параметр | QuickSilver Pro | openai |
|---|---|---|
| Каталог | GPT-6.1 Sol, GPT-6 Luna, Claude Opus 5.5, Claude Sonnet 5.5, Claude Haiku 5.5, Gemini 3.8 Flash, Mistral Large 4, DeepSeek V4.1 Flash, Qwen3.8 Max, Kimi K3, GLM 5.3 и Grok 4.7 | GPT-4, o1/o3-mini, DALL-E, Whisper, TTS |
| Веса моделей | Открытые (MIT / Apache) | Закрытые |
| Цена дешевого чата (GPT-4o-mini / DeepSeek V4 Flash) | $0.086 / $0.173 | $0.15 / $0.60 |
| Цена premium reasoning (o3-mini / DeepSeek V4 Pro) | $0.70 / $2.10 | $1.10 / $4.40 |
| Vision (входные изображения) | 37 из 71 моделей | Да (GPT-4o) |
| Audio (Whisper / TTS) | Нет | Да |
| Генерация изображений | Gemini 3 Pro Image, FLUX.2 Pro, FLUX.1 Schnell, SDXL Turbo, FLUX.2 Klein, Qwen-Image Max, Seedream 5.0 Pro, Seedream 4, Bria FIBO 1.5 и GPT Image 2 | Да (DALL-E) |
| Assistants API + встроенные инструменты | Нет | Да |
| OpenAI-compatible chat + tools + JSON | Да — json_schema зависит от модели | Да (оригинал) |
| Минимальное пополнение | $5 | $5 |
Цены (за 1 млн токенов, USD)
Прайс-листы конкурентов в том виде, в каком их публикуют сами провайдеры.
| Модель | QSP input | QSP output | openai input | openai output | к прайсу |
|---|---|---|---|---|---|
| deepseek-v4-flash vs gpt-4o-mini | $0.086 | $0.173 | $0.15 | $0.60 | ~71% |
| deepseek-v4-pro vs o3-mini | $0.70 | $2.10 | $1.10 | $4.40 | ~52% output |
| qwen3.6-35b vs gpt-4o | $0.112 | $0.80 | $2.50 | $10.00 | ~92% |
| kimi-k2.6 | $0.5472 | $2.728 | — | — | specialist tier |
Миграция - две строки
from openai import OpenAI
client = OpenAI(
base_url="https://api.quicksilverpro.io/v1",
api_key=os.environ["QSP_KEY"],
)
r = client.chat.completions.create(
model="deepseek-v4-pro",
messages=[{"role": "user", "content": "Hi"}],
)FAQ
DeepSeek V4 Flash против GPT-4o-mini: примерно на 43% дешевле по input и на 71% дешевле по output. DeepSeek V4 Pro против o3-mini: примерно в 1.6 раза дешевле по input и в 2 раза по output. На большинстве чисто текстовых задач качество сопоставимо.
Для премиальных reasoning-нагрузок с длинным контекстом DeepSeek V4 Pro довольно прямо сопоставляется с o3-mini: 1M контекста против 200K у o3-mini и цена $0.70 / $2.10 против $1.10/$4.40 — примерно в 2 раза дешевле по output. Kimi K2.6 ближе к agentic / planning-нише уровня Claude Opus; у OpenAI здесь нет такого же чистого аналога.
Да. Меняются только base_url, api_key и model. Streaming, tool calling и usage accounting поддерживаются. Strict-режим json_schema зависит от модели: модели Claude его не поддерживают — там схема носит рекомендательный характер, а по-настоящему жестким путем остается инструмент с `strict: true`. Модели новой волны V4 (V4 Flash, V4 Pro, Kimi K2.6) думают по умолчанию; для дешевого чата без размышлений передайте `reasoning: { enabled: false }`.
Когда нужны Whisper / TTS, Assistants API, embeddings или когда GPT-4 заметно выигрывает на ваших собственных evals. Vision и генерация изображений не повод оставаться: 37 из 71 моделей принимают изображения, а Gemini 3 Pro Image, FLUX.2 Pro, FLUX.1 Schnell, SDXL Turbo, FLUX.2 Klein, Qwen-Image Max, Seedream 5.0 Pro, Seedream 4, Bria FIBO 1.5 и GPT Image 2 их создают. Для текстового чата, который проходит ваши evals, выгоднее QSP.