QuickSilver Pro vs OpenAI
Для тех нагрузок, где open-source модель уже дает сопоставимое качество, QuickSilver Pro может быть до 30 раз дешевле OpenAI. DeepSeek V4 Flash заменяет GPT-4o-mini примерно на 63% дешевле; V4 Pro заменяет o3-mini с output cost ниже примерно в 6 раз. Для audio и Assistants API разумнее оставаться на OpenAI. Vision у нас есть: 23 из 40 моделей принимают изображения на вход. Эта страница честно показывает, где премия OpenAI оправдана, а где нет.
Кратко
| Параметр | QuickSilver Pro | openai |
|---|---|---|
| Каталог | Open-source LLM (DeepSeek V4 Flash + Pro, Qwen 3.7 Max + 3.6 Plus + 3.6, Kimi K2.6 + K2.7 Code, GLM 5.2) | GPT-4, o1/o3-mini, DALL-E, Whisper, TTS |
| Веса моделей | Открытые (MIT / Apache) | Закрытые |
| Цена дешевого чата (GPT-4o-mini / DeepSeek V4 Flash) | $0.112 / $0.224 | $0.15 / $0.60 |
| Цена premium reasoning (o3-mini / DeepSeek V4 Pro) | $0.435 / $0.87 | $1.10 / $4.40 |
| Vision (входные изображения) | 23 из 40 моделей | Да (GPT-4o) |
| Audio (Whisper / TTS) | Нет | Да |
| Генерация изображений | Gemini 3 Pro Image и FLUX.2 Pro | Да (DALL-E) |
| Assistants API + встроенные инструменты | Нет | Да |
| OpenAI-compatible chat + tools + JSON | Да | Да (оригинал) |
| Минимальное пополнение | $5 | $5 |
Цены (за 1 млн токенов, USD)
Прайс-листы конкурентов в том виде, в каком их публикуют сами провайдеры.
| Модель | QSP input | QSP output | openai input | openai output | к прайсу |
|---|---|---|---|---|---|
| deepseek-v4-flash vs gpt-4o-mini | $0.112 | $0.224 | $0.14 | $0.60 | ~63% |
| deepseek-v4-pro vs o3-mini | $0.435 | $0.87 | $1.10 | $4.40 | ~84% |
| qwen3.6-35b vs gpt-4o | $0.112 | $0.80 | $2.50 | $10.00 | ~92% |
| kimi-k2.6 | $0.5472 | $2.728 | — | — | specialist tier |
Миграция - две строки
from openai import OpenAI
client = OpenAI(
base_url="https://api.quicksilverpro.io/v1",
api_key=os.environ["QSP_KEY"],
)
r = client.chat.completions.create(
model="deepseek-v4-pro",
messages=[{"role": "user", "content": "Hi"}],
)FAQ
DeepSeek V4 Flash против GPT-4o-mini: примерно на 25% дешевле по input и на 63% дешевле по output. DeepSeek V4 Pro против o3-mini: примерно в 3 раза дешевле по input и в 6 раз по output. На большинстве чисто текстовых задач качество сопоставимо.
Для премиальных reasoning-нагрузок с длинным контекстом DeepSeek V4 Pro довольно прямо сопоставляется с o3-mini: 1M контекста против 200K у o3-mini и цена $0.435 / $0.87 против $1.10/$4.40 — примерно в 6 раз дешевле по output. Kimi K2.6 ближе к agentic / planning-нише уровня Claude Opus; у OpenAI здесь нет такого же чистого аналога.
Да. Меняются только base_url, api_key и model. Streaming, tool calling, strict json_schema и usage accounting поддерживаются. Модели новой волны V4 (V4 Flash, V4 Pro, Kimi K2.6) думают по умолчанию; для дешевого чата без размышлений передайте `reasoning: { enabled: false }`.
Когда нужны Whisper / TTS, Assistants API, embeddings или когда GPT-4 заметно выигрывает на ваших собственных evals. Vision и генерация изображений не повод оставаться: 23 из 40 моделей принимают изображения, а Gemini 3 Pro Image и FLUX.2 Pro их создают. Для текстового чата, который проходит ваши evals, выгоднее QSP.