Сравнение

QuickSilver Pro vs OpenAI

Для тех нагрузок, где open-source модель уже дает сопоставимое качество, QuickSilver Pro может быть до 30 раз дешевле OpenAI. DeepSeek V4 Flash заменяет GPT-4o-mini примерно на 71% дешевле; V4 Pro заменяет o3-mini с output cost ниже примерно в 2 раза. Для audio и Assistants API разумнее оставаться на OpenAI. Vision у нас есть: 37 из 71 моделей принимают изображения на вход. Эта страница честно показывает, где премия OpenAI оправдана, а где нет.

Кратко

ПараметрQuickSilver Proopenai
КаталогGPT-6.1 Sol, GPT-6 Luna, Claude Opus 5.5, Claude Sonnet 5.5, Claude Haiku 5.5, Gemini 3.8 Flash, Mistral Large 4, DeepSeek V4.1 Flash, Qwen3.8 Max, Kimi K3, GLM 5.3 и Grok 4.7GPT-4, o1/o3-mini, DALL-E, Whisper, TTS
Веса моделейОткрытые (MIT / Apache)Закрытые
Цена дешевого чата (GPT-4o-mini / DeepSeek V4 Flash)$0.086 / $0.173$0.15 / $0.60
Цена premium reasoning (o3-mini / DeepSeek V4 Pro)$0.70 / $2.10$1.10 / $4.40
Vision (входные изображения)37 из 71 моделейДа (GPT-4o)
Audio (Whisper / TTS)НетДа
Генерация изображенийGemini 3 Pro Image, FLUX.2 Pro, FLUX.1 Schnell, SDXL Turbo, FLUX.2 Klein, Qwen-Image Max, Seedream 5.0 Pro, Seedream 4, Bria FIBO 1.5 и GPT Image 2Да (DALL-E)
Assistants API + встроенные инструментыНетДа
OpenAI-compatible chat + tools + JSONДа — json_schema зависит от моделиДа (оригинал)
Минимальное пополнение$5$5

Цены (за 1 млн токенов, USD)

Прайс-листы конкурентов в том виде, в каком их публикуют сами провайдеры.

МодельQSP inputQSP outputopenai inputopenai outputк прайсу
deepseek-v4-flash vs gpt-4o-mini$0.086$0.173$0.15$0.60~71%
deepseek-v4-pro vs o3-mini$0.70$2.10$1.10$4.40~52% output
qwen3.6-35b vs gpt-4o$0.112$0.80$2.50$10.00~92%
kimi-k2.6$0.5472$2.728——specialist tier

Миграция - две строки

После - QuickSilver Pro
from openai import OpenAI

client = OpenAI(
    base_url="https://api.quicksilverpro.io/v1",
    api_key=os.environ["QSP_KEY"],
)

r = client.chat.completions.create(
    model="deepseek-v4-pro",
    messages=[{"role": "user", "content": "Hi"}],
)

FAQ

DeepSeek V4 Flash против GPT-4o-mini: примерно на 43% дешевле по input и на 71% дешевле по output. DeepSeek V4 Pro против o3-mini: примерно в 1.6 раза дешевле по input и в 2 раза по output. На большинстве чисто текстовых задач качество сопоставимо.

Для премиальных reasoning-нагрузок с длинным контекстом DeepSeek V4 Pro довольно прямо сопоставляется с o3-mini: 1M контекста против 200K у o3-mini и цена $0.70 / $2.10 против $1.10/$4.40 — примерно в 2 раза дешевле по output. Kimi K2.6 ближе к agentic / planning-нише уровня Claude Opus; у OpenAI здесь нет такого же чистого аналога.

Да. Меняются только base_url, api_key и model. Streaming, tool calling и usage accounting поддерживаются. Strict-режим json_schema зависит от модели: модели Claude его не поддерживают — там схема носит рекомендательный характер, а по-настоящему жестким путем остается инструмент с `strict: true`. Модели новой волны V4 (V4 Flash, V4 Pro, Kimi K2.6) думают по умолчанию; для дешевого чата без размышлений передайте `reasoning: { enabled: false }`.

Когда нужны Whisper / TTS, Assistants API, embeddings или когда GPT-4 заметно выигрывает на ваших собственных evals. Vision и генерация изображений не повод оставаться: 37 из 71 моделей принимают изображения, а Gemini 3 Pro Image, FLUX.2 Pro, FLUX.1 Schnell, SDXL Turbo, FLUX.2 Klein, Qwen-Image Max, Seedream 5.0 Pro, Seedream 4, Bria FIBO 1.5 и GPT Image 2 их создают. Для текстового чата, который проходит ваши evals, выгоднее QSP.

Начните со своим ключом

Две строки — и на 20% ниже прайса с первого вызова.

Получить API-ключ