Сравнение

QuickSilver Pro vs OpenAI

Для тех нагрузок, где open-source модель уже дает сопоставимое качество, QuickSilver Pro может быть до 30 раз дешевле OpenAI. DeepSeek V4 Flash заменяет GPT-4o-mini примерно на 63% дешевле; V4 Pro заменяет o3-mini с output cost ниже примерно в 6 раз. Для audio и Assistants API разумнее оставаться на OpenAI. Vision у нас есть: 23 из 40 моделей принимают изображения на вход. Эта страница честно показывает, где премия OpenAI оправдана, а где нет.

Кратко

ПараметрQuickSilver Proopenai
КаталогOpen-source LLM (DeepSeek V4 Flash + Pro, Qwen 3.7 Max + 3.6 Plus + 3.6, Kimi K2.6 + K2.7 Code, GLM 5.2)GPT-4, o1/o3-mini, DALL-E, Whisper, TTS
Веса моделейОткрытые (MIT / Apache)Закрытые
Цена дешевого чата (GPT-4o-mini / DeepSeek V4 Flash)$0.112 / $0.224$0.15 / $0.60
Цена premium reasoning (o3-mini / DeepSeek V4 Pro)$0.435 / $0.87$1.10 / $4.40
Vision (входные изображения)23 из 40 моделейДа (GPT-4o)
Audio (Whisper / TTS)НетДа
Генерация изображенийGemini 3 Pro Image и FLUX.2 ProДа (DALL-E)
Assistants API + встроенные инструментыНетДа
OpenAI-compatible chat + tools + JSONДаДа (оригинал)
Минимальное пополнение$5$5

Цены (за 1 млн токенов, USD)

Прайс-листы конкурентов в том виде, в каком их публикуют сами провайдеры.

МодельQSP inputQSP outputopenai inputopenai outputк прайсу
deepseek-v4-flash vs gpt-4o-mini$0.112$0.224$0.14$0.60~63%
deepseek-v4-pro vs o3-mini$0.435$0.87$1.10$4.40~84%
qwen3.6-35b vs gpt-4o$0.112$0.80$2.50$10.00~92%
kimi-k2.6$0.5472$2.728specialist tier

Миграция - две строки

После - QuickSilver Pro
from openai import OpenAI

client = OpenAI(
    base_url="https://api.quicksilverpro.io/v1",
    api_key=os.environ["QSP_KEY"],
)

r = client.chat.completions.create(
    model="deepseek-v4-pro",
    messages=[{"role": "user", "content": "Hi"}],
)

FAQ

DeepSeek V4 Flash против GPT-4o-mini: примерно на 25% дешевле по input и на 63% дешевле по output. DeepSeek V4 Pro против o3-mini: примерно в 3 раза дешевле по input и в 6 раз по output. На большинстве чисто текстовых задач качество сопоставимо.

Для премиальных reasoning-нагрузок с длинным контекстом DeepSeek V4 Pro довольно прямо сопоставляется с o3-mini: 1M контекста против 200K у o3-mini и цена $0.435 / $0.87 против $1.10/$4.40 — примерно в 6 раз дешевле по output. Kimi K2.6 ближе к agentic / planning-нише уровня Claude Opus; у OpenAI здесь нет такого же чистого аналога.

Да. Меняются только base_url, api_key и model. Streaming, tool calling, strict json_schema и usage accounting поддерживаются. Модели новой волны V4 (V4 Flash, V4 Pro, Kimi K2.6) думают по умолчанию; для дешевого чата без размышлений передайте `reasoning: { enabled: false }`.

Когда нужны Whisper / TTS, Assistants API, embeddings или когда GPT-4 заметно выигрывает на ваших собственных evals. Vision и генерация изображений не повод оставаться: 23 из 40 моделей принимают изображения, а Gemini 3 Pro Image и FLUX.2 Pro их создают. Для текстового чата, который проходит ваши evals, выгоднее QSP.

Начните со своим ключом

Две строки — и на 20% ниже прайса с первого вызова.

Получить API-ключ