QuickSilver Pro vs Together AI
Together AI 基于自有 GPU 对 DeepSeek 采用溢价定价。QuickSilver Pro 提供最新的 DeepSeek V4 wave——V4 Flash 廉价聊天 $0.086 / $0.173,V4 Pro 高端推理 $0.70 / $2.10——价格远低于 Together,还额外附带按 token 的缓存定价。
快速概览
| 特性 | QuickSilver Pro | together-ai |
|---|---|---|
| 目录侧重点 | 最新开源模型 | 50+ 开源模型 + 微调 |
| DeepSeek V4 Pro 输出 | $2.10 / 1M | $3.48 / 1M |
| 官方 V4 Flash 0731 | $0.086 / $0.173 | $0.14 / $0.28 |
| 微调 | 否 | 是 |
| 专用推理端点 | 否 | 是 |
| Embeddings | 否 | 是 |
| 图像生成 | Gemini 3 Pro Image、FLUX.2 Pro、FLUX.1 Schnell、SDXL Turbo、FLUX.2 Klein、Qwen-Image Max、Seedream 5.0 Pro、Seedream 4、Bria FIBO 1.5、GPT Image 2 | 是 |
| OpenAI-compatible chat | 是 | 是 |
| 最小充值金额 | $5 | 未公开 |
价格(每百万 tokens,USD)
对手方刊例价,最近核对于 2026-08-12。
| 模型 | QSP 输入 | QSP 输出 | together-ai 输入 | together-ai 输出 | 对比刊例价 |
|---|---|---|---|---|---|
| DeepSeek V4 Flash 0731 | $0.086 | $0.173 | $0.14 | $0.28 | 38% |
| DeepSeek V4 Pro | $0.70 | $2.10 | $1.74 | $3.48 | ~40% output |
| Qwen3.6-Plus | $0.26 | $1.56 | $0.50 | $3.00 | ~48% |
| Kimi K3 | $2.55 | $12.75 | $3.00 | $15.00 | 15% |
| Muse Glimmer 30B | $0.28 | $1.20 | $0.35 | $1.50 | 20% |
迁移:只改两行
import os
from openai import OpenAI
client = OpenAI(
base_url="https://api.quicksilverpro.io/v1",
api_key=os.environ["QSP_KEY"],
)
r = client.chat.completions.create(
model="deepseek-v4-pro",
messages=[{"role": "user", "content": "Hi"}],
)常见问题
同为 DeepSeek V4 Pro,QuickSilver Pro 为 $0.70 / $2.10,而 Together 当前为 $1.74/$3.48——输入约低 60%、输出约低 40%。官方 V4 Flash 0731 为 $0.086 / $0.173,比 Together 的 $0.14/$0.28 两条腿都低约 38%。
把 base_url 从 api.together.xyz/v1 改成 api.quicksilverpro.io/v1,替换 API key。模型 ID 映射:deepseek-ai/DeepSeek-V4-Pro -> deepseek-v4-pro。
如果你需要微调自定义模型、预留专用 GPU 端点、使用 Llama / Mistral,或者需要 embeddings,Together AI 更合适 —— 这些我们不提供。图像生成我们是有的:Gemini 3 Pro Image、FLUX.2 Pro、FLUX.1 Schnell、SDXL Turbo、FLUX.2 Klein、Qwen-Image Max、Seedream 5.0 Pro、Seedream 4、Bria FIBO 1.5、GPT Image 2。
对于聊天场景基本一样:streaming、tools、usage.cost 都能通过官方 OpenAI SDK 工作。json_schema strict mode 视模型而定 —— Claude 系列模型不支持,请改用 `strict: true` 的工具。