QuickSilver Pro vs OpenRouter
QuickSilver Pro 的公开单 token 价格大约比 OpenRouter 低 20% —— 既包括 Kimi K3、DeepSeek V4 Flash 与 Pro、Qwen 3.7 Plus 这类开源权重,也包括 Claude Opus 5、GPT-5.6、Grok 4.5 这类前沿闭源模型,而且仍然保持相同的 OpenAI-compatible API,迁移只要两行。在社区长尾模型上,OpenRouter 依然更全。
快速概览
| 特性 | QuickSilver Pro | openrouter |
|---|---|---|
| 模型目录规模 | 40 个 —— Kimi K3、DeepSeek V4、GLM 5.3、Qwen 3.7、Nemotron、Claude、GPT-5.6、Gemini、Grok | 300+ |
| 共享模型定价 | 绝大多数比 OpenRouter 低 20% | 基准价 |
| OpenAI-compatible 接口 | 是 | 是 |
| Streaming / tools / json_schema | 是 | 是 |
| 响应中的 usage.cost | 是(合成值) | 是 |
| 按 key 的月消费上限 | 是 | 是 |
| 前沿闭源模型(Claude、GPT-5.6、Gemini、Grok) | 有 —— 便宜 20% | 是 |
| 上线特惠 | 首次充值 100% 等额,最高 $50 | 有限的免费模型 |
| 最小充值金额 | $5 | $10 |
价格(每百万 tokens,USD)
对手方刊例价,最近核对于 2026-08-04。
| 模型 | QSP 输入 | QSP 输出 | openrouter 输入 | openrouter 输出 | 对比刊例价 |
|---|---|---|---|---|---|
| DeepSeek V4 Flash | $0.112 | $0.224 | $0.14 | $0.28 | 20% |
| DeepSeek V4 Pro | $0.435 | $0.87 | $0.435 | $0.87 | ~20% |
| Qwen3.6-35B-A3B | $0.112 | $0.80 | $0.14 | $1.00 | ~20% |
| Kimi K3 | $2.40 | $12.00 | $3.00 | $15.00 | ~20% |
| Claude Opus 5 | $4.00 | $20.00 | $5.00 | $25.00 | ~20% |
| Kimi K2.6 | $0.5472 | $2.728 | $0.589 | $2.48 | mixed by leg |
迁移:只改两行
from openai import OpenAI
client = OpenAI(
base_url="https://api.quicksilverpro.io/v1",
api_key=os.environ["QSP_KEY"],
)
r = client.chat.completions.create(
model="deepseek-v4-pro",
messages=[{"role": "user", "content": "Hi"}],
)常见问题
是的。绝大多数共享模型(Kimi K3、DeepSeek V4 Flash 与 Pro、Qwen 3.7 Plus、Claude Opus 5、GPT-5.6、Grok 4.5)比 OpenRouter 的公开单 token 价格低约 20%。Qwen 3.7 Max 是例外:Alibaba 是它唯一的 provider,所以我们按平价出售。上面的定价表里有精确数字。
只改两行 OpenAI SDK 配置:把 base_url 从 openrouter.ai/api/v1 改成 api.quicksilverpro.io/v1,再替换 API key。模型 ID 映射:deepseek/deepseek-v4-flash-0731 -> deepseek-v4-flash、deepseek/deepseek-v4-pro -> deepseek-v4-pro、qwen/qwen3.7-max -> qwen3.7-max、qwen/qwen3.7-plus -> qwen3.7-plus、qwen/qwen3.7-flash -> qwen3.7-flash、qwen/qwen3.6-plus -> qwen3.6-plus、qwen/qwen3.6-35b-a3b -> qwen3.6-35b、moonshotai/kimi-k2.6 -> kimi-k2.6、moonshotai/kimi-k2.7-code -> kimi-k2.7-code、moonshotai/kimi-k3 -> kimi-k3、z-ai/glm-5.3 -> glm-5.3、z-ai/glm-5.2 -> glm-5.2。
如果你的工作负载需要 Llama、Mistral 或社区长尾模型,那么 OpenRouter 更合适。但闭源前沿模型已经不再是理由:Claude、GPT-5.6、Gemini、Grok 在 QuickSilver Pro 上都有,而且比 OpenRouter 便宜 20%。
对于共享模型,基本一样。Streaming、tool / function calling、json_schema strict mode 和标准 usage 统计都能通过官方 OpenAI SDK 直接工作。每个响应还会返回一个按公开单 token 价格计算出的 usage.cost 合成值。
DeepSeek V4 Flash + Pro、Qwen 3.6/3.7 和 Kimi K2.6 在 OpenRouter 上都会默认开启 chain-of-thought,所以一句简单的“Hi”也可能返回数百个 reasoning tokens。对 DeepSeek V4 和 Kimi K2.6,我们原样透传请求:如需非思考的低成本聊天,请在请求体里传 `reasoning: { enabled: false }`。对 Qwen 3.6/3.7 系列,网关已默认发送 `reasoning: { enabled: false }`——如需思考,传 `reasoning: { enabled: true }` 开启。