QuickSilver Pro vs OpenRouter
QuickSilver Pro 上的 Claude 价格只有原来的一半或更低 —— Claude Opus 5.5 比 OpenRouter 的公开单 token 价格低 60%,Claude Sonnet 5.5 低 50%;GLM-5.3、Qwen 3.7 Plus、MiniMax M3 等开源权重模型低约 20%。GPT-6.1 Sol、Grok 4.7 按官方价出售。相同的 OpenAI-compatible API,迁移只要两行。在社区长尾模型上,OpenRouter 依然更全。
快速概览
| 特性 | QuickSilver Pro | openrouter |
|---|---|---|
| 模型目录规模 | 71 个 —— GPT-6.1 Sol、Claude 5.5、Gemini 3.8、Grok 4.7、Qwen3.8、GLM-5.3、DeepSeek、Kimi K3 | 300+ |
| 共享模型定价 | Claude 低 50–67%;很多开源模型低约 20%;GPT-6.1 Sol、Grok 4.7 按官方价 | 基准价 |
| OpenAI-compatible 接口 | 是 | 是 |
| Streaming / tools / json_schema | 是 —— json_schema 视模型而定 | 是 |
| 响应中的 usage.cost | 是(合成值) | 是 |
| 按 key 的月消费上限 | 是 | 是 |
| 前沿闭源模型(Claude、GPT-6.1、Gemini、Grok) | 有 —— 所有 Claude 模型便宜 50–67%(Opus 5.5 便宜 60%,Sonnet 5.5 便宜 50%),Gemini 便宜 15%,GPT-6.1 和 Grok 按官方价 | 是 |
| 首充返现 | 首次充值 100% 等额返还,最高 $50(下一次充值时到账) | 有限的免费模型 |
| 最小充值金额 | $5 | $10 |
价格(每百万 tokens,USD)
对手方刊例价,最近核对于 2026-09-30。
| 模型 | QSP 输入 | QSP 输出 | openrouter 输入 | openrouter 输出 | 对比刊例价 |
|---|---|---|---|---|---|
| Claude Opus 5.5 | $1.60 | $8.00 | $4.00 | $20.00 | 60% |
| Claude Sonnet 5.5 | $1.00 | $5.00 | $2.00 | $10.00 | 50% |
| GLM-5.3 | $1.12 | $3.52 | $1.40 | $4.40 | 20% |
| Gemini 3.8 Flash | $0.6375 | $3.1875 | $0.75 | $3.75 | 15% |
| Kimi K3 | $2.55 | $12.75 | $3.00 | $15.00 | ~15% |
| MiniMax M3 | $0.24 | $0.96 | $0.30 | $1.20 | 20% |
| Qwen 3.7 Plus | $0.256 | $1.024 | $0.32 | $1.28 | 20% |
| GPT-6.1 Sol | $2.00 | $10.00 | $2.00 | $10.00 | at list |
迁移:只改两行
from openai import OpenAI
client = OpenAI(
base_url="https://api.quicksilverpro.io/v1",
api_key=os.environ["QSP_KEY"],
)
r = client.chat.completions.create(
model="deepseek-v4-pro",
messages=[{"role": "user", "content": "Hi"}],
)常见问题
很多共享模型是的:Claude Opus 5.5 比 OpenRouter 公开单 token 价格低 60%,Claude Sonnet 5.5 低 50%;GLM-5.3、Qwen 3.7 Plus、MiniMax M3、MiMo V2.6 Pro 低约 20%;Kimi K3 与 Gemini 3.8 Flash 低约 15%。GPT-6.1 Sol、Grok 4.7 按官方价。价格会变动,上面的定价表是 2026 年 10 月的精确数字。
只改两行 OpenAI SDK 配置:把 base_url 从 openrouter.ai/api/v1 改成 api.quicksilverpro.io/v1,再替换 API key。模型 ID 映射:deepseek/deepseek-v4-flash-0731 -> deepseek-v4-flash、deepseek/deepseek-v4-pro -> deepseek-v4-pro、qwen/qwen3.7-max -> qwen3.7-max、qwen/qwen3.7-plus -> qwen3.7-plus、qwen/qwen3.7-flash -> qwen3.7-flash、qwen/qwen3.6-plus -> qwen3.6-plus、qwen/qwen3.6-35b-a3b -> qwen3.6-35b、moonshotai/kimi-k2.6 -> kimi-k2.6、moonshotai/kimi-k2.7-code -> kimi-k2.7-code、moonshotai/kimi-k3 -> kimi-k3、z-ai/glm-5.3 -> glm-5.3、z-ai/glm-5.3-flash -> glm-5.3-flash、openai/gpt-oss-120b -> gpt-oss-120b、qwen/qwen3.8-27b -> qwen3.8-27b、qwen/qwen3.8-flash -> qwen3.8-flash-next、qwen/qwen3.8-omni-flash -> qwen3.8-omni-flash、z-ai/glm-5.2 -> glm-5.2。
如果你的工作负载需要 Llama、Mistral 或社区长尾模型,那么 OpenRouter 更合适。闭源前沿模型这里也都有 —— GPT-6.1 Sol、Claude Opus 5.5 与 Sonnet 5.5、Gemini 3.8、Grok 4.7,一把 key 全搞定,其中 Claude Opus 5.5 比 OpenRouter 便宜 60%、Sonnet 5.5 便宜 50%,Gemini 比 Google 官方价便宜 15%。
对于共享模型,基本一样。Streaming、tool / function calling 和标准 usage 统计都能通过官方 OpenAI SDK 直接工作,每个响应还会返回一个按公开单 token 价格计算出的 usage.cost 合成值。json_schema strict mode 视模型而定:Claude 系列模型不支持,传入的 schema 只起提示作用,真正受约束的做法是声明一个 `strict: true` 的工具。
DeepSeek V4 Flash + Pro、Qwen 3.6/3.7 和 Kimi K2.6 在 OpenRouter 上都会默认开启 chain-of-thought,所以一句简单的“Hi”也可能返回数百个 reasoning tokens。对 DeepSeek V4 和 Kimi K2.6,我们原样透传请求:如需非思考的低成本聊天,请在请求体里传 `reasoning: { enabled: false }`。Qwen 3.6/3.7 系列在 QuickSilver Pro 上以非思考模式提供,直接作答;其中只有 Qwen 3.7 Max 可以通过 `enable_thinking: true` 重新开启思考。