首页/对比/vs openrouter
对比

QuickSilver Pro vs OpenRouter

QuickSilver Pro 上的 Claude 价格只有原来的一半或更低 —— Claude Opus 5.5 比 OpenRouter 的公开单 token 价格低 60%,Claude Sonnet 5.5 低 50%;GLM-5.3、Qwen 3.7 Plus、MiniMax M3 等开源权重模型低约 20%。GPT-6.1 Sol、Grok 4.7 按官方价出售。相同的 OpenAI-compatible API,迁移只要两行。在社区长尾模型上,OpenRouter 依然更全。

快速概览

特性QuickSilver Proopenrouter
模型目录规模71 个 —— GPT-6.1 Sol、Claude 5.5、Gemini 3.8、Grok 4.7、Qwen3.8、GLM-5.3、DeepSeek、Kimi K3300+
共享模型定价Claude 低 50–67%;很多开源模型低约 20%;GPT-6.1 Sol、Grok 4.7 按官方价基准价
OpenAI-compatible 接口是是
Streaming / tools / json_schema是 —— json_schema 视模型而定是
响应中的 usage.cost是(合成值)是
按 key 的月消费上限是是
前沿闭源模型(Claude、GPT-6.1、Gemini、Grok)有 —— 所有 Claude 模型便宜 50–67%(Opus 5.5 便宜 60%,Sonnet 5.5 便宜 50%),Gemini 便宜 15%,GPT-6.1 和 Grok 按官方价是
首充返现首次充值 100% 等额返还,最高 $50(下一次充值时到账)有限的免费模型
最小充值金额$5$10

价格(每百万 tokens,USD)

对手方刊例价,最近核对于 2026-09-30。

模型QSP 输入QSP 输出openrouter 输入openrouter 输出对比刊例价
Claude Opus 5.5$1.60$8.00$4.00$20.0060%
Claude Sonnet 5.5$1.00$5.00$2.00$10.0050%
GLM-5.3$1.12$3.52$1.40$4.4020%
Gemini 3.8 Flash$0.6375$3.1875$0.75$3.7515%
Kimi K3$2.55$12.75$3.00$15.00~15%
MiniMax M3$0.24$0.96$0.30$1.2020%
Qwen 3.7 Plus$0.256$1.024$0.32$1.2820%
GPT-6.1 Sol$2.00$10.00$2.00$10.00at list

迁移:只改两行

修改后 · QuickSilver Pro
from openai import OpenAI

client = OpenAI(
    base_url="https://api.quicksilverpro.io/v1",
    api_key=os.environ["QSP_KEY"],
)

r = client.chat.completions.create(
    model="deepseek-v4-pro",
    messages=[{"role": "user", "content": "Hi"}],
)

常见问题

很多共享模型是的:Claude Opus 5.5 比 OpenRouter 公开单 token 价格低 60%,Claude Sonnet 5.5 低 50%;GLM-5.3、Qwen 3.7 Plus、MiniMax M3、MiMo V2.6 Pro 低约 20%;Kimi K3 与 Gemini 3.8 Flash 低约 15%。GPT-6.1 Sol、Grok 4.7 按官方价。价格会变动,上面的定价表是 2026 年 10 月的精确数字。

只改两行 OpenAI SDK 配置:把 base_url 从 openrouter.ai/api/v1 改成 api.quicksilverpro.io/v1,再替换 API key。模型 ID 映射:deepseek/deepseek-v4-flash-0731 -> deepseek-v4-flash、deepseek/deepseek-v4-pro -> deepseek-v4-pro、qwen/qwen3.7-max -> qwen3.7-max、qwen/qwen3.7-plus -> qwen3.7-plus、qwen/qwen3.7-flash -> qwen3.7-flash、qwen/qwen3.6-plus -> qwen3.6-plus、qwen/qwen3.6-35b-a3b -> qwen3.6-35b、moonshotai/kimi-k2.6 -> kimi-k2.6、moonshotai/kimi-k2.7-code -> kimi-k2.7-code、moonshotai/kimi-k3 -> kimi-k3、z-ai/glm-5.3 -> glm-5.3、z-ai/glm-5.3-flash -> glm-5.3-flash、openai/gpt-oss-120b -> gpt-oss-120b、qwen/qwen3.8-27b -> qwen3.8-27b、qwen/qwen3.8-flash -> qwen3.8-flash-next、qwen/qwen3.8-omni-flash -> qwen3.8-omni-flash、z-ai/glm-5.2 -> glm-5.2。

如果你的工作负载需要 Llama、Mistral 或社区长尾模型,那么 OpenRouter 更合适。闭源前沿模型这里也都有 —— GPT-6.1 Sol、Claude Opus 5.5 与 Sonnet 5.5、Gemini 3.8、Grok 4.7,一把 key 全搞定,其中 Claude Opus 5.5 比 OpenRouter 便宜 60%、Sonnet 5.5 便宜 50%,Gemini 比 Google 官方价便宜 15%。

对于共享模型,基本一样。Streaming、tool / function calling 和标准 usage 统计都能通过官方 OpenAI SDK 直接工作,每个响应还会返回一个按公开单 token 价格计算出的 usage.cost 合成值。json_schema strict mode 视模型而定:Claude 系列模型不支持,传入的 schema 只起提示作用,真正受约束的做法是声明一个 `strict: true` 的工具。

DeepSeek V4 Flash + Pro、Qwen 3.6/3.7 和 Kimi K2.6 在 OpenRouter 上都会默认开启 chain-of-thought,所以一句简单的“Hi”也可能返回数百个 reasoning tokens。对 DeepSeek V4 和 Kimi K2.6,我们原样透传请求:如需非思考的低成本聊天,请在请求体里传 `reasoning: { enabled: false }`。Qwen 3.6/3.7 系列在 QuickSilver Pro 上以非思考模式提供,直接作答;其中只有 Qwen 3.7 Max 可以通过 `enable_thinking: true` 重新开启思考。

用你自己的 key 开始

改两行代码,从第一次调用起就低于刊例价 20%。

获取 API Key