共享算力

你的 Mac 跑模型,你赚 API 额度。

共享算力把闲置的 Apple Silicon Mac 接入 QuickSilver Pro 算力池。它用 Rapid-MLX 为开放权重模型 Qwen 3.8 27B 处理真实的客户请求,每处理一个 token 都会为你赚取额度,可用于调用我们托管的任何模型。

客户付费的 80%,以 API 额度发放。无需端口转发,随时可以停止。

看看你的 Mac 能赚多少额度

连接 Mac 前,先估算 30 天的收益。

请输入 Rapid-MLX 在你的 Mac 上显示的 tok/s。仅标注速度的预设是估算场景,并非机器性能测试。

这是一个假设值:在线时间中有多少用于处理请求,取决于算力池的流量。

每月 API 额度估算

$5.64

每个节点每月上限为 $20.00

每月输出 token 数估算:3,456,000

这些额度约可用于 GPT-6 Luna 的 11.28 百万个输出 token。

估算公式:tok/s × 每天小时数 × 3,600 × 30 天 × 处理请求的时间占比。额度按目录中的输出价格 × 80% 计算,且不超过上限。实际收益以客户支付金额为准。

此估算仅计算输出 token。实际收益还包括输入 token。上述可用量估算未计入输入费用。

算力池刚上线,流量有限。请将它视为抵扣 API 账单的方式,而非收入来源。这里的估算基于假设,不代表收益承诺。

工作原理

客户应用
QuickSilver API
算力池中转
你的 Mac

由你的 Mac 通过一条加密的 WebSocket 主动连接中转服务,外部不会有任何连接进入你的网络。

只需一条出站连接

不开入站端口,不做端口转发,也不需要公网 IP。你的 Mac 向中转服务建立一条 WebSocket 连接,请求会实时推送过来,不需要轮询任务队列。

真实请求,本地处理

Rapid-MLX 用你 Mac 的 GPU 运行模型并流式返回结果。算力池会把同一段对话固定路由到同一台设备,这样你 Mac 上的提示词缓存能让后续轮次保持快速。

每个 token 都有收益

token 数由 QuickSilver 自己计量,并计入你的账户余额。如果你的 Mac 正忙或离线,请求会改由云服务商处理,客户不会有任何感知。

四步开始共享

  1. 1

    创建 provider key

    登录后在控制台中打开「共享算力」,创建一个 provider key(以 qsppk- 开头)。它只能为你的账户注册设备,不能动用你的余额。 打开控制台

  2. 2

    安装 Rapid-MLX

    Rapid-MLX 是面向 Apple Silicon 的开源 MLX 推理引擎,需要 0.15.3 或更高版本。

    bash
    curl -fsSL https://rapidmlx.com/install.sh | bash
    export PATH="$HOME/.local/bin:$PATH"   # so this terminal finds rapid-mlx
    # or: brew install rapid-mlx

    通过 Homebrew 安装后首次运行出现证书错误?请运行 brew postinstall openssl@4,或使用上方的安装脚本。

  3. 3

    开始共享一个模型

    在终端运行下面的命令,并在提示时粘贴 provider key,这样密钥不会留在 shell 历史里。每台 Mac 请使用不同的 --worker 名称,按 Ctrl-C 即可停止。

    bash
    RAPID_MLX_DISABLE_DISK_CACHES=1 rapid-mlx share qwen3.8-27b --quicksilver --worker "$(hostname -s)"

    首次运行会下载约 15 GB 的模型,可能需要几分钟。准备就绪后,终端会显示“serving qwen3.8-27b to the QuickSilver pool”。

    请按示例将 RAPID_MLX_DISABLE_DISK_CACHES=1 保留在命令前;它可阻止 Rapid-MLX 将提示词缓存写入磁盘,使用 0.15.7 及更早版本时必须设置(这些版本在算力池模式下会忽略 --disable-disk-caches 标志)。后续 Rapid-MLX 版本会自动启用此保护。

    如果你在 2026-10-09 之前共享过算力,请一次性删除旧缓存:rm -rf ~/.cache/rapid-mlx/prefix_cache。

    更喜欢用图形界面?在 Rapid-MLX Desktop 中,于「设置 → 实验性功能」里打开共享算力,在 Live Pool 中选择模型,然后点击 Connect & serve。 下载 Rapid-MLX Desktop

  4. 4

    查看收益到账

    控制台中的「你的节点」会显示 Mac 是否在线,以及本月赚取的额度。收益每小时更新一次。

    打开控制台

    也可以在 Rapid-MLX Desktop 中查看收益:在控制台创建一个只读密钥(qsprk-),并添加到 Credits 页面。它只能读取你的收益。

不用 Mac?

算力池协议适用于任何运行 OpenAI 兼容服务(vLLM、llama.cpp、Ollama、LM Studio)的机器。用开源的参考客户端即可接入。 GitHub 上的 quicksilver-pool-node

阅读完整的 Rapid-MLX 共享算力指南

收益规则

你的 Mac 每处理一个请求,你就获得客户为该请求支付金额的 80%。收益自动跟随 QuickSilver 价目表:模型调价时,你的收益同步变化。QuickSilver 保留 20%,你的收益永远不会超过客户实际支付的金额。收益每小时结算一次,以 QuickSilver API 额度发放(非现金),每个节点每月上限 $20。

客户付费的 80%

你的 Mac 每处理一个请求,你就获得客户为该请求实际支付金额的 80%。QuickSilver 保留 20%,你的收益永远不会超过客户支付的金额。

跟随价目表

你的费率不是锁定的。它自动跟随 QuickSilver 价目表,模型涨价或降价时,你的收益同步变化。

每小时结算

收益每小时计入你的余额。结算延迟的部分会稍后补发,绝不会重复支付。

API 额度,不是现金

收益计入你的 QuickSilver 账户余额,可用于调用我们的任何模型。不支持提现、银行转账或加密货币支付,额度也不能转让。

单节点月度上限

为防范作弊,每个节点每个自然月(UTC)最多获得 $20。超出上限的部分不予支付,也不会结转到下月。

自己的流量不计收益

由你自己账户付费的 API 调用不会产生收益,即使由你的 Mac 处理也一样。你不能给自己付钱。

目前可以提供的模型

Qwen 3.8 27B 是算力池首发支持的模型。下表按当前标价计算你的收益(QuickSilver 价格的 80%,按每百万 token 计);每个请求实际按该客户被收取金额的 80% 结算。

你的收益(每百万 token,输入 / 输出)

Qwen3.8 27B
$0.272 / $1.632
qwen3.8-27b
推荐 Mac

M3/M4 Max 或 Ultra,36 GB 以上统一内存。27B 稠密模型需要 Max 级 GPU 算力才能快速响应。

费率自动跟随我们的价目表。之后我们会增加更多模型。

作为贡献者的责任

你的 Mac 会处理真实客户的提示词和回复。客户把这些数据托付给我们,因此共享算力即表示你同意谨慎对待这些数据。

  • 不要记录、保存或查看客户内容。 运行节点时关闭请求日志,绝不存储、查看或再利用任何提示词或回复。 请按示例将 RAPID_MLX_DISABLE_DISK_CACHES=1 保留在命令前;它可阻止 Rapid-MLX 将提示词缓存写入磁盘,使用 0.15.7 及更早版本时必须设置(这些版本在算力池模式下会忽略 --disable-disk-caches 标志)。后续 Rapid-MLX 版本会自动启用此保护。
  • 不要篡改输出。 如实运行所列模型,绝不修改、过滤或伪造回复。
  • 用量由我们计量。 QuickSilver 自行统计 token 数,不采信节点上报的数据。上报与实测不符的节点会被标记审查。
  • 我们可以移除节点。 如果节点违反这些规则或影响服务质量,我们可以将其移除,并暂扣通过滥用获得的额度。如需永久移除你的机器,请在控制台中打开「你的节点」→「移除」。如需帮助,请发送邮件至 hello@quicksilverpro.io。

贡献者条款是以下文件的一部分: 服务条款 · 隐私政策

常见问题

让你的 Mac 干活

创建一个 provider key,运行一条命令,你的 Mac 就开始在真实流量上赚取 API 额度。