定義
AI API 閘道器是放在多個大模型廠商前面的一層中間服務,對外只暴露一個穩定的介面地址。你不需要為 Claude、GPT、DeepSeek、Qwen、Kimi、GLM 各開一個賬號、各管一把 Key、各充一次餘額——客戶端只連一個 base_url,閘道器負責鑑權、選上游線路、轉發請求,並把回覆按廠商原本的格式返回。
QuantoPort 就是這樣的閘道器:一個 Key、一個餘額,同一臺主機上提供 OpenAI 相容、Anthropic 相容與 Responses 三種介面。
一次請求實際發生了什麼
- 鑑權:校驗你的 Key,並檢查這個 Key 關聯的餘額。
- 選路:按請求裡的模型名選擇上游廠商和介面格式。
- 轉換:如果你用 OpenAI 的格式請求 Anthropic 系模型(或反過來),閘道器在收發兩個方向各做一次格式轉換。
- 流式或緩衝:服務端推送(SSE)原樣透傳,流式客戶端不需要改程式碼。
- 計費:按廠商返回的用量統計輸入與輸出 token,從同一個餘額里扣。
- 對賬:控制台裡可以看每個 Key 的用量、消費和剩餘額度。
為什麼用閘道器,而不是每個廠商各開一個賬號
| 關注點 | 每家用一個賬號 | 用一個 AI API 閘道器 |
|---|---|---|
| 金鑰 | 每家一把 Key,分別輪換 | 一個 Key 通調所有模型 |
| 計費 | 多個餘額、多種幣種、多張賬單 | 一個餘額,一次充值 |
| 客戶端程式碼 | 每家一套 SDK 和請求格式 | OpenAI / Anthropic 相容的 base_url |
| 換模型 | 改程式碼、換憑證 | 改請求裡的模型名 |
| 開通門檻 | 逐家註冊,各有地區與支付限制 | 一次開通、一條支付通道 |
計費方式
按 token 計費,價格是廠商官方價的一個比例。QuantoPort 對外公示的比例是:
| 模型家族 | 相對官方價 |
|---|---|
| Claude / GPT | 官方價 6.6 折 |
| DeepSeek / Kimi | 官方價 8.8 折 |
| GLM-5.3 | 官方價八折 |
| GLM-5.2 | 官方價七折 |
| Qwen | 官方價 |
充值額度永不過期,最低充值 $10,支援 USDT(TRC-20 / BSC / Solana)。每個 Key 的實時模型列表隨時可以用 GET /v1/models 查;OpenAI 相容客戶端的 base_url 是 https://quantoport.com/v1,Anthropic 相容客戶端是 https://quantoport.com。
閘道器改變不了什麼
閘道器不是模型。它不訓練、不微調、也不自己託管它轉發的模型,也無法超過上游廠商的上下文長度、限流和能力邊界。模型名稱只表示相容性。QuantoPort 與 Anthropic、OpenAI、DeepSeek、阿里等廠商沒有關聯,也不代表它們的認可。
常見問題
閘道器會比直連官方慢嗎?閘道器多一跳網路和一次格式轉換。對聊天類流式任務,首字延遲的差異相對模型推理時間很小;而它省掉的是維護多套廠商接入的時間。
已有的 OpenAI 或 Anthropic 客戶端能直接用嗎?可以。把 base_url 指向閘道器、換成閘道器的 Key,請求格式不變,其他程式碼不用動。
怎麼知道現在有哪些模型?用你的 Key 調 GET /v1/models。這份列表是按 Key 實時生成的,比任何靜態目錄頁都準。
廠商改了介面怎麼辦?由閘道器吸收這次改動,你的客戶端繼續調同一個地址。