首頁 / 學習 / 什麼是 AI API 閘道器

什麼是 AI API 閘道器?

AI API 閘道器是一種服務:給你一個統一的介面地址、一個 Key、一個餘額,背後對接多個模型廠商。你的請求只發一次,閘道器負責選路、轉發、把回覆按原格式返回,並按實際用掉的 token 計費。

定義

AI API 閘道器是放在多個大模型廠商前面的一層中間服務,對外只暴露一個穩定的介面地址。你不需要為 Claude、GPT、DeepSeek、Qwen、Kimi、GLM 各開一個賬號、各管一把 Key、各充一次餘額——客戶端只連一個 base_url,閘道器負責鑑權、選上游線路、轉發請求,並把回覆按廠商原本的格式返回。

QuantoPort 就是這樣的閘道器:一個 Key、一個餘額,同一臺主機上提供 OpenAI 相容、Anthropic 相容與 Responses 三種介面。

一次請求實際發生了什麼

  1. 鑑權:校驗你的 Key,並檢查這個 Key 關聯的餘額。
  2. 選路:按請求裡的模型名選擇上游廠商和介面格式。
  3. 轉換:如果你用 OpenAI 的格式請求 Anthropic 系模型(或反過來),閘道器在收發兩個方向各做一次格式轉換。
  4. 流式或緩衝:服務端推送(SSE)原樣透傳,流式客戶端不需要改程式碼。
  5. 計費:按廠商返回的用量統計輸入與輸出 token,從同一個餘額里扣。
  6. 對賬:控制台裡可以看每個 Key 的用量、消費和剩餘額度。

為什麼用閘道器,而不是每個廠商各開一個賬號

關注點每家用一個賬號用一個 AI API 閘道器
金鑰每家一把 Key,分別輪換一個 Key 通調所有模型
計費多個餘額、多種幣種、多張賬單一個餘額,一次充值
客戶端程式碼每家一套 SDK 和請求格式OpenAI / Anthropic 相容的 base_url
換模型改程式碼、換憑證改請求裡的模型名
開通門檻逐家註冊,各有地區與支付限制一次開通、一條支付通道

計費方式

按 token 計費,價格是廠商官方價的一個比例。QuantoPort 對外公示的比例是:

模型家族相對官方價
Claude / GPT官方價 6.6 折
DeepSeek / Kimi官方價 8.8 折
GLM-5.3官方價八折
GLM-5.2官方價七折
Qwen官方價

充值額度永不過期,最低充值 $10,支援 USDT(TRC-20 / BSC / Solana)。每個 Key 的實時模型列表隨時可以用 GET /v1/models 查;OpenAI 相容客戶端的 base_url 是 https://quantoport.com/v1,Anthropic 相容客戶端是 https://quantoport.com。

閘道器改變不了什麼

閘道器不是模型。它不訓練、不微調、也不自己託管它轉發的模型,也無法超過上游廠商的上下文長度、限流和能力邊界。模型名稱只表示相容性。QuantoPort 與 Anthropic、OpenAI、DeepSeek、阿里等廠商沒有關聯,也不代表它們的認可。

常見問題

閘道器會比直連官方慢嗎?閘道器多一跳網路和一次格式轉換。對聊天類流式任務,首字延遲的差異相對模型推理時間很小;而它省掉的是維護多套廠商接入的時間。

已有的 OpenAI 或 Anthropic 客戶端能直接用嗎?可以。把 base_url 指向閘道器、換成閘道器的 Key,請求格式不變,其他程式碼不用動。

怎麼知道現在有哪些模型?用你的 Key 調 GET /v1/models。這份列表是按 Key 實時生成的,比任何靜態目錄頁都準。

廠商改了介面怎麼辦?由閘道器吸收這次改動,你的客戶端繼續調同一個地址。

用一個 Key 試一下

建立 Key,把客戶端指向 base_url,換模型只改模型名。