首頁 / 模型

模型目錄

Claude / GPT 6.6折 6.6折 · DeepSeek / Kimi K3 8.8折 · GLM 低至 8折。折扣是長期政策而非促銷——用 GET /v1/models 檢視你的 Key 實時可用模型。

計價基準

本站費率與各廠商官方刊例價的對照。你的金鑰對應的實時目錄以 GET /v1/models 為準。

模型系列計價基準
Claude6.6折
GPT6.6折
DeepSeek8.8折
Kimi官方價 88%
GLM-5.38折
GLM-5.27折
Qwen

以上為本站公開的計價口徑;實時價格請以你自己金鑰的 GET /v1/models 返回為準。

模型目錄

一把 Key 通調所有主流模型

Claude / GPT 6.6折 6.6折;DeepSeek / Kimi 8.8折、GLM 低至 8折。以 Key 查實時目錄:GET /v1/models

OpenAI GPT
GPT-5.5 · Codex 線路

GPT-5.5 旗艦推理與 Codex 編碼線路,適配 OpenAI Agent 生態——Responses 與 Chat 雙格式。

GPT-5.5 · 旗艦
Codex · 編碼線路
已上線Responses API
Claude
Anthropic · 推理

Opus 5:以約一半價格逼近 Fable 5 前沿智慧;Sonnet 5:最具 Agent 能力的 Sonnet;Haiku 4.5:最快最省,SWE-bench 73.3%。

Opus 5 · 1M 上下文
Fable 5 · 1M 上下文
Sonnet 5 · 1M 上下文
Haiku 4.5 · 200K
已上線
Kimi
月之暗面 · 長上下文

全球首個 3 萬億級開源模型——2.8T 引數、原生視覺、百萬級上下文,為長程程式設計與知識工作而生。

Kimi K3
已上線
GLM
智譜 · 中文原生

GLM-5.3:全部增益來自後訓練,程式設計較 5.2 提升 50%、開源最強;GLM-5.2:MIT 開源旗艦,真 1M 上下文。

GLM-5.3
GLM-5.3 Flash
GLM-5.2
已上線
DeepSeek
深度求索 · 寫程式碼

V4-Pro(1.6T/49B 啟用)效能對標頂級閉源模型;V4-Flash(284B/13B)高效平價。原生 1M 上下文。

分時段計費:北京時間週一至週五 09:00–12:00、14:00–18:00 按原價計費,其餘時間(含週末)半價。

V4 Pro / V4 Flash
已上線
Qwen
阿里 · 價效比 & 視覺

3.8-Max:2.4 萬億 MoE 開源旗艦,可自主編碼並交付橫跨 10 天以上的完整專案;Flash:每 token 僅啟用 6B 引數卻擁有 1M 上下文。

3.8 Max / Flash
3-VL Plus · 視覺
已上線
還需要什麼模型?
GPT-5.5 / Codex 也來了

多廠商路線持續擴充套件——Telegram 告訴我們你的需求。

計費方式說明

按量計費,逐次計量。無訂閱、額度永不過期。

輸入 tokens 1×
傳送給模型的提示詞與上下文,按各模型公佈價計費——Claude 與 GPT 6.6折DeepSeek / Kimi 8.8折。
輸出 tokens 輸入價的 5×
模型生成的文字。多數模型輸出價為輸入價的 5 倍(DeepSeek 為 2 倍)。流式與非流式計費相同。
快取命中(讀取) 輸入價的 0.1×
命中廠商提示詞快取的上下文——按輸入價的 10% 計費。保持 system prompt 穩定即可命中,這是最大的省錢槓桿。
快取寫入 輸入價的 1.25×
為複用而儲存上下文(Claude 系列模型),按輸入價的 125% 一次性計費,之後讀取按 10%。
思考 tokens = 輸出價
擴充套件思考模型的推理 tokens 完全按輸出價計費——沒有任何隱藏倍率。
折扣 長期有效
折扣是政策而非促銷:Claude 與 GPT 6.6折 6.6折,DeepSeek/Kimi 8.8折,GLM 低至 8折。永不過期、不繫結活動視窗。

控制台逐條列明每次呼叫——輸入、輸出、快取與思考 tokens 均可查。實時價格可用 GET /v1/models 核驗。