模型目錄
一把 Key 通調所有主流模型
Claude / GPT 6.6折 6.6折;DeepSeek / Kimi 8.8折、GLM 低至 8折。以 Key 查實時目錄:GET /v1/models
G
OpenAI GPT
GPT-5.5 · Codex 線路
GPT-5.5 旗艦推理與 Codex 編碼線路,適配 OpenAI Agent 生態——Responses 與 Chat 雙格式。
GPT-5.5 · 旗艦
Codex · 編碼線路
已上線Responses API
C
Claude
Anthropic · 推理
Opus 5:以約一半價格逼近 Fable 5 前沿智慧;Sonnet 5:最具 Agent 能力的 Sonnet;Haiku 4.5:最快最省,SWE-bench 73.3%。
Opus 5 · 1M 上下文
Fable 5 · 1M 上下文
Sonnet 5 · 1M 上下文
Haiku 4.5 · 200K
已上線
K
Kimi
月之暗面 · 長上下文
全球首個 3 萬億級開源模型——2.8T 引數、原生視覺、百萬級上下文,為長程程式設計與知識工作而生。
Kimi K3
已上線
G
GLM
智譜 · 中文原生
GLM-5.3:全部增益來自後訓練,程式設計較 5.2 提升 50%、開源最強;GLM-5.2:MIT 開源旗艦,真 1M 上下文。
GLM-5.3
GLM-5.3 Flash
GLM-5.2
已上線
D
DeepSeek
深度求索 · 寫程式碼
V4-Pro(1.6T/49B 啟用)效能對標頂級閉源模型;V4-Flash(284B/13B)高效平價。原生 1M 上下文。
分時段計費:北京時間週一至週五 09:00–12:00、14:00–18:00 按原價計費,其餘時間(含週末)半價。
V4 Pro / V4 Flash
已上線
Q
Qwen
阿里 · 價效比 & 視覺
3.8-Max:2.4 萬億 MoE 開源旗艦,可自主編碼並交付橫跨 10 天以上的完整專案;Flash:每 token 僅啟用 6B 引數卻擁有 1M 上下文。
3.8 Max / Flash
3-VL Plus · 視覺
已上線
還需要什麼模型?
GPT-5.5 / Codex 也來了
多廠商路線持續擴充套件——Telegram 告訴我們你的需求。
計費方式說明
按量計費,逐次計量。無訂閱、額度永不過期。
輸入 tokens 1×
傳送給模型的提示詞與上下文,按各模型公佈價計費——Claude 與 GPT 6.6折DeepSeek / Kimi 8.8折。
輸出 tokens 輸入價的 5×
模型生成的文字。多數模型輸出價為輸入價的 5 倍(DeepSeek 為 2 倍)。流式與非流式計費相同。
快取命中(讀取) 輸入價的 0.1×
命中廠商提示詞快取的上下文——按輸入價的 10% 計費。保持 system prompt 穩定即可命中,這是最大的省錢槓桿。
快取寫入 輸入價的 1.25×
為複用而儲存上下文(Claude 系列模型),按輸入價的 125% 一次性計費,之後讀取按 10%。
思考 tokens = 輸出價
擴充套件思考模型的推理 tokens 完全按輸出價計費——沒有任何隱藏倍率。
折扣 長期有效
折扣是政策而非促銷:Claude 與 GPT 6.6折 6.6折,DeepSeek/Kimi 8.8折,GLM 低至 8折。永不過期、不繫結活動視窗。
控制台逐條列明每次呼叫——輸入、輸出、快取與思考 tokens 均可查。實時價格可用 GET /v1/models 核驗。