模型目录
一把 Key 通调所有主流模型
Claude / GPT 官方价 6.6 折;DeepSeek / Kimi 8.8 折、GLM 低至 7 折。以 Key 查实时目录:GET /v1/models
G
OpenAI GPT
GPT-5.5 · Codex 线路
GPT-5.5 旗舰推理与 Codex 编码线路,适配 OpenAI Agent 生态——Responses 与 Chat 双格式。
GPT-5.5 · 旗舰
Codex · 编码线路
已上线Responses API
C
Claude
Anthropic · 推理
Opus 5:以约一半价格逼近 Fable 5 前沿智能;Sonnet 5:最具 Agent 能力的 Sonnet;Haiku 4.5:最快最省,SWE-bench 73.3%。
Opus 5 · 1M 上下文
Fable 5 · 1M 上下文
Sonnet 5 · 1M 上下文
Haiku 4.5 · 200K
已上线
K
Kimi
月之暗面 · 长上下文
全球首个 3 万亿级开源模型——2.8T 参数、原生视觉、百万级上下文,为长程编程与知识工作而生。
Kimi K3
已上线
G
GLM
智谱 · 中文原生
GLM-5.3:全部增益来自后训练,编程较 5.2 提升 50%、开源最强;GLM-5.2:MIT 开源旗舰,真 1M 上下文。
GLM-5.3
GLM-5.3 Flash
GLM-5.2
已上线
D
DeepSeek
深度求索 · 写代码
V4-Pro(1.6T/49B 激活)性能对标顶级闭源模型;V4-Flash(284B/13B)高效平价。原生 1M 上下文。
V4 Pro / V4 Flash
已上线
Q
Qwen
阿里 · 性价比 & 视觉
3.8-Max:2.4 万亿 MoE 开源旗舰,可自主编码并交付横跨 10 天以上的完整项目;Flash:每 token 仅激活 6B 参数却拥有 1M 上下文。
3.8 Max / Flash
3-VL Plus · 视觉
已上线
还需要什么模型?
GPT-5.5 / Codex 也来了
多厂商路线持续扩展——Telegram 告诉我们你的需求。
计费方式说明
按量计费,逐次计量。无订阅、额度永不过期。
输入 tokens 1×
发送给模型的提示词与上下文,按各模型公布价计费——Claude 与 GPT 官方价 6.6 折,其他主流模型按官方价。
输出 tokens 输入价的 5×
模型生成的文本。多数模型输出价为输入价的 5 倍(DeepSeek 为 2 倍)。流式与非流式计费相同。
缓存命中(读取) 输入价的 0.1×
命中厂商提示词缓存的上下文——按输入价的 10% 计费。保持 system prompt 稳定即可命中,这是最大的省钱杠杆。
缓存写入 输入价的 1.25×
为复用而存储上下文(Claude 系列模型),按输入价的 125% 一次性计费,之后读取按 10%。
思考 tokens = 输出价
扩展思考模型的推理 tokens 完全按输出价计费——没有任何隐藏倍率。
折扣 长期有效
折扣是政策而非促销:Claude 与 GPT 官方价 6.6 折,DeepSeek/Kimi 8.8 折,GLM 7–8 折。永不过期、不绑定活动窗口。
控制台逐条列明每次调用——输入、输出、缓存与思考 tokens 均可查。实时价格可用 GET /v1/models 核验。