按 token 实时计费 · 用多少算多少

模型定价

Claude、GPT / Codex、DeepSeek 全系列模型统一接入,按 token 用量实时结算, 表中即为实付单价。无月费、无最低消费,缓存命中的部分自动按折扣价计费。

输入 / 输出分别计价 缓存读取低至 1 折 余额永不过期 用量实时可查

模型价格

单价单位:美元 / 1M token
模型 上下文 输入 输出 缓存写入 缓存读取

费用估算

按一次典型会话估算,实际以「使用记录」页面的账单为准
预计花费
$0.00

计费说明

几条决定你实际花多少钱的规则

怎么算钱

每次请求按 输入 tokens × 输入单价 + 输出 tokens × 输出单价 结算,再乘以所选分组的倍率,从账户余额中扣除。没有月费,也没有最低消费。

缓存能省多少

Claude Code 等工具会自动缓存长上下文。首次写入缓存约为输入价的 1.25 倍,之后每次命中只按 输入价的 10% 计费——长会话里这部分往往占大头,实际支出远低于按输入原价估算。

倍率与分组

倍率是该分组相对基准单价的计费系数,表中展示的已是按倍率折算后的实付价,不必再乘一次。创建密钥时选定分组,之后可在密钥设置里随时更换;不同分组的模型清单与上游通道相互独立。

用量查询

登录后在「使用记录」页可以看到每次请求的模型、token 数与扣费明细,按天/按密钥汇总。本页价格如与站内展示不一致,以站内为准

先拿一把密钥,跑一跑再决定

五分钟接入 Claude Code / Codex / Gemini CLI,用量与花费实时可查。