主题
计费与套餐
两种付费方式
| 方式 | 怎么用 | 钱从哪扣 |
|---|---|---|
| 按量计费 | 充值余额,用多少扣多少 | 账户余额 |
| 时长卡 / 订阅 | 兑换码激活,有效期内按套餐额度用 | 套餐额度,不动余额 |
余额的单位
1 余额 = 1 美元的官方价。
也就是说,余额是按各家模型官方定价的美元来计的。你实际扣多少,等于
实付 = 官方价 × 套餐倍率倍率见 模型清单 的套餐表 —— 倍率就是折扣,越低越便宜。 比如倍率 ×0.18 的档,等于官方价打 1.8 折。
每一笔都能核
控制台 → 用量 页逐条列出每次调用的实际扣费、token 数、模型和所用倍率, 把鼠标停在某条上还能看到那次的倍率。
按量计费怎么算
每个按量套餐有一个倍率(见 模型清单 的套餐表)。倍率越低越便宜。
同一个模型在不同套餐里倍率不同 —— 比如 GPT 系列有「特惠 / 首选 / 满血」三档, 差别在上游通道的质量与价格,模型本身是一样的。
实际单价以控制台为准
控制台 → 用量 页能看到每一次请求的实际扣费、token 数、模型和耗时。 以这里显示的为准;本页只讲规则,不列具体单价(单价会随上游调整变化)。
时长卡怎么算
- 按有效期计费,期内按套餐额度使用
- 只能用套餐里包含的模型(见 模型清单)
- 额度与有效期在控制台 → 订阅 页查看
额度怎么算(时长卡必读)
按长度扣,不是按次数扣
一次完整请求算一次消耗,不是「一次提问」算一次。 消耗按请求的长度算 —— 对话越长、带的代码越多,一次扣得越多。
商品页写的「约多少次」是按短对话估的参考值(约 2000 字问 + 500 字答)。 用编程类软件(Claude Code、Codex 这类)跑任务时上下文长、一个任务来回几十次, 实际次数会明显少于那个参考值。
每张卡有单日上限,整张卡另有总上限。 当天用满要等第二天窗口刷新, 当期没用掉的不会攒到下一期。
「上午还好好的,下午全报错」就是这个原因
不是服务故障,是当天额度用满了,等次日窗口刷新即可。
🔴 DeepSeek 的高峰时段(按 2 倍扣减)
DeepSeek 三张卡(V4-Flash / V4.1-Flash / V4-Pro)有高峰时段:
| 时段 | 扣减 |
|---|---|
| 工作日 09:00–12:00 | 2 倍 |
| 工作日 14:00–18:00 | 2 倍 |
| 其余时间、周末全天 | 平时 |
其他品牌的卡没有高峰。
想错峰用就避开这两段。具体数字以控制台 → 用量 页每条调用标注的实际消耗为准。
缓存命中更便宜
重复的前缀内容(比如每次都带的系统提示词、长文档)会命中缓存, 缓存部分的单价显著低于首次输入。
想吃到这个折扣,就让重复的内容放在前面、变化的内容放在后面 —— 前缀一变,缓存就不命中了。
在哪看账
| 想看什么 | 去哪 |
|---|---|
| 每次请求扣了多少 | 控制台 → 用量 |
| 余额还剩多少 | 控制台 → 首页 / 个人中心 |
| 时长卡还剩多久 | 控制台 → 订阅 |
| 某个 key 用了多少 | 控制台 → API 密钥 → 用量 |
充值
在 济川 AI 独立站 购买兑换码, 回控制台 → 兑换 页填入即可到账。