外观
模型与价格
以模型广场最终单价为准
模型广场是当前可用模型和价格的唯一实时来源。页面会分别展示每 100 万 tokens 的输入、输出和缓存价格;部分模型还会在详情中展示长上下文或动态阶梯价格。
充值 1 元人民币会增加 1 个平台额度。这是站内计量规则,不是人民币与美元之间的外汇兑换。模型广场显示的人民币单价已经包含当前模型和分组的计费配置,不需要再手动乘一次分组倍率。
价格可能调整
模型、分组、缓存和长上下文价格可能随上游成本变化。调整后的价格仅作用于调整后发起的请求,历史消费不会重新计算。正式批量调用前请再次查看模型广场。
分组说明
| 分组 | 倍率 | 适合场景 | 注意事项 |
|---|---|---|---|
| GPT特价 | 0.15x | 价格优先的日常问答和轻量代码 | 不支持 gpt-5.6-luna,稳定性和模型能力可能波动 |
| GPT普通 | 0.24x | 日常对话、编程和综合任务 | 价格、响应速度和稳定性较均衡 |
| GPT低延迟 | 0.24x | 低并发、需要快速响应的交互任务 | 共享总限额为 RPM 10,高并发时可能返回 429 |
| GPT稳定 | 0.32x | 生产环境、复杂任务和重要工作流 | 优先考虑持续可用性 |
| Claude | 0.33x | Claude 系列模型 | 适合推理、编码、文件和工具任务 |
| 国模 | 0.08x | DeepSeek-V4-Flash、Qwen3.8-Flash-Next | 使用本组独立价格 |
| DeepSeek官方 | 1.50x | deepseek-official-flash、deepseek-official-v4-pro | 按北京时间峰谷时段计费 |
| 生图 | 1.50x | gpt-image-2 | 实验性线路,每次固定生成 1 张 |
| auto | 1.00x | 自动选择可用线路 | 不使用 GPT特价、GPT低延迟和生图线路 |
可用模型和分组关系会变化,以上表格用于解释分组定位,实际可选项以模型广场和创建令牌页面为准。
费用计算
对于按 tokens 计费的模型,可按模型广场当前显示的最终单价估算:
text
预计费用 = 输入 tokens ÷ 1,000,000 × 输入单价
+ 输出 tokens ÷ 1,000,000 × 输出单价
+ 缓存 tokens ÷ 1,000,000 × 缓存单价
+ 其他按次费用例如,某模型当前显示输入 ¥0.90 / 1M、输出 ¥5.40 / 1M,一次请求使用 100,000 输入 tokens 和 20,000 输出 tokens:
text
输入费用:100,000 ÷ 1,000,000 × ¥0.90 = ¥0.09
输出费用: 20,000 ÷ 1,000,000 × ¥5.40 = ¥0.108
预计合计:¥0.198这个例子只演示计算方法,不代表任何模型的长期固定价格。动态定价模型还需按模型详情中的上下文区间计算。
实际扣费与核对
最终扣费以控制台“日志”中的请求记录为准。核对时请同时检查:
- 请求时间和 Request ID;
- 模型名与令牌分组;
- 输入、输出和缓存 tokens;
- 是否进入长上下文或其他动态价格区间;
- 单次请求实际扣除的额度。
发现重复扣费、计量异常或页面价格与日志不一致时,请保留 Request ID 并发送邮件至 cxblai@yeah.net。