Skip to content

模型与价格

以模型广场最终单价为准

模型广场是当前可用模型和价格的唯一实时来源。页面会分别展示每 100 万 tokens 的输入、输出和缓存价格;部分模型还会在详情中展示长上下文或动态阶梯价格。

充值 1 元人民币会增加 1 个平台额度。这是站内计量规则,不是人民币与美元之间的外汇兑换。模型广场显示的人民币单价已经包含当前模型和分组的计费配置,不需要再手动乘一次分组倍率。

价格可能调整

模型、分组、缓存和长上下文价格可能随上游成本变化。调整后的价格仅作用于调整后发起的请求,历史消费不会重新计算。正式批量调用前请再次查看模型广场。

分组说明

分组倍率适合场景注意事项
GPT特价0.15x价格优先的日常问答和轻量代码不支持 gpt-5.6-luna,稳定性和模型能力可能波动
GPT普通0.24x日常对话、编程和综合任务价格、响应速度和稳定性较均衡
GPT低延迟0.24x低并发、需要快速响应的交互任务共享总限额为 RPM 10,高并发时可能返回 429
GPT稳定0.32x生产环境、复杂任务和重要工作流优先考虑持续可用性
Claude0.33xClaude 系列模型适合推理、编码、文件和工具任务
国模0.08xDeepSeek-V4-FlashQwen3.8-Flash-Next使用本组独立价格
DeepSeek官方1.50xdeepseek-official-flashdeepseek-official-v4-pro按北京时间峰谷时段计费
生图1.50xgpt-image-2实验性线路,每次固定生成 1 张
auto1.00x自动选择可用线路不使用 GPT特价、GPT低延迟和生图线路

可用模型和分组关系会变化,以上表格用于解释分组定位,实际可选项以模型广场和创建令牌页面为准。

费用计算

对于按 tokens 计费的模型,可按模型广场当前显示的最终单价估算:

text
预计费用 = 输入 tokens ÷ 1,000,000 × 输入单价
         + 输出 tokens ÷ 1,000,000 × 输出单价
         + 缓存 tokens ÷ 1,000,000 × 缓存单价
         + 其他按次费用

例如,某模型当前显示输入 ¥0.90 / 1M、输出 ¥5.40 / 1M,一次请求使用 100,000 输入 tokens 和 20,000 输出 tokens:

text
输入费用:100,000 ÷ 1,000,000 × ¥0.90 = ¥0.09
输出费用: 20,000 ÷ 1,000,000 × ¥5.40 = ¥0.108
预计合计:¥0.198

这个例子只演示计算方法,不代表任何模型的长期固定价格。动态定价模型还需按模型详情中的上下文区间计算。

实际扣费与核对

最终扣费以控制台“日志”中的请求记录为准。核对时请同时检查:

  • 请求时间和 Request ID;
  • 模型名与令牌分组;
  • 输入、输出和缓存 tokens;
  • 是否进入长上下文或其他动态价格区间;
  • 单次请求实际扣除的额度。

发现重复扣费、计量异常或页面价格与日志不一致时,请保留 Request ID 并发送邮件至 cxblai@yeah.net

平台仅供合规用途。