BSXin AI

模型、分组与计费

了解模型价格、分组倍率、缓存价格,以及单个请求的费用计算。

代币

BSXin AI 由 Remiaft LLC 运营并负责用量结算。BSXin AI 以代币计费。人民币 1 元等于 10 代币。在控制台中,每个代币金额前都有一个像素风面包图标。扣费最多保留 9 位小数。小额请求不会被向上取整到整分。

在哪里查看价格

  • 模型广场:打开 https://bsxinai.com/marketplace。选择一个分组,查看其价格。
  • API 密钥:选择密钥的模型价格与倍率,查看其所属分组的价格。
  • 创建密钥时:创建对话框会显示所选分组的价格摘要。

文本价格的单位是代币 / 百万 Token(/1M)。在模型广场中选择 /1K,可按代币 / 千 Token 查看。图片价格和按次计费的价格使用各自的单位。

模型广场

分组倍率

每个分组都有计费倍率。模型广场以标签形式显示倍率,例如 倍率 ×3.5。模型在分组内可以有自己的倍率。标签显示的是计费实际使用的倍率。

所有显示的价格都已包含倍率。 不要再次相乘。同一个模型在不同分组中的价格可能不同。

价格类型

价格适用范围
输入普通输入 Token。不含缓存读取和缓存写入。
输出全部输出 Token,包括推理 Token。
缓存读取从提示词缓存中读取的输入 Token。
缓存写入(5 分钟)写入有效期 5 分钟的缓存的输入 Token。
缓存写入(1 小时)写入有效期 1 小时的缓存的输入 Token。

没有单独缓存读取价格的模型,缓存读取按输入价格计费。某个缓存时长没有单独写入价格的模型,使用其通用缓存写入价格;没有通用价格时,使用输入价格。部分模型按上下文长度分档,例如短上下文和长上下文。每一档都有各自的价格。

单个请求的费用

单个文本请求的费用(以代币计)为:

C=Nin Pin+Nout Pout+Ncr Pcr+Ncw Pcw1,000,000C = \frac{N_{\text{in}} \, P_{\text{in}} + N_{\text{out}} \, P_{\text{out}} + N_{\text{cr}} \, P_{\text{cr}} + N_{\text{cw}} \, P_{\text{cw}}}{1{,}000{,}000}
  • NinN_{\text{in}}、NoutN_{\text{out}}、NcrN_{\text{cr}} 和 NcwN_{\text{cw}} 分别是使用记录中的输入、输出、缓存读取和缓存写入 Token 数。
  • PinP_{\text{in}}、PoutP_{\text{out}}、PcrP_{\text{cr}} 和 PcwP_{\text{cw}} 是显示的价格,单位为代币 / 百万 Token,已包含倍率。
  • PcwP_{\text{cw}} 是 5 分钟或 1 小时的缓存写入价格,取决于请求指定的缓存时长。

示例

某分组中一个模型的价格为:输入 30、输出 150、缓存读取 3、缓存写入(5 分钟)37.5,单位均为代币 / 百万 Token。某请求包含 1,000 个输入 Token、500 个输出 Token、8,000 个缓存读取 Token 和 2,000 个缓存写入 Token。

C=1000×30+500×150+8000×3+2000×37.51,000,000=0.204 CoinC = \frac{1000 \times 30 + 500 \times 150 + 8000 \times 3 + 2000 \times 37.5}{1{,}000{,}000} = 0.204 \text{ Coin}

费用为 0.204 代币,即人民币 0.0204 元。以上价格仅为示例,实际价格请在模型广场中查看。

余额还是套餐

  • 生效中的套餐所覆盖的请求,计入套餐限额,不扣减钱包余额。
  • 其他请求按其费用扣减钱包余额。
  • 价格之后发生变化,不会改变已记录的扣费。

套餐规则请参阅充值、套餐与兑换码。

降低费用

  • 把较长且稳定的内容放在提示词开头,以提高缓存命中率。
  • 在模型广场中比较同一模型在不同分组中的价格。
  • 在专业模式中为密钥设置倍率上限,跳过价格较高的线路。

本页目录