跳到主要内容

模型定价与计费

Bita API 中不同模型的输入、输出和其他能力价格可能不同。调用前应先在模型广场确认当前价格,并结合 API 密钥分组倍率估算实际消耗。

查看模型价格

打开 Bita API,点击顶部导航栏中的「模型广场」。

Bita API 模型广场

每张模型卡片会显示模型 ID、输入价格、输出价格、缓存价格、分组、定价类型和支持的接口标签。点击「详情」可以查看完整信息。

模型和价格可能随平台配置更新,本文中的公式用于帮助理解计费方式,具体价格始终以模型广场实时显示为准。

价格显示单位

模型列表上方可以在 /1M/1K 之间切换价格单位:

单位含义
/1M每 1,000,000 Token 的价格
/1K每 1,000 Token 的价格

两种单位只是同一价格的不同显示方式。例如:

$3 / 1M Token = $0.003 / 1K Token

切换单位不会改变模型实际价格,也不会改变 API 密钥分组。

“标准”和“充值”显示

模型广场顶部提供「标准」和「充值」价格展示口径。切换后,请按照页面当前显示的单位和数值比较模型价格。

这里的「充值」是价格展示口径,不表示平台支持在线充值。Bita API 当前仍通过线下渠道处理账户充值,具体参见线下充值

定价类型

按量计费

按量计费通常根据实际 Token 或其他使用量结算。文本模型常见的计费项目包括:

  • 输入:发送给模型的提示词、系统消息和历史上下文。
  • 输出:模型生成的回复内容。
  • 缓存:命中提示词缓存时适用的输入价格。

模型广场中输入、输出和缓存价格通常分别展示,不能只查看其中一个价格。

按次计费

按次计费按照请求次数或任务次数收取固定费用,常用于部分图片、视频或其他专项模型。

模型基础消耗 = 成功计费次数 × 单次价格

是否扣费、失败请求是否计费以及具体计费单位,应以模型详情和最终使用记录为准。

输入与输出费用

/1M 为显示单位时,文本请求的基础费用可以这样估算:

输入费用 = 输入 Token 数 ÷ 1,000,000 × 输入单价
输出费用 = 输出 Token 数 ÷ 1,000,000 × 输出单价
模型基础消耗 = 输入费用 + 输出费用

假设某模型显示:

  • 输入:$3 / 1M Token
  • 输出:$9 / 1M Token

一次请求使用 100,000 个输入 Token,并生成 20,000 个输出 Token:

输入费用 = 100,000 ÷ 1,000,000 × $3 = $0.30
输出费用 = 20,000 ÷ 1,000,000 × $9 = $0.18
模型基础消耗 = $0.30 + $0.18 = $0.48

这只是便于理解的计算示例,不代表某个具体模型的固定价格。

缓存价格

部分模型支持提示词缓存,并在模型卡片中显示「缓存」价格。

缓存命中时,对应的缓存输入通常按缓存价格计算,而不是再次按完整输入价格计算。是否支持缓存、缓存有效期和实际命中数量由模型及接口决定。

如果响应或使用记录中提供缓存 Token 数,可以结合模型卡片上的缓存价格核对费用。

分组倍率

API 密钥所属分组会参与最终计费。可以使用下面的简化公式理解:

实际消耗 = 模型基础消耗 × 分组倍率

继续使用上面的 $0.48 模型基础消耗示例:

分组倍率计算实际消耗
1x$0.48 × 1$0.48
0.7x$0.48 × 0.7$0.336
0.6x$0.48 × 0.6$0.288
不能只比较分组倍率

不同分组可能使用不同的模型渠道,支持的模型和基础价格也可能不同。应先确认模型可用,再结合模型价格和分组倍率比较最终成本。

关于分组的完整说明,参见创建 API 密钥:分组

上下文为什么会增加费用

对话接口通常会把当前消息、系统消息以及需要保留的历史消息一起发送给模型。对话轮次越多,输入 Token 数可能越大。

常见的费用增长原因包括:

  • 历史消息持续累积
  • 系统提示词过长
  • 输入大型文档或代码文件
  • 模型生成内容过长
  • 工具调用携带大量参数或返回结果
  • 图片、音频等多模态输入

控制上下文长度和输出上限,通常比单纯更换低倍率分组更能避免意外消耗。

预扣与结算

部分请求会先根据预计用量预扣余额,响应完成后再按照实际用量结算,并调整预扣与实际费用之间的差额。

因此,请求执行中的余额变化不一定是最终金额。核对费用时,应以请求完成后的调用记录为准。

核对某次调用的费用

进入使用记录页面,按时间、API 密钥或模型筛选对应请求,并检查:

  1. 调用的模型 ID
  2. 输入和输出 Token 数量
  3. 缓存或其他专项用量
  4. API 密钥所属分组
  5. 分组倍率
  6. 最终实际消耗

如果实际消耗与估算不同,还应确认模型价格是否更新、请求是否包含额外能力,以及对话上下文是否比预期更长。

控制使用成本

  • 为不同项目创建独立 API 密钥,方便分别核对用量。
  • 为测试或临时项目设置 API 密钥额度上限。
  • 首次接入时使用较短的提示词和输出内容。
  • 定期查看使用记录和余额变化。
  • 不再使用的 API 密钥应及时停用或删除。
  • 调用前在模型广场确认最新价格和分组倍率。

下一步

需要调整、停用或删除现有 API 密钥时,继续阅读管理 API Key