计费指南

模型 API 如何计费?

在模型广场查看当前模型、价格与倍率,并用控制台调用记录核对实际费用。

先在模型广场查看模型与价格

打开模型广场,可以按平台、分组、倍率和模型名称筛选当前模型,并比较本站价格与模型厂商的官方参考价。

  • 未登录访问:查看公开分组中的模型、计价方式、本站价格、官方参考价和分组倍率。
  • 登录后访问:除公开信息外,还可看到当前账户获准的专属分组和个人倍率。
  • 区分价格口径:官方参考价只用于比较,不是 KHaiXAPI 的结算价;本站价格和倍率可能随配置调整。
  • 核对实际费用:峰值倍率、缓存、推理、多模态及其他计费项目以页面提示和控制台调用记录为准。

模型 API 费用是怎么计算的

KHaiXAPI 的模型、单价、计价单位、倍率和可用状态会更新。请在模型广场查看当前公开计价信息,并以调用时适用的规则和控制台调用记录核对实际费用。

文本生成按实际用量计费,通常按照输入和输出 Token 数量计算,每次使用的消耗会因内容、上下文和输出长度不同而不同。图像生成按实际生成张数收费,每张图片的单价由本次请求最终确定的 1K、2K 或 4K 清晰度档位决定;同一请求返回多张图片时,按实际生成张数累计。具体计费项目以模型广场和调用记录为准。

文本基础费用 = 输入 Token ÷ 计价单位 × 输入单价 + 输出 Token ÷ 计价单位 × 输出单价

模型广场中的“本站价格”可用于了解当前计价水平;“官方参考价”用于和模型厂商公开价格比较,不是本站结算价。页面列出的倍率和峰值规则可能影响实际费用,最终应以调用记录为准。

一个 Token 等于多少字

Token 是模型处理文本时使用的单位,不等同于汉字数、单词数或字符数。语言、标点、数字、代码、空格和模型采用的分词方式都会影响结果,因此不存在长期准确的“一个 Token 等于几个汉字”换算表。

在 AI 应用里,输入用量通常不只包含输入框中看到的最后一句话。应用可能同时发送系统指令、角色设定、聊天历史、文件内容、工具定义和其他上下文,这些内容都会影响输入 Token。

账单中可能出现哪些计费项目

输入 Token

用户内容、系统指令、聊天历史、文件处理结果和工具定义等发送给模型的内容。

输出 Token

模型实际生成的正文、代码或结构化结果。回答越长,输出用量通常越高。

缓存与推理

部分模型会区分缓存读取、缓存写入或推理相关用量,是否单独计费取决于模型规则。

多模态与工具

图片、音频、视频、文件、联网或工具调用可能采用不同的计量方式,不能直接套用文本公式。

计费倍率是什么意思

倍率通常用于表示基础费用与实际结算费用之间的换算关系。例如 0.8 倍表示按基础费用的 80% 结算,1.2 倍表示按基础费用的 120% 结算。“基础费用”如何定义、倍率是否已经包含在展示价格中,具体可查看模型广场。

模型广场展示项使用方法注意事项
本站输入与输出价格结合实际 Token 用量理解当前费用仍需核对峰值规则和调用记录
官方参考价与当前倍率用于比较官方价格和本站计价水平官方参考价不是本站结算价

人民币充值与美元服务额度如何换算

充值比例 1 元人民币 = 1 美元消费额度
充值方式 支付宝

这里的美元是平台用于模型调用计费的账户额度,不是实时外汇汇率,也不是可以提现或转出的美元。余额扣减时仍按模型、Token 用量、分组倍率和其他实际计费项目结算。

充值时选择支付宝并输入人民币金额,支付完成后按上述比例计入消费额度。

为什么同一句问题的费用会不同

用户看到的最后一句问题相同,不代表应用发给模型的完整请求相同。下面几项最容易造成差异。

聊天历史变长

连续对话可能反复发送前面的内容,输入 Token 会逐轮增加。

应用附加指令

不同应用会加入系统提示词、角色设定、知识库片段或工具说明。

模型与输出不同

不同模型单价不同,模型生成内容的长度也不会完全一致。

重试与并行请求

网络中断、应用自动重试或同时发出多条请求,可能形成多条调用记录。

五步核对一条调用记录

在控制台按模型、Token、倍率和请求状态核对调用记录。不同应用使用独立 API Key,更容易区分来源。

  1. 确认实际调用的模型名称是否与应用设置一致。
  2. 查看请求时间、状态以及输入和输出 Token。
  3. 核对调用时的模型单价、计价单位和倍率口径。
  4. 检查同一时间附近是否存在重试、并行或重复请求。
  5. 记录请求信息后,核查无法解释的费用。

怎样降低模型 API 使用成本

  • 按任务选模型:简单整理和分类不一定需要使用成本最高的模型。
  • 控制上下文:长对话可适时新建会话,避免重复发送不再需要的历史内容。
  • 限制输出长度:明确要求回答范围,减少与任务无关的长篇输出。
  • 减少重复文件:确认应用是否在每轮请求中重新附带完整文档或知识库内容。
  • 检查自动重试:了解应用的并发、重试和后台任务设置,避免无意重复调用。
  • 分开管理密钥:按应用创建 API Key,定期查看用量和余额变化。

发现异常用量时怎么处理

先暂停可能持续请求的应用或相关 API Key,再记录请求时间、模型、状态、Token 用量和费用。失败、超时或自动重试可能产生不同的调用记录,请以控制台状态和用量为准。

无法确认时,请准备请求信息并进行核查。具体计费边界可同时查看服务条款服务特定条款

常见问题

计费倍率是什么意思?

倍率用于说明模型基础价格与本站价格之间的换算关系。模型广场会同时标明本站价格、官方参考价和当前倍率;官方参考价不是本站结算价,实际扣费以调用记录为准。

Token 计费怎么算?

文本调用通常分别计算输入和输出费用:输入 Token 除以计价单位后乘输入单价,输出 Token 除以计价单位后乘输出单价,再按实际规则处理倍率或其他计费项目。

一个 Token 等于多少个汉字?

没有固定换算关系。Token 数量会受到语言、标点、数字、代码、分词方式和模型实现影响,应以实际调用记录为准。

为什么同一句问题的费用会不同?

应用可能同时发送系统指令、聊天历史、文件内容或工具定义,模型输出长度、重试次数和实际使用的模型也可能不同,因此可见问题相同不代表实际请求用量相同。

失败或中断的请求一定不收费吗?

失败、超时或自动重试可能产生不同的调用记录。请在控制台核对请求状态和用量,有疑问时携带请求信息

充值 1 元人民币为什么会获得 1 美元额度?

充值 1 元人民币可获得 1 美元消费额度,支持使用支付宝充值。这里的美元是用于模型调用计费的账户额度,不是外汇兑换或可提现美元。