输入 Token
用户内容、系统指令、聊天历史、文件处理结果和工具定义等发送给模型的内容。
计费指南
在模型广场查看当前模型、价格与倍率,并用控制台调用记录核对实际费用。
打开模型广场,可以按平台、分组、倍率和模型名称筛选当前模型,并比较本站价格与模型厂商的官方参考价。
KHaiXAPI 的模型、单价、计价单位、倍率和可用状态会更新。请在模型广场查看当前公开计价信息,并以调用时适用的规则和控制台调用记录核对实际费用。
文本生成按实际用量计费,通常按照输入和输出 Token 数量计算,每次使用的消耗会因内容、上下文和输出长度不同而不同。图像生成按实际生成张数收费,每张图片的单价由本次请求最终确定的 1K、2K 或 4K 清晰度档位决定;同一请求返回多张图片时,按实际生成张数累计。具体计费项目以模型广场和调用记录为准。
模型广场中的“本站价格”可用于了解当前计价水平;“官方参考价”用于和模型厂商公开价格比较,不是本站结算价。页面列出的倍率和峰值规则可能影响实际费用,最终应以调用记录为准。
Token 是模型处理文本时使用的单位,不等同于汉字数、单词数或字符数。语言、标点、数字、代码、空格和模型采用的分词方式都会影响结果,因此不存在长期准确的“一个 Token 等于几个汉字”换算表。
在 AI 应用里,输入用量通常不只包含输入框中看到的最后一句话。应用可能同时发送系统指令、角色设定、聊天历史、文件内容、工具定义和其他上下文,这些内容都会影响输入 Token。
用户内容、系统指令、聊天历史、文件处理结果和工具定义等发送给模型的内容。
模型实际生成的正文、代码或结构化结果。回答越长,输出用量通常越高。
部分模型会区分缓存读取、缓存写入或推理相关用量,是否单独计费取决于模型规则。
图片、音频、视频、文件、联网或工具调用可能采用不同的计量方式,不能直接套用文本公式。
倍率通常用于表示基础费用与实际结算费用之间的换算关系。例如 0.8 倍表示按基础费用的 80% 结算,1.2 倍表示按基础费用的 120% 结算。“基础费用”如何定义、倍率是否已经包含在展示价格中,具体可查看模型广场。
| 模型广场展示项 | 使用方法 | 注意事项 |
|---|---|---|
| 本站输入与输出价格 | 结合实际 Token 用量理解当前费用 | 仍需核对峰值规则和调用记录 |
| 官方参考价与当前倍率 | 用于比较官方价格和本站计价水平 | 官方参考价不是本站结算价 |
这里的美元是平台用于模型调用计费的账户额度,不是实时外汇汇率,也不是可以提现或转出的美元。余额扣减时仍按模型、Token 用量、分组倍率和其他实际计费项目结算。
充值时选择支付宝并输入人民币金额,支付完成后按上述比例计入消费额度。
用户看到的最后一句问题相同,不代表应用发给模型的完整请求相同。下面几项最容易造成差异。
连续对话可能反复发送前面的内容,输入 Token 会逐轮增加。
不同应用会加入系统提示词、角色设定、知识库片段或工具说明。
不同模型单价不同,模型生成内容的长度也不会完全一致。
网络中断、应用自动重试或同时发出多条请求,可能形成多条调用记录。
在控制台按模型、Token、倍率和请求状态核对调用记录。不同应用使用独立 API Key,更容易区分来源。
先暂停可能持续请求的应用或相关 API Key,再记录请求时间、模型、状态、Token 用量和费用。失败、超时或自动重试可能产生不同的调用记录,请以控制台状态和用量为准。
倍率用于说明模型基础价格与本站价格之间的换算关系。模型广场会同时标明本站价格、官方参考价和当前倍率;官方参考价不是本站结算价,实际扣费以调用记录为准。
文本调用通常分别计算输入和输出费用:输入 Token 除以计价单位后乘输入单价,输出 Token 除以计价单位后乘输出单价,再按实际规则处理倍率或其他计费项目。
没有固定换算关系。Token 数量会受到语言、标点、数字、代码、分词方式和模型实现影响,应以实际调用记录为准。
应用可能同时发送系统指令、聊天历史、文件内容或工具定义,模型输出长度、重试次数和实际使用的模型也可能不同,因此可见问题相同不代表实际请求用量相同。
失败、超时或自动重试可能产生不同的调用记录。请在控制台核对请求状态和用量,有疑问时携带请求信息。
充值 1 元人民币可获得 1 美元消费额度,支持使用支付宝充值。这里的美元是用于模型调用计费的账户额度,不是外汇兑换或可提现美元。