介绍

控制过长回复的费用 ​

回复越长,通常输出 Token 越多。先明确你要多详细,可以减少不必要的生成。

怎样理解 ​

先要求一份简要目录或几条结论,确认方向后再展开必要部分。需要长报告或完整代码时,长度本身有用途,就应为相应输出预留预算。

在哪里核对 ​

  1. 打开模型广场,选择与密钥一致的分组。
  2. 进入模型详情,确认当前单价、单位和计费档位。
  3. 完成一个短测试后打开使用日志。
  4. 找到同一时间、同一密钥的记录,展开 Token 和费用详情。

界面位置

价格在模型详情中,实际用量在日志详情中。截图只能解释操作位置,不能替代当前报价。

常见情况 ​

限制字数后费用仍然偏高 ​

费用还可能来自长输入、推理、缓存写入或额外工具调用。回到日志逐项核对,不只看可见回复。

手算金额与日志不同 ​

检查缓存是否重复相加、倍率是否已经包含,以及是否还有图片、推理或工具费用。先保留请求 ID 和时间,再联系支持核对;不要通过反复发送同一请求来试验扣费。

下一步 ​

阅读一次请求的费用可以使用示例计算器。需要限制某个工具的预算时,为它单独设置密钥额度。

阅读中遇到问题?联系支持
AI 助手