5 项计费细项说明
对于具备上下文提示词缓存(Prompt Caching)的模型(如 Anthropic Claude 系列、OpenAI GPT-4o 系列):- 输入价格 (Input Tokens):未经缓存命中的常规提示词输入价格。
- 补全价格 (Output Tokens):模型生成的输出回复 Token 价格。
- 5m 缓存创建价格 (Cache Write 5m):首次写入并保留 5 分钟的提示词缓存创建费率。
- 1h 缓存创建价格 (Cache Write 1h):长效写入保留 1 小时的提示词缓存创建费率。
- 缓存命中读取价格 (Cache Read Hit):后续请求命中已有上下文缓存的读取价格(通常仅为标准输入价格的 10%,极大节省重复提示词开销)。