Skip to main content
在 SocialVision 网关中,对话与文本推理模型采用异构价格细项标准进行精确计费,计费单位均为 美元 / 100万 Tokens ($ / 1M Tokens)。

5 项计费细项说明

对于具备上下文提示词缓存(Prompt Caching)的模型(如 Anthropic Claude 系列、OpenAI GPT-4o 系列):
  1. 输入价格 (Input Tokens):未经缓存命中的常规提示词输入价格。
  2. 补全价格 (Output Tokens):模型生成的输出回复 Token 价格。
  3. 5m 缓存创建价格 (Cache Write 5m):首次写入并保留 5 分钟的提示词缓存创建费率。
  4. 1h 缓存创建价格 (Cache Write 1h):长效写入保留 1 小时的提示词缓存创建费率。
  5. 缓存命中读取价格 (Cache Read Hit):后续请求命中已有上下文缓存的读取价格(通常仅为标准输入价格的 10%,极大节省重复提示词开销)。

真实扣费计算公式与凭证日志

每次请求完成后,网关将根据实际消耗 Token 换算并生成显化公式存入扣费流水(在控制台用量日志中可随时查验):

命中缓存时的计算公式:

Total Cost=未缓存输入×Pin1,000,000+缓存命中×Phit1,000,000+补全输出×Pout1,000,000\text{Total Cost} = \frac{\text{未缓存输入} \times P_{\text{in}}}{1,000,000} + \frac{\text{缓存命中} \times P_{\text{hit}}}{1,000,000} + \frac{\text{补全输出} \times P_{\text{out}}}{1,000,000} 例如:

划线原价与立享 50% 折让

模型广场展示的划线原价基于官方发售价 +260% 进行锚定标注,用户购买调用立享 50% 折让,性价比极高。