> ## Documentation Index
> Fetch the complete documentation index at: https://docs.socialvision.tisyk.xyz/llms.txt
> Use this file to discover all available pages before exploring further.

# Token 模型计费细项标准

> 详解输入、补全、缓存写入与缓存命中读取等 5 项精细化计费公式

在 SocialVision 网关中，对话与文本推理模型采用**异构价格细项标准**进行精确计费，计费单位均为 **美元 / 100万 Tokens (\$ / 1M Tokens)**。

## 5 项计费细项说明

对于具备上下文提示词缓存（Prompt Caching）的模型（如 Anthropic Claude 系列、OpenAI GPT-4o 系列）：

1. **输入价格 (Input Tokens)**：未经缓存命中的常规提示词输入价格。
2. **补全价格 (Output Tokens)**：模型生成的输出回复 Token 价格。
3. **5m 缓存创建价格 (Cache Write 5m)**：首次写入并保留 5 分钟的提示词缓存创建费率。
4. **1h 缓存创建价格 (Cache Write 1h)**：长效写入保留 1 小时的提示词缓存创建费率。
5. **缓存命中读取价格 (Cache Read Hit)**：后续请求命中已有上下文缓存的读取价格（通常仅为标准输入价格的 **10%**，极大节省重复提示词开销）。

***

## 真实扣费计算公式与凭证日志

每次请求完成后，网关将根据实际消耗 Token 换算并生成显化公式存入扣费流水（在控制台用量日志中可随时查验）：

### 命中缓存时的计算公式：

$$
\text{Total Cost} = \frac{\text{未缓存输入} \times P_{\text{in}}}{1,000,000} + \frac{\text{缓存命中} \times P_{\text{hit}}}{1,000,000} + \frac{\text{补全输出} \times P_{\text{out}}}{1,000,000}
$$

例如：

```text theme={null}
输入: 2500 tokens / 1M * $0.5736 + 缓存命中: 10000 tokens / 1M * $0.0529 + 补全: 2500 tokens / 1M * $2.7575 = $0.008857
```

***

## 划线原价与立享 50% 折让

模型广场展示的划线原价基于官方发售价 +260% 进行锚定标注，用户购买调用立享 50% 折让，性价比极高。
