Files
inspiration-collector/cards/20260621125325_---.md
2026-06-21 13:00:02 +08:00

97 lines
2.8 KiB
Markdown
Raw Blame History

This file contains ambiguous Unicode characters

This file contains Unicode characters that might be confused with other characters. If you think that this is intentional, you can safely ignore this warning. Use the Escape button to reveal them.

---
title: "---"
date: 2026-06-21T12:53:25+08:00
uid: ""
source: "memos"
---
---
title: TokenPlan vs DeepSeek 选择分析
date: 2026-06-21 12:43
tags:
- #新知
- TokenPlan
- DeepSeek
- 计费
- 缓存命中
- 性价比
---
# TokenPlan vs DeepSeek我的选择分析
## 一、真实账单数据¥5.5 = 2400万 tokens
冯先生实际账单:
- **DeepSeek V4 Flash**¥5.5 = 2400万 tokens → **¥0.229/百万 tokens**
- **腾讯云 TokenPlan**¥28 = 3500万 tokens → **¥0.8/百万 tokens**
## 二、计费逻辑差异
### TokenPlan批发包
- 统一单价:**¥0.8/百万 tokens**
- **不区分**输入/输出/缓存是否命中
- 设计初衷:体验套餐,简化计费
### DeepSeek 官方 API按量计费
| 类型 | 单价(/百万 tokens |
|:---|:---|
| 输入(缓存命中) | **¥0.02**(极便宜) |
| 输入(未命中) | ¥1 |
| 输出 | **¥2**(贵) |
## 三、我的使用模式重新分析
### 输入侧(占大头)
1. 加载文库文章(青州兵 2900字 ≈ 4000 tokens
2. 加载相关文章(多篇合计 ≈ 8000 tokens
3. 加载 MEMORY.md + 今日日志(≈ 5000 tokens
4. **同一天内多次对话 → 相同内容重复加载**
### 输出侧(相对小)
1. 灵感日报 ≈ 2000 tokens/天
2. 深度分析 ≈ 3000 tokens/次每周1次
3. 日常对话 ≈ 500-1000 tokens/次
4. **总量不超过 1万字/天 ≈ 10,000 tokens**
## 四、关键发现:缓存命中率
### 同一天内的对话模式
```
第1次问青州兵 → 加载文章(未命中)
第2次问横财 → 同样文章(缓存命中)
第3次问曹操 → 同样文章(缓存命中)
```
**缓存命中率可能 70%+**
### 重新算账(按实际模式)
| 场景 | DeepSeek 日成本 | TokenPlan 日成本 | DeepSeek 优势 |
|:---|:---|:---|:---|
| 缓存 50% | ¥0.036 | ¥0.044 | **便宜 18%** |
| 缓存 70% | ¥0.028 | ¥0.044 | **便宜 36%** |
| 缓存 90% | ¥0.020 | ¥0.044 | **便宜 55%** |
## 五、结论
1. **我的模式是"输入密集、高缓存复用"**,不是"输出密集"
2. **TokenPlan 固定单价**在这种模式下反而不占优势
3. **DeepSeek 缓存命中**才是真正省钱的点
4. 一天内对话次数越多(>3次DeepSeek 越便宜
## 六、修正决策
**原决策**:用完 TokenPlan 再切 DeepSeek
**修正后**
1. 现在继续用 TokenPlan反正 16 天后过期)
2. 过期后切 DeepSeek**重点观察缓存命中率**
3. 如果一天内对话多(>3次DeepSeek 会更便宜
4. TokenPlan 适合"输出很长、输入很短"的场景,我不适合
## 七、下次买套餐的教训
1. **别买有效期短的**16天用不完 2200万
2. **别买批发包**,按量计费更适合我的模式
3. **缓存命中率是关键**,选支持缓存的 API