2.8 KiB
2.8 KiB
title, date, uid, source
| title | date | uid | source |
|---|---|---|---|
| --- | 2026-06-21T12:53:25+08:00 | memos |
title: TokenPlan vs DeepSeek 选择分析 date: 2026-06-21 12:43 tags:
- #新知
- TokenPlan
- DeepSeek
- 计费
- 缓存命中
- 性价比
TokenPlan vs DeepSeek:我的选择分析
一、真实账单数据(¥5.5 = 2400万 tokens)
冯先生实际账单:
- DeepSeek V4 Flash:¥5.5 = 2400万 tokens → ¥0.229/百万 tokens
- 腾讯云 TokenPlan:¥28 = 3500万 tokens → ¥0.8/百万 tokens
二、计费逻辑差异
TokenPlan(批发包)
- 统一单价:¥0.8/百万 tokens
- 不区分输入/输出/缓存是否命中
- 设计初衷:体验套餐,简化计费
DeepSeek 官方 API(按量计费)
| 类型 | 单价(/百万 tokens) |
|---|---|
| 输入(缓存命中) | ¥0.02(极便宜) |
| 输入(未命中) | ¥1 |
| 输出 | ¥2(贵) |
三、我的使用模式重新分析
输入侧(占大头)
- 加载文库文章(青州兵 2900字 ≈ 4000 tokens)
- 加载相关文章(多篇合计 ≈ 8000 tokens)
- 加载 MEMORY.md + 今日日志(≈ 5000 tokens)
- 同一天内多次对话 → 相同内容重复加载
输出侧(相对小)
- 灵感日报 ≈ 2000 tokens/天
- 深度分析 ≈ 3000 tokens/次(每周1次)
- 日常对话 ≈ 500-1000 tokens/次
- 总量不超过 1万字/天 ≈ 10,000 tokens
四、关键发现:缓存命中率
同一天内的对话模式
第1次问青州兵 → 加载文章(未命中)
第2次问横财 → 同样文章(缓存命中)
第3次问曹操 → 同样文章(缓存命中)
缓存命中率可能 70%+
重新算账(按实际模式)
| 场景 | DeepSeek 日成本 | TokenPlan 日成本 | DeepSeek 优势 |
|---|---|---|---|
| 缓存 50% | ¥0.036 | ¥0.044 | 便宜 18% |
| 缓存 70% | ¥0.028 | ¥0.044 | 便宜 36% |
| 缓存 90% | ¥0.020 | ¥0.044 | 便宜 55% |
五、结论
- 我的模式是"输入密集、高缓存复用",不是"输出密集"
- TokenPlan 固定单价在这种模式下反而不占优势
- DeepSeek 缓存命中才是真正省钱的点
- 一天内对话次数越多(>3次),DeepSeek 越便宜
六、修正决策
原决策:用完 TokenPlan 再切 DeepSeek 修正后:
- 现在继续用 TokenPlan(反正 16 天后过期)
- 过期后切 DeepSeek,重点观察缓存命中率
- 如果一天内对话多(>3次),DeepSeek 会更便宜
- TokenPlan 适合"输出很长、输入很短"的场景,我不适合
七、下次买套餐的教训
- 别买有效期短的(16天用不完 2200万)
- 别买批发包,按量计费更适合我的模式
- 缓存命中率是关键,选支持缓存的 API