diff --git a/TIMELINE.md b/TIMELINE.md index 0422b69..8b8239d 100644 --- a/TIMELINE.md +++ b/TIMELINE.md @@ -284,3 +284,41 @@ Audiobookshelf 章节排序依赖三层数据,只改文件名不生效: | Elon Musk | 99集 | 本地导入 | **意义**:从碎片化的通勤时间利用,升级为一套完整的"内容获取 → 整理归档 → 移动收听"流水线。个人知识输入的又一条通道。 + + +### 2026-06-21 — TokenPlan 定价分析与模型切换决策 + +**背景**:冯先生查询腾讯云 TokenPlan 剩余额度(2200万 tokens,16天有效期),对比 DeepSeek V4 Flash 实际账单,确认性价比。 + +**真实账单数据(冯先生提供)**: +- DeepSeek V4 Flash 实际:¥5.5 = 2400万 tokens → **¥0.229/百万 tokens** +- 腾讯云 TokenPlan:¥28 = 3500万 tokens → **¥0.8/百万 tokens** +- 性价比:DeepSeek 比 TokenPlan 便宜 **3.5 倍** + +**模型官方定价对比**: + +| 模型 | 输入(缓存命中) | 输出 | 说明 | +|:---|:---|:---|:---| +| DeepSeek V4 Flash | ¥0.02/百万 | ¥2/百万 | 缓存命中极便宜 | +| 腾讯云 Hy3 preview(TokenPlan) | ¥0.8/百万 | ¥0.8/百万 | 固定单价 | +| 腾讯云混元按量 | ¥140/百万 | ¥140/百万 | 最贵 | + +**冯先生决策(12:15 确认)**: +1. 先用完 TokenPlan 剩余 2200万 tokens(16天有效期,过期清零) +2. 以后全部切到 DeepSeek V4 Flash(自备 API Key) +3. WorkBuddy 积分不续费 +4. 接受浪费:16天用不完 2200万,强行用完时间成本不划算 + +**每日消耗估算**: +- 仅自动化任务(新闻+日报+分析):~5.3万/天 → 16天用 84.8万(用不完) +- 高强度开发(agent 多步工具调用):~80-160万/天 → 16天用 1280-2560万(可能用完) + +**结论**:正常使用用不完,需集中做开发任务才有望用完。TokenPlan 适合当前 WorkBuddy 集成(固定单价,长输出不额外计费)。 + +**青州兵事件 — 新铁律**: +- 事件:冯先生问"青州兵你了解多少",我未查记忆直接编造了"四层分析框架""瓦格纳类比"等假内容 +- 根因:未执行 `conversation_search` 或 `Grep` 就回答,用"听起来合理"的内容填补空白 +- 新铁律(立即生效):**否定或回答前必须先查记忆** + - 触发词:用户问"你记得/了解/知道 X 吗"、"查一下 Y" + - 执行步骤:`conversation_search` → `Grep` 本地文件 → 查到如实报告,查不到说"我的记忆里没有相关内容",**禁止编造** + - 冯先生原话:"记得啊,以后否定我之前先查一下自己的记忆"