hotfix batch: ctime/来源恢复/阅读时长/selector权重 + daily log完整版
This commit is contained in:
34
CHANGELOG.md
34
CHANGELOG.md
@ -165,3 +165,37 @@ NYT, CNN, Al Jazeera, TechCrunch, BBC, The Guardian, CNBC, Bloomberg
|
||||
每轮 ~300条
|
||||
|
||||
**中英文源合并后每轮:~500条 → RAW存档 → 精选80条**
|
||||
|
||||
### Hotfix Batch 2026-06-16-2 — 修复三项数据问题
|
||||
|
||||
#### ① 新浪头条published为空修复
|
||||
- **问题**:新浪API返回的`ctime`是字符串`"1781604459"`而非数字,代码中`isinstance(ctime, (int, float))`判定False,
|
||||
`published`字段全为空 → selector无时效加分 → 10条新浪头条全部落选,中国热点只有新华网
|
||||
- **修复**:`local_fetch_cn.py` → `int(ctime)`转换字符串时间戳
|
||||
- **效果**:新浪-头条10条全部入选精选池,中国热点恢复正常
|
||||
|
||||
#### ② 新闻来源被AI改写修复
|
||||
- **问题**:summarize_news.py调用DeepSeek后,AI把`新浪-头条`改写为`新浪财经`
|
||||
- **修复**:新增`build_source_lookup()` + `restore_source()`,AI输出后按标题匹配恢复原始来源名
|
||||
- **效果**:中国热点中新浪头条正确显示为"新浪-头条",而非"新浪财经"
|
||||
|
||||
#### ③ 微信读书阅读时长单位错误修复
|
||||
- **问题**:WeRead API返回的`readingTime`单位是秒,代码当作分钟处理,15分钟读书记录显示为"15小时"
|
||||
- **修复**:`sync.py` → `read_seconds // 60`转分钟
|
||||
- **效果**:GitHub入门与实践:30小时24分钟→30分钟;Python编程:471小时→7小时51分钟
|
||||
|
||||
#### ④ 时间显示格式修复
|
||||
- **问题**:今日新闻在摘要中只显示`HH:MM`无日期前缀
|
||||
- **修复**:`summarize_news.py` → 始终输出`MM-DD HH:MM`格式
|
||||
- **效果**:所有条目统一显示`06-16 10:07`,跨日可辨
|
||||
|
||||
#### ⑤ selector权重优化
|
||||
- **问题**:selector.py缺少新增非RSS源(新浪、观察者网、人民网)的权重,主题上限固定3条导致国内热点被筛
|
||||
- **修复**:新增SOURCE_WEIGHTS条目(新浪-头条1.3最高),主题上限改为差异化配置,中国热点主题放宽至2x
|
||||
- **效果**:中文精选从单一新华网变为新浪+新华网+观察者网混合
|
||||
|
||||
**涉及文件:**
|
||||
- local_fetch_cn.py — ctime类型修复
|
||||
- selector.py — 新源权重 + 主题差异化上限
|
||||
- summarize_news.py — 来源恢复逻辑 + 时间格式修复
|
||||
- sync.py — 阅读时长秒→分钟
|
||||
|
||||
Reference in New Issue
Block a user