Install
openclaw skills install @jes614753-sketch/weread-fulltext微信读书整本书全文导出为 Markdown。两层架构:采集层(大视口画布扫掠 + 真实键盘翻页,零注入零写入)+ 离线重建层(官方章节骨架 + 证据化拼接 + 全程溯源)。支持 canvas 防拷贝渲染书籍。产物带来源索引与质量报告。
openclaw skills install @jes614753-sketch/weread-fulltext把微信读书里一本书的完整正文导出为可溯源的 Markdown。
| 层 | 依赖 | 职责 |
|---|---|---|
| 采集层 | 浏览器登录态 | 大视口(1920×2160)下画布容纳整章,真实键盘 ArrowRight 逐跨页推进,被动 toDataURL 导出画布 |
| 重建层 | 无(纯离线) | 官方 chapterUid 骨架 + 阅读顺序指针分章 + 证据化拼接(包含/重叠/页序连续),OCR 缓存键 = 图片 SHA-256,产出正文 + source_map.json + quality_report.md |
# 0) 依赖(一次性)
pip install -r scripts/requirements.txt
playwright install chromium
# 1) 首次登录(弹出浏览器,微信扫码)
python scripts/export_fulltext.py --login
# 2) 采集 + 重建一本书
python scripts/export_fulltext.py --book-id 3300229133 --out ./exports
# 3) 仅离线重建已有运行(不打开浏览器)
python scripts/export_fulltext.py --rebuild-run ./exports/3300229133/run_YYYYMMDD_HHMMSS
# 可选:--headless --max-spreads 60
产物在 exports/<bookId>/run_<时间戳>/ 下:fde_rebuilt.md(正文,问题章节带状态标注 + 备选捕获附录)、source_map.json(段落→图片→OCR 行溯源)、quality_report.md、manifest.jsonl、run_meta.json(起止位置与停止原因)、spreads/ 截图。