| name | good-txt-to-hwreader |
| description | 清理和修复盗版 txt 电子书中的乱码、广告和排版问题。当用户需要处理 txt 格式电子书、修复乱码、去除广告水印、规范化章节排版时使用此 skill。触发词:txt清理、电子书修复、去广告、修乱码、排版修复、清理txt、修复电子书、txt乱码、txt广告。 |
Good Txt To Hwreader
将盗版 txt 电子书转换为干净、规范的阅读格式。
触发关键词
用户可以通过以下方式触发此技能:
| 关键词 | 示例 |
|---|
| txt清理 | 帮我清理这个txt文件 |
| 电子书修复 | 修复这本电子书 |
| 去广告 | 去掉txt里的广告 |
| 修乱码 | 修复txt乱码 |
| 排版修复 | 修复txt排版 |
| txt乱码 | 这个txt有乱码 |
| txt广告 | txt里好多广告 |
用户输入方式
方式一:直接指定文件路径
清理 /path/to/book.txt
修复电子书 ~/Downloads/novel.txt
方式二:模糊搜索手机 txt 文件
当用户说:
清理一本txt(未指定具体文件)
帮我找个txt文件清理一下
修复某个电子书
执行步骤:
- 使用
search_file 工具搜索用户设备上的 txt 文件
- 列出匹配的文件供用户选择
- 用户确认后执行清理
方式三:搜索关键词
清理包含"斗破"的txt
修复文件名有"修仙"的电子书
执行步骤:
- 使用
search_file 工具按关键词搜索
- 列出匹配结果
- 用户选择后执行清理
依赖
- Python 3.6+
- chardet 库:
pip install chardet
处理流程
阶段一:文件获取
- 使用
search_file 搜索用户手机上的 txt 文件
- 使用
upload_file 上传到云端获取 URL
- 使用
curl 下载到工作目录
阶段二:清理修复
- 编码检测 — 自动识别 GBK/UTF-8/GB2312 等编码
- 广告清理 — 匹配常见广告模式
- 乱码修复 — 替换常见乱码字符
- 排版规范化 — 统一章节标题、段落格式
阶段三:输出结果
- 发送文件给用户 — 使用
send_file_to_user 发送清理后的文件
- 输出修复报告 — 以简洁的 md 表格展示修复结果
输出报告
清理完成后,助手会解析脚本输出,生成简洁表格:
| 项目 | 结果 |
|------|------|
| 原文长度 | 199,044 字符 |
| 清理后长度 | 198,702 字符 |
| 移除内容 | 342 字符 (0.17%) |
| 广告清理 | 0 字符 |
| 乱码修复 | 0 字符 |
| 多余空行 | 342 字符 |
Resources
scripts/
references/
ads_patterns.md — 常见广告模式列表
mojibake_patterns.md — 常见乱码映射表
assets/
chapter_template.txt — 标准章节格式模板
完整示例
用户: 帮我修复下载的三体txt文件
执行流程:
1. search_file(query="三体 txt")
→ 找到: /storage/.../三体.txt
2. upload_file(fileInfos=[{"mediaUri": "file://docs/..."}])
→ 获取公网URL(原始文件)
3. curl -o "三体.txt" "URL"
→ 下载到工作目录
4. python3 ~/.openclaw/workspace/skills/good-txt-to-hwreader/scripts/clean_txt.py "三体.txt"
→ 生成: 三体_清理版.txt
5. send_file_to_user(fileLocalUrls=["三体_清理版.txt"])
→ 发送清理后的文件给用户
6. 解析脚本输出,生成简洁表格报告
常见问题
| 问题 | 原因 | 解决方案 |
|---|
| 文件过大 | 超过 10MB | 分卷处理或提示用户 |
| 编码无法识别 | 特殊编码 | 尝试多种编码,使用 errors='replace' |
| 乱码过多 | 编码错误 | 自动修复常见乱码,无法修复的移除 |
| 章节识别不准 | 格式不规范 | 使用正则匹配多种章节格式 |
重要说明
📖 一键导入书架
收到清理后的文件后,您可以:
- 在聊天中长按文件
- 选择"分享"
- 选择"华为阅读"
即可一键导入书架,享受修复完美的阅读体验!
技能版本: 3.6.0 (完善文档与脚本一致性)