| name | xhs-material-pipeline |
| description | 用于小红书图文素材包生成:分析素材、爆款参考、账号反馈和历史违规记录,产出标题、正文、封面/配图方案、发布 manifest、自动发布适配表,并完成图文包校验。 |
小红书图文素材生成流程
默认中文工作。目标是把素材整理成可发布、可自动发布的小红书图文素材包。
先遵循共享规则:
/Users/wangbin/data/jupyter/实战/爬网页/小红书/自动化工作流/.codex/skills/xhs-shared-rules/SKILL.md
本 skill 只负责图文内容和素材包生成;爬取、发布、Gmail 汇报由自动编排 skill 负责。
不要生成 04_分析依据/爆款参考矩阵.md。爆款参考只作为本 skill 的内部分析依据;需要留痕时,把简短参考来源、可迁移点、避开点、差异化改动和话题来源写入 README.md 或已有分析记录,不新增固定矩阵文件。
什么时候使用
- 生成小红书标题、正文、封面、配图、爆款拆解、二创方案;
- 根据账号数据、历史发布记录、爆款参考生成新笔记;
- 生成
publish_manifest.json、merged_table.xlsx、publish_queue.xlsx、发布图片清单;
- 校验标题、正文、图片、话题、合集、humanizer/imagegen 证据。
内容判断
- 参考
docs/优质内容的判断标准.md:主旨清晰、表达通俗、结构完整、风格统一,给读者明确获得感。
- 参考
docs/优质封面和标题的标准.md:封面和标题负责信息流点击,优先满足用户利益点,标题准确反映内容,不夸大误导。
- 选题先过 HKR:H=好奇心/点击钩子,K=知识密度/可执行价值,R=情绪或身份共鸣。可发布选题至少满足两项;只占一项时先补角度、补案例或换更具体的人群/场景。
- 小红书文案要像有经验的普通人把有用发现讲清楚,不写成报告、百科或培训课讲义。
标准流程
-
检查素材
- 用
rg --files 或 find 查看文件。
- 优先找 Excel/CSV 中的
标题、点赞、收藏、评论、推文、话题、媒体文件路径、封面地址 等列。
- 如果有账号数据,找
笔记标题、浏览量、点赞量、收藏量、评论量、转发量。
- 如存在违规历史目录,先读
docs/目前遇到的违规情况,提炼“历史违规规避清单”。
- 如有社区规范 PDF,生成发布内容前参考
docs/xhs_community_guidelines.pdf。
-
分析爆款参考
- 只做素材生成所需的内部分析:筛出可迁移的事实、场景、结构、视觉元素和话题来源。
- 不再生成
爆款参考矩阵.md;必要留痕写进 README.md 或已有分析记录。
- 遵守共享规则:爆款参考要做“1:1 参考式模仿”,贴着学习标题钩子、正文骨架、段落节奏、页面顺序、图片素材思路、封面逻辑和评论触发方式;1:1 指结构、节奏和阅读路径高度对齐,不复制原句,不冒充他人的真实亲历,不保留作者身份、头像、账号名、私有数据或专有作品。
-
生成文案
- 按
references/文案参考.md 生成图文内容大纲。
- 大纲必须用
<page> 分页,每页以 [封面]、[内容] 或 [总结] 开头。
- 默认 6-12 页;用户明确要求页数时可在 2-18 页内调整。
- 第一页是封面/标题页,包含标题和副标题;每页内容要具体、适合配图生成。
- 文案终稿仍按共享规则调用 humanizer,并写入记录和 manifest 字段。
-
生成或处理图片
- 按
references/配图参考.md 为每一页生成对应图片 prompt,并调用 imagegen 一页一图生成最终视觉。
- 图片默认竖版 3:4、高清、适合手机阅读;封面标题最大,内容页层级清楚,总结页有完成感。
- 生成图片时同时参考用户原始需求和完整内容大纲,保持全套页面配色、风格、视觉元素和排版一致。
- 图片不能横置、倒置,所有文字必须完整呈现;不合格就重生成或移出上传顺序。
- 本地代码只做裁剪、压缩、拆图、搬运、加
to be here 水印和 manifest 更新。
- 按共享规则写入
04_分析依据/imagegen生成记录.md 和 manifest 字段。
-
创建素材包
自动发布适配
生成或更新:
00_自动发推适配/merged_table.xlsx
00_自动发推适配/publish_queue.xlsx
00_自动发推适配/publish_manifest.json
00_自动发推适配/发布图片清单.txt
Excel 至少包含 标题、推文、封面地址。兼容旧表时保留 15 列:
链接, 标题, 点赞, 作者, 作者链接, 推文, 收藏, 评论, Unnamed: 8, 封面地址, Unnamed: 10, Unnamed: 11, Unnamed: 12, Unnamed: 13, Unnamed: 14
publish_manifest.json 中图片顺序为:封面第一,其余配图按上传顺序排列。body 和 publish_row.推文 必须无话题标签。
校验脚本
在 skill 目录下使用脚本,python 不可用时用 python3。
python3 scripts/validate_xhs_package.py <package-path>
检查标题、正文、图片数量、图片存在性、尺寸和疑似拼接图。
python3 scripts/split_carousel_images.py <package-or-image-path> \
--report <package>/00_自动发推适配/配图裁剪检测报告.json
拆分横向拼接图,输出到 03_配图/单张裁剪/,并补到 1080x1440。
python3 scripts/watermark_images.py <input-folder-or-image> \
--output-dir <package>/03_配图/加水印 \
--text "to be here"
拆图后再加水印。最终 manifest 和图片清单必须指向单张、加水印后的最终上传图。
最终 QA
发布前按共享规则完成共同检查,并额外确认:
- 爆款参考拆解已经记录到
04_分析依据/;
- 未生成
04_分析依据/爆款参考矩阵.md;
- HKR 至少满足两项,或已补角度/补素材/改选题;
- 正文有明确可带走价值,且核心观点有素材细节或可验证信息支撑;
- 如果是同主题续写,已记录与历史发布内容的差异点;
- 账号反馈、爆款参考和历史违规规避结果已经归档。
参考文件
- 共享规则:
../xhs-shared-rules/SKILL.md
- 文案生成参考:
references/文案参考.md
- 配图生成参考:
references/配图参考.md
- 自动发布适配细节:
references/xhs_adapter_schema.md
- 账号表现复盘细节:
references/account_performance_feedback.md
- 优质封面标题:
docs/优质封面和标题的标准.md
- 优质内容判断:
docs/优质内容的判断标准.md