一键导入
docx
「面向 .docx 文件的文档创建、编辑与分析」——支持修订记录、批注、格式保持与文本抽取。当 Claude 需要处理专业 Word 文档(.docx)以执行以下任一任务时请使用本技能:(1) 创建新文档;(2) 修改或编辑内容;(3) 处理修订记录;(4) 添加批注;或其他文档相关工作。
用 Codex 或 Claude 帮你安装 复制这段 Prompt,粘贴到 Codex、Claude 或其他助手里,让它检查 Skill 页面并帮你完成安装。
菜单
「面向 .docx 文件的文档创建、编辑与分析」——支持修订记录、批注、格式保持与文本抽取。当 Claude 需要处理专业 Word 文档(.docx)以执行以下任一任务时请使用本技能:(1) 创建新文档;(2) 修改或编辑内容;(3) 处理修订记录;(4) 添加批注;或其他文档相关工作。
用 Codex 或 Claude 帮你安装 复制这段 Prompt,粘贴到 Codex、Claude 或其他助手里,让它检查 Skill 页面并帮你完成安装。
基于 SOC 职业分类
“面向 PowerPoint 演示文稿(.pptx)的创建、编辑与分析”。当 Claude 需要创建新演示文稿、修改现有内容、处理版式、添加批注或演讲者备注等与幻灯相关的任务时,请使用本技能。
使用带种子随机性的 p5.js,通过交互式参数探索生成原创算法艺术。适用于用户提出涉及代码生成艺术、算法艺术、流场或粒子系统的请求。始终创作原创算法艺术,避免直接复制现有艺术家的作品,以免引发版权问题。
一套基于现代前端技术(React、Tailwind CSS、shadcn/ui)的工具,用来创建复杂的 claude.ai HTML 成品。适用于需要状态管理、路由或 shadcn/ui 组件的复杂作品,不适用于简单的单文件 HTML/JSX。
将 Anthropic 官方品牌配色与字体应用到需要呈现 Anthropic 风格的任何产出物上。当涉及品牌配色、风格规范、视觉格式或公司设计标准时请使用本技能。
基于设计哲学在 .png 与 .pdf 文档中创作精美视觉作品。当用户请求海报、艺术作品、设计稿或其他静态作品时,请使用本技能。务必创作原创视觉设计,避免复制现有艺术家的作品,以免触犯版权。
面向 PDF 的全能工具包,可用于抽取文本与表格、创建新 PDF、合并/拆分文档以及处理表单。当 Claude 需要填写 PDF 表单,或要批量处理、生成、分析 PDF 文件时请使用本技能。
| name | docx |
| description | 「面向 .docx 文件的文档创建、编辑与分析」——支持修订记录、批注、格式保持与文本抽取。当 Claude 需要处理专业 Word 文档(.docx)以执行以下任一任务时请使用本技能:(1) 创建新文档;(2) 修改或编辑内容;(3) 处理修订记录;(4) 添加批注;或其他文档相关工作。 |
| license | 专有许可。完整条款见 LICENSE.txt |
用户可能会要求你创建、编辑或分析 .docx 文件的内容。DOCX 本质上是包含 XML 文件与其他资源的 ZIP 压缩包,你可以读取或编辑其中的内容。针对不同任务,你可以选择不同的工具与工作流。
使用“文本抽取”或“原始 XML 访问”部分所述方法。
使用“创建全新 Word 文档”工作流。
你自己创作的文档 + 简单修改
使用“基础 OOXML 编辑”工作流
他人提供的文档
使用 “修订模式工作流”(推荐默认)
法律、学术、商务或政府文档
使用 “修订模式工作流”(必须)
如仅需阅读文档文字,可使用 pandoc 将其转换为 Markdown。Pandoc 在保持结构方面表现优秀,并能展示修订记录:
# 将文档转换成带修订的 Markdown
pandoc --track-changes=all path-to-file.docx -o output.md
# 可选项:--track-changes=accept/reject/all
当需要处理批注、复杂格式、文档结构、嵌入媒体或元数据时,就必须访问原始 XML。此类需求应先解包文档并阅读其中的 XML 文件。
python ooxml/scripts/unpack.py <office_file> <output_directory>
word/document.xml —— 主体内容word/comments.xml —— 与 document.xml 对应的批注word/media/ —— 嵌入的图像与媒体<w:ins>(插入)与 <w:del>(删除)标签从头开始创建新文档时,请使用 docx-js,可通过 JavaScript/TypeScript 构建 Word 文件。
docx-js.md(约 500 行)。阅读时严禁限制行号范围。需通读文件,了解语法、关键格式规则与最佳实践,再着手创建文档。Packer.toBuffer() 导出为 .docx。编辑现有文档时,请使用 Document library(基于 Python 的 OOXML 操作库)。该库会自动处理基础设施,并提供多种文档操作方法。对于复杂场景,可以直接通过库访问底层 DOM。
ooxml.md(约 600 行)。阅读时严禁限制行号范围。 需通读文件,掌握 Document library API 以及直接编辑文档时的 XML 模式。python ooxml/scripts/unpack.py <office_file> <output_directory>python ooxml/scripts/pack.py <input_directory> <office_file>Document library 提供常用操作的高级方法,也允许你在复杂场景下直接操作 DOM。
该工作流允许你先用 Markdown 规划完整的修订,再在 OOXML 中逐步实现。重点:要完整记录修订,必须系统性地实施所有变更。
批处理策略:将相关变更按 3-10 项归为一批。这样既便于调试,也能保持效率。每批测试通过后再继续下一批。
原则:最小且精准的编辑
处理修订时,仅标记实际修改的内容。重复标记未变部分会让审阅更困难,也显得不专业。请将替换拆分为:【未改文本】+【删除段】+【插入段】+【未改文本】。未改文本需保留原 <w:r> 的 RSID,可通过提取原文档中的 <w:r> 元素后重复使用来实现。
示例 —— 将句子中的 “30 days” 改为 “60 days”:
# 错误示例:替换整句
'<w:del><w:r><w:delText>The term is 30 days.</w:delText></w:r></w:del><w:ins><w:r><w:t>The term is 60 days.</w:t></w:r></w:ins>'
# 正确示例:仅标记变化部分,并复用未改文本的 <w:r>
'<w:r w:rsidR="00AB12CD"><w:t>The term is </w:t></w:r><w:del><w:r><w:delText>30</w:delText></w:r></w:del><w:ins><w:r><w:t>60</w:t></w:r></w:ins><w:r w:rsidR="00AB12CD"><w:t> days.</w:t></w:r>'
获取 Markdown 表示:将文档转换为保留修订记录的 Markdown:
pandoc --track-changes=all path-to-file.docx -o current.md
识别并分组所有修改:审阅文档,找出所有需要的修改,并按逻辑分批:
定位方法(在 XML 中定位需要修改的位置):
批次组织(每批 3-10 项变更):
阅读文档并解包:
ooxml.md(约 600 行)。**切勿限制行号范围。**重点关注“Document Library”与“Tracked Change Patterns”章节。python ooxml/scripts/unpack.py <file.docx> <dir>分批实施修改:按逻辑将变更分组(按章节、按类型或按位置),每批在同一个脚本中实现。这种方式:
推荐分组方式:
对于每批相关变更:
a. 将文本映射到 XML:在 word/document.xml 中 grep 目标文本,确认其在 <w:r> 中的拆分方式。
b. 编写并运行脚本:使用 get_node 定位节点,实施修改后调用 doc.save()。具体模式详见 ooxml.md 中的 “Document Library” 章节。
注意:每次编写脚本前都要立即在 word/document.xml 中 grep,获取最新行号并确认文本。每次脚本运行后行号可能改变。
重新打包文档:全部批次完成后,将解包目录打包回 .docx:
python ooxml/scripts/pack.py unpacked reviewed-document.docx
最终验证:对整份文档进行全面检查:
pandoc --track-changes=all reviewed-document.docx -o verification.md
grep "original phrase" verification.md # 不应再出现原短语
grep "replacement phrase" verification.md # 应能找到替换短语
如需从视觉上分析 Word 文档,可使用两步流程转换为图像:
将 DOCX 转为 PDF:
soffice --headless --convert-to pdf document.docx
将 PDF 页面转为 JPEG 图像:
pdftoppm -jpeg -r 150 document.pdf page
将生成 page-1.jpg、page-2.jpg 等文件。
常用选项:
-r 150:分辨率 150 DPI(可根据质量/大小调整)-jpeg:输出 JPEG(若需 PNG,请用 -png)-f N:起始页(如 -f 2 从第 2 页开始)-l N:结束页(如 -l 5 到第 5 页结束)page:输出文件前缀指定页码范围示例:
pdftoppm -jpeg -r 150 -f 2 -l 5 document.pdf page # 仅转换第 2-5 页
重要:编写与 DOCX 相关的代码时请注意:
如环境中缺少,请安装以下依赖:
sudo apt-get install pandoc(用于文本抽取)npm install -g docx(用于创建新文档)sudo apt-get install libreoffice(用于 PDF 转换)sudo apt-get install poppler-utils(pdftoppm 所需,用于将 PDF 转成图像)pip install defusedxml(安全解析 XML)