Codex または Claude でインストール この Prompt をコピーして Codex、Claude、または他のアシスタントに貼り付けると、Skill ページを確認してインストールできます。
直接コマンドでは確認用 Prompt が省略されます。実行前にソースを確認してください。
npx skills add https://github.com/cas-bigdatalab/piflow --skill docx-text-extractコマンドは1行のまま表示されます。コピー前に横へスクロールして全体を確認してください。
ローカルで確認しますか?SkillsMP が現在取得できるファイルをダウンロードできます。
Dataspace 文件输入源算子。用于根据 Dataspace 数据源实例 ID 和空间内文件路径下载单个文件,并将该文件作为工作流输入提供给下游算子。该算子没有上游输入,必须作为 DAG 的起始节点使用。
Dataspace 文件输出终止算子。用于接收上游算子的单个文件输出,按指定相对目录上传到 Dataspace 空间目录中,实际文件名自动沿用输入文件名。该算子必须作为 DAG 的终止节点使用。
用于编辑或创建 Gaussian 输入文件(.gjf),支持添加 Link 0 指令(%chk、%oldchk、%nprocshared、%mem)、Route 行关键词、电荷和多重度。可对已有 gjf 文件进行参数填充,也可从零创建新的 gjf 文件。
SOC 職業分類に基づく
SKILL.md を表示中
| name | docx_text_extract |
| description | 从DOCX文件中提取文本内容 |
| version | 1.0.0 |
| category | document_processing |
| name_zh | 从DOCX文件中提取文本内容算子 |
| input_params | [{"name":"input_path","type":"docx_file","description":"输入DOCX文件路径"},{"name":"output_path","type":"docx_file","description":"输出DOCX文件路径"}] |
| output_params | [{"name":"output_path","type":"text_file","description":"提取的文本文件(.txt)"}] |
| tag | 数据解析 |
| publisher | COMMUNITY |
该技能从DOCX文件中提取纯文本内容,保存为txt文件,适用于需要提取文档文本进行分析或处理的场景。
python scripts/run_docx_text_extract.py --input_path <输入DOCX> --output_path <输出TXT>
| 参数 | 类型 | 必填 | 默认值 | 说明 |
|---|---|---|---|---|
| input_path | string | 是 | - | 输入DOCX文件路径 |
| output_path | string | 是 | - | 输出TXT文件路径 |
python scripts/run_docx_text_extract.py --input_path document.docx --output_path text.txt