用 Codex 或 Claude 帮你安装 复制这段 Prompt,粘贴到 Codex、Claude 或其他助手里,让它检查 Skill 页面并帮你完成安装。
直接命令不会经过审查 Prompt;运行前请先检查来源。
npx skills add https://github.com/cas-bigdatalab/piflow --skill pdf-metadata-extract-restored命令会保持在同一行。复制前请横向滚动并检查完整内容。
想先保存到本地?可下载 SkillsMP 当前能够提供的文件。
Dataspace 文件输入源算子。用于根据 Dataspace 数据源实例 ID 和空间内文件路径下载单个文件,并将该文件作为工作流输入提供给下游算子。该算子没有上游输入,必须作为 DAG 的起始节点使用。
Dataspace 文件输出终止算子。用于接收上游算子的单个文件输出,按指定相对目录上传到 Dataspace 空间目录中,实际文件名自动沿用输入文件名。该算子必须作为 DAG 的终止节点使用。
用于编辑或创建 Gaussian 输入文件(.gjf),支持添加 Link 0 指令(%chk、%oldchk、%nprocshared、%mem)、Route 行关键词、电荷和多重度。可对已有 gjf 文件进行参数填充,也可从零创建新的 gjf 文件。
基于 SOC 职业分类
正在显示 SKILL.md
| name | pdf_metadata_extract_restored |
| description | 提取 PDF 文件元数据并输出 JSON 结果。 当用户提到把这次流程沉淀成 skill、保存为 skill等需求时使用此 skill。 |
| version | 1.0.0 |
| name_zh | PDF 元数据提取回调算子 |
| category | document_processing |
| tag | 数据解析 |
| metadata | {"entry_chain":"callback_distillation","verified":true,"restored_from_flow":true,"flow_task_name":"PDF 元数据提取","flow_success_evidence":{"output_path":"workspace/outputs/pdf_metadata_extract_output.json"}} |
| input_params | [{"name":"input_path","type":"string","role":"input_data","description":"输入 PDF 文件路径","required":true}] |
| output_params | [{"name":"output_path","type":"json_file","role":"output_data","description":"输出 JSON 文件路径"}] |
| publisher | COMMUNITY |
提取 PDF 文件元数据并输出 JSON 结果。 当用户提到把这次流程沉淀成 skill、保存为 skill等需求时使用此 skill。
python scripts/run_pdf_metadata_extract.py --input_path <input_path>
| 参数 | 类型 | 角色 | 必填 | 默认值 | 说明 |
|---|---|---|---|---|---|
| input_path | string | input_data | 是 | - | 输入 PDF 文件路径 |
| 参数 | 类型 | 角色 | 默认值 | 说明 |
|---|---|---|---|---|
| output_path | json_file | output_data | - | 输出 JSON 文件路径 |
python scripts/run_pdf_metadata_extract.py --input_path workspace/temp/document.pdf --output_path workspace/outputs/pdf_metadata_extract_output.json
{
"output_path": "workspace/outputs/pdf_metadata_extract_output.json"
}
{
"output_path": "workspace/outputs/pdf_metadata_extract_output.json"
}