一键导入
pdf-reader
用 pdfplumber 快速提取本地 PDF 的纯文本并转成 Markdown,便于后续阅读、总结和分析。适用于用户发来的 PDF,或从 OpenAlex、PubMed、网页抓取后落到本地的 PDF 文件。仅覆盖有文本层的 PDF;扫描件/图片型 PDF 会明确提示无法直接提取。
用 Codex 或 Claude 帮你安装 复制这段 Prompt,粘贴到 Codex、Claude 或其他助手里,让它检查 Skill 页面并帮你完成安装。
菜单
用 pdfplumber 快速提取本地 PDF 的纯文本并转成 Markdown,便于后续阅读、总结和分析。适用于用户发来的 PDF,或从 OpenAlex、PubMed、网页抓取后落到本地的 PDF 文件。仅覆盖有文本层的 PDF;扫描件/图片型 PDF 会明确提示无法直接提取。
用 Codex 或 Claude 帮你安装 复制这段 Prompt,粘贴到 Codex、Claude 或其他助手里,让它检查 Skill 页面并帮你完成安装。
基于 SOC 职业分类
AI4S 端到端干实验自动化研究引擎。自启动检查+追溯入职(半路加入也能补齐历史)+强制Worklog(W1)+输出目录README(W2)+强制文献验证(W3)+强制脚本日志(W4)+分层记忆注入+SPEC驱动+OODA循环+Gate门控。适用于scRNA-seq/空间转录组/跨物种比较等计算生物学项目。
深度调研技能 - 完全内置的多 Agent 并行执行引擎,支持引用管理、文件发送、轻量量化验证和实时进度反馈。支持 2-8 个内置 agent 同时工作,大幅提升 Token 使用效率和执行速度。
Loop 系统工程师 — 从用户需求出发,设计并开发完整的多 skill 联动 package。扫描三镜像仓库现有资产,识别可复用 skill 与缺失 skill,调用 skill-governor 规范逐一开发缺失项,组包并编写主调度 skill 的平滑层。也可用于对已有 package 进行联动完整性审计(格式合规+主调度逻辑+入口文档同步+命名一致性)。当用户说"我需要一个 XX 系统/loop/agent 包"、"帮我设计一个多技能联动方案"、"从需求出发开发一整套 skill"、"检查 package 联动完整性"时触发。不适用于:单个 skill 的开发(用 skill-governor)、纯代码调试(用 debug)、纯研究任务。
首席私人医疗架构师 - 循证医学与中医结合的顶级私人医疗顾问。具备临床医学与药理学背景,深度掌握循证医学检索能力,擅长通过实时调用顶级医学数据库,结合传统中医理论,为高净值人群提供科学的健康管理与个性化医疗方案。
国自然基金资深评审专家与辅导顾问 - 深谙NSFC评审规则与基金委导向,提供从破题、科学问题提炼、立项依据撰写到预算规划的全流程辅导。
论文阅读助手 - 资深学术研究员,专精于跨学科文献的精读与批判性分析。帮助用户高效、深刻地理解学术论文,提供结构化的精读报告和批判性思考。
| name | pdf-reader |
| description | 用 pdfplumber 快速提取本地 PDF 的纯文本并转成 Markdown,便于后续阅读、总结和分析。适用于用户发来的 PDF,或从 OpenAlex、PubMed、网页抓取后落到本地的 PDF 文件。仅覆盖有文本层的 PDF;扫描件/图片型 PDF 会明确提示无法直接提取。 |
用这个 skill 处理“先把本地 PDF 变成可读文本,再继续分析”的场景。
.pdf 文件路径如果脚本提示“没有可提取文本”,直接告诉用户这份 PDF 很可能是扫描件,需要 OCR 流程;不要在这个 skill 里继续硬拆。
默认把 Markdown 写到 PDF 同目录下的同名 .md 文件:
uv run --with pdfplumber python3 workspace/skills/pdf-reader/scripts/extract_pdf_text.py /path/to/file.pdf
显式指定输出文件:
uv run --with pdfplumber python3 workspace/skills/pdf-reader/scripts/extract_pdf_text.py /path/to/file.pdf --output /path/to/file.md
只抽取部分页码:
uv run --with pdfplumber python3 workspace/skills/pdf-reader/scripts/extract_pdf_text.py /path/to/file.pdf --first-page 1 --last-page 5
直接打印到标准输出:
uv run --with pdfplumber python3 workspace/skills/pdf-reader/scripts/extract_pdf_text.py /path/to/file.pdf --stdout
## Page N 分段.pdf 被 read 工具读取时,会自动改走缓存的 Markdown sidecar(*.pdf.md)。MediaPath/MediaType 并走通用 file preprocessing;这个不由本 skill 单独保证。docx,改用 office-docs 或专门的 DOCX skill。| 关系 | Skill | 场景 |
|---|---|---|
| 被调用 | deep-research | 调研中需要提取 PDF 内容 |
| 被调用 | vitaforge-orchestrator | 文档工具调用 |
| 被调用 | office-docs | 文档处理前需提取 PDF 原文 |