원클릭으로
markdownify-mcp
转 Markdown 工具。仅当用户明确要把网页、PDF、图片、音频、YouTube、DOCX、XLSX、PPTX 等内容转换为 Markdown 时使用。优先采用本机可运行的 stdio 方式,不要写远程 SSE/HTTP MCP 配置。
Codex 또는 Claude로 설치 이 Prompt를 복사해 Codex, Claude 또는 다른 어시스턴트에 붙여 넣으면 Skill 페이지를 검토하고 설치를 진행할 수 있습니다.
메뉴
转 Markdown 工具。仅当用户明确要把网页、PDF、图片、音频、YouTube、DOCX、XLSX、PPTX 等内容转换为 Markdown 时使用。优先采用本机可运行的 stdio 方式,不要写远程 SSE/HTTP MCP 配置。
Codex 또는 Claude로 설치 이 Prompt를 복사해 Codex, Claude 또는 다른 어시스턴트에 붙여 넣으면 Skill 페이지를 검토하고 설치를 진행할 수 있습니다.
Word文档处理:创建、编辑、读取.docx文件。用户提到"Word"、"文档"、".docx"、"报告"、"信函"时使用。
使用腾讯云 API 密钥调用腾讯云各种服务,包括翻译、CVM、COS等。
图片识别与图文理解,基于 PaddleOCR-VL 模型,支持识别图片中的文字、场景、物体等信息。支持109种语言,可输出JSON或Markdown格式。
You MUST use this for gathering contexts before any work. This is a Knowledge management for AI agents. Use `brv` to store and retrieve project patterns, decisions, and architectural rules in .brv/context-tree. Uses a configured LLM provider (default: ByteRover, no API key needed) for query and curate operations.
Typed knowledge graph for structured agent memory and composable skills. Use when creating/querying entities (Person, Project, Task, Event, Document), linking related objects, enforcing constraints, planning multi-step actions as graph transformations, or when skills need to share state. Trigger on "remember", "what do I know about", "link X to Y", "show dependencies", entity CRUD, or cross-skill data access.
Transform AI agents from task-followers into proactive partners that anticipate needs and continuously improve. Now with WAL Protocol, Working Buffer, Autonomous Crons, and battle-tested patterns. Part of the Hal Stack 🦞
SOC 직업 분류 기준
| name | markdownify-mcp |
| description | 转 Markdown 工具。仅当用户明确要把网页、PDF、图片、音频、YouTube、DOCX、XLSX、PPTX 等内容转换为 Markdown 时使用。优先采用本机可运行的 stdio 方式,不要写远程 SSE/HTTP MCP 配置。 |
| triggers | ["转 markdown","转换成 markdown","网页转 markdown","pdf转markdown","文档转markdown","markdownify","提取为 markdown"] |
| mcp | {"command":"npx","args":["-y","@zcaceres/markdownify-mcp"]} |
这是一个内容转 Markdown的 skill,不是天气 skill。
支持把这些内容转成 Markdown:
当前宿主机只支持 stdio 类型 MCP。 所以这里的接入原则很简单:
command + args 本地启动sse / 远程 HTTP / streamable_httpconfig.json 里塞远程 SSE 地址适合:
不适合:
如果后续真要注册到 MCP client,应该是这种 stdio 形式:
{
"mcp": {
"clients": {
"markdownify": {
"name": "markdownify",
"enabled": true,
"transport": "stdio",
"command": "npx",
"args": ["-y", "@zcaceres/markdownify-mcp"],
"env": {},
"cwd": ""
}
}
}
}
docx-to-markdownxlsx-to-markdownpptx-to-markdownimage-to-markdownaudio-to-markdownyoutube-to-markdownyoutube-to-markdownpdf-to-markdownbing-search-to-markdownwebpage-to-markdownimage-to-markdownaudio-to-markdowndocx-to-markdownxlsx-to-markdownpptx-to-markdownget-markdown-file这玩意儿该干的事只有一个:把内容变成 Markdown。 别再拿它伪装成天气能力,也别再配成 SSE 把本机搞挂。
# 转换网页为Markdown
npx -y @zcaceres/markdownify-mcp webpage-to-markdown --url https://example.com/article
# 指定输出文件
npx -y @zcaceres/markdownify-mcp webpage-to-markdown --url https://news.example.com --output article.md
# 转换多个网页
npx -y @zcaceres/markdownify-mcp webpage-to-markdown --urls https://site1.com,https://site2.com
# 转换PDF文件
npx -y @zcaceres/markdownify-mcp pdf-to-markdown --input document.pdf
# 指定页面范围
npx -y @zcaceres/markdownify-mcp pdf-to-markdown --input report.pdf --pages 1-10
# 批量转换PDF
for pdf in *.pdf; do
npx -y @zcaceres/markdownify-mcp pdf-to-markdown --input "$pdf" --output "${pdf%.pdf}.md"
done
# Word文档转Markdown
npx -y @zcaceres/markdownify-mcp docx-to-markdown --input report.docx
# Excel表格转Markdown
npx -y @zcaceres/markdownify-mcp xlsx-to-markdown --input data.xlsx --sheet "Sheet1"
# PowerPoint转Markdown
npx -y @zcaceres/markdownify-mcp pptx-to-markdown --input presentation.pptx
# 图像转Markdown(OCR提取)
npx -y @zcaceres/markdownify-mcp image-to-markdown --input screenshot.png
# 音频转Markdown(语音转文字)
npx -y @zcaceres/markdownify-mcp audio-to-markdown --input podcast.mp3
# YouTube视频转Markdown
npx -y @zcaceres/markdownify-mcp youtube-to-markdown --url https://youtube.com/watch?v=example
#!/bin/bash
# 批量内容转Markdown脚本
INPUT_DIR="./raw_content"
OUTPUT_DIR="./markdown_output"
mkdir -p "$OUTPUT_DIR"
# 处理PDF文件
find "$INPUT_DIR" -name "*.pdf" | while read pdf; do
basename=$(basename "$pdf" .pdf)
echo "处理PDF: $basename"
npx -y @zcaceres/markdownify-mcp pdf-to-markdown --input "$pdf" --output "$OUTPUT_DIR/${basename}.md"
done
# 处理Word文档
find "$INPUT_DIR" -name "*.docx" | while read docx; do
basename=$(basename "$docx" .docx)
echo "处理Word: $basename"
npx -y @zcaceres/markdownify-mcp docx-to-markdown --input "$docx" --output "$OUTPUT_DIR/${basename}.md"
done
# 处理网页URL
if [ -f "$INPUT_DIR/urls.txt" ]; then
count=1
while read url; do
if [ -n "$url" ]; then
echo "处理网页: $url"
npx -y @zcaceres/markdownify-mcp webpage-to-markdown --url "$url" --output "$OUTPUT_DIR/webpage_${count}.md"
((count++))
fi
done < "$INPUT_DIR/urls.txt"
fi
echo "转换完成!结果保存在: $OUTPUT_DIR"
#!/bin/bash
# 研究资料转Markdown整理
RESEARCH_DIR="./research"
OUTPUT_DIR="./organized_research"
mkdir -p "$OUTPUT_DIR"
# 创建主索引文件
INDEX_FILE="$OUTPUT_DIR/README.md"
echo "# 研究资料索引" > "$INDEX_FILE"
echo "" >> "$INDEX_FILE"
echo "## 文件列表" >> "$INDEX_FILE"
echo "" >> "$INDEX_FILE"
# 处理各种格式文件
process_file() {
local file="$1"
local basename=$(basename "$file")
local extension="${file##*.}"
local name="${basename%.*}"
echo "处理: $basename"
case "$extension" in
pdf)
npx -y @zcaceres/markdownify-mcp pdf-to-markdown --input "$file" --output "$OUTPUT_DIR/${name}.md"
echo "- [${name}.md](${name}.md) (PDF转Markdown)" >> "$INDEX_FILE"
;;
docx)
npx -y @zcaceres/markdownify-mcp docx-to-markdown --input "$file" --output "$OUTPUT_DIR/${name}.md"
echo "- [${name}.md](${name}.md) (Word转Markdown)" >> "$INDEX_FILE"
;;
pptx)
npx -y @zcaceres/markdownify-mcp pptx-to-markdown --input "$file" --output "$OUTPUT_DIR/${name}.md"
echo "- [${name}.md](${name}.md) (PPT转Markdown)" >> "$INDEX_FILE"
;;
jpg|jpeg|png)
npx -y @zcaceres/markdownify-mcp image-to-markdown --input "$file" --output "$OUTPUT_DIR/${name}.md"
echo "- [${name}.md](${name}.md) (图片OCR转Markdown)" >> "$INDEX_FILE"
;;
*)
echo "跳过不支持格式: $extension"
;;
esac
}
# 处理所有文件
find "$RESEARCH_DIR" -type f \( -name "*.pdf" -o -name "*.docx" -o -name "*.pptx" -o -name "*.jpg" -o -name "*.jpeg" -o -name "*.png" \) | while read file; do
process_file "$file"
done
echo "" >> "$INDEX_FILE"
echo "## 处理说明" >> "$INDEX_FILE"
echo "" >> "$INDEX_FILE"
echo "- 所有文件已转换为Markdown格式" >> "$INDEX_FILE"
echo "- 支持全文搜索和编辑" >> "$INDEX_FILE"
echo "- 转换时间: $(date)" >> "$INDEX_FILE"
echo "研究资料整理完成!索引文件: $INDEX_FILE"
# 设置代理(如果需要)
export HTTP_PROXY="http://proxy.example.com:8080"
export HTTPS_PROXY="http://proxy.example.com:8080"
# 设置输出目录
export MARKDOWNIFY_OUTPUT_DIR="./output"
# 设置语言(OCR和语音识别)
export LANGUAGE="zh-CN"
# 网页转换选项
npx -y @zcaceres/markdownify-mcp webpage-to-markdown \
--url https://example.com \
--timeout 30 \
--user-agent "Mozilla/5.0" \
--include-images
# PDF转换选项
npx -y @zcaceres/markdownify-mcp pdf-to-markdown \
--input document.pdf \
--ocr true \
--language chi_sim \
--dpi 300
# 图像转换选项
npx -y @zcaceres/markdownify-mcp image-to-markdown \
--input photo.jpg \
--language eng+chi_sim \
--preserve-layout
1. npx命令找不到
# 检查Node.js安装
node --version
# 如果未安装Node.js
# Ubuntu/Debian: sudo apt install nodejs npm
# macOS: brew install node
# Windows: 下载Node.js安装包
2. 转换失败或超时
# 增加超时时间
npx -y @zcaceres/markdownify-mcp webpage-to-markdown --url https://example.com --timeout 60
# 使用代理
export HTTP_PROXY="http://proxy:8080"
npx -y @zcaceres/markdownify-mcp webpage-to-markdown --url https://example.com
# 简化输出
npx -y @zcaceres/markdownify-mcp webpage-to-markdown --url https://example.com --simple
3. 大文件处理失败
# 分块处理PDF
npx -y @zcaceres/markdownify-mcp pdf-to-markdown --input large.pdf --chunk-size 10
# 降低图像质量
npx -y @zcaceres/markdownify-mcp image-to-markdown --input large.jpg --quality 50
# 使用更多内存
export NODE_OPTIONS="--max-old-space-size=4096"
npx -y @zcaceres/markdownify-mcp pdf-to-markdown --input large.pdf
4. 中文内容识别问题
# 指定中文语言
npx -y @zcaceres/markdownify-mcp pdf-to-markdown --input chinese.pdf --language chi_sim
npx -y @zcaceres/markdownify-mcp image-to-markdown --input chinese.jpg --language chi_sim
# 使用中文OCR引擎
export TESSDATA_PREFIX="/usr/share/tesseract-ocr/4.00/tessdata"
# 并行处理多个文件
parallel 'npx -y @zcaceres/markdownify-mcp pdf-to-markdown --input {} --output {.}.md' ::: *.pdf
# 使用缓存(如果支持)
npx -y @zcaceres/markdownify-mcp webpage-to-markdown --url https://example.com --cache
# 预处理大文件
pdftoppm large.pdf -jpeg -r 150 | xargs -I {} npx -y @zcaceres/markdownify-mcp image-to-markdown --input {}
提示: markdownify-mcp是一个强大的内容转换工具,特别适合将各种格式的资料整理成统一的Markdown格式,便于后续搜索、编辑和版本控制。