一键导入
firecrawl
网页数据抓取工具,用于 AI 应用。将网页转换为 Markdown 或结构化 JSON 数据。支持抓取、爬取、搜索等功能。适用于需要获取网页内容的 AI Agent 场景。
用 Codex 或 Claude 帮你安装 复制这段 Prompt,粘贴到 Codex、Claude 或其他助手里,让它检查 Skill 页面并帮你完成安装。
菜单
网页数据抓取工具,用于 AI 应用。将网页转换为 Markdown 或结构化 JSON 数据。支持抓取、爬取、搜索等功能。适用于需要获取网页内容的 AI Agent 场景。
用 Codex 或 Claude 帮你安装 复制这段 Prompt,粘贴到 Codex、Claude 或其他助手里,让它检查 Skill 页面并帮你完成安装。
基于 SOC 职业分类
Claude Code 无限开发循环技能 - 让 Claude 成为无限开发循环:spec → feature list → implement → test → commit → repeat,跨无限制上下文窗口。
专业 PPT 演示文稿全流程 AI 生成助手。模拟万元/页级别 PPT 设计公司的完整工作流,输出高质量 HTML 演示文稿 + 可编辑矢量 PPTX。
WPS Office 智能助手 - AI编程助手通过自然语言操控WPS Office的MCP工具集。支持Excel(80工具) / Word(24工具) / PPT(111工具) / 通用(9工具)。
小红书内容自动化 — 监控关键词、生成爆款文案、自动发布。 基于 Agent-Reach 实现小红书阅读、搜索、发帖、评论、点赞。 适用于博物馆/文博/文物等垂直领域,也支持通用爆款生成。
Comprehensive Git operations for repository management. Use when working with Git repositories for: - Committing changes (git commit with conventional commits format) - Creating branches (feature, bugfix, hotfix branches) - Stashing changes - Viewing history, diffs, and status - Merging and rebasing - Creating pull requests (GitHub, GitLab) - Undoing commits and changes - Syncing with remote (push, pull, fetch)
Universal HTTP retry mechanism with exponential backoff. Use when making API calls that may fail due to network issues, timeouts, or rate limits.
| name | firecrawl |
| description | 网页数据抓取工具,用于 AI 应用。将网页转换为 Markdown 或结构化 JSON 数据。支持抓取、爬取、搜索等功能。适用于需要获取网页内容的 AI Agent 场景。 |
Firecrawl 是一个强大的网页数据 API,专为 AI 应用设计。可以把网页转换为 LLM 可用的 Markdown 或结构化数据。
npm install @mendable/firecrawl-js
# 或
pnpm add @mendable/firecrawl-js
import { FirecrawlApp } from '@mendable/firecrawl-js';
const app = new FirecrawlApp({ apiKey: 'your-api-key' });
// 抓取网页内容
const scrapeResult = await app.scrapeUrl('https://example.com', {
formats: ['markdown', 'html', 'text'],
});
console.log(scrapeResult.markdown);
// 爬取网站的所有页面
const crawlResult = await app.crawlUrl('https://example.com', {
limit: 10,
formats: ['markdown'],
});
console.log(crawlResult.data);
// 搜索网页
const searchResult = await app.search('what is firecrawl', {
limit: 5,
});
console.log(searchResult.data);
创建脚本文件 scripts/firecrawl-scrape.js:
import { FirecrawlApp } from '@mendable/firecrawl-js';
const apiKey = process.env.FIRECRAWL_API_KEY;
const app = new FirecrawlApp({ apiKey });
const url = process.argv[2];
const format = process.argv[3] || 'markdown';
async function scrape() {
try {
const result = await app.scrapeUrl(url, {
formats: [format],
});
console.log(JSON.stringify(result, null, 2));
} catch (error) {
console.error('Error:', error.message);
process.exit(1);
}
}
scrape();
运行:
FIRECRAWL_API_KEY=your-key node scripts/firecrawl-scrape.js https://example.com markdown
// 在 OpenClaw 的 exec 工具中运行
const { FirecrawlApp } = require('@mendable/firecrawl-js');
const app = new FirecrawlApp({ apiKey: process.env.FIRECRAWL_API_KEY });
const result = await app.scrapeUrl('https://news.ycombinator.com', { formats: ['markdown'] });
console.log(result.markdown);
const result = await app.scrapeUrl('https://example.com/news', {
formats: ['markdown'],
onlyMainContent: true,
});
// 将内容传给 LLM
const result = await app.crawlUrl('https://competitor.com/blog', {
limit: 20,
formats: ['markdown'],
});
const search = await app.search('your research topic', { limit: 10 });
// 获取搜索结果后逐个抓取
| 选项 | 类型 | 说明 |
|---|---|---|
| formats | string[] | 输出格式:markdown, html, text, json |
| onlyMainContent | boolean | 只提取主要内容,去除导航、广告等 |
| waitFor | number | 等待 JS 渲染的毫秒数 |
| timeout | number | 请求超时毫秒数 |
| 选项 | 类型 | 说明 |
|---|---|---|
| limit | number | 最多抓取页面数 |
| formats | string[] | 输出格式 |
| exclude | string[] | 排除的路径模式 |
| include | string[] | 只抓取的路径模式 |
FIRECRAWL_API_KEY=your-api-key-here