| name | arxiv |
| description | 搜索和下载 arXiv 论文。使用 arXiv API 搜索学术论文,支持下载 PDF。当用户说"搜索 arXiv"、"下载论文"、"arXiv 搜索"时使用。 |
| argument-hint | [搜索词或 arXiv ID] [--download] [--max N] [--dir PATH] |
arXiv 论文搜索与下载
搜索 arXiv 学术论文库,获取论文元数据和下载 PDF。
参数
$ARGUMENTS 包含:
- 搜索词或 arXiv ID: 必需,可以是关键词或 arXiv ID(如 2301.07041)
--download: 下载搜索结果的 PDF
--max N: 最大结果数,默认 10
--dir PATH: PDF 保存目录,默认 papers/
使用示例
# 搜索论文
/arxiv transformer attention
/arxiv 2301.07041 # 按 ID 搜索
# 搜索并下载
/arxiv attention mechanism --download
/arxiv 2301.07041 --download
# 指定下载数量和目录
/arxiv deep learning --max 20 --download --dir literature/
执行步骤
Step 1: 解析参数
从 $ARGUMENTS 中提取:
query: 搜索词或 arXiv ID
download: 是否下载 PDF
max_results: 最大结果数
output_dir: PDF 保存目录
Step 2: 执行搜索
python3 tools/search/arxiv_fetch.py search "QUERY" --max MAX_RESULTS
Step 3: 显示结果
arXiv 搜索 "QUERY": 找到 N 条结果
| # | arXiv ID | 标题 | 作者 | 日期 | 分类 |
|---|----------|------|------|------|------|
| 1 | 2301.07041 | Attention Is All... | Vaswani et al. | 2017-06-12 | cs.LG |
| 2 | ... | ... | ... | ... | ... |
─── 详情 ───
1. {标题}
arXiv: {id} - {url}
作者: {authors}
日期: {published}
分类: {categories}
摘要: {abstract 前 200 字}...
本地 PDF: papers/{id}.pdf (如已下载)
Step 4: 下载 PDF(可选)
如果指定了 --download:
python3 tools/search/arxiv_fetch.py download "ID1,ID2,..." --dir OUTPUT_DIR
下载结果:
✓ 2301.07041: Downloaded (842 KB)
✓ 2302.00001: Downloaded (1.2 MB)
arXiv ID 格式
支持两种格式:
- 新格式:
YYMM.NNNNN(如 2301.07041)
- 旧格式:
category/NNNNNNN(如 cs/0601001)
可包含版本号:2301.07041v2
相关 Skill
/smart-search - 多源智能检索(推荐使用)
/cnki-search - CNKI 搜索
/cnki-download - CNKI 下载
注意事项
- 速率限制: arXiv API 有请求频率限制,批量下载时会有延迟
- 文件验证: 下载的 PDF 会验证大小(>10KB),避免下载错误页面
- 重复下载: 已存在的 PDF 会被跳过