ワンクリックで
arxiv-paper-search
在arXiv学术平台检索、下载论文摘要和全文PDF,支持批量下载和智能筛选。当用户需要搜索英文学术论文、下载论文摘要或获取PDF全文时使用此技能。
Codex または Claude でインストール この Prompt をコピーして Codex、Claude、または他のアシスタントに貼り付けると、Skill ページを確認してインストールできます。
メニュー
在arXiv学术平台检索、下载论文摘要和全文PDF,支持批量下载和智能筛选。当用户需要搜索英文学术论文、下载论文摘要或获取PDF全文时使用此技能。
Codex または Claude でインストール この Prompt をコピーして Codex、Claude、または他のアシスタントに貼り付けると、Skill ページを確認してインストールできます。
SOC 職業分類に基づく
行动者网络理论专家分析技能,整合参与者识别、网络分析和转译过程追踪功能,提供全面的ANT分析框架
当用户需要执行行动者网络理论分析,包括参与者识别、关系网络构建、转译过程追踪和网络动态分析时使用此技能
当用户需要检验扎根理论饱和度,包括新概念识别、范畴完善度、关系充分性和理论完整性评估时使用此技能
执行布迪厄场域分析,包括场域边界识别、资本分布分析、自主性评估和习性模式分析。当需要分析社会场域的结构、权力关系和文化资本时使用此技能。
扎根理论专家分析技能,整合开放编码、轴心编码、选择式编码、备忘录撰写和理论饱和度检验功能,提供完整的扎根理论分析框架
当用户需要执行扎根理论的轴心编码,包括范畴识别、属性维度分析、关系建立和Paradigm模型构建时使用此技能
| name | arxiv-paper-search |
| description | 在arXiv学术平台检索、下载论文摘要和全文PDF,支持批量下载和智能筛选。当用户需要搜索英文学术论文、下载论文摘要或获取PDF全文时使用此技能。 |
| version | 1.0.0 |
| author | socienceAI.com |
| license | MIT |
| tags | ["literature-search","arxiv","paper-download","academic-search","pdf-download"] |
| compatibility | Claude 3.5 Sonnet and above |
| metadata | {"domain":"literature-search","methodology":"api-based","complexity":"intermediate","integration_type":"api-integration","last_updated":"2025-12-28","website":"https://arxiv.org","language":"bilingual"} |
| allowed-tools | ["python","requests","urllib"] |
在arXiv学术平台(https://arxiv.org/)自动检索英文学术论文,支持批量下载摘要和PDF全文,提供智能筛选和多数量选项。
Use this skill when the user requests:
When user needs arXiv paper search:
当用户提到以下需求时,使用此技能:
关键词触发(中文):
关键词触发(英文):
支持功能:
支持数量选项:
提取信息:
下载功能:
from skills.arxiv_paper_search.scripts.arxiv_searcher import ArxivPaperSearcher
# 初始化
searcher = ArxivPaperSearcher()
# 搜索论文(获取摘要)
results = searcher.search(
query="large language models",
max_results=20, # 可选: 10, 20, 50, 100
sort_by="relevance" # relevance, lastUpdatedDate, submittedDate
)
# 下载单篇PDF
searcher.download_pdf(
arxiv_id="2312.11805",
output_dir="papers/"
)
# 批量下载PDF
searcher.batch_download_pdfs(
results=results,
output_dir="papers/",
max_papers=10
)
参数说明:
query: 搜索关键词(必需)max_results: 返回结果数(默认20,可选10/20/50/100)sort_by: 排序方式(默认relevance)categories: arXiv分类筛选(可选)filters: 额外筛选条件(可选){
"search_request": {
"query": "搜索关键词(必需)",
"max_results": 20,
"sort_by": "relevance",
"categories": ["cs.AI", "cs.LG"],
"date_range": {
"start": "2024-01-01",
"end": "2024-12-31"
}
},
"download_request": {
"arxiv_id": "2312.11805",
"output_dir": "papers/",
"download_abstract": true,
"download_pdf": false
}
}
{
"search_summary": {
"query": "large language models",
"total_results": 20,
"search_time_seconds": 2.3
},
"papers": [
{
"index": 1,
"title": "Attention Is All You Need",
"authors": ["Vaswani, A.", "Shazeer, N.", "Parmar, N."],
"summary": "The dominant sequence transduction models...",
"published": "2017-06-12",
"updated": "2017-06-12",
"arxiv_id": "1706.03762",
"pdf_url": "https://arxiv.org/pdf/1706.03762.pdf",
"categories": ["cs.CL", "cs.LG"],
"doi": "10.1234/arxiv.1706.03762",
"comment": "8 pages, 5 figures",
"journal_ref": "NIPS 2017"
}
]
}
| 数量 | 适用场景 | 响应时间 | 数据量 |
|---|---|---|---|
| 10篇 | 快速预览、初步调研 | ~1-2秒 | ~50KB |
| 20篇 | 中等调研(推荐) | ~2-3秒 | ~100KB |
| 50篇 | 深度调研 | ~5-8秒 | ~250KB |
| 100篇 | 全面覆盖、批量分析 | ~10-15秒 | ~500KB |
cs.AI - 人工智能cs.CL - 计算语言学cs.CV - 计算机视觉cs.LG - 机器学习cs.NE - 神经网络cs.CR - 加密学math.OC - 优化与控制math.ST - 统计理论physics.comp-ph - 计算物理quant-ph - 量子物理stat.ML - 机器学习统计详细文档请查看:
references/USER_GUIDE.md - 完整使用指南references/API_REFERENCE.md - API参考references/ARXIV_CATEGORIES.md - arXiv完整分类列表references/ADVANCED_USAGE.md - 高级用法和最佳实践最小依赖(只包含必需的2个库):
# 方法1: 使用 uv(推荐,极快)
uv pip install -r requirements.txt
# 方法2: 使用 pip(传统)
pip install -r requirements.txt
依赖列表:
requests>=2.31.0 - HTTP请求feedparser>=6.0.10 - 解析arXiv API响应安装说明:
测试:
python scripts/test_arxiv_searcher.py
# 用户: "在arXiv搜索关于LLM的论文"
searcher = ArxivPaperSearcher()
results = searcher.search("large language models", max_results=20)
for paper in results[:5]:
print(f"{paper['title']}")
print(f"{paper['summary'][:100]}...")
# 用户: "下载50篇GPT相关论文的摘要"
results = searcher.search("GPT", max_results=50)
searcher.save_abstracts(results, 'gpt_abstracts.json')
# 用户: "下载10篇最新AI论文的PDF"
results = searcher.search(
"artificial intelligence",
categories=["cs.AI"],
sort_by="lastUpdatedDate",
max_results=10
)
searcher.batch_download_pdfs(results, 'ai_papers/')
⚠️ 重要声明:
✅ 最佳实践:
版本: 1.0.0 最后更新: 2025-12-28 维护者: SSCI Research Tools