| name | research-lit |
| description | 논문 검색, 선행연구 조사, 레퍼런스 찾기, 인용 확인, 문헌 리뷰, 이 주제 논문 있는지 확인, 참고문헌 정리 요청에 사용합니다. '이 주제 논문 찾아줘', '선행연구 뭐 있어?', '레퍼런스 좀 모아줘', '이 인용 실제로 있는 논문이야?', '문헌 리뷰 해줘' 같은 요청에 대응합니다. 단, 일반 웹·시장 자료 조사는 /research, 이미 모은 출처의 등급 판정은 /verify를 사용합니다. |
lit Workflow
Codex-compatible mirror of lit.md from the research archetype.
/lit — 논문 리서치와 레퍼런스
학술 문헌을 찾고, 실재하는지 확인하고, 근거 강도까지 매겨 정리한다.
설계 근거: LLM은 문헌 **검색(발견)에서 재현율 13%**로 있는 논문의 68~96%를 놓치지만, 스크리닝(거르기)에서는 민감도 0.92~0.93으로 사람에 준한다. 그래서 이 커맨드는 찾기를 사람·DB에 맡기고 거르기·정리를 에이전트에 맡기는 순서로 짜여 있다.
그리고 조작된 인용은 2023년 논문 2,828편당 1편에서 2026년 277편당 1편으로 늘었다. 실재 확인이 선택이 아니다.
사용법
/lit {주제} # 주제로 선행연구 탐색
/lit --check {인용문자열} # 이 인용이 실재하는지만 확인
/lit --seminal {분야} # 그 분야의 기초 논문 계보
실행 흐름
Step 1: 질문을 검색 가능한 형태로
- 무엇을 알고 싶은지 한 문장으로 적는다. 이게 안 되면 검색이 산으로 간다.
- 동의어·표기 변형을 나열한다 (한/영, 축약형, 옛 명칭).
- 제외 조건도 적는다 — 어떤 게 나오면 관련 없는 것인지.
10-questions/에 저장한다.
Step 2: 찾기 — DB 우선, 에이전트는 보조
무료 공개 API를 먼저 쓴다. 인증 없이 열린다.
| 소스 | 용도 | 비고 |
|---|
Crossref (api.crossref.org/works?query=) | DOI·서지·인용수 | 메타데이터 광범위 |
OpenAlex (api.openalex.org/works?search=) | 인용 네트워크·주제 분류·오픈액세스 여부 | 무료, 키 불필요 |
| PubMed E-utilities | 생의학 | 초록까지 |
| arXiv API | preprint | D급 기본 — 피어리뷰 아님 |
| Semantic Scholar | 인용 맥락·영향력 | rate limit 주의 |
- 검색 쿼리에 연도를 붙인다 (
... 2025, after:2024). 최신성 편향을 의도적으로 건다.
- 결과를 버리지 말고 전부
20-raw/에 저장한다. 거르기는 다음 단계다.
- 접근 실패는 URL과 실패 코드를 기록한다. 조용히 빠뜨리지 않는다.
Step 3: 거르기 — 여기서 에이전트를 쓴다
- Step 1의 질문과 제외 조건으로 포함/제외를 판정하고 사유를 한 줄씩 남긴다.
- 제외한 것도 목록에 남긴다. 나중에 "왜 이 논문이 없냐"는 질문에 답할 수 있어야 한다.
- 제외한 자료는 이후 요약·집계에 절대 들어가지 않는다 (
frameworks/output-correctness.md §1).
Step 4: 실재 확인 ★ (건너뛰지 않는다)
포함된 항목마다 확인한다.
- DOI가 실제로 해석되는가 — Crossref/doi.org로 조회. 안 되면 그 인용은 쓰지 않는다.
- 저자·연도·저널이 메타데이터와 일치하는가 — 하나라도 어긋나면 원문을 다시 본다.
- 철회(retracted)되지 않았는가 — Crossref의
update-to/Retraction Watch 표시 확인. 철회 논문은 명시적으로 표시하고 인용하지 않는다.
- preprint인가 게재본인가 — arXiv/bioRxiv 판만 있으면 D급이고, 저널 게재 여부를 확인해 등급을 올린다.
확인 못 한 항목은 "확인 불가"로 남긴다. 추측으로 채우면 그 뒤 전부가 오염된다.
Step 5: 등급과 근거 강도
50-sources/source_grades.md 기준으로 A~E를 매기고, 주장별로 이렇게 가른다.
| 상태 | 조건 | 본문 사용 |
|---|
| verified | 독립 출처 2개 이상, 충돌 없음, 1차 소스 도달 | 단정 가능 |
| unresolved | 출처 1개거나 충돌 미해소 | 단정 금지 — 별도 섹션 |
| refuted | 신뢰할 만한 반박 존재 | 반박과 함께만 언급 |
핵심 수치·인과 주장에는 반증 검색 1회를 붙인다. 반박이 나오면 refuted로 보낸다.
Step 6: 정리와 기록
50-sources/_registry.md에 등재: 식별자·서지·등급·확인일·접근 경로.
- 외부 API를 썼으면
third_party 메타데이터를 남긴다 (서비스명·이용약관/프라이버시 URL·확인일). 링크 부패도 관리 대상이다.
- 최종 정리는
40-reports/에.
산출물
10-questions/{주제}-lit-question.md 질문·동의어·제외조건
20-raw/{주제}/ 검색 원본(전량)
50-sources/_registry.md 등재(식별자·등급·확인일)
40-reports/{주제}-lit-review.md 본문 + Unresolved/Refuted + 미확인 푸터
품질 게이트
참조
- 판정 기준:
frameworks/verification-rubric.md (§4 조작된 참고문헌 — 식별자가 아무데도 없으면 not-found도 유죄)
- 산출물 규칙:
frameworks/output-correctness.md
- CRAAP 점수화:
frameworks/craap-test.md
- 위임: 탐색은
source-scout, 실재·인용 판정은 citation-reviewer