Zotero PDF Inventory - qwen 정리

제공해주신 Zotero PDF storage inventory를 분석한 결과입니다. 현재 라이브러리는 NSCLC (비소세포폐암) 치료, 특히 Durvalumab 관련 연구와 AI/Radiomics 기반의 예측 모델 연구가 주를 이루고 있습니다.

1. 전체 상태 요약

---

2. 최근 PDF bundle 목록 정리 우선순위 제안

중복 제거와 메타데이터 정리가 가장 시급한 영역입니다. 아래 그룹별로 처리를 권장합니다.

A. 높은 우선순위: 명확한 중복 (Exact Duplicates)

동일한 논문을 여러 번 다운로드하거나 import하여 발생한 중복입니다. 하나만 유지하고 나머지를 삭제해야 합니다.

  1. Takeda et al. (Durvalumab Real-World Japan)
  1. Park et al. (PACIFIC-KR)
  1. Stana et al. (Chemo-Radio-Immunotherapy NSCLC III)
  1. Bos and Ware (ARDS causes/pathophysiology)
  1. Adar et al. (Sublobar resection/SBRT/ablation)
  1. Amin et al. (AJCC 8th Edition Staging)
  1. 1-s2.0-S1556086422018536-main.pdf (Unknown Title)

B. 중간 우선순위: 유사 주제 또는 불명확한 파일명

C. 낮은 우선순위: 고유하지만 용량이 큰 파일

---

3. 중복 또는 여러 PDF가 들어 있는 Attachment Key 확인 포인트

현재 목록에서 "Attachment keys with multiple PDFs: 없음"이라고 명시되었으므로, 기술적으로는 하나의 key에 여러 파일이 묶여 있는 경우는 없습니다.

하지만 논리적 중복(Logical Duplicates)이 존재합니다. 즉, 같은 논문을 다른 key로 저장한 경우입니다. 위 '2번 항목'에서 지적한 7그룹의 중복이 이에 해당합니다.

확인 포인트:

  1. DOI 기반 중복 검색: Zotero 내에서 DOI 필드를 기준으로 중복을 찾아보세요. PIIS... 또는 1-s2.0-... 형태의 파일명은 종종 DOI가 제대로 인식되지 않아 중복으로 저장되는 원인이 됩니다.
  2. 파일명 유사성: main.pdf로 끝나는 파일들이 여러 개 있습니다. 이 파일들은 출판사(PubMed Central, Elsevier 등)에서 직접 다운로드한 것으로 보이며, 제목이 누락된 경우가 많습니다. 이들을 우선적으로 메타데이터를 채워야 합니다.

---

4. 사람 vs 자동화 작업 분리

🤖 자동화 (Zotero 플러그인 또는 스크립트 활용)

  1. 중복 항목 찾기 및 병합:
  1. 메타데이터 자동 채우기:
  1. 파일명 표준화:

👤 사람이 해야 할 일 (수동 검토 및 결정)

  1. 중복 병합 시 최종 선택:
  1. 제목이 없는 파일의 수동 검색:
  1. 주제 분류 및 태그링:
  1. 불필요한 파일 삭제 확인:

요약 액션 플랜

  1. Step 1: Zotero에서 "Find Duplicates" 실행 → 위 A그룹 7개 중복 쌍을 병합.
  2. Step 2: DOI가 있는 무제 파일(PIIS..., 1-s2.0-...)에 대해 메타데이터 검색 실행.
  3. Step 3: 여전히 제목이 없는 파일(JIIJVXB3 등)은 수동으로 DOI를 통해 정보 채우기.
  4. Step 4: 전체 라이브러리에 주제별 태그(#NSCLC, #AI) 적용.

이 과정을 거치면 154개 중 약 10~15개의 중복/불필요 파일이 정리되고, 메타데이터가 완성된 깔끔한 라이브러리가 될 것입니다.