docs: PDF 하이라이트 참조·이미지 추출 정리 규칙 추가

Co-Authored-By: Claude Fable 5 <noreply@anthropic.com>
This commit is contained in:
songyc macbook 2026-07-18 10:06:15 +09:00
parent fbbdf62b57
commit f78e188234

View File

@ -65,6 +65,26 @@
단, 덧붙이는 내용은 **해당 챕터의 범위를 절대 넘지 않는다.** 뒤 챕터 내용을 미리 끌어와 설명하지 않는다 (책 본문이 직접 예고한 연결을 언급하는 것은 허용). 질문의 답도 반드시 그 챕터 안에서 찾을 수 있어야 한다.
## PDF 하이라이트·이미지 활용 (정리 시)
정리 본문을 PDF 원문과 연결해, 정리를 읽다가 클릭 한 번으로 해당 PDF 위치로 점프할 수 있게 한다.
### 하이라이트 참조 — PDF 위치 링크
- 사용자가 Logseq PDF 뷰어에서 하이라이트를 만들면 `pages/hls__<PDF명>.md`에 블록이 생긴다 (`id:: <uuid>`, `hl-page:: <쪽>` 속성 포함).
- Claude는 hls 페이지를 **읽기만** 하고, 정리 본문의 관련 개념 옆에 블록 참조 `((uuid))`를 삽입한다. 클릭하면 PDF의 정확한 위치로 이동한다.
- 배치 기준: 개념 정의, 핵심 정리(定理), 중요 예제 등 **원문 대조가 유용한 지점에만** 넣는다. 남발하지 않는다.
- Claude는 하이라이트를 **직접 생성하지 않는다** (`assets/*.edn`에 렌더링 좌표를 써야 해서 불안정하고, 앱 캐시 롤백과 충돌 위험). 정리 중 원문 링크가 필요한데 해당 하이라이트가 없으면, 정리 완료 보고 시 **하이라이트 요청 목록**(쪽 번호 + 해당 문구)을 정리해 사용자에게 알린다. 사용자가 하이라이트를 만든 뒤 다시 요청하면 그때 `((uuid))` 참조를 채워 넣는다.
- 그림·도표는 사용자가 **영역(area) 하이라이트**로 만들어두면 참조 시 이미지로 렌더링된다. 영역 하이라이트가 있으면 별도 추출 없이 그것을 우선 참조한다.
### PDF 이미지 추출·임베드
- 그림·도표·그래프가 이해에 도움이 되면 PDF에서 직접 추출해 정리에 임베드한다 (영역 하이라이트가 없는 경우).
- 추출 방법: PyMuPDF(`pip3 install pymupdf`)로 해당 쪽/영역을 PNG로 렌더링해 `assets/`에 저장한다.
- 파일명 규칙: `<단원>_p<쪽>_<간단한 설명>.png` (예: `1장_p12_벡터합_평행사변형.png`). 타임스탬프 형식(`image_..._0.png`)은 Logseq 자동 생성 전용이므로 쓰지 않는다.
- 임베드: `![설명](../assets/파일명.png)` 후, 같은 블록이나 자식 블록에 출처 쪽 번호를 병기한다 (예: `(p.12, 그림 1-4)`).
- `assets/`**새 파일 추가만** 한다. 기존 파일 수정·삭제 금지는 그대로 적용된다.
## 현재 진행: 선형대수학 (스트랭 6판)
- `1장 백터와 행렬.md`, `2장 선형방정식 풀기.md`에 OCR PDF가 링크되어 있다 (`assets/1장_벡터와_행렬OCR_*.pdf`, `assets/2장_선형방정식_풀기OCR_*.pdf`).