답변과 함께 출처 페이지를 보여주는 논문 리더
요약
논문 리더 'Paper Margins'는 로컬 PDF나 arXiv ID를 열어 사용자가 특정 구절을 선택하고 설명이나 번역을 요청할 수 있게 합니다. 오른쪽 여백에는 모델 응답과 함께 근거가 된 원본 페이지 텍스트가 표시되어 신뢰성을 높입니다.
핵심 포인트
- 선택된 구절의 출처와 근거를 명확히 제시합니다.
- 로컬 PDF 및 arXiv ID 기반으로 작동하여 보안성이 높습니다.
- 질문, 요약 요청 시 관련 발췌문을 모델에 전달합니다.
저는 연구 논문의 밀도 높은 단락에서 자주 멈추며 빠른 설명이 필요합니다. 채팅 응답이 도움이 될 수 있지만, 여전히 그 근거가 된 문장과 페이지를 확인해야 합니다. 저는 이 순간을 위해 Paper Margins라는 작은 로컬 리더를 만들었습니다.
이 리더는 로컬 PDF 또는 arXiv ID를 엽니다. 저는 렌더링된 페이지에서 구절을 선택하고 '설명(Explain)' 또는 '번역(Translate)'을 선택할 수 있습니다. 오른쪽 여백에는 모델 응답과 해당 요청에 사용된 추출된 페이지 텍스트가 표시됩니다. 발췌문을 클릭하면 해당 페이지로 돌아갑니다. 또한 질문을 하거나, 현재 섹션을 요약하거나, 짧은 논문 요약을 요청할 수도 있습니다.

데모는 리포지토리에 포함된 원본 2페이지 PDF를 사용합니다. Transformer 논문을 인용했기 때문에 참고 자료 미리보기가 실제 arXiv 기록을 확인할 수 있습니다. GIF에서 선택된 텍스트, 설명, 그리고 출처 조회는 실행 중인 도구에서 가져온 것입니다.
리더 작동 방식
PDF.js가 브라우저에서 페이지를 렌더링하고 로컬 Node 서버에서 텍스트를 추출합니다. 질문의 경우, 서버는 질문의 단어들로 짧은 텍스트 청크를 점수화하여 일치하는 몇 가지 발췌문을 구성된 모델로 전송합니다. 선택된 구절의 경우, 해당 구절과 같은 페이지의 근처 텍스트를 보냅니다. 응답 패널에는 생성된 답변과는 별도로 이러한 발췌문이 표시되므로, 제가 모델이 실제로 받은 내용과 답변을 대조해 볼 수 있습니다.
Ollama가 기본 모델 연결입니다. 호환되는 채팅 엔드포인트를 구성할 수도 있습니다. 로컬 PDF는 컴퓨터에 그대로 유지되며 기본 로컬 모델을 사용합니다. 원격 모델 주소를 설정하면, 요청에 사용된 발췌문은 해당 서비스로 전송됩니다. 참고 자료를 클릭하면 그 arXiv ID, DOI 또는 인쇄된 참고 문헌 텍스트가 메타데이터 서비스로 전송되며, 전체 PDF는 전송되지 않습니다.
제한 사항 및 피드백
이것은 한 번에 하나의 논문을 읽는 리더입니다. 스캔된 페이지의 경우 텍스트 작업을 수행하려면 OCR(광학 문자 인식)이 필요합니다. PDF의 텍스트 순서는 복잡한 레이아웃에서 잘못될 수 있으며, 이는 섹션 및 참고문헌 감지에 영향을 미칩니다. 긴 섹션은 최대 다섯 페이지를 사용합니다. 발췌본은 모델이 본 것을 보여주지만, 그 답변이 정확하다는 것을 증명하지는 않습니다.
저는 2단 PDF, 인용 형식 또는 섹션 제목 때문에 잘못된 결과가 발생하는 예시들을 원합니다. 출처, 테스트, 샘플 PDF 및 데모는 https://github.com/Arthur031221/paper-margins에 있습니다.
AI 자동 생성 콘텐츠
본 콘텐츠는 Dev.to AI tag의 원문을 AI가 자동으로 요약·번역·분석한 것입니다. 원 저작권은 원저작자에게 있으며, 정확한 내용은 반드시 원문을 확인해 주세요.
원문 바로가기