소스 가져오기와 웹 클리핑
소스 가져오기와 웹 클리핑
Glif는 외부 자료를 바로 원본 문서로 취급하지 않는다. 파일이나 웹페이지를 가져오면, 먼저 Markdown 문서나 Markdown 문서셋으로 승격한 뒤 Binder 안에서 편집한다.
로컬 파일을 가져올 때
Input Gate의 소스 파일 가져오기는 로컬 문서를 미리보기로 열고, 가져올 수 있는 포맷은 Markdown 문서로 변환한다. 현재 가져오기 대상은 PDF, DOCX, HWP/HWPX, HTML/HTM, RTF, ODT, EPUB, XLSX, CSV, TSV, ODS 같은 source 문서와 표 데이터다.
여러 파일을 한 번에 옮길 때는 Input Gate의 일괄 가져오기를 사용할 수 있다. Glif는 선택한 파일을 하나씩 변환하고, 첫 번째 성공 결과만 editor에서 열며, 성공/실패/건너뜀 개수를 한 번에 알려준다. 가져올 수 없는 포맷은 실패가 아니라 건너뜀으로 집계된다.
폴더 단위로 옮길 때는 Shelf에서 폴더 context menu의 폴더의 소스 문서 모두 가져오기를 사용할 수 있다. Glif는 폴더 아래의 가져올 수 있는 소스 문서를 찾고, 개수를 확인받은 뒤 같은 일괄 가져오기 규칙으로 변환한다.
가져오기 결과는 원본 파일 자체가 아니라 Binder 안에서 편집할 Markdown artifact다. 변환 결과에는 원본 경로와 Glif의 형식별 변환 경로 같은 provenance 정보가 남지만, PDF나 Office 문서의 레이아웃을 그대로 보존하는 native 편집 모드는 아니다. HTML/HTM, ODT, RTF, EPUB 가져오기는 Glif의 형식별 경로로 처리하며 별도 변환 플러그인이나 런타임을 다운로드하지 않는다.
URL을 보관할 때와 클립할 때
Cart에 URL을 넣으면 링크를 보관하고 나중에 문서에 삽입할 수 있다. 이 상태에서는 웹페이지 내용이 Binder로 복사되지 않는다.
웹페이지 내용을 편집 가능한 문서로 만들려면 Cart의 URL item에서 Clip to Markdown을 실행한다. Glif는 공개 HTTP/HTTPS 페이지를 가져와 active Binder의 Web Clips/ 폴더 아래 Markdown note로 저장한다. 원래 URL item은 Cart에 남아 있으므로, 링크 보관과 문서 클립 결과를 따로 다룰 수 있다.
클립이 성공하면 생성된 note는 Shelf의 Web Clips/ 폴더에 바로 보이고, 첫 번째 성공 결과는 editor에서 열린다. 결과 note를 열지 못하면 실패 이유가 결과 알림에 표시된다.
생성되는 문서에는 원본 URL, 최종 URL, 제목, 사이트명, 가져온 시각 같은 provenance 정보가 frontmatter로 남는다. 페이지 본문은 Markdown으로 변환되고, 가져올 수 있는 이미지 asset은 제한된 범위에서 note 옆 asset 폴더로 복사된다.
지원 범위
웹 클리핑은 정적인 공개 웹페이지를 대상으로 한다. Glif는 브라우저 쿠키나 로그인 정보를 사용하지 않고, 페이지 JavaScript를 실행하지 않는다. 로그인 뒤에만 보이는 페이지, 동적으로 렌더링되는 SPA, 사내망이나 localhost 같은 private network URL은 v1 클립 대상이 아니다.
이미지 asset은 실패해도 note 생성을 막지 않는다. 대신 결과 알림에 실패 개수와 diagnostics가 표시된다.
폴더형 HTML 문서셋
index.html 또는 index.htm이 있는 로컬 폴더는 Shelf context menu에서 Binder로 가져올 수 있다. 이 흐름은 웹 URL 클리핑과 다르게 네트워크를 사용하지 않고, 원본 폴더와 같은 레벨에 Markdown 문서셋 폴더를 만든 뒤 해당 결과를 Binder로 연다.
단일 URL 웹 클리핑과 로컬 HTML 문서셋 가져오기는 같은 Markdown 편집 결과를 목표로 하지만, 입력 위치와 보안 경계가 다르다.