글자가 가끔 깨지는 이유
텍스트 파일에는 문자가 들어 있지만 그 문자를 어떤 표에 따라 읽어야 하는지에 대한 정보는 없습니다. 그래서 프로그램은 추측할 수밖에 없습니다. 오래된 윈도우 편집기로 저장한 파일은 대개 Windows-1252를, 요즘 시스템은 UTF-8을 씁니다. 프로그램이 윈도우 파일을 UTF-8로 읽으면 글자가 깨집니다. 그래서 먼저 내용이 올바른 UTF-8인지 확인하고, 아니면 Windows-1252로 되돌립니다. 인식된 인코딩은 미리보기 위에 표시되며 언제든 바꿀 수 있습니다.
소스 코드와 기록에는 고정폭을
소스 코드, 설정 파일, 서버 기록에서는 들여쓰기와 열의 위치가 뜻을 담습니다. 폭이 다른 글꼴에서는 i가 m보다 좁기 때문에 어긋납니다. 고정폭 글꼴은 모든 글자에 같은 자리를 주므로 표와 들여쓰기가 그대로 정렬됩니다. 반면 메모나 편지 같은 흐르는 글에는 산세리프 글꼴이 읽기 편합니다.
긴 줄과 줄바꿈
텍스트 파일은 용지 너비를 모릅니다. 기록 한 줄이 수백 글자에 이를 수도 있습니다. 그래서 변환할 때 줄을 나누어 아무것도 잘리지 않게 합니다. 원한다면 줄 끝의 작은 표시가 그곳에 실제 줄바꿈이 없었고 줄이 이어진다는 것을 알려 줍니다. 긴 줄이 많다면 가로 방향과 좁은 여백도 함께 고르세요.
표시할 수 있는 문자
PDF에 내장된 표준 글꼴은 서유럽 문자 집합을 다루며 모든 강세 부호와 유로 기호를 포함합니다. 키릴, 그리스, 아랍, 히브리 문자와 한글·한자를 포함한 아시아 문자는 여기에 들어 있지 않아 대체 기호로 나타납니다. 이는 도구가 아니라 그 글꼴의 한계입니다. 그런 문자가 담긴 파일이라면 입력한 글로 PDF를 만드는 도구가 더 알맞습니다.
일상에서 쓸모 있는 경우
장애 신고를 위해 기록을 깔끔히 인쇄하기, 간단한 편집기의 메모를 보관하기, 시험이나 문서에 소스 코드를 첨부하기, 데이터 발췌본을 바꿀 수 없는 문서로 전달하기. 이 모든 경우에 형식 없는 파일이 확실하게 열리고 인쇄되고 보관되는 무언가가 되어야 합니다. PDF는 바로 그것을 위해 만들어졌습니다.
개인정보: 파일은 당신에게 남습니다
텍스트 파일은 브라우저의 파일 기능으로 읽히고 그 자리에서 PDF로 바뀝니다. 업로드는 일어나지 않으며 내용이 서버로 전송되거나 저장되는 일도 없습니다. 주소, 이름, 접속 정보가 들어 있을 수 있는 기록 파일에서 특히 중요합니다. 페이지를 한 번 불러온 뒤에는 인터넷 연결 없이도 작동합니다.