TXT → PDF 変換について
テキストファイルにはページという概念がありません。文字と改行が並んでいるだけで、見た目は開いたエディターによって変わります。この変換ツールは、その文字の並びを実際のページに組みます。用紙は A4(既定)またはレターで、四辺に 0.75 インチ(約 19 mm)の余白を取ります。長い行はページの端からはみ出さずに余白で折り返され、空行や行頭のインデントはそのまま保たれます。タブは 1 つにつき半角スペース 4 つに置き換わるので、インデントしたブロックの見た目が崩れません。ファイルに改ページ文字(フォームフィード)がある箇所では新しいページが始まります。昔のラインプリンターと同じ決まりです。
書体は 2 種類から選べます。既定のサンセリフは、メモ、手紙、文章に向いています。等幅はすべての文字を同じ幅で表示するので、桁をそろえた表、アスキーアートの図、ソースコード、ログ出力を元の形のまま保てます。文字サイズは 10、11(既定)、12、14 ポイントから選べます。
.txt のほかに .log、.csv、.md のファイルも受け付け、どれもプレーンテキストとして扱います。CSV はカンマ区切りの行がそのまま表示され、Markdown も「#」や「*」の記号が残ります。見出し、リスト、表を実際に整形した Markdown にしたい場合は、Markdown → PDF 変換を使ってください。
TXT → PDF 変換の使い方
- テキストファイルを追加する.txt、.log、.csv、.md のファイルを 1 つ以上選ぶか、ツールにドラッグします。ファイルごとにそれぞれ 1 つの PDF に変換されます。
- 用紙、書体、サイズを選ぶA4 かレター、サンセリフか等幅、10〜14 ポイントの文字サイズを選びます。コード、ログ、スペースで位置をそろえたテキストには等幅のほうが合います。
- PDF を作成して保存する「PDF を作成」を押したら、PDF を 1 つずつダウンロードします。複数のファイルを変換した場合は、「すべてダウンロード(ZIP)」でまとめて保存することもできます。
主な利用シーン
PDF 提出が求められる申請や応募
人事システム、学校、保険会社などから PDF での提出を求められたのに、文章は .txt で保存するメモアプリで書いてしまったとします。そんなときは変換すれば、どの端末でも同じように開けるファイルを提出できます。
サポート問い合わせに添付するログの抜粋
等幅を選ぶと、タイムスタンプや列がきちんとそろいます。長いエラー行もページの端で切れて消えずに余白で折り返されるので、問い合わせを読む担当者が各メッセージを最後まで確認できます。
README や文字起こしファイルをまとめて印刷する
テキストファイル一式を一度に追加し、プリンターに合った用紙を選べば、ファイルごとの PDF を収めた ZIP ファイルをダウンロードできます。そのまま印刷やアーカイブに使えます。
文字コードの判定方法
テキストファイルは、どの文字コードで保存されているかを自分では示さないことがほとんどです。そこで変換ツールは手がかりを探します。最近のエディターで標準の UTF-8 を既定とみなし、ファイルの先頭に UTF-8 の BOM(バイトオーダーマーク)があっても正しく処理します。ファイルが BOM で始まる場合は UTF-16 と判定します。一部の Windows ソフトが「Unicode」として保存するテキストがこれにあたります。どちらにも当てはまらないものは、西欧言語向けの古い Windows ソフトが使っていた従来の文字コード、Windows-1252 として読み込みます。
文字化けが起きるのは、この最後の読み込み方のときです。Windows-1251 で保存されたロシア語のファイルや、Shift-JIS で保存された日本語のファイルは、アクセント付きのラテン文字や記号がでたらめに並んだ状態になります。古いソフトで作った日本語のテキストは Shift-JIS のことがよくあるので、文字化けしたらまずこれを疑ってください。テキストエディターでファイルを開いて UTF-8 で保存し直し、もう一度変換すれば解決します。
PDF に使われるフォント
| ファイル内の文字 | 使われるフォント | PDF への影響 |
|---|---|---|
| ラテン文字(アルファベット) | Helvetica(サンセリフ)または Courier(等幅) | PDF リーダーに組み込まれているため、フォントは埋め込まれません |
| ギリシャ文字、キリル文字 | Roboto(Apache-2.0) | 使われた文字だけを埋め込み |
| 中国語、日本語 | Droid Sans Fallback(Apache-2.0) | 約 4 MB。テキストに必要なときだけブラウザにダウンロードされ、サブセットとして埋め込まれます |
| 韓国語(ハングル)、アラビア語、ヘブライ語、ヒンディー語、タイ語など | 非対応 | ハングルはこのツールに対応フォントがなく、疑問符(?)で表示されます。そのほかは正しくレイアウトされません |
サブセット化とは、テキストで実際に使われている字形だけを PDF に入れることです。そのため日本語を 1 ページ分変換しても、数 MB あるフォント全体がファイルに入り込むことはありません。右から左に書く文字や、デーヴァナーガリー文字、タイ文字のように字形の変化が必要な文字は、文字の順番が狂ったり、つながるべき文字が離れたりします。そうした文字を含む文書には、それぞれの文字に対応したアプリを使ってください。
できあがる PDF の中身
すべての文字は文字の画像ではなく、選択できる本物のテキストです。PDF 内を検索したり、文字をコピーしたり、拡大してもぼやけたりしません。ファイルもコンパクトに収まり、特にラテン文字だけのテキストならフォントの埋め込みがまったく不要です。テキストファイルには装飾の情報がないため、結果も同様で、書体は 1 種類、文字サイズも 1 種類、太字・色・画像はありません。出力にページ番号を入れたい場合は、あとから PDF ページ番号追加で付けられます。文書のプロパティに入れるタイトルは PDF メタデータ編集で設定できます。
この変換ツールでは対応できないこと
- 表計算ソフトのような表。CSV はカンマを含む行がそのまま印字されます。きちんとした表にしたい場合は、表計算アプリから PDF を書き出してください。
- 書式付きの Markdown。見出し、太字、リストを反映するには Markdown → PDF 変換が必要です。
- 複数のファイルを 1 つの文書にすること。テキストファイルはそれぞれ別の PDF になります。あとで PDF 結合で 1 つにまとめてください。
- スマートフォンでの巨大なログ。非常に長いファイルはレイアウトに多くのメモリを使うため、パソコンのほうが安定して処理できます。
テキストの読み込みとページへの配置は、このブラウザのタブの中で行われます。元のファイルも完成した PDF もアップロードされません。この点を自分で確かめる方法はプライバシーのページにまとめています。