PDFのプライバシー検査
送る前に、PDFが何を語るかを確認します。情報欄、ファイルの経路、個人情報まで。
PDFのプライバシー検査は端末上で行われ、報告する例はすべて伏字にします。ファイルについて何もアップロードも記録もしません。
ページに印刷された内容を黒塗りする
PDFのプライバシー検査 について
どのPDFも、ページに見えている以上のものを運びます。属性の辞書はたいてい著者名を含み、どのアプリがいつ作ったかを記録し、ときには利用者名とフォルダー構成を含む端末上の経路まで残します。文字の層にはさらに多くが潜みます。フッターのメールアドレス、表の中の口座番号、誰も読み返さなかった付録のカード番号。この検査は両方を報告します。情報欄の指摘は個人特定の度合いで段階付けされ、本文は住所やカード、各種番号の型と照合されます。
機能
- 著者、表題、主題、キーワード、作成器、生成器、日時を読み取り
- 利用者名とフォルダー構成を露わにしがちな端末上の経路を検出
- メール、電話番号、IBAN、カード、IPアドレス、各種番号を照合
- カード番号はLuhnの検査に通し、誤検出を減らします
- 例はすべて伏字にして報告し、そのままは表示しません
- 平易な言葉の説明が付いた、単一のリスク指標
- すべての情報欄をひと押しで消し、別の文書として保存
PDFのプライバシー検査 の使い方
- PDFをページに置きます
- 情報欄の指摘と、本文で見つかった個人情報を読みます
- リスク指標を見て、何を変えるべきか判断します
- 情報欄を消し、本文の指摘が重要ならページを黒塗りします
例
入力
tender-response.pdf
出力
High risk: author "J. Whitfield", path C:\Users\jwhitfield\Bids\…, 4 email addresses in the text.
いちばん驚かれるのは経路です。端末の利用者アカウント名が現れます。
よくあるエラーとトラブルシューティング
- 検査が何も報告しません。 — 情報欄を書かない生成器もあり、それは良い結果です。ページに印刷された内容については、本文の指摘を別に確認してください。
- 電話番号として拾われたものが、実は整理番号でした。 — 数字の並びは重なります。検査は報告寄りに倒しているので、伏字の例を読んで違うものは外してください。
- 情報欄を消したのに、ページから氏名が消えません。 — 情報欄とページの内容は別物です。印刷された氏名はページそのものから黒塗りしてください。
- 明らかに情報の多い文書なのに、本文の検査が何も見つけません。 — PDFが文字の層のないスキャンで、照合する対象がありません。先に文字を認識してから、もう一度検査してください。
よくある質問
- PDFがいちばんよく漏らすものは何ですか。
- 著者の欄、次いで作成したアプリです。どちらもファイルを作ったものが自動で設定し、読むときには見えません。
- 検査のために文書はアップロードされますか。
- いいえ。情報欄の読み取りも本文の照合もこのタブ内です。プライバシーを調べるために文書を送っては本末転倒です。
- 例が伏字なのはなぜですか。
- 報告そのものを安心して撮影・共有できるようにするためです。どんな住所が見つかったかは分かりますが、値そのものは画面に出ません。
- 情報欄を消すとページは変わりますか。
- いいえ。書き換えるのは文書の属性だけで、ページも文字も書体もそのままです。
- どの水準なら安心して送れますか。
- 検査が低いと示したものです。中は氏名と日時のことが多く、社内なら問題なく、外へ出す前に消しておくのが無難です。
関連ツール
すべての ArrayKit ツール