できること
スマートフォンのカメラを、書類スキャナーに。
以下はすべて、このタブの中、この端末の上で動きます。ページを読み込んでしまえば、アカウントもサブスクリプションも接続も要りません。
紙を見つける
カメラを動かすあいだ、紙の輪郭がその場で描かれます。違う辺を拾ってしまったときは、角をドラッグして直せます。
傾きを直す
斜めから撮った紙が、きちんとした長方形になって返ってきます。片手で持って撮ったのではなく、フラットベッドに置いたかのように。
光のムラをならす
影も、電球色のデスクライトも、スマートフォン写真特有の灰色っぽさも均されて、紙は白く、インクは黒く読めるようになります。
文字を読み取る
OCR がすべてのページを走るので、できあがる PDF は書類の写真ではなく、中を検索でき、文字を選択できるものになります。
複数ページの PDF にまとめる
撮り続けてください。ページはトレイに溜まり、書類を書き出す前に並べ替え・回転・削除ができます。
端末の中に留める
できあがったスキャンは、このブラウザー自身の保存領域に入ります。書き出すのはあなたの自由で、コピーを抱えているサーバーはどこにもありません。
仕組み
どの工程も、あなたの機械の中で起きます。
スキャンの中核は Rust で書かれ、WebAssembly にコンパイルされています。転送量は gzip で 139 KB。タブの中のバックグラウンドワーカーで動くので、1200 万画素の写真で明るさのスライダーを動かしてもつっかえません。
紙を見つける
動かしているあいだ、ファインダーの中に紙の輪郭がその場で描かれます。輪郭がずれていたら、四隅のどれでも正しい位置へドラッグしてください。
傾きを直す
撮影された四辺形が長方形に写し戻されます。大きさは紙の手前側の辺から決めるので、解像した細部が捨てられません。
きれいにする
写真・補正・白黒の三つに、明るさと回転。補正は、白飛びも黒つぶれもさせずに、紙を白へ、インクを黒へ引き戻します。
読み取る
端末内の文字認識が、ページ画像の裏に透明なレイヤーを置きます。だから PDF は検索も選択もできるのに、見た目はスキャンそのままです。
PDF を組み立てる
ページの追加・並べ替え・削除に上限はありません。用紙は A4、レター、リーガル、スキャンそのままの形から選べ、圧縮の強さも指定できます。
残す、あるいは残さない
できあがった書類はこのブラウザーに残り、これまでにスキャンしたすべての中を横断して検索できます。検索の手がかりは、認識が読み取った語そのものです。
無料で、オープンソース。すべての機能を、登録なし・透かしなし・枚数制限なしで。
ほかに動く場所
iPhone・iPad・Android 版も作っています。
上のスキャナーは、スマートフォンのものも含め、最近のブラウザーならどれでも動きます。今日の製品はこれがすべてです。同じ Rust のコアはネイティブアプリにも組み込まれつつあり、カメラもファイル選択もオフライン保存もブラウザーのタブではなくプラットフォームから来ます。スキャンのコードはまったく同じで、電話向けにコンパイルしただけです。
- 利用可能 ブラウザーの中で すべての機能が、どの端末でも。ホーム画面に追加すればアプリのように開き、オフラインでも動きます。
- リリース候補 Android 今日からサイドロードできるネイティブビルドです。まだ初期で、写真をスキャンエンジンに渡すところまでしかできません。
- 制作中 iPhone と iPad 同じエンジンが両方で動き、iPad 向けのレイアウトも入っています。配布用の署名はまだなので、ダウンロードできるものはありません。
プライバシー
プライバシーの主張を自分で確かめられる、唯一のスキャナー。
どのスキャンアプリも、あなたの書類は外に出ないと言います。ネイティブアプリでは、それは検証しようのない約束です。ここでは、目の前で起きるのを見られます。開発者ツールを開き、ネットワークパネルに切り替えて、一枚スキャンしてみてください。アプリが読み込まれたあとは、何も要求されません。
- コアはネットワークに届かない スキャンを行う Rust モジュールには、HTTP クライアントもネットワーク関連の依存も一切コンパイルされていません。サーバーへ至るコードの道筋が存在しないのです。
- 文字認識はここから配信される 認識エンジンはふつう、モデルを公開 CDN から取ってきます。それはスキャンするたびに第三者へ知らせるのと同じです。ここでは、その一バイト残らずこのサイトから配信しています。
- クロスオリジンの要求は、避けるのではなく拒否される サービスワーカーがページの出す全リクエストの前に立ち、別のオリジン宛てのものには 403 を返します。読み取りだけでなく、すべてのメソッドについてです。
- スキャンにアカウントは要らない 登録するものはなく、サインインの向こう側にある機能もありません。任意のアカウントはあり、私たちのアプリ間でクレジットを運びますが、あなたの書類はブラウザーがあなたの端末に保存するもので、そこへ届くことはありません。
- 広告もトラッカーも第三者の解析もなし このページは第三者のスクリプトを読み込まず、クッキーも置きません。リクエストが一つでもオリジンの外へ出れば、テストスイートが失敗します。
料金
無料。すべて。
このページにある機能はすべて無料です。ページ数の上限も、透かしも、試用期間も、アカウントもありません。誘導する有料プランがそもそも存在しないのは、すべてがあなたの端末で動き、私たちには運用費がかからないからです。
これが置き換えるスキャンアプリは、透かしを消すのにサブスクリプションを求め、一つの書類のページ数に上限を設け、あるいはスキャンを自社のサーバーに置きます。これはそのどれもしませんし、ソースは公開なので自分で確かめられます。
質問
何かをスキャンする前に。
- オフラインでも使えますか?
- 使えます。ページを一度読み込んでしまえば、接続がなくても動き続けます。ふつうはサーバーが要る文字認識も含めて、です。
- スマートフォン用のアプリはありますか?
- このページがそれです。ホーム画面に追加すれば、ほかのアプリと同じように開き、オフラインでも動き、背面カメラを使えます。同じスキャンのコードから作る iPhone・iPad・Android のネイティブ版も進行中ですが、まだ初期段階です。完成しているのはブラウザー版のほうです。
- アカウントは必要ですか?
- 必要ありません。ここにサインインの向こう側にあるものはひとつもありません。任意のアカウントはあり、私たちのアプリ間でクレジットを持ち運ぶためのものですが、スキャンしたものがそこに含まれることはありません。
- 文字認識はどの言語を読めますか?
- 今のところ英語です。認識した文字は透明なレイヤーとして PDF に書き込まれますが、このレイヤーが扱えるのは今はラテン文字だけです。符号化できない語は文字化けさせずに検索レイヤーから外すだけで、ページの画像そのものには影響しません。
- スキャンした書類はどこに保存されますか?
- このブラウザーの中、この端末の上です。サーバー上ではありません。そのぶん他の端末には現れませんし、閲覧データを消せば一緒に消えます。
- 本当にオープンソースですか?
- はい。全体が MIT または Apache-2.0 で公開されています。