無料 · オープンソース · アップロードなし

書類を撮るだけで、本物のスキャンに。

スマートフォンを紙に向けてください。OpenDocScan が紙の端を見つけ、傾きを直し、光のムラをならし、文字を読み取って、検索も文字選択もできる複数ページの PDF を書き出します。下で動いているのは、そのスクリーンショットではなく本体です。

各ページから OCR が読み取った文字を検索します。

すべてがこの端末の中で起きます

OpenDocScan は、このタブの中で動くコードだけで紙を見つけ、傾きを直し、きれいにし、文字を読み、PDF を書き出します。スキャンはこのブラウザーに保存され、アップロードされることはありません。

信じてもらう必要はありません。ブラウザーの開発者ツールを開き、ネットワークタブに切り替えて書類をスキャンしてみてください。アプリ本体が読み込まれたあとは、リクエストは一件もありません。

登録するものはなく、透かしもなく、ページ数の上限もなく、インストールするものもありません。

できること

スマートフォンのカメラを、書類スキャナーに。

以下はすべて、このタブの中、この端末の上で動きます。ページを読み込んでしまえば、アカウントもサブスクリプションも接続も要りません。

紙を見つける

カメラを動かすあいだ、紙の輪郭がその場で描かれます。違う辺を拾ってしまったときは、角をドラッグして直せます。

傾きを直す

斜めから撮った紙が、きちんとした長方形になって返ってきます。片手で持って撮ったのではなく、フラットベッドに置いたかのように。

光のムラをならす

影も、電球色のデスクライトも、スマートフォン写真特有の灰色っぽさも均されて、紙は白く、インクは黒く読めるようになります。

文字を読み取る

OCR がすべてのページを走るので、できあがる PDF は書類の写真ではなく、中を検索でき、文字を選択できるものになります。

複数ページの PDF にまとめる

撮り続けてください。ページはトレイに溜まり、書類を書き出す前に並べ替え・回転・削除ができます。

端末の中に留める

できあがったスキャンは、このブラウザー自身の保存領域に入ります。書き出すのはあなたの自由で、コピーを抱えているサーバーはどこにもありません。

仕組み

どの工程も、あなたの機械の中で起きます。

スキャンの中核は Rust で書かれ、WebAssembly にコンパイルされています。転送量は gzip で 139 KB。タブの中のバックグラウンドワーカーで動くので、1200 万画素の写真で明るさのスライダーを動かしてもつっかえません。

紙を見つける

動かしているあいだ、ファインダーの中に紙の輪郭がその場で描かれます。輪郭がずれていたら、四隅のどれでも正しい位置へドラッグしてください。

傾きを直す

撮影された四辺形が長方形に写し戻されます。大きさは紙の手前側の辺から決めるので、解像した細部が捨てられません。

きれいにする

写真・補正・白黒の三つに、明るさと回転。補正は、白飛びも黒つぶれもさせずに、紙を白へ、インクを黒へ引き戻します。

読み取る

端末内の文字認識が、ページ画像の裏に透明なレイヤーを置きます。だから PDF は検索も選択もできるのに、見た目はスキャンそのままです。

PDF を組み立てる

ページの追加・並べ替え・削除に上限はありません。用紙は A4、レター、リーガル、スキャンそのままの形から選べ、圧縮の強さも指定できます。

残す、あるいは残さない

できあがった書類はこのブラウザーに残り、これまでにスキャンしたすべての中を横断して検索できます。検索の手がかりは、認識が読み取った語そのものです。

139 KBコアの転送量
80コアのテスト数
0読み込み後のリクエスト
01 回のスキャンあたりの長いタスク

無料で、オープンソース。すべての機能を、登録なし・透かしなし・枚数制限なしで。

ほかに動く場所

iPhone・iPad・Android 版も作っています。

上のスキャナーは、スマートフォンのものも含め、最近のブラウザーならどれでも動きます。今日の製品はこれがすべてです。同じ Rust のコアはネイティブアプリにも組み込まれつつあり、カメラもファイル選択もオフライン保存もブラウザーのタブではなくプラットフォームから来ます。スキャンのコードはまったく同じで、電話向けにコンパイルしただけです。

  • 利用可能 ブラウザーの中で すべての機能が、どの端末でも。ホーム画面に追加すればアプリのように開き、オフラインでも動きます。
  • リリース候補 Android 今日からサイドロードできるネイティブビルドです。まだ初期で、写真をスキャンエンジンに渡すところまでしかできません。
  • 制作中 iPhone と iPad 同じエンジンが両方で動き、iPad 向けのレイアウトも入っています。配布用の署名はまだなので、ダウンロードできるものはありません。

プライバシー

プライバシーの主張を自分で確かめられる、唯一のスキャナー。

どのスキャンアプリも、あなたの書類は外に出ないと言います。ネイティブアプリでは、それは検証しようのない約束です。ここでは、目の前で起きるのを見られます。開発者ツールを開き、ネットワークパネルに切り替えて、一枚スキャンしてみてください。アプリが読み込まれたあとは、何も要求されません。

  • コアはネットワークに届かない スキャンを行う Rust モジュールには、HTTP クライアントもネットワーク関連の依存も一切コンパイルされていません。サーバーへ至るコードの道筋が存在しないのです。
  • 文字認識はここから配信される 認識エンジンはふつう、モデルを公開 CDN から取ってきます。それはスキャンするたびに第三者へ知らせるのと同じです。ここでは、その一バイト残らずこのサイトから配信しています。
  • クロスオリジンの要求は、避けるのではなく拒否される サービスワーカーがページの出す全リクエストの前に立ち、別のオリジン宛てのものには 403 を返します。読み取りだけでなく、すべてのメソッドについてです。
  • スキャンにアカウントは要らない 登録するものはなく、サインインの向こう側にある機能もありません。任意のアカウントはあり、私たちのアプリ間でクレジットを運びますが、あなたの書類はブラウザーがあなたの端末に保存するもので、そこへ届くことはありません。
  • 広告もトラッカーも第三者の解析もなし このページは第三者のスクリプトを読み込まず、クッキーも置きません。リクエストが一つでもオリジンの外へ出れば、テストスイートが失敗します。

料金

無料。すべて。

このページにある機能はすべて無料です。ページ数の上限も、透かしも、試用期間も、アカウントもありません。誘導する有料プランがそもそも存在しないのは、すべてがあなたの端末で動き、私たちには運用費がかからないからです。

これが置き換えるスキャンアプリは、透かしを消すのにサブスクリプションを求め、一つの書類のページ数に上限を設け、あるいはスキャンを自社のサーバーに置きます。これはそのどれもしませんし、ソースは公開なので自分で確かめられます。

質問

何かをスキャンする前に。

オフラインでも使えますか?
使えます。ページを一度読み込んでしまえば、接続がなくても動き続けます。ふつうはサーバーが要る文字認識も含めて、です。
スマートフォン用のアプリはありますか?
このページがそれです。ホーム画面に追加すれば、ほかのアプリと同じように開き、オフラインでも動き、背面カメラを使えます。同じスキャンのコードから作る iPhone・iPad・Android のネイティブ版も進行中ですが、まだ初期段階です。完成しているのはブラウザー版のほうです。
アカウントは必要ですか?
必要ありません。ここにサインインの向こう側にあるものはひとつもありません。任意のアカウントはあり、私たちのアプリ間でクレジットを持ち運ぶためのものですが、スキャンしたものがそこに含まれることはありません。
文字認識はどの言語を読めますか?
今のところ英語です。認識した文字は透明なレイヤーとして PDF に書き込まれますが、このレイヤーが扱えるのは今はラテン文字だけです。符号化できない語は文字化けさせずに検索レイヤーから外すだけで、ページの画像そのものには影響しません。
スキャンした書類はどこに保存されますか?
このブラウザーの中、この端末の上です。サーバー上ではありません。そのぶん他の端末には現れませんし、閲覧データを消せば一緒に消えます。
本当にオープンソースですか?
はい。全体が MIT または Apache-2.0 で公開されています。