O que ele faz
A câmera do celular, transformada em um scanner de documentos.
Tudo o que vem abaixo roda dentro desta aba, neste aparelho. Depois que a página carrega, nada aqui precisa de conta, assinatura ou conexão.
Encontra a página
A folha é contornada ao vivo enquanto você move a câmera, e os cantos podem ser arrastados se o contorno pegar a borda errada.
Endireita a perspectiva
Uma página fotografada de lado volta retangular, como se tivesse sido colocada em um scanner de mesa em vez de segurada com uma das mãos.
Uniformiza a luz
Sombras, a luz amarelada de um abajur e o cinza típico de foto de celular são igualados, para que o papel fique branco e a tinta preta.
Lê o texto
O OCR passa por todas as páginas, então o PDF que você recebe é um em que dá para buscar e selecionar texto, não uma foto de um documento.
Monta um PDF de várias páginas
Continue fotografando; as páginas se juntam em uma bandeja em que você pode reordenar, girar ou remover antes de o documento ser gravado.
Mantém no aparelho
As digitalizações prontas ficam no armazenamento do próprio navegador. São suas para exportar, e nenhum servidor guarda uma cópia.
Como funciona
Cada etapa acontece na sua própria máquina.
O núcleo de digitalização é escrito em Rust e compilado para WebAssembly — 139 KB pela rede, com gzip. Ele roda em um worker em segundo plano dentro da aba, e por isso arrastar o controle de brilho em uma foto de 12 megapixels não trava.
Encontrar a página
A folha é contornada ao vivo no visor enquanto você se move. Se o contorno estiver errado, arraste qualquer um dos quatro cantos para o lugar certo.
Endireitar
O quadrilátero fotografado é remapeado para um retângulo, dimensionado pela borda mais próxima da página, de modo que nenhum detalhe nítido seja jogado fora.
Limpar
Foto, Realçar ou Preto e branco, com brilho e rotação. Realçar puxa a página de volta para papel branco e tinta preta sem estourar nenhum dos dois.
Ler
O reconhecimento de texto no próprio aparelho coloca uma camada invisível atrás da imagem da página, então o PDF é pesquisável e selecionável e continua com a cara da digitalização.
Montar o PDF
Adicione, reordene e apague páginas sem limite. Escolha A4, Carta, Ofício ou o próprio formato da digitalização, e o quanto comprimir.
Guardar, ou não
Documentos prontos ficam neste navegador e podem ser buscados em todas as digitalizações que você já fez — pelas palavras que o reconhecimento leu dentro delas.
Grátis e de código aberto (open source): todos os recursos, sem conta, sem marca d'água, sem limite.
Onde mais ele roda
Também está sendo feito para iPhone, iPad e Android.
O scanner acima roda em qualquer navegador moderno, inclusive o do seu celular. Hoje, é esse o produto inteiro. O mesmo núcleo em Rust também está sendo colocado em aplicativos nativos, para que a câmera, o seletor de arquivos e o armazenamento offline venham da plataforma em vez de uma aba do navegador — o mesmíssimo código de digitalização, compilado para o telefone.
- Pronto No seu navegador Todos os recursos, em qualquer aparelho. Adicione à tela de início e ele abre como um aplicativo e funciona offline.
- Candidata a versão final Android Uma versão nativa que você já pode instalar por fora. Ainda inicial — leva uma foto até o motor de digitalização e nada além disso.
- Em andamento iPhone e iPad O mesmo motor, rodando nos dois e com layout para o iPad. Ainda não assinado para distribuição, então não há nada para baixar.
Privacidade
O único scanner em que você mesmo pode conferir a promessa de privacidade.
Todo aplicativo de digitalização diz que seus documentos ficam em sigilo. Em um aplicativo nativo, essa é uma promessa que você não tem como auditar. Aqui é algo que dá para ver acontecendo: abra as ferramentas de desenvolvedor, vá ao painel de rede e digitalize uma página. Depois que o app carrega, nada mais é requisitado.
- O núcleo não alcança a rede O módulo em Rust que faz a digitalização não tem cliente HTTP nem dependência de rede compilados. Não existe caminho de código até um servidor.
- O reconhecimento de texto vem daqui Motores de reconhecimento normalmente buscam o modelo em uma CDN pública, o que avisaria um terceiro toda vez que você digitalizasse algo. Aqui, cada byte é servido deste site.
- Requisições para outras origens são recusadas, não apenas evitadas Um service worker fica à frente de cada requisição da página e responde com 403 a tudo que vá para outra origem — em todos os métodos, não só leituras.
- Digitalizar não exige conta Não há nada para registrar, e nenhum recurso fica atrás de um login. Existe uma conta opcional — ela leva créditos entre nossos aplicativos —, mas seus documentos são guardados pelo seu navegador, no seu aparelho, e nunca chegam até ela.
- Sem anúncios, sem rastreadores, sem análise de terceiros Esta página não carrega nenhum script de terceiros nem grava cookies, e a bateria de testes falha se alguma requisição sair da origem.
Preço
Grátis. Tudo.
Todos os recursos desta página são gratuitos, sem limite de páginas, sem marca d'água, sem período de teste e sem conta. Não existe um plano pago para o qual empurrar você, porque tudo roda no seu próprio aparelho e não nos custa nada.
Os scanners que ele substitui cobram assinatura para tirar a marca d'água, limitam as páginas de um documento ou guardam suas digitalizações nos servidores deles. Este não faz nada disso, e o código é público para você conferir.
Dúvidas
Antes de digitalizar qualquer coisa.
- Funciona sem conexão?
- Sim. Depois que a página carrega, ela continua funcionando sem conexão — inclusive o reconhecimento de texto, que é justamente a parte que costuma exigir um servidor.
- Existe um aplicativo para o celular?
- Esta página é um. Adicione-a à tela de início e ela abre como qualquer outro aplicativo, funciona sem conexão e usa a câmera traseira. Versões nativas para iPhone, iPad e Android também estão em andamento sobre o mesmo código de digitalização, mas ainda são iniciais. A versão do navegador é a completa.
- Preciso de uma conta?
- Não. Aqui não há nada atrás de um login. Existe uma conta opcional que leva créditos entre nossos aplicativos; suas digitalizações nunca fazem parte dela.
- Quais idiomas o reconhecimento de texto lê?
- Hoje, inglês. O texto reconhecido é gravado no PDF como uma camada invisível que, por enquanto, só carrega alfabeto latino — uma palavra que ela não consegue codificar fica de fora da camada pesquisável em vez de sair corrompida, e a imagem da página não muda.
- Onde ficam guardados meus documentos?
- Neste navegador, neste aparelho. Não em um servidor — o que também significa que eles não aparecem nos seus outros aparelhos, e limpar os dados de navegação os apaga.
- É mesmo de código aberto?
- Sim — tudo, sob MIT ou Apache-2.0.