← Ferramentas de Imagem

OCR de imagem

Imagem atualEnvie uma imagem para desbloquear as configurações de OCR

Como transformar fotos e capturas de tela em texto editável

Faça OCR de imagem para copiar o texto de uma foto, captura de tela ou página digitalizada. Escolha texto simples ou Markdown, extraia o conteúdo e confira os trechos importantes com a imagem antes de usar o resultado.

Custo: Há opções gratuitas. As opções Pro ou o uso além da cota gratuita podem exigir créditos; consulte o guia abaixo.

Como extrair texto de uma imagem

  1. Envie a imagem

    Arraste um JPG, PNG, WebP, HEIC, HEIF, AVIF, BMP ou TIFF de até 200 MB para a prévia, ou clique em Envie uma imagem para extrair texto. Para aproveitar uma imagem enviada em outra ferramenta, abra Files, a lista compartilhada de arquivos. Cada execução lê uma imagem.

  2. Defina o formato do texto

    No painel OCR, deixe TXT para obter texto simples ou escolha Markdown para conservar a estrutura com marcações. Faça essa escolha antes de iniciar: ela é aplicada durante a extração.

  3. Confira a dica de idioma

    Dica de idioma começa em Auto-detect, com reconhecimento automático. Você também pode selecionar o idioma da imagem. A seleção usa outro mecanismo de reconhecimento; pode ajudar a comparar uma leitura de caracteres ambíguos.

  4. Inicie a extração

    Clique em Extract text, o botão para extrair texto. A foto permanece na prévia. O conteúdo reconhecido aparece abaixo, em Texto extraído, acompanhado da contagem de caracteres.

  5. Revise e salve

    Compare nomes, valores, datas e códigos com a imagem. Copiar envia o texto para a área de transferência; Copiado confirma a ação. Baixar salva um arquivo UTF-8 chamado ocr-result.txt ou ocr-result.md. O resultado também entra na lista compartilhada de arquivos.

Formato de saída e dica de idioma

As duas opções do painel OCR controlam o texto reconhecido. Elas não alteram a imagem enviada.

TXT
É o formato inicial. Produz texto simples, sem marcações de Markdown. Tabelas reconhecidas ficam com uma linha por registro e tabulações entre as células, úteis ao colar em uma planilha. Sinais pertencentes ao conteúdo, como #hashtags, __init__ e <div> em uma captura de código, são preservados como texto. Use para mensagens, recibos, cartas e campos de formulários.
Markdown
Representa títulos com #, listas, ênfase e tabelas por meio de marcações. Serve para levar um documento estruturado a um aplicativo de notas ou wiki. Abra o .md em um editor que renderize Markdown para ver a formatação; em um editor de texto simples, as marcações continuam visíveis. A estrutura reconhecida ainda precisa de revisão.
Dica de idioma: Auto-detect
Envia a imagem ao GLM-OCR, modelo de reconhecimento da Z.ai que identifica o idioma e o sistema de escrita sem receber uma dica de idioma. É a opção padrão.
Dica de idioma: idioma específico
A lista mostra English, German, Spanish, French, Italian, Portuguese, Russian, Japanese, Chinese, Arabic e Hindi: inglês, alemão, espanhol, francês, italiano, português, russo, japonês, chinês, árabe e hindi. Ao selecionar um deles, a imagem vai ao Google Gemini com uma dica sobre o idioma, a escrita e a direção de leitura. Isso pode orientar a identificação de caracteres compartilhados pelo chinês e pelo japonês, por exemplo, ou a leitura do árabe da direita para a esquerda. A instrução é transcrever sem traduzir, resumir ou corrigir o conteúdo, mantendo também os trechos em outros idiomas.

Quem processa a imagem

A extração é coordenada nos nossos servidores; não acontece só no navegador. A imagem completa é enviada a um serviço externo de IA. Auto-detect usa GLM-OCR da Z.ai. Um idioma selecionado usa a API do Google Gemini. Se a API do Gemini atingir um limite de requisições ou quota, a mesma solicitação pode seguir para o modelo Gemini via OpenRouter. Considere esse envio antes de carregar documentos pessoais, extratos ou informações confidenciais.

Trocar entre Auto-detect e um idioma específico permite comparar leituras feitas por mecanismos diferentes. Cada nova execução tem seu próprio consumo de uso. A tarefa tem uma janela de processamento de até 30 minutos, sem uma nova tentativa automática; isso não é uma estimativa de duração para todas as imagens.

Prepare a imagem e confira a transcrição

O reconhecimento depende dos caracteres que a imagem realmente permite distinguir.

Recorte a região necessária

Textos em placas, etiquetas e outras áreas do fundo também podem entrar no resultado. Use Cortar imagem para limitar a leitura ao documento ou trecho de interesse.

Coloque as linhas na posição correta

Uma página de lado ou inclinada dificulta a leitura das linhas. Ajuste a orientação com Girar imagem e confira se letras e números continuam nítidos antes de extrair.

Prefira uma captura à foto da tela

Uma captura de tela evita reflexos, faixas de moiré e distorções de perspectiva que podem aparecer ao fotografar um monitor. Para documentos em papel, procure iluminação uniforme e foco suficiente para ler os caracteres na própria imagem.

Leia documentos de várias páginas com OCR de PDF

Esta ferramenta recebe uma imagem por vez, não um PDF. Se as páginas digitalizadas já estão em um documento PDF, OCR de PDF pode processar todas elas ou um intervalo de páginas na mesma tarefa.

Formatos, uso e armazenamento

Entrada
JPG, PNG, WebP, HEIC, HEIF, AVIF, BMP e TIFF; uma imagem de até 200 MB por execução
Saída
Texto simples (.txt) ou Markdown (.md) em UTF-8, além de cópia para a área de transferência
Processamento
Nos nossos servidores, com reconhecimento pela Z.ai ou Google Gemini e encaminhamento via OpenRouter quando o limite do Gemini exigir
Uso e créditos
Cada imagem conta como uma execução. A franquia gratuita depende da configuração de uso; depois dela, visitantes precisam entrar na conta e cada imagem adicional custa 1 crédito.
Marca d'água
Nenhuma marca d'água é acrescentada ao texto
Arquivos salvos no site
Uploads e arquivos de resultado são removidos após 48 horas para visitantes e 30 dias para contas gratuitas. Planos pagos podem conservá-los por mais tempo. Baixe o texto que deseja guardar.

Perguntas frequentes

O OCR de imagem traduz o texto?

Não. O objetivo é devolver o que está escrito na imagem, no mesmo idioma. Dica de idioma orienta a leitura de caracteres ambíguos e da direção de escrita; não pede tradução. Trechos em outros idiomas também devem permanecer como estão.

Por que algumas letras ou números saem errados?

Texto pequeno, desfocado, pouco contrastado, sombreado ou fotografado em ângulo pode ser difícil de distinguir. Confira especialmente 0 e O, 1 e l, ou rn e m. Compare códigos e valores com o original. Uma fonte mais nítida, um recorte ou outra execução com Dica de idioma diferente podem ajudar a obter uma leitura mais útil, sem dispensar a revisão.

Quando usar TXT ou Markdown?

Escolha TXT para colar em mensagens, formulários e planilhas; tabelas reconhecidas são organizadas em linhas com células separadas por tabulações. Escolha Markdown quando quiser conservar títulos, listas e tabelas como estrutura em um editor compatível com esse formato. Defina o formato antes de extrair.

Minha imagem é enviada a terceiros?

Sim. Auto-detect envia a imagem à Z.ai; selecionar um idioma usa Google Gemini, com possível encaminhamento via OpenRouter se houver limitação de requisições ou quota. Os arquivos salvos no nosso site seguem os prazos de 48 horas para visitantes e 30 dias para contas gratuitas. Esses prazos não descrevem a retenção dos provedores externos.

O que fazer se a extração falhar?

Uma imagem sem texto legível pode terminar com uma mensagem de que nenhum texto foi extraído. Verifique o foco e o tamanho dos caracteres, remova áreas desnecessárias com Cortar imagem e tente novamente com uma fonte adequada. Cada nova execução conta separadamente no uso disponível.