Guia de OCR para equações

Como eu escaneio uma equação sem confiar cegamente no OCR

Atualizado

O erro que eu queria evitar com entrada por foto era tratar OCR como solver de matemática. OCR apenas tenta reconhecer caracteres em pixels. Por isso meu fluxo é foto → texto reconhecido → revisão humana → solver. Essa revisão impede que uma leitura errada vire uma conta matematicamente correta para a equação errada.

Como eu escaneio uma equação sem confiar cegamente no OCR

Eu tiro a foto pensando em legibilidade, não em beleza

Recorto uma única equação, mantenho a câmera paralela ao papel, evito sombras e procuro deixar x, ×, 1, l, 0 e O claramente diferentes. Texto impresso costuma ser mais fácil, mas uma letra bem definida também pode funcionar.

Se a página tem vários exercícios, o OCR não sabe qual deles eu quero. O sistema atual favorece linhas com x e sinal de igualdade, mas isso é apenas uma heurística. Um recorte apertado é mais confiável.

Eu já espero erros em alguns símbolos

Expoentes, barras de fração, radicais, sinais de menos e multiplicação são pontos comuns de falha. x² pode virar x2, √ pode virar v e barras de módulo podem parecer o número 1.

Depois do reconhecimento, comparo imagem e texto justamente nesses pontos. Se a foto mostra x² - 5x + 6 = 0 e o campo mostra x2 - 5x + 6 = 0, corrijo o expoente antes de resolver.

x² ↔ x2
− ↔ -
× ↔ x
√ ↔ v
|x - 3| ↔ 1x - 31

O resultado do OCR volta para o campo normal de propósito

Eu não disparo Solve automaticamente depois do OCR. O texto reconhecido vai para o mesmo campo usado por digitação e LaTeX, então posso editar e conferir a prévia MathML.

Só depois dessa revisão eu resolvo. A partir daí, OCR e entrada manual usam a mesma normalização, parser, solver, passos, verificação e gráfico.

Eu deixo a fronteira de privacidade clara

Resolver equações suportadas não exige uma API matemática externa. O OCR opcional carrega Tesseract.js e recursos de reconhecimento deste site quando é ativado. O reconhecimento e a imagem permanecem no navegador; nenhuma imagem é enviada a um provedor externo de OCR.

Também evito dados sensíveis em equações ou em URLs compartilháveis com ?q=.

Quando o OCR insiste em errar, eu troco pelo caminho confiável mais rápido

Para uma equação curta, digitar pode ser mais rápido. Se a origem já contém LaTeX, colar LaTeX costuma ser mais preciso. Se a escrita está ambígua, eu transcrevo manualmente e uso a prévia como conferência.

A meta não é provar que OCR lê qualquer folha. É reduzir digitação quando a imagem está clara e manter a equação final sob meu controle antes de qualquer cálculo.