API OCR de PDFs com Tesseract e FastAPI — ideal para automações e n8n
10K+
🧠 Tesseract OCR API (FastAPI + Docker)
API de OCR local para extração de texto de PDFs com o Tesseract, pronta para integração com n8n, Python, Node.js ou Postman.
🚀 Recursos
📄 OCR de PDFs (idiomas: por, eng, por+eng)
⚙️ Controle de DPI e limite de páginas
🔐 Autenticação via Bearer Token (API_TOKEN)
🐳 Deploy instantâneo com Docker Compose
🏗️ Como usar
docker run -d \
-p 8085:8000 \
-e API_TOKEN=secret-key \
gabriellopesdesouza2002/tesseract-ocr-api:latest
Acesse a interface Swagger: 👉 http://localhost:8085/docs
🔧 Variáveis de ambiente Variável Descrição Obrigatória API_TOKEN Chave Bearer para autenticação ✅
Exemplo:
environment: API_TOKEN: secret-key
📬 Exemplo de requisição
curl -X POST "http://localhost:8085/ocr-pdf" \
-H "Authorization: Bearer secret-key" \
-F "file=@/path/arquivo.pdf" \
-F "lang=por+eng" \
-F "dpi=400" \
-F "limit_pages=2"
Ou, se preferir com docker-compose:
version: '3.9'
services:
ocr:
image: gabriellopesdesouza2002/tesseract-ocr-api:latest
container_name: tesseract_ocr_api
ports:
- "8085:8000"
environment:
API_TOKEN: secret-key
restart: unless-stopped
⚡ Resposta
{
"text": "Invoice 0001\nTotal: R$ 2.500,00\n...",
"parameters": {
"language": "por+eng",
"dpi": 400,
"limit_pages": 2
}
}
✅ Testado com
Docker Compose
n8n (HTTP Request + Binary File)
Postman / cURL
Python requests
Imagem Base: python:3.11-slim Porta padrão: 8085 Execução: uvicorn main:app --host 0.0.0.0 --port 8000
Content type
Image
Digest
sha256:9d27539fb…
Size
209.1 MB
Last updated
12 months ago
docker pull gabriellopesdesouza2002/tesseract-ocr-api