Pipeline de IA para análise automática de documentos jurídicos
Resultado: 80%+ de redução no tempo de triagem de documentos jurídicos.
Escritórios de advocacia previdenciária precisam analisar centenas de PDFs de extratos bancários e processos jurídicos para identificar expurgos inflacionários. O processo manual é lento, repetitivo e sujeito a erros humanos que custam processos.
Pipeline ponta a ponta que combina OCR com IA Generativa (Google Gemini) para extrair e estruturar automaticamente os dados relevantes de qualquer PDF jurídico — sem intervenção manual.
PDF Input
│
▼
OCR Engine ──── Extração de texto (PDFs escaneados ou digitais)
│
▼
Google Gemini API ──── Análise NLP + extração de dados estruturados
│
▼
Output JSON ──── Dados organizados prontos para uso
| Métrica | Antes | Depois |
|---|---|---|
| Tempo de triagem por documento | ~15 min | ~2 min |
| Taxa de erro | ~8% | <1% |
| Capacidade diária | 30 docs | 200+ docs |
| Custo operacional | Alto | Reduzido |
- Python 3.11+ — processamento principal
- Google Gemini API — análise de linguagem natural e extração de dados
- OCR Engine — extração de texto de PDFs escaneados
- FastAPI — endpoints de integração
- PostgreSQL — armazenamento estruturado dos dados extraídos
git clone https://github.com/lucasguilhermessilva/perazzo-vision.git
cd perazzo-vision
pip install -r requirements.txt
cp .env.example .env # configure suas chaves de APIGEMINI_API_KEY=sua_chave_aqui
DATABASE_URL=postgresql://...from perazzo_vision import Pipeline
pipeline = Pipeline()
resultado = pipeline.processar("documento.pdf")
print(resultado) # JSON estruturado com dados extraídosDesenvolvido por Lucas Guilherme para o escritório Perazzo Advocacia, Recife — PE.