O Ollama-OCR envolve cinco modelos de visão em uma API instalável via pip que retorna JSON, pares chave-valor ou dados tabulares diretamente da chamada de extração. Sem parsing downstream, sem custos de API, nada sai da sua máquina.
Aponte para uma pasta de faturas ou contratos digitalizados, obtenha dados estruturados de volta com processamento paralelo e rastreamento de progresso. A abstração certa para pipelines de documentos é estrutura no momento da extração, não texto plano mais pós-processamento.
- Instalação:
pip install ollama-ocr - Modelos: 5 modelos de visão suportados
- Saída: JSON · chave-valor · tabular
Repositório
GitHub: imanoop7/Ollama-OCR
#OllamaOCR #DocumentAI #LocalFirst #AIEngineering #OpenSource
