probar pick editorial #document-parser
run-llama/liteparse
Apache-2.0, Rust core con bindings Python/Node.js/WASM, 12.080★, 828 forks, 6 meses. Parser PDF/DOCX/XLSX/PPTX/IMG sin dependencias cloud, con bounding boxes espaciales, OCR pluggable (Tesseract bundled, HTTP server para EasyOCR/PaddleOCR/custom), complexity detection (decide si necesita OCR o LLM) y output estructurado para pipelines RAG.
Estrellas
12.080
Forks
828
Lenguaje
Rust
Licencia
Apache-2.0
Issues
26
Estado
—
Cómo funciona
Implementa Document parser
Núcleo
run-llama/liteparse Rust · Apache-2.0 document-ocrdocument-processingocrocr-recognitionpdfpdf-parsertext-extraction
Se cruza con relevante para LlamaIndex
Diagrama derivado de madurez_senales (lenguaje, licencia, estado y topics) y de las relaciones que este repo tiene en el grafo de conocimiento. No es una arquitectura del proyecto: es su posición funcional tal como la registran los boletines.
Posición en el ecosistema
run-llama/liteparse
implementa
Document parser
run-llama/liteparse
relevante para
LlamaIndex
Relaciones que aportó este boletín