PaddleOCR es una herramienta de OCR de código abierto que convierte PDFs e imágenes en datos estructurados (JSON/Markdown) para LLMs. Incluye PP-OCRv6 para reconocimiento multilingüe (más de 100 idiomas), PaddleOCR-VL para análisis de documentos, y PP-StructureV3 para conversión basada en el diseño.
Código abierto. Nuevas posibilidades.
Descubre proyectos de código abierto de calidad, envía proyectos de forma anónima y reclama y edita tu propio proyecto.
Un poco de curiosidad. Un mundo de código abierto.
THE FIRST COLLECTIONCLIO Agent es un sistema de IA autónomo para la gestión de datos científicos a gran escala. Construido en la plataforma IOWarp, orquesta múltiples niveles de expertos con soporte para FastMCP para HDF5/Parquet/CSV y cuenta con una UI de terminal Bubbletea. Se integra con LLMs principales (Ollama, OpenAI, Anthropic) y actúa como la capa de inteligencia (CEI) del ecosistema IOWarp.
MinerU es un motor de código abierto de análisis de documentos que convierte PDF, imágenes, DOCX, PPTX y XLSX en Markdown/JSON estructurado para flujos de trabajo de LLM, RAG y agentes. Admite motores duales VLM+OCR, OCR en 109 idiomas y despliegue privado/sin conexión.