Высокоточный инструмент с открытым кодом, преобразующий PDF, DOCX, PPTX, XLSX и изображения в структурированный Markdown/JSON с помощью VLM+OCR-движка.
источник ↗#document-parsing
2 записейМодель baidu/Unlimited-OCR для однокадрового парсинга документов и OCR с поддержкой Transformers, vLLM, SGLang и Docker.
источник ↗