ocr
Repositorios de código abierto monitorizados etiquetados con ocr, ordenados por estrellas.
Temas relacionados
Temas que aparecen con frecuencia junto a ocr en un mismo repositorio.
Emergentes recientes
Repositorios creados en los últimos 90 días, etiquetados con ocr.
- #1
Formato FlyingMouse: Herramienta gratuita de conversión de formatos de archivo para Windows (disponible sin conexión, incluye FFmpeg/LibreOffice/Poppler/Tesseract). Conversión cruzada de imágenes, documentos, hojas de cálculo, PPT, PDF, audio/video y WPS + OCR + conversión por lote; el audio solo admite formatos comunes. Autor: LaoFeng | Solo para uso personal y gratuito, prohibida la venta comercial, reventa o empaquetado.
★ 5022 - #2★ 895
- #3
[dsh] Una caja de herramientas visual más potente diseñada para modelos de texto plano: instalación y uso gratuito, reconocimiento directo de imágenes pegadas, preguntas y respuestas sobre múltiples imágenes, captura de pantalla a UI frontend y más | Integración nativa de DeepSeek Harness para el kit de herramientas visuales de agentes: Q&A de imágenes, OCR de capturas de pantalla largas, restauración de UI, grounding, diferencia de píxeles, Artifacts y Web UI.
★ 842 - #4
SumatraPDF fork: Chinese EPUB/MOBI, smart PDF dark mode, OCR, TTS, offline dictionary.
★ 814 - #5
Herramienta de traducción de pantalla en tiempo real para Android sin necesidad de ROOT, ideal para juegos, novelas visuales y manga. Soporta OCR local y en la nube, LLM offline, múltiples servicios de traducción y síntesis de voz (TTS), con visualización directa sobre la pantalla.
★ 697
- #1
Convierte cualquier documento PDF o imagen en datos estructurados para tu IA. Un kit de herramientas OCR potente y ligero que puentea la brecha entre imágenes/PDFs y LLMs. Compatible con más de 100 idiomas.
★ 88.454+374Variación de estrellas de los últimos 7 días - #2
Transforma documentos complejos como PDFs y documentos de Office en markdown/JSON aptos para LLM para tus flujos de trabajo de Agentic.
★ 78.747+564Variación de estrellas de los últimos 7 días - #3★ 76.249+152Variación de estrellas de los últimos 7 días
- #4
Software OCR gratuito y sin conexión. Soporta captura de pantalla/importación por lotes de imágenes, reconocimiento de documentos PDF, exclusión de marcas de agua/encabezados y pies de página, y escaneo/generación de códigos QR. Biblioteca multilingüe integrada.
★ 46.972+238Variación de estrellas de los últimos 7 días - #5
Un sistema de gestión de documentos mejorado respaldado por la comunidad: escanea, indexa y archiva todos tus documentos
★ 44.699+217Variación de estrellas de los últimos 7 días - #6
ShareX es una aplicación gratuita y de código abierto que permite a los usuarios capturar o grabar cualquier área de su pantalla con una sola pulsación de tecla. También admite la carga de imágenes, texto y varios tipos de archivos a una amplia gama de destinos.
★ 39.373+137Variación de estrellas de los últimos 7 días - #7
OCR en JavaScript puro para más de 100 idiomas 📖🎉🖥
★ 38.677+26Variación de estrellas de los últimos 7 días - #8
OCRmyPDF añade una capa de texto OCR a los archivos PDF escaneados, permitiendo que sean buscables
★ 34.611+88Variación de estrellas de los últimos 7 días - #9
OCR listo para usar con más de 80 idiomas compatibles y todas las escrituras populares, incluyendo latín, chino, árabe, devanagari, cirílico, etc.
★ 29.951+20Variación de estrellas de los últimos 7 días - #10
Analizador de PDF para datos listos para IA. Automatiza la accesibilidad de PDF. Código abierto.
★ 28.856+215Variación de estrellas de los últimos 7 días - #11
🌈 Un software multiplataforma para traducción de texto y reconocimiento OCR.
★ 19.380+72Variación de estrellas de los últimos 7 días - #12
pix2tex: uso de un ViT para convertir imágenes de ecuaciones en código LaTeX
★ 16.549+5Variación de estrellas de los últimos 7 días - #13
Convierte documentos en datos estructurados sin esfuerzo. Unstructured es una solución ETL de código abierto para transformar documentos complejos en formatos limpios y estructurados para modelos de lenguaje. Visita nuestro sitio web para obtener más información sobre nuestro producto de plataforma de nivel empresarial para flujos de trabajo de producción, particionamiento, enriquecimientos, fragmentación e incrustación.
★ 15.362+31Variación de estrellas de los últimos 7 días - #14
Convierte sitios web de documentación, repositorios de GitHub y archivos PDF en habilidades de Claude AI con detección automática de conflictos
★ 14.858+64Variación de estrellas de los últimos 7 días - #15★ 14.683+42Variación de estrellas de los últimos 7 días
- #16★ 14.399+111Variación de estrellas de los últimos 7 días
- #17
Traductor de novelas visuales / Visual Novel Translator
★ 12.955+121Variación de estrellas de los últimos 7 días - #18
OCR en chino ultraligero, compatible con reconocimiento de texto vertical y motores de inferencia ncnn, mnn, tnn (dbnet(1.8M) + crnn(2.5M) + anglenet(378KB)), modelo total de solo 4.7M
★ 12.339+5Variación de estrellas de los últimos 7 días - #19★ 12.265+1Variación de estrellas de los últimos 7 días
- #20★ 12.196+46Variación de estrellas de los últimos 7 días
- #21
Modelo OCR que maneja tablas complejas, formularios y escritura a mano con diseño completo.
★ 12.182+34Variación de estrellas de los últimos 7 días - #22
BISHENG es una plataforma DevOps de LLM abierta para aplicaciones de IA empresarial de próxima generación. Las características potentes e integrales incluyen: flujo de trabajo GenAI, RAG, Agent, gestión unificada de modelos, evaluación, SFT, gestión de conjuntos de datos, gestión de sistemas a nivel empresarial, observabilidad y más.
★ 11.917+14Variación de estrellas de los últimos 7 días - #23
PyMuPDF es una biblioteca de Python de alto rendimiento para la extracción, análisis, conversión y manipulación de documentos PDF (y otros).
★ 10.602+67Variación de estrellas de los últimos 7 días - #24
Traducir manga/imágenes. Traducción con un clic de textos dentro de imágenes https://cotrans.touhou.ai/ (ya no funciona)
★ 10.363+38Variación de estrellas de los últimos 7 días - #25
X-AnyLabeling: una aplicación de escritorio multiplataforma ligera, eficiente y unificada para anotar texto, imágenes, video y datos multimodales, que combina herramientas versátiles integradas con modelos de IA de última generación y una exportación flexible en múltiples formatos.
★ 10.254+107Variación de estrellas de los últimos 7 días - #26★ 9738+6Variación de estrellas de los últimos 7 días
- #27
Extracción de subtítulos incrustados en video para generar archivos srt. Sin necesidad de solicitar API de terceros, reconocimiento de texto local. Framework de extracción de subtítulos basado en deep learning, que incluye detección de área y extracción de contenido.
★ 9412+35Variación de estrellas de los últimos 7 días - #28
El repositorio oficial de “Dolphin: Document Image Parsing via Heterogeneous Anchor Prompting”, ACL, 2025.
★ 9049-1Variación de estrellas de los últimos 7 días - #29
Una herramienta de traducción y OCR lista para usar desarrollada con WPF
★ 7878+56Variación de estrellas de los últimos 7 días - #30
Experimenta, aprende y programa las últimas innovaciones revolucionarias con Microsoft AI
★ 7854+0Variación de estrellas de los últimos 7 días