Saltar al contenido principal
buildradar
Tema · ocr

ocr

Repositorios de código abierto monitorizados etiquetados con ocr, ordenados por estrellas.

Repositorios
184
Estrellas totales
1.085.735
Estrellas de media
5901
Proporción
0,06%

Temas que aparecen con frecuencia junto a ocr en un mismo repositorio.

Emergentes recientes

Repositorios creados en los últimos 90 días, etiquetados con ocr.

  • flyingmouse-format@LaoFeng-mouse

    Formato FlyingMouse: Herramienta gratuita de conversión de formatos de archivo para Windows (disponible sin conexión, incluye FFmpeg/LibreOffice/Poppler/Tesseract). Conversión cruzada de imágenes, documentos, hojas de cálculo, PPT, PDF, audio/video y WPS + OCR + conversión por lote; el audio solo admite formatos comunes. Autor: LaoFeng | Solo para uso personal y gratuito, prohibida la venta comercial, reventa o empaquetado.

    5022
  • lift@datalab-to

    Extraiga datos estructurados de documentos de forma rápida y precisa.

    895
  • dsh-vision-toolkit@Anionex

    [dsh] Una caja de herramientas visual más potente diseñada para modelos de texto plano: instalación y uso gratuito, reconocimiento directo de imágenes pegadas, preguntas y respuestas sobre múltiples imágenes, captura de pantalla a UI frontend y más | Integración nativa de DeepSeek Harness para el kit de herramientas visuales de agentes: Q&A de imágenes, OCR de capturas de pantalla largas, restauración de UI, grounding, diferencia de píxeles, Artifacts y Web UI.

    842
  • SumatraPDF fork: Chinese EPUB/MOBI, smart PDF dark mode, OCR, TTS, offline dictionary.

    814
  • Herramienta de traducción de pantalla en tiempo real para Android sin necesidad de ROOT, ideal para juegos, novelas visuales y manga. Soporta OCR local y en la nube, LLM offline, múltiples servicios de traducción y síntesis de voz (TTS), con visualización directa sobre la pantalla.

    697
  • PaddleOCR@PaddlePaddle

    Convierte cualquier documento PDF o imagen en datos estructurados para tu IA. Un kit de herramientas OCR potente y ligero que puentea la brecha entre imágenes/PDFs y LLMs. Compatible con más de 100 idiomas.

    88.454+374Variación de estrellas de los últimos 7 días
  • MinerU@opendatalab

    Transforma documentos complejos como PDFs y documentos de Office en markdown/JSON aptos para LLM para tus flujos de trabajo de Agentic.

    78.747+564Variación de estrellas de los últimos 7 días
  • tesseract@tesseract-ocr

    Motor OCR de código abierto Tesseract (repositorio principal)

    76.249+152Variación de estrellas de los últimos 7 días
  • Umi-OCR@hiroi-sora

    Software OCR gratuito y sin conexión. Soporta captura de pantalla/importación por lotes de imágenes, reconocimiento de documentos PDF, exclusión de marcas de agua/encabezados y pies de página, y escaneo/generación de códigos QR. Biblioteca multilingüe integrada.

    46.972+238Variación de estrellas de los últimos 7 días
  • paperless-ngx@paperless-ngx

    Un sistema de gestión de documentos mejorado respaldado por la comunidad: escanea, indexa y archiva todos tus documentos

    44.699+217Variación de estrellas de los últimos 7 días
  • ShareX@ShareX

    ShareX es una aplicación gratuita y de código abierto que permite a los usuarios capturar o grabar cualquier área de su pantalla con una sola pulsación de tecla. También admite la carga de imágenes, texto y varios tipos de archivos a una amplia gama de destinos.

    39.373+137Variación de estrellas de los últimos 7 días
  • tesseract.js@naptha

    OCR en JavaScript puro para más de 100 idiomas 📖🎉🖥

    38.677+26Variación de estrellas de los últimos 7 días
  • OCRmyPDF@ocrmypdf

    OCRmyPDF añade una capa de texto OCR a los archivos PDF escaneados, permitiendo que sean buscables

    34.611+88Variación de estrellas de los últimos 7 días
  • EasyOCR@JaidedAI

    OCR listo para usar con más de 80 idiomas compatibles y todas las escrituras populares, incluyendo latín, chino, árabe, devanagari, cirílico, etc.

    29.951+20Variación de estrellas de los últimos 7 días
  • opendataloader-pdf@opendataloader-project

    Analizador de PDF para datos listos para IA. Automatiza la accesibilidad de PDF. Código abierto.

    28.856+215Variación de estrellas de los últimos 7 días
  • pot-desktop@pot-app

    🌈 Un software multiplataforma para traducción de texto y reconocimiento OCR.

    19.380+72Variación de estrellas de los últimos 7 días
  • LaTeX-OCR@lukas-blecher

    pix2tex: uso de un ViT para convertir imágenes de ecuaciones en código LaTeX

    16.549+5Variación de estrellas de los últimos 7 días
  • unstructured@Unstructured-IO

    Convierte documentos en datos estructurados sin esfuerzo. Unstructured es una solución ETL de código abierto para transformar documentos complejos en formatos limpios y estructurados para modelos de lenguaje. Visita nuestro sitio web para obtener más información sobre nuestro producto de plataforma de nivel empresarial para flujos de trabajo de producción, particionamiento, enriquecimientos, fragmentación e incrustación.

    15.362+31Variación de estrellas de los últimos 7 días
  • Skill_Seekers@yusufkaraaslan

    Convierte sitios web de documentación, repositorios de GitHub y archivos PDF en habilidades de Claude AI con detección automática de conflictos

    14.858+64Variación de estrellas de los últimos 7 días
  • ddddocr@sml2h3

    Reconocimiento de códigos de verificación universal OCR, versión pypi

    14.683+42Variación de estrellas de los últimos 7 días
  • Easydict@tisfeng

    Una aplicación de diccionario y traductor para macOS concisa y elegante.

    14.399+111Variación de estrellas de los últimos 7 días
  • LunaTranslator@HIllya51

    Traductor de novelas visuales / Visual Novel Translator

    12.955+121Variación de estrellas de los últimos 7 días
  • chineseocr_lite@DayBreak-u

    OCR en chino ultraligero, compatible con reconocimiento de texto vertical y motores de inferencia ncnn, mnn, tnn (dbnet(1.8M) + crnn(2.5M) + anglenet(378KB)), modelo total de solo 4.7M

    12.339+5Variación de estrellas de los últimos 7 días
  • zerox@getomni-ai

    OCR y extracción de documentos usando modelos de visión

    12.265+1Variación de estrellas de los últimos 7 días
  • liteparse@run-llama

    Un analizador de documentos rápido, útil y de código abierto

    12.196+46Variación de estrellas de los últimos 7 días
  • chandra@datalab-to

    Modelo OCR que maneja tablas complejas, formularios y escritura a mano con diseño completo.

    12.182+34Variación de estrellas de los últimos 7 días
  • bisheng@dataelement

    BISHENG es una plataforma DevOps de LLM abierta para aplicaciones de IA empresarial de próxima generación. Las características potentes e integrales incluyen: flujo de trabajo GenAI, RAG, Agent, gestión unificada de modelos, evaluación, SFT, gestión de conjuntos de datos, gestión de sistemas a nivel empresarial, observabilidad y más.

    11.917+14Variación de estrellas de los últimos 7 días
  • PyMuPDF@pymupdf

    PyMuPDF es una biblioteca de Python de alto rendimiento para la extracción, análisis, conversión y manipulación de documentos PDF (y otros).

    10.602+67Variación de estrellas de los últimos 7 días
  • Traducir manga/imágenes. Traducción con un clic de textos dentro de imágenes https://cotrans.touhou.ai/ (ya no funciona)

    10.363+38Variación de estrellas de los últimos 7 días
  • X-AnyLabeling@CVHub520

    X-AnyLabeling: una aplicación de escritorio multiplataforma ligera, eficiente y unificada para anotar texto, imágenes, video y datos multimodales, que combina herramientas versátiles integradas con modelos de IA de última generación y una exportación flexible en múltiples formatos.

    10.254+107Variación de estrellas de los últimos 7 días
  • Bob@ripperhe

    Bob es un software de traducción y OCR para la plataforma macOS.

    9738+6Variación de estrellas de los últimos 7 días
  • Extracción de subtítulos incrustados en video para generar archivos srt. Sin necesidad de solicitar API de terceros, reconocimiento de texto local. Framework de extracción de subtítulos basado en deep learning, que incluye detección de área y extracción de contenido.

    9412+35Variación de estrellas de los últimos 7 días
  • Dolphin@bytedance

    El repositorio oficial de “Dolphin: Document Image Parsing via Heterogeneous Anchor Prompting”, ACL, 2025.

    9049-1Variación de estrellas de los últimos 7 días
  • STranslate@STranslate

    Una herramienta de traducción y OCR lista para usar desarrollada con WPF

    7878+56Variación de estrellas de los últimos 7 días
  • ailab@microsoft

    Experimenta, aprende y programa las últimas innovaciones revolucionarias con Microsoft AI

    7854+0Variación de estrellas de los últimos 7 días
← Volver a temas