es

Please fill in your name

Mobile phone format error

Ingrese el teléfono

Introduzca el nombre de su empresa

Introduzca el correo electrónico de su empresa.

Ingrese los datos requeridos

Successful submission! Thank you for your support.

Format error, Please fill in again

Confirm

El requisito de datos no puede ser inferior a 5 palabras y no pueden ser números puros.

Datasets de OCR

Mejore instantáneamente el rendimiento del modelo de IA con Datasets listos para usar de alta calidad.

Tipo de dato

Todo
27
Documento
3
Escenario general
11
Escritura a mano
16
Imagen de internet
1
Factura
3
Otros
4
Examen
1
Tabla
1

Idioma

Todo
27
Chino
5
Inglés
5
Hindi
4
Japonés
7
Coreano
6
Otros
19
Vietnamita
4

4.995 imágenes datos OCR vietnamita: anotación + transcripción

4.995 imágenes de datos de OCR en vietnamita anotados y transcritos incluyen 258 imágenes naturales, 2.553 de internet, 2.184 de texto. Anotación: Contenido por línea: caja delimitadora cuadrilátera por línea, transcripción por línea; Contenido vertical: caja delimitadora cuadrilátera vertical, transcripción vertical. Este conjunto de datos de OCR en vietnamita anotados y transcritos puede usarse para reconocimiento de vietnamita en múltiples escenarios, traducción fotográfica de vietnamita, etc.
Vietnamita OCR imágenes documentos imágenes internet escenas naturales múltiples ángulos diferentes condiciones luz anotación cuadrilátero delimitador transcripción nivel línea textos transcripción nivel columna textos

500.000 imágenes de datos OCR de escenas naturales y documentos en múltiples países

500.000 imágenes de datos OCR de escenas naturales y documentos multinacionales, que incluyen 20 idiomas como chino tradicional, japonés, coreano, indonesio, malayo, tailandés, vietnamita, polaco, etc. La diversidad de captura incluye múltiples escenas naturales, múltiples ángulos de toma. Este conjunto de datos puede usarse para tareas OCR de idiomas multinacionales.
Escenas naturales Documentos OCR

9.497 imágenes datos OCR 10 tipos formularios

9.497 imágenes de datos OCR para 10 tipos de tablas, anotadas mediante cuadros delimitadores rectangulares. Este conjunto es utilizable para detección y reconocimiento de tablas.
OCR formularios

3.506 imágenes datos OCR hindi: anotación + transcripción

3.506 imágenes de datos de OCR en hindi anotados y transcritos incluyen 2.056 imágenes naturales, 1.103 de internet, 347 de texto. Anotación: Contenido por línea: caja delimitadora cuadrilátera por línea, transcripción por línea; Contenido vertical: caja delimitadora cuadrilátera vertical, transcripción vertical. Este conjunto de datos de OCR en hindi anotados y transcritos puede usarse para reconocimiento de hindi en múltiples escenarios, traducción fotográfica de hindi, etc.
Hindi OCR imágenes documentos imágenes internet escenas naturales múltiples ángulos diferentes condiciones luz anotación cuadrilátero delimitador transcripción nivel línea textos transcripción nivel columna textos

17.561 imágenes datos captura exámenes matemáticas primaria

17.561 imágenes de datos de recolección de exámenes matemáticos de primaria con fondo liso. Cubre múltiples tipos de preguntas, formatos de examen (cuadernillos, exámenes, pruebas competitivas, etc.), grados. Este conjunto de datos de recolección de exámenes matemáticos de primaria puede usarse para corrección automática, tutorías, etc.
Exámenes matemáticas primaria OCR múltiples tipos preguntas (Cálculo vertical Cálculo horizontal Cálculo recursivo Fracciones Resolución ecuaciones etc.) múltiples tipos exámenes (cuadernos ejercicios exámenes preguntas competición) múltiples cursos

14.511 imágenes datos OCR escritura manual inglés

14.511 hojas de datos OCR en escritura inglesa. Los soportes de texto son papel A4, papel cuadriculado horizontal y papel inglés. El dispositivo de adquisición es un teléfono móvil, y el ángulo de adquisición es una perspectiva de vista plana. El contenido de estos datos abarca los campos de la composición inglesa, la poesía, la prosa, las noticias, los relatos, etc. En cuanto a la anotación, se marcan los cuadros cuadriláteros del texto a nivel de línea y se transcribe el texto a nivel de línea. Este conjunto de datos puede utilizarse para tareas de reconocimiento óptico de escritura en inglés.
Escritura manual inglés OCR

104.320 imágenes datos OCR escenas naturales coreano-hindi

104.320 datos OCR de escenas naturales en coreano e hindi. Escenarios de recopilación incluyen empaques de productos, carteles, boletos de transporte, letreros informativos, menús, señales de edificios, etc. Diversidad: múltiples escenarios, ángulos de captura, condiciones de iluminación. Distribución lingüística: coreano, hindi e inglés (pequeña cantidad). En anotaciones: Anotación de caja poligonal (o cuadrilátero, rectángulo) a nivel de línea, transcripción de contenido a nivel de línea, atributos de texto (tipo de idioma); Anotación de caja poligonal (o cuadrilátero, rectángulo) a nivel de columna, transcripción de contenido a nivel de columna, atributos de texto (tipo de idioma). Este conjunto de datos OCR de escenas naturales en coreano e hindi puede usarse para tareas OCR en escenas naturales coreanas e hindúes.
Coreano Hindi Datos OCR Escena natural Datos transliteración OCR

71.535 imágenes de datos OCR escenas naturales inglés

71.535 imágenes de datos OCR en escenas naturales en inglés, las escenas de recopilación fueron capturadas in situ en Reino Unido y Estados Unidos. La diversidad de datos incluye múltiples escenas, múltiples ángulos de captura y múltiples condiciones de iluminación. En cuanto a anotaciones, se realizó anotación de cuadros delimitadores rectangulares (o cuadriláteros) a nivel de línea, palabra y carácter para los datos OCR en inglés, y se transcribió el contenido textual. Este conjunto de datos OCR en escenas naturales en inglés puede utilizarse para tareas OCR en escenas naturales en inglés.
Inglés escenas naturales OCR múltiples escenas múltiples ángulos fotográficos múltiples condiciones de luz cuadro delimitador a nivel de línea & palabra & carácter transcripción de texto

105.941 imágenes datos OCR 12 idiomas escenas naturales

Los 105.941 datos OCR de escenas naturales abarcan 12 idiomas, incluidos 6 idiomas asiáticos y 6 idiomas europeos, y la colección cubre una variedad de escenas naturales y una variedad de ángulos de toma. En cuanto a la anotación, se etiquetan los cuadros cuadriláteros de texto a nivel de línea y se transcribe el texto a nivel de línea. Este conjunto de datos puede utilizarse para tareas de OCR multilingüe.
Japonés Coreano Indonesio Malayo Vietnamita Tailandés Francés Alemán Italiano Portugués Ruso Español OCR escenas naturales múltiples ángulos fotográficos anotación cuadrilátero nivel línea y transcripción para textos

loading

Personalice sus datos ahora

Por qué Datasets listos para usar

  • Derechos de autor

    Derechos de autor

    Derechos de autor claros y Listo para revisar
  • Seguridad

    Seguridad

    Autorizado adecuadamente Uso seguro
  • Profesional

    Profesional

    Diseñado y producido por expertos en datos de IA
  • Diversidad

    Diversidad

    Recogido de una variedad de escenas reales
  • Efectivo en costos

    Efectivo en costos

    Más rentable que los datos personalizados
  • Eficiencia

    Eficiencia

    Listo para llevar entrega en segundos
1425b75a-c49e-41aa-802c-832aa5065cfb