Detectar texto en imágenes

Reconocimiento óptico de caracteres (OCR)

La API Vision puede detectar y extraer texto de imágenes. Hay dos funciones de anotación que admiten el reconocimiento óptico de caracteres (OCR):

  • TEXT_DETECTION detecta y extrae texto de cualquier imagen. Por ejemplo, una fotografía puede contener una señal de tráfico o un cartel de una calle. El JSON incluye toda la cadena extraída, así como palabras individuales y sus cuadros delimitadores.

    Imagen de la señal de tráfico

  • DOCUMENT_TEXT_DETECTION también extrae texto de una imagen, pero la respuesta está optimizada para texto denso y documentos. El archivo JSON incluye información sobre páginas, bloques, párrafos, palabras y saltos de línea.

    Imagen densa con anotaciones

    Consulta más información sobre DOCUMENT_TEXT_DETECTION para la extracción de escritura a mano y la extracción de texto de archivos (PDF o TIFF).

Solicitudes de detección de texto

Configurar el Google Cloud proyecto y la autenticación