Detecta etiquetas

La API de Vision puede detectar y extraer información sobre las entidades de una imagen en un amplio grupo de categorías.

Las etiquetas pueden identificar objetos generales, ubicaciones, actividades, especies de animales, productos y mucho más. Si necesitas etiquetas personalizadas de orientación, Cloud AutoML Vision te permite entrenar un modelo de aprendizaje automático personalizado para clasificar imágenes.

Las etiquetas se muestran solo en inglés. La API de Cloud Translation puede traducir etiquetas en inglés a muchos otros idiomas.

Imagen de calle de barrio en Setagaya
Créditos de imagen: Alex Knight en Unsplash.

Por ejemplo, la imagen anterior puede mostrar la siguiente lista de etiquetas:

Descripción Puntuación
Calle 0.872
Instantánea 0.852
Pueblo 0.848
Noche 0.804
Callejón 0.713

Solicitudes de detección de etiquetas

Configura tu proyecto de Google Cloud y la autenticación

Detecta etiquetas en una imagen local

Puedes usar la API de Vision para realizar la detección de características en un archivo de imagen local.

Para las solicitudes de REST, envía el contenido del archivo de imagen como una string codificada en base64 en el cuerpo de tu solicitud.

Para las solicitudes de biblioteca cliente y gcloud, especifica la ruta a una imagen local en tu solicitud.

REST

Antes de usar cualquiera de los datos de solicitud a continuación, realiza los siguientes reemplazos:

  • BASE64_ENCODED_IMAGE: Es la representación en base64 (string ASCII) de los datos de la imagen binaria. Esta string debería ser similar a la siguiente:
    • /9j/4QAYRXhpZgAA...9tAVx/zDQDlGxn//2Q==
    Visita Codificación en base64 para obtener más información.
  • RESULTS_INT: Un valor de número entero de resultados que se mostrarán (opcional). Si omites el campo "maxResults" y su valor, la API muestra el valor predeterminado de 10 resultados. Este campo no se aplica a los siguientes tipos de funciones: TEXT_DETECTION, DOCUMENT_TEXT_DETECTION o CROP_HINTS.
  • PROJECT_ID: Es el ID del proyecto de Google Cloud .

Método HTTP y URL:

POST https://vision.googleapis.com/v1/images:annotate

Cuerpo JSON de la solicitud:

{
  "requests": [
    {
      "image": {
        "content": "BASE64_ENCODED_IMAGE"
      },
      "features": [
        {
          "maxResults": RESULTS_INT,
          "type": "LABEL_DETECTION"
        }
      ]
    }
  ]
}

Para enviar tu solicitud, elige una de estas opciones:

curl

Guarda el cuerpo de la solicitud en un archivo llamado request.json y ejecuta el siguiente comando:

curl -X POST \
-H "Authorization: Bearer $(gcloud auth print-access-token)" \
-H "x-goog-user-project: PROJECT_ID" \
-H "Content-Type: application/json; charset=utf-8" \
-d @request.json \
"https://vision.googleapis.com/v1/images:annotate"

PowerShell

Guarda el cuerpo de la solicitud en un archivo llamado request.json y ejecuta el siguiente comando:

$cred = gcloud auth print-access-token
$headers = @{ "Authorization" = "Bearer $cred"; "x-goog-user-project" = "PROJECT_ID" }

Invoke-WebRequest `
-Method POST `
-Headers $headers `
-ContentType: "application/json; charset=utf-8" `