La respuesta a una solicitud de procesamiento contiene un objeto Document que incluye toda la información que se conoce sobre el documento procesado, incluida toda la información estructurada que Document AI ha podido extraer.
En esta página se explica el diseño del objeto Document mediante documentos de ejemplo y, a continuación, se asignan aspectos de los resultados del OCR a los elementos específicos del JSON del objeto Document.
También proporciona bibliotecas de cliente, ejemplos de código y ejemplos de código del SDK de Document AI Toolbox.
Estos ejemplos de código usan el procesamiento online, pero el análisis del objeto Document funciona igual en el procesamiento por lotes.

Los rectángulos y las flechas naranjas y azules representan que al menos un campo de los objetos conectados es .layout o detectedLanguage, respectivamente. El diagrama usa la notación de pata de gallina.
Usa un visor o una utilidad de edición de JSON diseñados específicamente para expandir o contraer elementos. Revisar el JSON sin formato en una utilidad de texto sin formato es ineficiente.
Texto, diseño y niveles de calidad
Aquí tienes un documento de texto de ejemplo:

Este es el objeto de documento completo devuelto por el procesador Enterprise Document OCR:
Este resultado de OCR también se incluye siempre en el resultado del procesador de Document AI, ya que los procesadores ejecutan el OCR. Utiliza los datos de OCR que ya existen, por lo que puede introducir datos JSON de este tipo en los procesadores de Document AI mediante la opción de documento insertado.
image=None, # all our samples pass this var
mime_type="application/json",
inline_document=document_response # pass OCR output to CDE input - undocumented
Estos son algunos de los campos importantes:
Texto sin formato
El campo text contiene el texto que reconoce Document AI.
Este texto no contiene ninguna estructura de diseño que no sean espacios, tabulaciones y
saltos de línea. Este es el único campo que almacena la información textual de un documento y sirve como fuente de información veraz del texto del documento. Otros campos pueden hacer referencia a partes del campo de texto por posición (startIndex y endIndex).
{
text: "Sample Document\nHeading 1\nLorem ipsum dolor sit amet, ..."
}
Tamaño de página e idiomas
Cada page del objeto de documento corresponde a una página física del documento de muestra. La salida JSON de ejemplo contiene una página porque es una sola imagen PNG.
{
"pages:" [
{
"pageNumber": 1,
"dimension": {
"width": 679.0,
"height": 460.0,
"unit": "pixels"
},
}
]
}
- El campo
pages[].detectedLanguages[]contiene los idiomas detectados en una página determinada, junto con la puntuación de confianza.
{
"pages": [
{
"detectedLanguages": [
{
"confidence": 0.98009938,
"languageCode": "en"
},
{
"confidence": 0.01990064,
"languageCode": "und"
}
]
}
]
}
Datos de OCR
El OCR de Document AI detecta texto con varios niveles de granularidad u organización en la página, como bloques de texto, párrafos, tokens y símbolos (el nivel de símbolo es opcional si se configura para que genere datos a nivel de símbolo). Todos estos son miembros del objeto de página.
Cada elemento tiene un layout correspondiente que
describe su posición y su texto. Los elementos visuales que no son texto (como las casillas de verificación) también están a nivel de página.
{
"pages": [
{
"paragraphs": [
{
"layout": {
"textAnchor": {
"textSegments": [
{
"endIndex": "16"
}
]
},
"confidence": 0.9939527,
"boundingPoly": {
"vertices": [ ... ],
"normalizedVertices": [ ... ]
},
"orientation": "PAGE_UP"
}
}