Elenco dei processori

Questa pagina contiene informazioni dettagliate su tutti i processori offerti da Document AI. Puoi visualizzare un elenco di tutti i processori per tipo di soluzione.

Tutti i processori Document AI rispettano i Termini per il trattamento e la sicurezza dei dati.

Per ulteriori dettagli, consulta la documentazione Gestione delle versioni del processore. Inoltre, si applicano limiti specifici per i processori, oltre alle quote e ai limiti complessivi del prodotto.

Digitalizzare il testo

Enterprise Document OCR (riconoscimento ottico dei caratteri)

Descrizione

Identifica ed estrai il testo in diversi tipi di documenti.

Questo processore ti consente di identificare ed estrarre testo, incluso il testo scritto a mano, dai documenti in più di 200 lingue. Il processore utilizza anche il machine learning per eseguire una valutazione della qualità di un documento in base alla leggibilità dei suoi contenuti.

Category Digitalizza
Funzioni OCR, analisi della qualità
Fase di rilascio Disponibilità generale
Stato dell'accesso Pubblico
Digita API OCR_PROCESSOR
Lingue supportate
Elenco completo delle lingue
Nome della lingua Tag BCP 47 Script Scrittura a mano libera supportata
Afrikaans af Latn
Albanese sq Latn
Arabo ar Arab
Armeno hy Armn
Bielorusso be Cyrl
Bengalese bn Beng
Bengalese bn Beng
Bulgaro bg Cyrl
Catalano ca Latn
Cinese zh Hani
Croato hr Latn
Ceco cs Latn
Danese da Latn
Olandese nl Latn
Inglese en Latn
Estone et Latn
Filippino fil Latn
Finlandese fi Latn
Francese fr Latn
Tedesco de Latn
Greco el Grek
Gujarati gu Gujr
Ebraico iw Hebr
Hindi hi Deva
Ungherese hu Latn
Islandese is Latn
Indonesiano id Latn
Italiano it Latn
Giapponese ja Jpan
Kannada kn Knda
Khmer km Khmr
Coreano ko Kore
Lao lo Laoo
Lettone lv Latn
Lituano lt Latn
Macedone mk Cyrl
Malese ms Latn
Malayalam ml Mlym
Marathi mr Deva
Nepalese ne Deva
Norvegese no Latn
Persiano fa Arab
Polacco pl Latn
Portoghese (Portogallo e Brasile) pt Latn
Punjabi pa Guru
Romeno ro Latn
Russo ru Cyrl
Serbo sr Cyrl
Slovacco sk Latn
Sloveno sl Latn
Spagnolo es Latn
Svedese sv Latn
Tagalog tl Latn
Tamil ta Taml
Telugu te Telu
Tailandese th Thai
Turco tr Latn
Ucraino uk Cyrl
Vietnamita vi Latn
Yiddish yi Hebr
Versioni del processore
ID versione Canale di rilascio Maturità della release Descrizione
pretrained-ocr-v1.2-2022-11-10 Stabile GA Versione del modello bloccata v1.0: file, configurazioni e binari del modello di un'istantanea della versione bloccati in un'immagine container per un massimo di 18 mesi.
pretrained-ocr-v2.0-2023-06-02 Stabile GA Modello pronto per la produzione specializzato per i casi d'uso dei documenti. Include l'accesso a tutti i componenti aggiuntivi OCR.
pretrained-ocr-v2.1-2024-08-07 Stabile GA I principali miglioramenti della versione 2.1 riguardano: un migliore riconoscimento del testo stampato, un rilevamento più preciso delle caselle di controllo e un ordine di lettura più accurato.
pretrained-ocr-v2.1.1-2025-01-31 Candidato per la release Anteprima pubblica La versione 2.1.1 è simile alla versione 2.1 ed è disponibile in tutte le regioni, ad eccezione di: US, EU e asia-southeast1.

Per saperne di più, consulta Gestione delle versioni del processore.

Quote e limiti
Numero massimo di pagine (richieste online/sincrone): 15
Numero massimo di pagine (richieste batch/offline/asincrone): 500
Numero massimo di pagine (modalità senza immagini richieste online/sincrone): 30
Uptraining
File di input di esempio Apri in una nuova finestra.
Output di esempio Apri in una nuova finestra.
Regioni supportate
  • asia-south1
  • asia-southeast1
  • australia-southeast1
  • eu
  • europe-west2
  • europe-west3
  • northamerica-northeast1
  • us
Ulteriori informazioni Enterprise Document OCR

Estrai entità dai documenti

Consulta Set di dati di esempio per set di dati etichettati e non etichettati di esempio da utilizzare per l'addestramento.

Estrattore personalizzato

Descrizione

Estrai i campi dai documenti utilizzando l'AI generativa o modelli personalizzati; perfeziona i modelli per estrarre con precisione i dati dai tuoi documenti.

Category Estrai
Funzioni OCR, estrazione di entità
Fase di rilascio Disponibilità generale
Stato dell'accesso Pubblico
Digita API CUSTOM_EXTRACTION_PROCESSOR
Note
  • Se utilizzi l'AI generativa per l'estrazione:

    • È supportata ufficialmente solo la lingua inglese.
    • La disponibilità per regione è in US, EU, northamerica-northeast1 e asia-southeast1.

Lingue supportate
Elenco completo delle lingue
Nome della lingua Tag BCP 47 Script Scrittura a mano libera supportata
Afrikaans af Latn
Arabo ar Arab
Azero az Latn
Azero (cirillico) az-Cyrl Cyrl
Bielorusso be Cyrl
Bulgaro bg Cyrl
Bosniaco bs Latn
Catalano ca Latn
Cebuano ceb Latn
Ceco cs Latn
Gallese cy Latn
Danese da Latn
Tedesco de Latn
Greco el Grek
Inglese en Latn
Esperanto eo Latn
Spagnolo es Latn
Estone et Latn
Basco eu Latn
Persiano fa Arab
Finlandese fi Latn
Filippino fil Latn
Francese fr Latn
Irlandese ga Latn
Galiziano gl Latn
Hindi hi Deva
Croato hr Latn
Creolo haitiano ht Latn
Ungherese hu Latn
Indonesiano id Latn
Islandese is Latn
Italiano it Latn
Ebraico iw Hebr
Giapponese ja Jpan
Giavanese jv Latn
Kazako kk Cyrl
Coreano ko Kore
Kirgizo ky Cyrl
Latino la Latn
Lituano lt Latn
Lettone lv Latn
Macedone mk Cyrl
Mongolo mn Cyrl
Marathi mr Deva
Malese ms Latn
Maltese mt Latn
Nepalese ne Deva
Olandese nl Latn
Norvegese no Latn
Polacco pl Latn
Pashto ps Arab
Portoghese (Portogallo e Brasile) pt Latn
Romeno ro Latn
Russo ru Cyrl
Russo (ortografia petrina) ru-PETR1708 Cyrl
Sanscrito sa Deva
Slovacco sk Latn
Sloveno sl Latn
Albanese sq Latn
Serbo sr Cyrl
Svedese sv Latn
Swahili sw Latn
Tagalog tl Latn
Turco tr Latn
Ucraino uk Cyrl
Urdu ur Arab
Uzbeko uz Latn
Uzbeko (cirillico) uz-Cyrl Cyrl
Vietnamita vi Latn
Yiddish yi Hebr
Cinese semplificato zh-Hans Hani
Cinese tradizionale zh-Hant Hani
Zulu zu Latn
Versioni del processore
ID versione Canale di rilascio Maturità della release Descrizione
pretrained-foundation-model-v1.5-2025-05-05 Stabile GA Candidato pronto per la produzione basato sul modello LLM Gemini 2.5 Flash. Consigliato per chi vuole sperimentare con modelli più recenti.
pretrained-foundation-model-v1.5-pro-2025-06-20 Stabile GA Modello pronto per la produzione basato sul modello LLM Gemini 2.5 Pro. Supporta una quota massima di 30 pagine al minuto per le richieste di elaborazione online. Questo modello ha una qualità migliore rispetto alla versione 1.5 e potrebbe avere una latenza più elevata.
pretrained-foundation-model-v1.5.1-2025-08-07 Candidato per la release Anteprima pubblica Modello di anteprima pubblica basato sul modello LLM Gemini 2.5 Flash. Questo modello ha le stesse funzionalità della v1.5 e ha migliorato l'apprendimento adattivo few-shot.
pretrained-foundation-model-v1.6-pro-2025-12-01 Candidato per la release Anteprima pubblica Modello di anteprima basato sul modello LLM Gemini 3 Pro.
pretrained-foundation-model-v1.6-2026-01-13 Candidato per la release Anteprima pubblica Modello di anteprima basato sul modello LLM Gemini 3 Flash.
pretrained-foundation-model-v3.5-2026-05-26 Candidato per la release Anteprima pubblica Modello di anteprima basato sul modello LLM Gemini 3.5 Flash.

Per saperne di più, consulta Gestione delle versioni del processore.

Quote e limiti
Numero massimo di pagine (richieste online/sincrone): 15
Numero massimo di pagine (richieste batch/offline/asincrone): 200
Numero massimo di pagine (modalità senza immagini richieste online/sincrone): 30
Tipi di dati normalizzati

Per saperne di più, consulta le pagine Arricchimento e normalizzazione e Crea set di dati.

Elenco completo dei tipi di dati normalizzati
  • dateTime as STRING
  • currency as STRING
  • money as google.type.Money
  • number as FLOAT or INTEGER