Daftar pemroses

Halaman ini berisi informasi mendetail tentang semua pemroses yang ditawarkan oleh Document AI. Anda dapat melihat daftar semua pemroses menurut jenis solusi.

Semua pemroses Document AI mematuhi Persyaratan Pemrosesan dan Keamanan Data.

Lihat dokumentasi Mengelola versi pemroses untuk mengetahui detail selengkapnya. Selain itu, batas prosesor tertentu berlaku selain kuota dan batas produk secara keseluruhan.

Mendigitalkan teks

Enterprise Document OCR (Pengenalan Karakter Optik)

Deskripsi

Mengidentifikasi dan mengekstrak teks dalam berbagai jenis dokumen.

Pemroses ini membantu Anda mengidentifikasi dan mengekstrak teks, termasuk teks tulis tangan, dari dokumen dalam lebih dari 200 bahasa. Prosesor juga menggunakan machine learning untuk melakukan penilaian kualitas dokumen berdasarkan keterbacaan kontennya.

Kategori Mendigitalkan
Fungsi OCR, Analisis Kualitas
Tahap rilis Ketersediaan umum
Status akses Publik
Ketik API OCR_PROCESSOR
Bahasa yang didukung
Daftar lengkap bahasa
Nama Bahasa Tag BCP 47 Skrip Tulisan tangan didukung
Afrika af Latn
Albania sq Latn
Arab ar Arab
Armenia hy Armn
Belarus be Cyrl
Bangla bn Beng
Bengali bn Beng
Bulgaria bg Cyrl
Catalan ca Latn
Cina zh Hani
Kroasia hr Latn
Ceko cs Latn
Denmark da Latn
Belanda nl Latn
Inggris en Latn
Estonia et Latn
Filipina fil Latn
Finlandia fi Latn
Prancis fr Latn
Jerman de Latn
Yunani el Grek
Gujarat gu Gujr
Ibrani iw Hebr
Hindi hi Deva
Hungaria hu Latn
Islandia is Latn
Indonesia id Latn
Italia it Latn
Jepang ja Jpan
Kannada kn Knda
Khmer km Khmr
Korea ko Kore
Laos lo Laoo
Latvia lv Latn
Lituania lt Latn
Makedonia mk Cyrl
Melayu ms Latn
Malayalam ml Mlym
Marathi mr Deva
Nepal ne Deva
Norwegia no Latn
Persia fa Arab
Polandia pl Latn
Portugis (Portugal & Brasil) pt Latn
Punjab pa Guru
Rumania ro Latn
Rusia ru Cyrl
Serb sr Cyrl
Slovakia sk Latn
Slovenia sl Latn
Spanyol es Latn
Swedia sv Latn
Tagalog tl Latn
Tamil ta Taml
Telugu te Telu
Thai th Thai
Turki tr Latn
Ukraina uk Cyrl
Vietnam vi Latn
Yiddi yi Hebr
Versi prosesor
ID versi Saluran Rilis Kematangan Rilis Deskripsi
pretrained-ocr-v1.2-2022-11-10 Stabil GA Versi model yang di-freeze v1.0: File model, konfigurasi, dan biner snapshot versi yang di-freeze dalam image container hingga 18 bulan.
pretrained-ocr-v2.0-2023-06-02 Stabil GA Model siap produksi yang dikhususkan untuk kasus penggunaan dokumen. Mencakup akses ke semua add-on OCR.
pretrained-ocr-v2.1-2024-08-07 Stabil GA Area utama peningkatan untuk v2.1 adalah: pengenalan teks cetak yang lebih baik, deteksi kotak centang yang lebih akurat, dan urutan pembacaan yang lebih akurat.
pretrained-ocr-v2.1.1-2025-01-31 Kandidat rilis Pratinjau Publik v2.1.1 mirip dengan V2.1, dan tersedia di semua wilayah kecuali: US, EU, dan asia-southeast1.

Untuk mengetahui informasi selengkapnya, lihat Mengelola versi pemroses.

Kuota dan batas
Halaman maksimum (permintaan online/sinkron): 15
Halaman maksimum (permintaan batch/offline/asinkron): 500
Halaman maksimum (permintaan online/sinkron mode tanpa gambar): 30
Uptraining
Contoh File Input Buka di jendela baru.
Contoh Output Buka di jendela baru.
Wilayah yang didukung
  • asia-south1
  • asia-southeast1
  • australia-southeast1
  • eu
  • europe-west2
  • europe-west3
  • northamerica-northeast1
  • us
Informasi selengkapnya Enterprise Document OCR

Mengekstrak entity dari dokumen

Lihat Set data sampel untuk set data berlabel dan tidak berlabel sampel yang akan digunakan untuk pelatihan.

Pengekstrak Kustom

Deskripsi

Ekstrak kolom dari dokumen menggunakan AI generatif atau model kustom; sesuaikan model agar dapat mengekstrak data dari dokumen Anda secara akurat.

Kategori Mengekstrak
Fungsi OCR, Ekstraksi Entity
Tahap rilis Ketersediaan umum
Status akses Publik
Ketik API CUSTOM_EXTRACTION_PROCESSOR
Catatan
  • Jika menggunakan AI generatif untuk ekstraksi, maka:

    • Hanya bahasa Inggris yang didukung secara resmi.
    • Ketersediaan wilayah ada di US, EU, northamerica-northeast1, dan asia-southeast1.

Bahasa yang didukung
Daftar lengkap bahasa
Nama Bahasa Tag BCP 47 Skrip Tulisan tangan didukung
Afrika af Latn
Arab ar Arab
Azerbaijan az Latn
Azerbaijan (Sirilik) az-Cyrl Cyrl
Belarus be Cyrl
Bulgaria bg Cyrl
Bosnia bs Latn
Catalan ca Latn
Cebuano ceb Latn
Ceko cs Latn
Wales cy Latn
Denmark da Latn
Jerman de Latn
Yunani el Grek
Inggris en Latn
Esperanto eo Latn
Spanyol es Latn
Estonia et Latn
Basque eu Latn
Persia fa Arab
Finlandia fi Latn
Filipina fil Latn
Prancis fr Latn
Irlandia ga Latn
Galisia gl Latn
Hindi hi Deva
Kroasia hr Latn
Kreol Haiti ht Latn
Hungaria hu Latn
Indonesia id Latn
Islandia is Latn
Italia it Latn
Ibrani iw Hebr
Jepang ja Jpan
Jawa jv Latn
Kazak kk Cyrl
Korean ko Kore
Kirgiz ky Cyrl
Latin la Latn
Lituania lt Latn
Latvia lv Latn
Makedonia mk Cyrl
Mongol mn Cyrl
Marathi mr Deva
Melayu ms Latn
Malta mt Latn
Nepal ne Deva
Belanda nl Latn
Norwegia no Latn
Polandia pl Latn
Pashtun ps Arab
Portugis (Portugal & Brasil) pt Latn
Rumania ro Latn
Rusia ru Cyrl
Rusia (Ortografi Petrine) ru-PETR1708 Cyrl
Sansekerta sa Deva
Slovakia sk Latn
Slovenia sl Latn
Albania sq Latn
Serb sr Cyrl
Swedia sv Latn
Swahili sw Latn
Tagalog tl Latn
Turki tr Latn
Ukraina uk Cyrl
Urdu ur Arab
Uzbek uz Latn
Uzbekistan (Sirilik) uz-Cyrl Cyrl
Vietnam vi Latn
Yiddi yi Hebr
China aksara sederhana zh-Hans Hani
China (Aksara Tradisional) zh-Hant Hani
Zulu zu Latn
Versi prosesor
ID versi Saluran Rilis Kematangan Rilis Deskripsi
pretrained-foundation-model-v1.5-2025-05-05 Stabil GA Kandidat siap produksi yang didukung oleh LLM Gemini 2.5 Flash. Direkomendasikan bagi mereka yang ingin bereksperimen dengan model yang lebih baru.
pretrained-foundation-model-v1.5-pro-2025-06-20 Stabil GA Model siap produksi yang didukung oleh LLM Gemini 2.5 Pro. Mendukung kuota hingga 30 halaman per menit untuk permintaan proses online. Model ini memiliki kualitas yang lebih baik dibandingkan dengan v1.5, dan mungkin memiliki latensi yang lebih tinggi.
pretrained-foundation-model-v1.5.1-2025-08-07 Kandidat rilis Pratinjau Publik Model pratinjau publik yang didukung oleh LLM Gemini 2.5 Flash. Model ini memiliki fitur yang sama dengan v1.5, dan telah meningkatkan pembelajaran adaptif few-shot.
pretrained-foundation-model-v1.6-pro-2025-12-01 Kandidat rilis Pratinjau Publik Model pratinjau yang didukung oleh LLM Gemini 3 Pro.
pretrained-foundation-model-v1.6-2026-01-13 Kandidat rilis Pratinjau Publik Model pratinjau yang didukung oleh LLM Gemini 3 Flash.
pretrained-foundation-model-v3.5-2026-05-26 Kandidat rilis Pratinjau Publik Model pratinjau yang didukung oleh LLM Gemini 3.5 Flash.

Untuk mengetahui informasi selengkapnya, lihat Mengelola versi pemroses.

Kuota dan batas
Halaman maksimum (permintaan online/sinkron): 15
Halaman maksimum (permintaan batch/offline/asinkron): 200
Halaman maksimum (permintaan online/sinkron mode tanpa gambar): 30
Jenis data yang dinormalisasi

Anda dapat menemukan informasi selengkapnya di halaman Pengayaan & normalisasi, dan Buat set data.

Daftar lengkap jenis data yang dinormalisasi
  • dateTime as STRING
  • currency as STRING
  • money as google.type.Money
  • number as FLOAT or INTEGER
Uptraining
Contoh File Input Buka di jendela baru.
Contoh Output Buka di jendela baru.
Wilayah yang didukung
  • asia-south1
  • asia-southeast1
  • australia-southeast1
  • eu
  • europe-west2
  • europe-west3
  • northamerica-northeast1
  • us
Informasi selengkapnya Pengekstrak Kustom

Form Parser

Deskripsi

Mengekstrak pasangan nilai kunci umum (entity dan kotak centang), tabel, dan entity generik dari dokumen selain teks OCR.

Pemroses ini menerapkan teknologi machine learning canggih untuk mengekstrak pasangan kunci-nilai, kotak centang, dan tabel dari dokumen dalam lebih dari 200 bahasa. Prosesor ini juga memanfaatkan model deep learning untuk mengekstrak 11 entity generik yang umum dalam berbagai jenis dokumen.

Kategori Mengekstrak
Fungsi OCR, Penguraian Formulir, Ekstraksi Entity
Tahap rilis Ketersediaan umum
Status akses Publik
Ketik API FORM_PARSER_PROCESSOR
Bahasa yang didukung
Daftar lengkap bahasa
Nama Bahasa Tag BCP 47 Skrip Tulisan tangan didukung
Afrika af Latn
Albania sq Latn
Arab ar Arab
Belarus be Cyrl
Catalan ca Latn
Cina zh Hani
Kroasia hr Latn
Ceko cs Latn
Denmark da Latn
Belanda nl Latn
Inggris en Latn
Estonia et Latn
Filipina fil Latn
Finlandia fi Latn
Prancis fr Latn
Jerman de Latn
Ibrani iw Hebr
Hindi hi Deva
Hungaria hu Latn
Islandia is Latn
Indonesia id Latn
Italia it Latn
Jepang ja Jpan
Korean ko Kore
Latvia lv Latn
Lituania lt Latn
Makedonia mk Cyrl
Melayu ms Latn
Marathi mr Deva
Nepal ne Deva
Norwegia no Latn
Persia fa Arab
Polandia pl Latn
Portugis (Portugal & Brasil) pt Latn
Rumania ro Latn
Rusia ru Cyrl
Serb sr Cyrl
Slovakia sk Latn
Slovenia sl Latn
Spanyol es Latn
Swedia sv Latn
Tagalog tl Latn
Turki tr Latn
Ukraina uk Cyrl
Vietnam vi Latn
Yiddi yi Hebr
Versi prosesor
ID versi Saluran Rilis Kematangan Rilis Kolom tambahan terdeteksi Deskripsi
pretrained-form-parser-v1.0-2020-09-23 Stabil GA

Tidak ada

Versi lama. Untuk kualitas terbaik dan set fitur lengkap, gunakan Form Parser v2.0.
pretrained-form-parser-v2.0-2022-11-10 Stabil GA
Tampilkan kolom
  • email
  • phone
  • url
  • date_time
  • address
  • person
  • organization
  • quantity
  • price
  • id
  • page_number
Versi yang direkomendasikan. Mendukung entitas generik dan menyertakan model tabel, KVP, dan kotak centang yang ditingkatkan, serta lebih dari 200 bahasa.
pretrained-form-parser-v2.1-2023-06-26 Kandidat Rilis Pratinjau Publik

Tidak ada

Versi Pratinjau Publik. Model yang sama dengan v2.0 dengan ekstraksi teks native dari file PDF digital yang diaktifkan.

Untuk mengetahui informasi selengkapnya, lihat Mengelola versi pemroses.

Kuota dan batas
Halaman maksimum (permintaan online/sinkron): 15
Halaman maksimum (permintaan batch/offline/asinkron): 100
Halaman maksimum (permintaan online/sinkron mode tanpa gambar): 30
Uptraining
Contoh File Input Buka di jendela baru.
Contoh Output Buka di jendela baru.
Wilayah yang didukung
  • asia-south1
  • asia-southeast1
  • australia-southeast1
  • eu
  • europe-west2
  • europe-west3
  • northamerica-northeast1
  • us
Informasi selengkapnya Form Parser

Layout Parser

Deskripsi

Mengekstrak elemen konten dokumen (teks, tabel, dan daftar) serta membuat potongan kontekstual.

Layout Parser mengekstrak elemen konten dokumen seperti teks, tabel, dan daftar, serta membuat potongan kontekstual yang memfasilitasi pengambilan informasi dalam AI generatif dan aplikasi penemuan.

Kategori Mengekstrak
Fungsi Penguraian Tata Letak, Pemotongan Dokumen
Tahap rilis Ketersediaan umum
Status akses Publik
Ketik API LAYOUT_PARSER_PROCESSOR
Catatan
  • Parser ini mendukung file PDF, HTML, DOCX, PPTX, dan XLSX/XLSM.
Bahasa yang didukung
Daftar lengkap bahasa
Nama Bahasa Tag BCP 47 Skrip Tulisan tangan didukung
Afrika af Latn
Albania sq Latn
Arab ar Arab
Armenia hy Armn
Belarus be Cyrl
Bangla bn Beng
Bengali bn Beng
Bulgaria bg Cyrl
Catalan ca Latn
Cina zh Hani
Kroasia hr Latn
Ceko cs Latn
Denmark da Latn
Belanda nl Latn
Inggris en Latn
Estonia et Latn
Filipina fil Latn
Finlandia fi Latn
Prancis fr Latn
Jerman de Latn
Yunani el Grek
Gujarat gu Gujr
Ibrani iw Hebr
Hindi hi Deva
Hungaria hu Latn
Islandia is Latn
Indonesia id