Dukungan bahasa OCR

Fitur pengenalan teks Cloud Vision dapat mendeteksi banyak bahasa, termasuk beberapa bahasa dalam satu gambar. Jika Vision API mengalami kesulitan mendeteksi bahasa secara otomatis, Anda dapat memberikan petunjuk bahasa untuk membantu meningkatkan output deteksi.

Untuk menggunakan fitur ini dan menentukan bahasa, lihat panduan untuk mendeteksi teks atau mendeteksi tulisan tangan. Untuk mencoba deteksi teks dengan petunjuk bahasa langsung di browser Anda, lihat bagian Coba di halaman deteksi teks.

Menentukan petunjuk bahasa

Anda menentukan petunjuk bahasa opsional dalam ImageContext permintaan sebagai daftar languageHints untuk permintaan TEXT_DETECTION atau DOCUMENT_TEXT_DETECTION.

Setiap parameter kode bahasa terdiri dari ID BCP-47. Parameter ini menggunakan bentuk bahasa-region, dengan:

  • language: Bahasa utama.
  • region: Wilayah opsional, biasanya ID negara, untuk dialek tertentu.

Misalnya, bahasa China dapat direpresentasikan sebagai China Aksara Sederhana, seperti yang digunakan di Republik Rakyat China (zh-Hans), atau China Aksara Tradisional, seperti yang digunakan di Taiwan (zh-Hant).

Fitur pengenalan teks mendukung tiga tingkat bahasa:

  1. Bahasa yang didukung adalah bahasa yang diprioritaskan dan dievaluasi performanya secara rutin oleh Google.
  2. Bahasa Eksperimental adalah bahasa yang sedang dalam pengembangan aktif, tetapi performanya tidak dievaluasi secara rutin.
  3. Bahasa yang dipetakan didukung dengan memetakan ke kode bahasa lain atau pengenal karakter umum. Misalnya, en-GB diperlakukan seperti en untuk pengenalan teks. Meskipun Google berupaya menampilkan kode bahasa yang dipetakan dengan benar di kolom Lokalitas entitas, bahasa-bahasa ini lebih rentan salah diidentifikasi sebagai bahasa serupa dibandingkan dengan bahasa yang didukung sepenuhnya atau bahasa eksperimental.

Jika Anda membiarkan petunjuk bahasa kosong, layanan akan mencoba mendeteksi secara otomatis bahasa yang paling sesuai. Secara khusus:

  • Endpoint TEXT_DETECTION hanya mendeteksi sebagian bahasa yang didukung secara otomatis.
  • Endpoint DOCUMENT_TEXT_DETECTION otomatis mendeteksi rangkaian lengkap bahasa yang didukung.

Daftar bahasa (dengan kode languageHint terkait) yang didukung oleh TEXT_DETECTION dan DOCUMENT_TEXT_DETECTION muncul dalam daftar berikut.

Bahasa yang didukung

Bahasa berikut diprioritaskan dan dievaluasi secara berkala.

Untuk memfilter daftar bahasa, ketik nama bahasa di kotak penelusuran:

Bahasa Bahasa (nama bahasa Inggris) Kode languageHints Skrip Catatan
Afrikaans Afrika af Latn
shqip Albania sq Latn
العربية Arabic ar Arab Standar Modern
Հայ Armenia hy Armn
беларуская Belarusia be Cyrl
বাংলা Bengali bn Beng
български Bulgaria bg Cyrl
Català Catalan ca Latn
普通话 China zh Hans/Hant
Hrvatski Kroasia hr Latn
Čeština Ceko cs Latn
Dansk Dansk da Latn
Nederlands Belanda nl Latn
English Inggris en Latn Amerika
Eesti keel Estonia et Latn
Filipino Filipina fil Latn
Suomi Suomi fi Latn
Français French fr Latn Eropa
Deutsch German de Latn
Ελληνικά Yunani el Grek
ગુજરાતી Gujarati gu Gujr
עברית Ibrani iw Hebr
हिन्दी Hindi hi Deva
Magyar Hungaria hu Latn
Íslenska Islandia is Latn
Bahasa Indonesia Indonesia id Latn
Italiano Italia it Latn
日本語 Jepang ja Jpan
ಕನ್ನಡ Kannada kn Knda
ភាសាខ្មែរ Khmer km Khmr
한국어 Korean ko Kore
ລາວ Laos lo Laoo
Latviešu Latvi lv Latn
Lietuvių Lituania lt Latn
Македонски Makedonia mk Cyrl
Bahasa Melayu Melayu ms Latn
മലയാളം Malayalam ml Mlym
मराठी Marathi mr Deva
नेपाली Nepal ne Deva
Norsk Norwegia no Latn Bokmål
فارسی Persia fa Arab
Polski Polandia pl Latn
Português Portugis pt Latn Brasil
ਪੰਜਾਬੀ Punjabi pa Guru Gurmukhi
Română Rumania ro Latn
Русский Russian ru Cyrl
Русский (старая орфография) Russian ru-PETR1708 Cyrl Ortografi Lama
Српски Serbia sr Cyrl
Српски (латиница) Serbia sr-Latn Latn
Slovenčina Slovakia sk Latn
Slovenščina Slovenia sl Latn
Español Spanish es Latn Eropa
Svenska Swensk sv Latn
Tagalog Tagalog tl Latn
தமிழ் Tamil ta Taml
తెలుగు Telugu te Telu
ไทย Thai th Thai
Türkçe Turki tr Latn
Українська Ukraina uk Cyrl
Tiếng Việt Vietnam vi Latn
Yiddish Yiddish yi Hebr

Bahasa eksperimental

Bahasa berikut sedang dalam pengembangan aktif dan belum dievaluasi secara berkala.

Bahasa Bahasa (nama bahasa Inggris) Kode languageHints Skrip Catatan
አማርኛ Amhara am Ethi
Αρχαία ελληνικά Yunani Kuno grc Grek
অসমীয়া Assam as Beng
Azərbaycan Azerbaijani az Latn
Azərbaycan (qədim yazı) Azerbaijani az-Cyrl Cyrl Ortografi Lama
Euskara Basque eu Latn
Bosanski Bosnia bs Latn
မြန်မာ Burma my Mymr
Cebuano Cebu ceb Latn
ᏣᎳᎩ ᎦᏬᏂᎯᏍᏗ Cherokee chr Cher
dhivehi, dhivehi-bas Dhivehi dv Thaa
རྫོང་ཁ Dzonkha dz Tibt
Esperanto Esperanto eo Latn
Galego Galisia gl Latn
ქართული Georgia ka Geor
Kreyòl Ayisyen Kreol Haiti ht Latn
Gaeilge Irlandia ga Latn
Jawa Jawa jv Latn
Қазақ Kazakh kk Cyrl
Kirghiz Kirgiz ky Cyrl
Latine Latin la Latn
Malti Malta mt Latn
Монгол Mongolia mn Cyrl
ଓଡ଼ିଆ Oriya or Orya
پښتو Pashto ps Arab
संस्कृतम् Sanskrit sa Deva
සිංහල Sinhala si Sinh
Swahili Swahili sw Latn
leššānā Suryāyā Suryani syr Syriac
བོད་སྐད་ Tibet bo Tibt
ትግርኛ Tigirinya ti Ethi
اردو Urdu ur Arab
oʻzbekcha Uzbekistan uz Latn Latin
oʻzbekcha Uzbekistan uz-Cyrl Cyrl Ortografi Lama