Fitur pengenalan teks Cloud Vision dapat mendeteksi banyak bahasa, termasuk beberapa bahasa dalam satu gambar. Jika Vision API mengalami kesulitan mendeteksi bahasa secara otomatis, Anda dapat memberikan petunjuk bahasa untuk membantu meningkatkan output deteksi.
Untuk menggunakan fitur ini dan menentukan bahasa, lihat panduan untuk mendeteksi teks atau mendeteksi tulisan tangan. Untuk mencoba deteksi teks dengan petunjuk bahasa langsung di browser Anda, lihat bagian Coba di halaman deteksi teks.
Menentukan petunjuk bahasa
Anda menentukan petunjuk bahasa opsional dalam
ImageContext permintaan sebagai
daftar languageHints untuk permintaan
TEXT_DETECTION atau DOCUMENT_TEXT_DETECTION.
Setiap parameter kode bahasa terdiri dari ID BCP-47. Parameter ini menggunakan bentuk bahasa-region, dengan:
- language: Bahasa utama.
- region: Wilayah opsional, biasanya ID negara, untuk dialek tertentu.
Misalnya, bahasa China dapat direpresentasikan sebagai China Aksara Sederhana, seperti yang digunakan di Republik Rakyat China (zh-Hans), atau China Aksara Tradisional, seperti yang digunakan di Taiwan (zh-Hant).
Fitur pengenalan teks mendukung tiga tingkat bahasa:
- Bahasa yang didukung adalah bahasa yang diprioritaskan dan dievaluasi performanya secara rutin oleh Google.
- Bahasa Eksperimental adalah bahasa yang sedang dalam pengembangan aktif, tetapi performanya tidak dievaluasi secara rutin.
- Bahasa yang dipetakan didukung dengan memetakan ke kode bahasa lain atau pengenal karakter umum. Misalnya,
en-GBdiperlakukan sepertienuntuk pengenalan teks. Meskipun Google berupaya menampilkan kode bahasa yang dipetakan dengan benar di kolom Lokalitas entitas, bahasa-bahasa ini lebih rentan salah diidentifikasi sebagai bahasa serupa dibandingkan dengan bahasa yang didukung sepenuhnya atau bahasa eksperimental.
Jika Anda membiarkan petunjuk bahasa kosong, layanan akan mencoba mendeteksi secara otomatis bahasa yang paling sesuai. Secara khusus:
- Endpoint
TEXT_DETECTIONhanya mendeteksi sebagian bahasa yang didukung secara otomatis. - Endpoint
DOCUMENT_TEXT_DETECTIONotomatis mendeteksi rangkaian lengkap bahasa yang didukung.
Daftar bahasa (dengan kode languageHint terkait) yang didukung oleh
TEXT_DETECTION dan DOCUMENT_TEXT_DETECTION muncul dalam daftar berikut.
Bahasa yang didukung
Bahasa berikut diprioritaskan dan dievaluasi secara berkala.
Untuk memfilter daftar bahasa, ketik nama bahasa di kotak penelusuran:
| Bahasa | Bahasa (nama bahasa Inggris) | Kode languageHints |
Skrip | Catatan | |
|---|---|---|---|---|---|
| Afrikaans | Afrika | af |
Latn |
||
| shqip | Albania | sq |
Latn |
||
| العربية | Arabic | ar |
Arab |
Standar Modern | |
| Հայ | Armenia | hy |
Armn |
||
| беларуская | Belarusia | be |
Cyrl |
||
| বাংলা | Bengali | bn |
Beng |
||
| български | Bulgaria | bg |
Cyrl |
||
| Català | Catalan | ca |
Latn |
||
| 普通话 | China | zh |
Hans/Hant |
||
| Hrvatski | Kroasia | hr |
Latn |
||
| Čeština | Ceko | cs |
Latn |
||
| Dansk | Dansk | da |
Latn |
||
| Nederlands | Belanda | nl |
Latn |
||
| English | Inggris | en |
Latn |
Amerika | |
| Eesti keel | Estonia | et |
Latn |
||
| Filipino | Filipina | fil |
Latn |
||
| Suomi | Suomi | fi |
Latn |
||
| Français | French | fr |
Latn |
Eropa | |
| Deutsch | German | de |
Latn |
||
| Ελληνικά | Yunani | el |
Grek |
||
| ગુજરાતી | Gujarati | gu |
Gujr |
||
| עברית | Ibrani | iw |
Hebr |
||
| हिन्दी | Hindi | hi |
Deva |
||
| Magyar | Hungaria | hu |
Latn |
||
| Íslenska | Islandia | is |
Latn |
||
| Bahasa Indonesia | Indonesia | id |
Latn |
||
| Italiano | Italia | it |
Latn |
||
| 日本語 | Jepang | ja |
Jpan |
||
| ಕನ್ನಡ | Kannada | kn |
Knda |
||
| ភាសាខ្មែរ | Khmer | km |
Khmr |
||
| 한국어 | Korean | ko |
Kore |
||
| ລາວ | Laos | lo |
Laoo |
||
| Latviešu | Latvi | lv |
Latn |
||
| Lietuvių | Lituania | lt |
Latn |
||
| Македонски | Makedonia | mk |
Cyrl |
||
| Bahasa Melayu | Melayu | ms |
Latn |
||
| മലയാളം | Malayalam | ml |
Mlym |
||
| मराठी | Marathi | mr |
Deva |
||
| नेपाली | Nepal | ne |
Deva |
||
| Norsk | Norwegia | no |
Latn |
Bokmål | |
| فارسی | Persia | fa |
Arab |
||
| Polski | Polandia | pl |
Latn |
||
| Português | Portugis | pt |
Latn |
Brasil | |
| ਪੰਜਾਬੀ | Punjabi | pa |
Guru |
Gurmukhi | |
| Română | Rumania | ro |
Latn |
||
| Русский | Russian | ru |
Cyrl |
||
| Русский (старая орфография) | Russian | ru-PETR1708 |
Cyrl |
Ortografi Lama | |
| Српски | Serbia | sr |
Cyrl |
||
| Српски (латиница) | Serbia | sr-Latn |
Latn |
||
| Slovenčina | Slovakia | sk |
Latn |
||
| Slovenščina | Slovenia | sl |
Latn |
||
| Español | Spanish | es |
Latn |
Eropa | |
| Svenska | Swensk | sv |
Latn |
||
| Tagalog | Tagalog | tl |
Latn |
||
| தமிழ் | Tamil | ta |
Taml |
||
| తెలుగు | Telugu | te |
Telu |
||
| ไทย | Thai | th |
Thai |
||
| Türkçe | Turki | tr |
Latn |
||
| Українська | Ukraina | uk |
Cyrl |
||
| Tiếng Việt | Vietnam | vi |
Latn |
||
| Yiddish | Yiddish | yi |
Hebr |
Bahasa eksperimental
Bahasa berikut sedang dalam pengembangan aktif dan belum dievaluasi secara berkala.
| Bahasa | Bahasa (nama bahasa Inggris) | Kode languageHints |
Skrip | Catatan | |
|---|---|---|---|---|---|
| አማርኛ | Amhara | am |
Ethi |
||
| Αρχαία ελληνικά | Yunani Kuno | grc |
Grek |
||
| অসমীয়া | Assam | as |
Beng |
||
| Azərbaycan | Azerbaijani | az |
Latn |
||
| Azərbaycan (qədim yazı) | Azerbaijani | az-Cyrl |
Cyrl |
Ortografi Lama | |
| Euskara | Basque | eu |
Latn |
||
| Bosanski | Bosnia | bs |
Latn |
||
| မြန်မာ | Burma | my |
Mymr |
||
| Cebuano | Cebu | ceb |
Latn |
||
| ᏣᎳᎩ ᎦᏬᏂᎯᏍᏗ | Cherokee | chr |
Cher |
||
| dhivehi, dhivehi-bas | Dhivehi | dv |
Thaa |
||
| རྫོང་ཁ | Dzonkha | dz |
Tibt |
||
| Esperanto | Esperanto | eo |
Latn |
||
| Galego | Galisia | gl |
Latn |
||
| ქართული | Georgia | ka |
Geor |
||
| Kreyòl Ayisyen | Kreol Haiti | ht |
Latn |
||
| Gaeilge | Irlandia | ga |
Latn |
||
| Jawa | Jawa | jv |
Latn |
||
| Қазақ | Kazakh | kk |
Cyrl |
||
| Kirghiz | Kirgiz | ky |
Cyrl |
||
| Latine | Latin | la |
Latn |
||
| Malti | Malta | mt |
Latn |
||
| Монгол | Mongolia | mn |
Cyrl |
||
| ଓଡ଼ିଆ | Oriya | or |
Orya |
||
| پښتو | Pashto | ps |
Arab |
||
| संस्कृतम् | Sanskrit | sa |
Deva |
||
| සිංහල | Sinhala | si |
Sinh |
||
| Swahili | Swahili | sw |
Latn |
||
| leššānā Suryāyā | Suryani | syr |
Syriac |
||
| བོད་སྐད་ | Tibet | bo |
Tibt |
||
| ትግርኛ | Tigirinya | ti |
Ethi |
||
| اردو | Urdu | ur |
Arab |
||
| oʻzbekcha | Uzbekistan | uz |
Latn |
Latin | |
| oʻzbekcha | Uzbekistan | uz-Cyrl |
Cyrl |
Ortografi Lama | |