Cloud Vision 的文字辨識功能可偵測多種語言,包括單一圖片中的多種語言。如果 Vision API 無法自動偵測語言,您可以提供語言提示,協助改善偵測結果。
如要使用這些功能並指定語言,請參閱偵測文字或偵測手寫內容的指南。如要直接在瀏覽器中試用文字偵測功能,並提供語言提示,請參閱文字偵測頁面的「試用」一節。
指定語言提示
您可以在要求的 ImageContext 中指定選用語言提示,做為 TEXT_DETECTION 或 DOCUMENT_TEXT_DETECTION 要求的 languageHints 清單。
每個語言代碼參數都是由 BCP-47 ID 組成。這個參數的格式為「語言-地區」,其中:
- language:主要語言。
- 地區:選填地區,通常是特定方言的國家/地區 ID。
舉例來說,中文可以表示為中華人民共和國使用的簡體中文 (zh-Hans),或是臺灣使用的繁體中文 (zh-Hant)。
文字辨識功能支援三種語言層級:
- 支援的語言是 Google 優先處理的語言,且會定期評估成效。
- 實驗性語言是指正在積極開發中,但不會定期評估成效的語言。
- 對應語言:透過對應至其他語言代碼或一般字元辨識器,支援對應語言。舉例來說,文字辨識功能會將
en-GB視為en。雖然 Google 會嘗試在「實體地區設定」欄位中傳回正確的對應語言代碼,但與完全支援或實驗性語言相比,這些語言更容易被誤認為類似語言。
如果將語言提示留空,服務會嘗試自動偵測最合適的語言。具體情況如下:
TEXT_DETECTION端點只會自動偵測部分支援的語言。DOCUMENT_TEXT_DETECTION端點會自動偵測整組支援的語言。
下表列出 TEXT_DETECTION 和 DOCUMENT_TEXT_DETECTION 支援的語言 (附上相關的 languageHint 代碼)。
支援的語言
我們會優先處理下列語言,並定期評估。
如要篩選語言清單,請在搜尋框中輸入語言名稱: