Tutoriel de détection de document texte dense

Audience

L'objectif de ce tutoriel est de vous aider à développer des applications à l'aide de la détection de documents texte de l'API Cloud Vision de Google Cloud. Il y est supposé que vous maîtrisez les concepts et les techniques de base de la programmation. Mais même si vous êtes un programmemeur débutant, vous devriez pouvoir suivre et exécuter ce tutoriel sans difficulté, puis utiliser la documentation de référence de l'API Vision pour créer des applications de base.

Prérequis

Annoter une image à l'aide de la reconnaissance optique des caractères d'un document texte

Ce tutoriel vous présente une application de base de l'API Cloud Vision qui envoie une DOCUMENT_TEXT_DETECTION requête, puis traite la fullTextAnnotation réponse.

Une fullTextAnnotation est une réponse hiérarchique structurée pour le texte UTF-8 extrait de l'image. Elle est organisée sous la forme Pages → Blocks → Paragraphs → Words → Symbols (Pages → Blocs → Paragraphes → Mots → Symboles) :