Audience
L'objectif de ce tutoriel est de vous aider à développer des applications à l'aide de la détection de documents texte de l'API Cloud Vision de Google Cloud. Il y est supposé que vous maîtrisez les concepts et les techniques de base de la programmation. Mais même si vous êtes un programmemeur débutant, vous devriez pouvoir suivre et exécuter ce tutoriel sans difficulté, puis utiliser la documentation de référence de l'API Vision pour créer des applications de base.
Prérequis
- Configurez un projet d'API Vision dans la Google Cloud console.
Configurez votre environnement pour utiliser les identifiants par défaut de l'application.
Python
- Installez Python.
- Installez pip.
- Installez la bibliothèque cliente Google Cloud et la bibliothèque de traitement d'images Python Imaging Library.
Annoter une image à l'aide de la reconnaissance optique des caractères d'un document texte
Ce tutoriel vous présente une application de base de l'API Cloud Vision qui envoie une
DOCUMENT_TEXT_DETECTION requête, puis traite la fullTextAnnotation
réponse.
Une fullTextAnnotation est une réponse hiérarchique structurée pour le texte UTF-8 extrait de l'image. Elle est organisée sous la forme Pages → Blocks → Paragraphs → Words → Symbols (Pages → Blocs → Paragraphes → Mots → Symboles) :