Créer, utiliser et gérer un classificateur de documents personnalisé
Le classificateur personnalisé est conçu pour classer des documents. Créez-le de A à Z avec vos propres documents et classes personnalisées. L'IA générative intégrée permet d'utiliser l'apprentissage few-shot et l'affinage. Cela améliore la justesse avec moins d'échantillons et les corrections avec l'étiquetage automatique itératif.
Le classificateur personnalisé couvre ces trois cas d'utilisation généraux.
- Modèle pré-entraîné : utilisez le modèle de fondation d'IA générative pré-entraîné pour classer rapidement les documents avec les étiquettes que vous avez fournies.
- Affiner : améliorez la précision en entraînant le modèle de fondation d'IA générative sur vos propres données et étiquettes.
- Entraîner un modèle personnalisé : entraînez un extracteur personnalisé d'IA non générative à l'aide de vos propres données et étiquettes.
Versions des modèles du classificateur personnalisé
Les scores de confiance sont compatibles avec les modèles du classificateur personnalisé en version preview. Pour des performances optimales, utilisez-les avec des modèles affinés.
| Version de modèle | Description | Version disponible | Traitement ML aux États-Unis et dans l'UE | Affinage aux États-Unis et dans l'UE | Date de sortie |
|---|---|---|---|---|---|
pretrained-classifier-v1.5-2025-08-05 |
Modèle prêt pour la production, optimisé par le LLM Gemini 2.5 Flash. Inclut également des fonctionnalités OCR avancées. Ce modèle pré-entraîné peut être utilisé sans entraînement préalable. Il est compatible avec la classification zero-shot et offre une meilleure prise en charge de la classe fourre-tout. | Stable | Oui | États-Unis, UE (preview) | 5 août 2025 |
pretrained-classifier-v1.6-2026-03-09 |
Version candidate optimisée par le LLM Gemini 3.1 Flash. | Version candidate | Oui | Non | 9 mars 2026 |
pretrained-classifier-v1.6-pro-2026-03-09 |
Version candidate optimisée par le LLM Gemini 3.1 Pro. | Version candidate | Oui | Non | 9 mars 2026 |
Créer un classificateur personnalisé dans la console Google Cloud
Vous pouvez créer des classificateurs personnalisés spécifiquement adaptés à vos documents, et entraînés et évalués à l'aide de vos données. Cet outil de traitement identifie les classes de documents d'un ensemble de classes défini par l'utilisateur. Vous pouvez ensuite utiliser cet outil de traitement entraîné dans d'autres documents. Vous utiliserez généralement un classificateur personnalisé pour les documents de différents types, puis l'identification pour transmettre les documents à un outil d'extraction afin d'extraire les entités.
Pour connaître le processus général de création et d'utilisation d'un outil de traitement, consultez la section Instructions.
Vous pouvez définir vos propres configurations en fonction de votre workflow.
Pour obtenir des instructions détaillées sur cette tâche directement dans la console Google Cloud , cliquez sur Visite guidée :
Avant de commencer
- Connectez-vous à votre compte Google Cloud . Si vous débutez sur Google Cloud, créez un compte pour évaluer les performances de nos produits en conditions réelles. Les nouveaux clients bénéficient également de 300 $ de crédits sans frais pour exécuter, tester et déployer des charges de travail.
-
In the Google Cloud console, on the project selector page, select or create a Google Cloud project.
Roles required to select or create a project
- Select a project: Selecting a project doesn't require a specific IAM role—you can select any project that you've been granted a role on.
-
Create a project: To create a project, you need the Project Creator role
(
roles/resourcemanager.projectCreator), which contains theresourcemanager.projects.createpermission. Learn how to grant roles.
-
If you're using an existing project for this guide, verify that you have the permissions required to complete this guide. If you created a new project, then you already have the required permissions.
-
Verify that billing is enabled for your Google Cloud project.
Enable the Document AI, Cloud Storage APIs.
Roles required to enable APIs
To enable APIs, you need the
serviceusage.services.enablepermission. If you created the project, then you likely already have this permission through the Owner role (roles/owner). Otherwise, you can get this permission through the Service Usage Admin role (roles/serviceusage.serviceUsageAdmin). Learn how to grant roles.-
In the Google Cloud console, on the project selector page, select or create a Google Cloud project.
Roles required to select or create a project
- Select a project: Selecting a project doesn't require a specific IAM role—you can select any project that you've been granted a role on.
-
Create a project: To create a project, you need the Project Creator role
(
roles/resourcemanager.projectCreator), which contains theresourcemanager.projects.createpermission. Learn how to grant roles.
-
If you're using an existing project for this guide, verify that you have the permissions required to complete this guide. If you created a new project, then you already have the required permissions.
-
Verify that billing is enabled for your Google Cloud project.
Enable the Document AI, Cloud Storage APIs.
Roles required to enable APIs
To enable APIs, you need the
serviceusage.services.enablepermission. If you created the project, then you likely already have this permission through the Owner role (roles/owner). Otherwise, you can get this permission through the Service Usage Admin role (roles/serviceusage.serviceUsageAdmin). Learn how to grant roles.
Rôles requis
Pour obtenir les autorisations nécessaires pour créer un classificateur personnalisé, demandez à votre administrateur de vous accorder les rôles IAM suivants sur votre projet :
- Administrateur Document AI (
roles/documentai.admin) - Administrateur de l'espace de stockage (
roles/storage.admin)
Pour en savoir plus sur l'attribution de rôles, consultez Gérer l'accès aux projets, aux dossiers et aux organisations.
Vous pouvez également obtenir les autorisations requises avec des rôles personnalisés ou d'autres rôles prédéfinis.
Créer un outil de traitement
Procédez comme suit :
Accédez à Workbench.
Dans le champ "Classificateur de documents personnalisé", sélectionnez
Créer un outil de traitement .
Dans le menu Créer un outil de traitement, saisissez le nom de votre outil de traitement (par exemple,
my-custom-document-classifier).
Sélectionnez la région la plus proche de vous.
Sélectionnez Créer. L'onglet Détails de l'outil de traitement s'affiche.
Configurer l'ensemble de données
Pour entraîner ce nouvel outil de traitement, vous devez créer un ensemble de données contenant des données d'entraînement et de test afin de l'aider à identifier les documents que vous souhaitez scinder et classer. Cet ensemble de données nécessite un nouvel emplacement. Il peut s'agir d'un bucket Cloud Storage ou d'un dossier vide, ou vous pouvez autoriser un emplacement géré en interne.
Lorsque l'onglet Détails de l'outil de traitement s'affiche, vous pouvez :
- Sélectionner Stockage géré par Google si vous souhaitez utiliser Cloud Storage.
- Sélectionner Je spécifierai mon propre emplacement de stockage si vous souhaitez utiliser votre propre espace de stockage afin d'utiliser des clés de chiffrement gérées par le client (CMEK) et suivre la procédure décrite dans Créer un ensemble de données.

Importer des documents dans un ensemble de données
Vous allez ensuite importer vos documents dans votre ensemble de données.
Dans l'onglet Compiler, sélectionnez
Importer des documents .
Si vous choisissez d'utiliser un bucket de stockage, vous devez saisir le chemin source du bucket. Pour cet exemple d'entraînement, saisissez le nom de ce bucket dans
Chemin source . Cela renvoie directement vers un document.cloud-samples-data/documentai/Custom/Patents/PDF/computer_vision_20.pdfPour Répartition des données, sélectionnez Non attribué. Le document de ce dossier n'est attribué ni à l'ensemble de test, ni à l'ensemble d'entraînement. Ne cochez pas la case Importer avec l'étiquetage automatique.
Sélectionnez Importer. Document AI lit les documents du bucket dans l'ensemble de données. Il ne modifie pas le bucket d'importation et ne lit pas ses données une fois l'importation terminée.
Facultatif : Pour supprimer des documents importés, dans l'onglet Compiler, accédez à Gérer l'ensemble de données > sélectionnez les documents > cliquez sur Supprimer.
Lorsque vous importez des documents, vous pouvez les attribuer aux ensembles d'entraînement ou de test définis lors de l'importation, ou attendre de les attribuer ultérieurement.
Pour en savoir plus sur la préparation de vos données pour l'importation, consultez le