Gemini 3.8 Flash (gemini-3.8-flash) est disponible pour tous les utilisateurs et prêt à être utilisé en production. Il s'agit de notre modèle Flash le plus intelligent, conçu pour l'ingénierie logicielle à long terme, les agents autonomes et les workflows d'entreprise complexes.
Ce guide explique les nouveautés de Gemini 3.8 Flash, les modifications apportées à l'API, des exemples de code et des conseils de migration.
Nouveau modèle
| Modèle | ID du modèle | Niveau de raisonnement par défaut | Tarifs | Description |
|---|---|---|---|---|
| Gemini 3.8 Flash | gemini-3.8-flash |
medium |
3.8 Flash est disponible jusqu'à la fin de l'année au prix de lancement de 0,75 $/1 M de jetons d'entrée et de 3,75 $/1 M de jetons de sortie. Pour en savoir plus, consultez les tarifs. | Notre modèle Flash le plus intelligent, conçu pour l'ingénierie logicielle à long terme, les agents autonomes et les workflows d'entreprise complexes. |
Gemini 3.8 Flash est compatible avec une fenêtre de contexte d'un million de jetons, 64 000 jetons de sortie maximum, des niveaux de raisonnement réglables (low, medium, high) et la même suite complète d'outils intégrés.
Pour obtenir les spécifications complètes, consultez la page du modèle Gemini 3.8 Flash. Pour en savoir plus sur les tarifs de lancement, consultez la section Tarifs ci-dessous ou la page des tarifs.
Guide de démarrage rapide
Python
from google import genai
client = genai.Client()
interaction = client.interactions.create(
model="gemini-3.8-flash",
input="Write a three.js script that renders a realistic 3D black hole."
)
print(interaction.output_text)
JavaScript
import { GoogleGenAI } from "@google/genai";
const client = new GoogleGenAI({});
const interaction = await client.interactions.create({
model: "gemini-3.8-flash",
input: "Write a three.js script that renders a realistic 3D black hole.",
});
console.log(interaction.output_text);
Java
import com.google.genai.Client;
import com.google.genai.gaos.models.interactions.CreateModelInteraction;
import com.google.genai.gaos.models.interactions.Interaction;
import com.google.genai.gaos.models.interactions.InteractionsInput;
import com.google.genai.gaos.models.interactions.Model;
import com.google.genai.gaos.models.operations.CreateInteractionRequestBody;
Client client = new Client();
CreateModelInteraction req = CreateModelInteraction.builder()
.model(Model.of("gemini-3.8-flash"))
.input(InteractionsInput.of("Hello world"))
.build();
Interaction interaction =
client.interactions.create(CreateInteractionRequestBody.of(req)).interaction().get();
System.out.println(interaction.outputText().orElse(""));
REST
curl "https://generativelanguage.googleapis.com/v1beta/interactions" \
-H "x-goog-api-key: $GEMINI_API_KEY" \
-H 'Content-Type: application/json' \
-X POST \
-d '{
"model": "gemini-3.8-flash",
"input": "Write a three.js script that renders a realistic 3D black hole."
}'
Nouveautés de Gemini 3.8 Flash
- Ingénierie logicielle à long terme : obtient des résultats de pointe sur des benchmarks de codage réels, des refactorisations complexes de plusieurs fichiers et une exécution déterministe des outils. Pour en savoir plus, consultez la méthodologie d'évaluation.
- Agents autonomes : vous permet de créer des workflows de planification et d'orchestration d'outils en plusieurs étapes résilients, ce qui réduit considérablement les boucles et les erreurs.
- Workflows d'entreprise complexes : offre une précision supérieure, un raisonnement approfondi et une rigueur factuelle élevée pour les tâches de domaine exigeantes et les pipelines de données à grande échelle.
- Modèle par défaut pour les agents gérés : l'agent par défaut pour les agents gérés, l'agent Antigravity, utilise désormais Gemini 3.8 Flash. Le SDK Antigravity utilise également Gemini 3.8 Flash par défaut.
- Tarifs de lancement : Gemini 3.8 Flash est disponible au tarif de lancement de 0,75 $/1 M de jetons d'entrée et de 3,75 $/1 M de jetons de sortie jusqu'au 31 décembre 2026. Les tarifs standards de 1,50 $/1 M de jetons d'entrée et de 7,50 $/1 M de jetons de sortie entreront en vigueur le 1er janvier 2027.
Gemini 3.8 Flash peut utiliser plus de jetons pour les tâches plus longues et complexes, par conception. Pour fournir des résultats de meilleure qualité sur des objectifs difficiles en plusieurs étapes, le modèle effectue des étapes de raisonnement plus petites, appelle les outils de manière itérative et vérifie son travail en cours de route. Tous les workflows n'ont pas besoin de ce niveau de vérification. Pour les tâches quotidiennes, vous pouvez réduire l'effort de raisonnement afin de diminuer la consommation de jetons. Vous pouvez également continuer à utiliser Gemini 3.7 Flash, qui reste entièrement compatible.
Comprendre les niveaux de raisonnement
Gemini 3.8 Flash vous offre un contrôle flexible sur la latence et l'intelligence en ajustant le niveau de raisonnement du modèle :
- Faible effort de raisonnement : réduit le délai de réponse pour les tâches critiques en termes de latence, telles que les pipelines de réponse aux incidents, le chat en temps réel, la rédaction de brouillons et l'analyse de données rapide.
- Moyen (par défaut) : meilleure qualité pour la plupart des tâches. Recommandé pour le code complexe et les cas d'utilisation agentiques, offrant une plus grande précision dès la première passe.
- Effort de raisonnement élevé : maximise les capacités de raisonnement et d'orchestration d'outils du modèle. Idéal pour le raisonnement approfondi, les mathématiques et les tâches complexes en plusieurs étapes.
L'exemple suivant définit thinking_level sur medium pour une demande d'analyse de code complexe :
Python
from google import genai
client = genai.Client()
interaction = client.interactions.create(
model="gemini-3.8-flash",
input="Analyze this payment processing pipeline for race conditions during retry attempts and rewrite the transaction locks safely.",
generation_config={
"thinking_level": "medium" # Balanced reasoning effort for complex tasks
}
)
print(interaction.output_text)
JavaScript
import { GoogleGenAI } from "@google/genai";
const client = new GoogleGenAI({});
const interaction = await client.interactions.create({
model: "gemini-3.8-flash",
input: "Analyze this payment processing pipeline for race conditions during retry attempts and rewrite the transaction locks safely.",
generation_config: {
thinking_level: "medium"
}
});
console.log(interaction.output_text);
Java
import com.google.genai.Client;
import com.google.genai.gaos.models.interactions.CreateModelInteraction;
import com.google.genai.gaos.models.interactions.Interaction;
import com.google.genai.gaos.models.interactions.InteractionsInput;
import com.google.genai.gaos.models.interactions.Model;
import com.google.genai.gaos.models.operations.CreateInteractionRequestBody;
Client client = new Client();
CreateModelInteraction req = CreateModelInteraction.builder()
.model(Model.of("gemini-3.8-flash"))
.input(InteractionsInput.of("Hello world"))
.build();
Interaction interaction =
client.interactions.create(CreateInteractionRequestBody.of(req)).interaction