3.6 Flash và 3.5 Flash-Lite Trang này
Gemini 3.5 Flash đã phát hành rộng rãi (GA), ổn định và sẵn sàng để sử dụng trong quy trình sản xuất quy mô lớn. Là mô hình Flash thông minh nhất của chúng tôi, Gemini 3.5 Flash mang lại hiệu suất vượt trội và bền vững trong việc thực thi tác nhân, lập trình và các nhiệm vụ dài hạn ở quy mô lớn.
Hướng dẫn này cung cấp thông tin tổng quan về các điểm cải tiến, thay đổi về API và hướng dẫn di chuyển cho Gemini 3.5 Flash.
Mô hình mới
| Mô hình | Mã kiểu máy | Mô tả |
|---|---|---|
| Gemini 3.5 Flash | gemini-3.5-flash |
Mô hình thông minh nhất của chúng tôi, mang lại hiệu suất vượt trội trong các tác vụ liên quan đến tác nhân và lập trình. |
Gemini 3.5 Flash hỗ trợ cửa sổ ngữ cảnh 1 triệu token, tối đa 65.000 token đầu ra, khả năng tư duy và cùng một bộ công cụ cũng như các tính năng của nền tảng như Gemini 3 Flash, bao gồm cả Sử dụng máy tính (Bản dùng thử).
Để biết đầy đủ thông số kỹ thuật, hãy xem tổng quan về các mô hình. Để biết giá, hãy xem trang giá.
Bắt đầu nhanh
Tất cả ví dụ trong hướng dẫn này đều sử dụng Interactions API. GenerateContent API cũng được hỗ trợ; các lựa chọn cấu hình và đề xuất tương tự cũng được áp dụng.
Python
from google import genai
client = genai.Client()
interaction = client.interactions.create(
model="gemini-3.5-flash",
input="Explain how parallel agentic execution works in three sentences."
)
print(interaction.output_text)
JavaScript
import { GoogleGenAI } from "@google/genai";
const client = new GoogleGenAI({});
async function main() {
const interaction = await client.interactions.create({
model: "gemini-3.5-flash",
input: "Explain how parallel agentic execution works in three sentences.",
});
console.log(interaction.output_text);
}
main();
REST
curl -X POST "https://generativelanguage.googleapis.com/v1beta/interactions" \
-H "x-goog-api-key: $GEMINI_API_KEY" \
-H 'Content-Type: application/json' \
-d '{
"model": "gemini-3.5-flash",
"input": "Explain how parallel agentic execution works in three sentences."
}'
Tính năng mới
- Hiệu suất vượt trội bền vững: Mô hình Flash thông minh nhất của chúng tôi, được tối ưu hoá cho các tác vụ lập trình và tác nhân ở quy mô lớn.
- Thực thi có tác nhân: Triển khai tác nhân phụ, giải quyết vấn đề và các vòng lặp có tác nhân nhanh chóng ở quy mô lớn.
- Lập trình: Các chu kỳ lập trình lặp đi lặp lại, khám phá nhanh và tạo mẫu để kiểm thử các đường dẫn thay thế và khám phá các giải pháp một cách linh hoạt.
- Dài hạn: Quy trình làm việc nhiều bước và sử dụng công cụ ở quy mô lớn.
- Lưu giữ các bước suy luận: Mô hình tự động duy trì quá trình suy luận trung gian trong các cuộc trò chuyện nhiều lượt. Không cần thay đổi API.
- Mức độ nỗ lực mặc định mới: Mức độ nỗ lực tư duy mặc định đã thay đổi từ
highthànhmedium. Hãy xem phần Mức độ nỗ lực mặc định mới để biết thông tin chi tiết. - Cải thiện khả năng tư duy của
low: Giờ đây,lowđã được cải thiện đáng kể cho mã và các tác vụ dựa trên tác nhân đòi hỏi ít bước hơn, mang lại chất lượng cao với độ trễ và chi phí thấp hơn. - Bản phát hành GA: Mô hình ổn định để sử dụng trong sản xuất trên quy mô lớn.
Chọn mô hình Flash phù hợp
Gemini 3.5 Flash là mô hình Flash thông minh và mạnh mẽ nhất của chúng tôi. Tuy nhiên, các trường hợp sử dụng khác nhau có thể có các yêu cầu khác nhau về chi phí và độ trễ.
- Gemini 3.1 Flash-Lite: Đối với những tác vụ có chi phí thấp, số lượng lớn mà không yêu cầu khả năng suy luận chuyên sâu của 3.5 Flash, bạn nên sử dụng