Bạn có thể yêu cầu mô hình Gemini tạo văn bản từ câu lệnh chỉ có văn bản hoặc câu lệnh đa phương thức. Khi sử dụng Firebase AI Logic, bạn có thể đưa ra yêu cầu này ngay trong ứng dụng của mình.
Câu lệnh đa phương thức có thể bao gồm nhiều loại dữ liệu đầu vào (chẳng hạn như văn bản cùng với hình ảnh, tệp PDF, tệp văn bản thuần tuý, âm thanh và video).
Hướng dẫn này cho biết cách tạo văn bản từ một câu lệnh chỉ có văn bản và từ một câu lệnh cơ bản có nhiều phương thức bao gồm cả một tệp.
Chuyển đến mã cho dữ liệu đầu vào chỉ có văn bản Chuyển đến mã cho dữ liệu đầu vào đa phương thức Chuyển đến mã cho các câu trả lời được truyền trực tuyến
|
Xem các hướng dẫn khác để biết thêm lựa chọn về cách xử lý văn bản Tạo đầu ra có cấu trúc Trò chuyện nhiều lượt Tạo văn bản trên thiết bị Chuyển văn bản sang lời nói (TTS) Tạo hình ảnh từ văn bản |
Trước khi bắt đầu
|
Nhấp vào nhà cung cấp Gemini API để xem nội dung và mã dành riêng cho nhà cung cấp trên trang này. |
Nếu bạn chưa thực hiện, hãy hoàn tất hướng dẫn bắt đầu sử dụng. Hướng dẫn này mô tả cách thiết lập dự án Firebase, kết nối ứng dụng với Firebase, thêm SDK, khởi chạy dịch vụ phụ trợ cho nhà cung cấp Gemini API mà bạn chọn và tạo một thực thể GenerativeModel.
Để kiểm thử và cải tiến câu lệnh, bạn nên sử dụng Google AI Studio.
Tạo văn bản từ dữ liệu đầu vào chỉ có văn bản
|
Trước khi dùng thử mẫu này, hãy hoàn tất phần Trước khi bắt đầu của hướng dẫn này để thiết lập dự án và ứng dụng. Trong phần đó, bạn cũng sẽ nhấp vào một nút cho nhà cung cấp Gemini API mà bạn đã chọn để xem nội dung dành riêng cho nhà cung cấp trên trang này. |
Bạn có thể yêu cầu mô hình Gemini tạo văn bản bằng cách đưa ra câu lệnh chỉ có văn bản.