ממשקי Vertex AI API ליצירת חוויות חיפוש ו-RAG

‫Vertex AI מציע חבילה של ממשקי API שיעזרו לכם ליצור אפליקציות של Retrieval-Augmented Generation (יצירה משולבת-אחזור, RAG) או מנוע חיפוש. בדף הזה מוצגים ממשקי ה-API האלה.

אחזור ויצירה

RAG היא מתודולוגיה שמאפשרת למודלים גדולים של שפה (LLMs) ליצור תשובות שמבוססות על מקור הנתונים שתבחרו. יש שני שלבים ב-RAG:

  1. אחזור: קבלת העובדות הכי רלוונטיות במהירות יכולה להיות בעיה נפוצה בחיפוש. בעזרת RAG, אפשר לאחזר במהירות את העובדות שחשובות ליצירת תשובה.
  2. יצירה: העובדות שאוחזרו משמשות את ה-LLM ליצירת תשובה מבוססת.

‫Vertex AI מציע אפשרויות לשני השלבים כדי להתאים למגוון צרכים של מפתחים.

אחזור

בוחרים את שיטת השחזור שהכי מתאימה לצרכים שלכם:

  • חיפוש באמצעות סוכן: חיפוש באמצעות סוכן הוא מנוע לאחזור מידע באיכות של חיפוש Google, שיכול להיות רכיב בכל אפליקציית AI גנרטיבי שמשתמשת בנתונים של הארגון שלכם. חיפוש מבוסס סוכנים פועל כמנוע חיפוש סמנטי ומנוע חיפוש מילות מפתח מוכן לשימוש עבור RAG, עם יכולת לעבד מגוון סוגים של מסמכים ועם מחברים למגוון מערכות מקור, כולל BigQuery ומערכות רבות של צד שלישי.

    מידע נוסף זמין במאמר בנושא חיפוש סוכנים.

  • יצירת אחזור משלכם: אם אתם רוצים ליצור חיפוש סמנטי, אתם יכולים להסתמך על ממשקי Vertex AI API לרכיבים של מערכת RAG מותאמת אישית. חבילת ממשקי ה-API הזו מספקת הטמעות באיכות גבוהה של ניתוח מסמכים, יצירת הטמעות, חיפוש וקטורי ודירוג סמנטי. השימוש בממשקי ה-API ברמה הנמוכה יותר מאפשר גמישות מלאה בתכנון רכיב המאחזר, ובמקביל מקצר את זמן יציאה לשוק ומספק איכות גבוהה באמצעות הסתמכות על ממשקי Vertex AI API ברמה נמוכה יותר.

    מידע נוסף זמין במאמר בנושא יצירת דור מוגבר של אחזור (RAG).

  • שימוש באחזור קיים: אתם יכולים להשתמש בחיפוש הקיים שלכם ככלי אחזור ליצירה מבוססת-קרקע. אפשר גם להשתמש ב-RAG כדי להצמיד תשובות למקורות מידע, וכך לשדרג את החיפוש הקיים לאיכות גבוהה יותר. מידע נוסף זמין במאמר סקירה כללית על ביסוס.

  • Vertex AI RAG Engine: ‏ Vertex AI RAG Engine מספק זמן ריצה מנוהל במלואו לתיאום RAG, שמאפשר למפתחים לבנות RAG לשימוש בהקשרים של ייצור ומוכנות לארגונים.

    מידע נוסף זמין במאמר סקירה כללית של Vertex AI RAG Engine בתיעוד בנושא AI גנרטיבי ב-Vertex AI.

  • חיפוש Google: כשמשתמשים ב-Grounding עם חיפוש Google עבור מודל Gemini, ‏ Gemini משתמש בחיפוש Google ויוצר פלט שמבוסס על תוצאות החיפוש הרלוונטיות. השיטה הזו לא דורשת ניהול, ומאפשרת לכם לגשת לידע העולמי שזמין ב-Gemini.

    מידע נוסף זמין במאמר בנושא הארקה באמצעות חיפוש Google במסמכי התיעוד של AI גנרטיבי ב-Vertex AI.

יצירה

בוחרים את שיטת היצירה שהכי מתאימה לצרכים שלכם:

  • התבסס על הנתונים שלך: יצירת תשובות מבוססות לשאילתת משתמש. ממשק ה-API של יצירה מבוססת-קרקע משתמש במודלים מיוחדים של Gemini שעברו כוונון עדין, והוא דרך יעילה לצמצם הזיות ולספק תשובות שמבוססות על המקורות שלכם או על מקורות של צד שלישי, כולל הפניות לתוכן תמיכה בנושא יצירה מבוססת-קרקע.

    מידע נוסף זמין במאמר בנושא יצירת תשובות שמבוססות על מקורות באמצעות RAG.

    אפשר גם לעגן את התשובות לנתוני חיפוש מבוסס סוכנים באמצעות AI גנרטיבי ב-Vertex AI. מידע נוסף זמין במאמר התבססות על הנתונים.

  • עיגון באמצעות חיפוש Google: Gemini הוא המודל הכי מתקדם של Google, והוא מציע עיגון מוכן לשימוש בחיפוש Google. אתם יכולים להשתמש בו כדי לבנות פתרון מותאם אישית לחלוטין ליצירת תוכן מבוסס.

    מידע נוסף זמין במאמר בנושא עיגון באמצעות חיפוש Google במסמכי התיעוד של AI גנרטיבי ב-Vertex AI.

  • Model Garden: אם אתם רוצים שליטה מלאה במודל שבחרתם, אתם יכולים להשתמש בכל אחד מהמודלים ב-Vertex AI Model Garden כדי ליצור תוכן.

יצירת Retrieval Augmented Generation משלכם

פיתוח מערכת RAG בהתאמה אישית להארקה מאפשר גמישות ושליטה בכל שלב בתהליך. ‫Vertex AI מציע חבילה של ממשקי API שיעזרו לכם ליצור פתרונות חיפוש משלכם. השימוש בממשקי ה-API האלה מאפשר לכם גמישות מלאה בתכנון אפליקציית ה-RAG, ובמקביל מציע קיצור משמעותי של זמן יציאה לשוק ואיכות גבוהה, כי הוא מבוסס על ממשקי ה-API ברמה הנמוכה של Vertex AI.

  • הכלי Document AI Layout Parser. הכלי Document AI Layout Parser הופך מסמכים בפורמטים שונים לייצוגים מובְנים, וכך מאפשר גישה לתוכן כמו פסקאות, טבלאות, רשימות ורכיבים מבניים כמו כותרות, כותרות עליונות וכותרות תחתונות של דפים. הוא גם יוצר נתחים מודעים-הקשר שמקלים על אחזור מידע במגוון אפליקציות של AI גנרטיבי וגילוי.

    מידע נוסף זמין במאמר בנושא Document AI Layout Parser במאמרי העזרה של Document AI.

  • Embeddings API: ממשקי ה-API של Vertex AI embeddings מאפשרים ליצור הטמעות של טקסט או של קלט מולטימודאלי. הטמעה היא וקטור של מספרים עם נקודה עשרונית שנועד לתעד את המשמעות של הקלט. אפשר להשתמש בהטמעות כדי להפעיל חיפוש סמנטי באמצעות חיפוש וקטורי.