במדריך הזה מוצגת סקירה כללית של השימוש ב-Cloud Run לאירוח אפליקציות, להפעלת הסקה ולבניית תהליכי עבודה של AI.
Cloud Run לאירוח אפליקציות AI, סוכנים ונקודות קצה של API שניתנות להרחבה
Cloud Run מספק פלטפורמה מנוהלת לחלוטין שמתאימה את עומסי העבודה ואת אפליקציות ה-AI שלכם לעומס.
כשמאחסנים אפליקציות AI ב-Cloud Run, בדרך כלל יש את רכיבי הארכיטקטורה הבאים:
- הצגה ותזמור: אתם פורסים את קוד האפליקציה או הקונטיינר ב-Cloud Run.
- מודלים של AI: אתם משתמשים במודלים של AI מבית Google, במודלים בקוד פתוח או במודלים בהתאמה אישית באפליקציה שלכם.
- שילובים: אתם יכולים להתחבר ל Cloud de Confiance שירותים או לשירותי צד שלישי לזיכרון, למסדי נתונים, לאחסון, לאבטחה ועוד.
- כלים: אפשר להתחבר לכלים למשימות ולפעולות אחרות.
הדיאגרמה הבאה מציגה סקירה כללית של השימוש ב-Cloud Run כפלטפורמת אירוח לאפליקציות AI:
כפי שמוצג בתרשים:
בשכבת ההגשה והתזמור, שירות Cloud Run פועל כנקודת קצה ל-API שניתנת להרחבה עבור הלוגיקה המרכזית של האפליקציה. הוא מנהל ביעילות מספר משתמשים בו-זמנית באמצעות שינוי גודל מהיר, אוטומטי ועל פי דרישה של המופעים.
כדי לפרוס קונטיינר ב-Cloud Run, צריך לארוז את האפליקציה ואת התלות שלה בקונטיינר.
אפליקציית ה-AI פועלת כנקודת קצה ל-API שניתנת להרחבה, שמטפלת בבקשות נכנסות ושולחת נתונים למודל AI שעבר אימון מראש לצורך עיבוד, ואז מחזירה את התוצאות.
אם יש לכם מודל מותאם אישית שאומן על ידכם, אתם יכולים להשתמש בו גם עם משאב Cloud Run.
Cloud de Confiance by S3NS Vertex AI מציע מגוון רחב של פתרונות לתמיכה בתשתית של אפליקציית ה-AI שלכם.אפשר גם לבצע אינטגרציה עם פתרונות של צד שלישי.
כלים מאפשרים לאפליקציות ולמודלים של AI ליצור אינטראקציה עם שירותים, ממשקי API או אתרים שפועלים באופן חיצוני או ב-Cloud Run.
לדוגמה, אם אפליקציית ה-AI שלכם היא סוכן AI, יכול להיות שהסוכן ישלח בקשה לשרת MCP כדי להפעיל כלי חיצוני, או ישתמש בכלים שפועלים במאגר שלכם, כמו הרצת קוד, שימוש במחשב, אחזור מידע וכן הלאה.