התאמה אוטומטית לעומס מוסיפה מכונות וירטואליות (הרחבה אופקית) או מסירה מכונות וירטואליות (צמצום אופקי) מקבוצת מופעי מכונה מנוהלים (MIG). במאמר הזה מוסבר איך כלי לשינוי גודל אוטומטי קובע מתי לשנות את גודל ה-MIG.
איך כלי שינוי הגודל האוטומטי מחשבים את הגודל המומלץ ומשפיעים על גודל היעד
כשמגדירים התאמה אוטומטית לעומס (autoscaling) לקבוצת MIG, המערכת עוקבת כל הזמן אחרי הקבוצה ומחשבת גודל מומלץ – מספר מכונות ה-VM שנדרשות כדי לטפל בעומס שנצפה. לאחר מכן, ה-MIG משתמש בהמלצה הזו כדי להגדיר את גודל היעד של הקבוצה.
חישוב הגודל המומלץ
הכלי לשינוי גודל אוטומטי מחשב מחדש את הגודל המומלץ באופן קבוע על סמך:
- כברירת מחדל, הכלי לשינוי גודל אוטומטי מגדיר את הגודל המומלץ לטיפול בעומס שימוש שיא שנצפה במהלך תקופת הייצוב.
- אם התאמה אוטומטית לעומס מבוססת-חיזוי מופעלת, המידרוג האוטומטי חוזה את העומס העתידי על סמך היסטוריית השימוש במעבד, ומגדיר את הגודל המומלץ על סמך החיזוי.
כדי לבדוק את הגודל המומלץ, אפשר להציג את התרשים גודל הקבוצה ב- Cloud de Confiance console. אם אתם משתמשים ב-Google Cloud CLI או ב-Compute Engine API, אתם יכולים לקבל את פרטי הכוונון האוטומטי ולחפש את השדה recommendedSize בפלט.
מגבלות על הגודל המומלץ
הגודל המומלץ הסופי כפוף למגבלות הבאות:
- מספר המינימום והמקסימום של המופעים: הגודל צריך להיות בטווח שמוגדר במדיניות ההתאמה האוטומטית לעומס.
- אמצעי בקרה לצמצום הקיבולת: אם הגדרתם אמצעי בקרה לצמצום הקיבולת במדיניות של התאמה אוטומטית לעומס, המידרוג האוטומטי יגביל את מידת ההפחתה של הגודל המומלץ בכל פעם, כדי למנוע ירידות פתאומיות בקיבולת.
השפעה על גודל היעד
התגובה של ה-MIG לגודל המומלץ תלויה בmode של קנה המידה האוטומטי:
-
ON: קבוצת ה-MIG מגדירה את גודל היעד לגודל המומלץ ומשנה את גודל הקבוצה בהתאם. -
ONLY_SCALE_OUT: גודל היעד גדל רק אם הגודל המומלץ גדל. הוא לא יקטן גם אם הגודל המומלץ יקטן. -
OFF: גודל היעד נשאר ללא שינוי. הכלי לשינוי גודל אוטומטי עדיין מחשב את הגודל המומלץ ברקע, אבל לא משתמש בו כדי לשנות את גודל היעד.
אם מוחקים את ההגדרה של שינוי הגודל האוטומטי, המערכת מפסיקה לחשב את הגודל המומלץ.
פערים בין מדדי הניצול בפועל לבין יעדי הניצול
כשמשתמשים במדיניות של שינוי גודל אוטומטי עם אותות מבוססי-מדדים, יכול להיות שתבחינו שבקבוצות קטנות של מכונות, יש פער גדול בין רמת הניצול בפועל של קבוצת המכונות לבין רמת הניצול שהוגדרה כיעד. הסיבה לכך היא שמנגנון לשינוי גודל אוטומטי תמיד פועל בצורה שמרנית, ומעגל כלפי מעלה או מטה כשהוא מפרש נתוני ניצול וקובע כמה מופעים להוסיף או להסיר. כך נמנע מצב שבו הכלי להתאמת קנה מידה אוטומטית מוסיף מספר לא מספיק של משאבים או מסיר יותר מדי משאבים.
לדוגמה, אם הגדרתם יעד ניצול של 0.7 והאפליקציה חורגת מיעד הניצול, יכול להיות שהכלי לשינוי גודל אוטומטי יקבע שהוספה של 1.5 מכונות וירטואליות (VM) תפחית את הניצול לרמה קרובה ל-0.7. מכיוון שאי אפשר להוסיף 1.5 מכונות וירטואליות, המערכת להרחבת הקיבולת מעגלת כלפי מעלה ומוסיפה שתי מכונות וירטואליות. יכול להיות שהדבר יקטין את ניצול ה-CPU הממוצע לערך נמוך מ-0.7, אבל הוא יבטיח שלאפליקציה יהיו מספיק משאבים לתמיכה בה.
באופן דומה, אם מנגנון שינוי הגודל האוטומטי יקבע שהסרה של 1.5 מכונות וירטואליות תגדיל את רמת הניצול שלכם קרוב מדי ל-0.7, הוא יסיר רק מכונה וירטואלית אחת.
בקבוצות גדולות יותר עם יותר מופעי מכונות וירטואליות, השימוש מתחלק בין מספר גדול יותר של מופעים, והוספה או הסרה של מופעי מכונות וירטואליות גורמת לפער קטן יותר בין השימוש בפועל לבין השימוש המקסימלי.
אם משתמשים בהתאמה אוטומטית לעומס לפי לוח זמנים עם אות אחר של התאמה אוטומטית לעומס, יכול להיות שיידרשו יותר מכונות וירטואליות ממה שנדרש לניצול. במקרים כאלה, רמת הניצול בפועל נמוכה מרמת הניצול שהוגדרה כיעד, כי לוח הזמנים של התאמה אוטומטית לעומס קובע את הגודל המומלץ של קבוצת המכונות.
עיכובים בהרחבת הקיבולת
כשמגדירים את התכונה 'התאמה אוטומטית לעומס', מציינים תקופת אתחול שמשקפת את משך הזמן שנדרש לאתחול של מכונות ה-VM. הכלי לשינוי גודל אוטומטי ימליץ על הגדלת הקיבולת רק אם רמת הניצול הממוצעת של המכונות שלא נמצאות בתהליך אתחול גבוהה מרמת הניצול הרצויה.
אם תגדירו ערך של תקופת אתחול שהוא ארוך משמעותית מהזמן שנדרש לאתחול של מופע, יכול להיות שהכלי לשינוי גודל קבוצה באופן אוטומטי יתעלם מנתוני שימוש לגיטימיים, ויעריך הערכת חסר את הגודל הנדרש של הקבוצה.
עיכובים בהקטנת הקיבולת
לצורך הגדלת הקיבולת, הכלי לשינוי גודל אוטומטי מחשב את גודל היעד המומלץ של הקבוצה על סמך עומס השיא במהלך תקופת הייצוב.
התבוננות בשימוש במהלך תקופת הייצוב עוזרת למנגנון לשינוי גודל הקיבולת באופן אוטומטי:
- מוודאים שפרטי השימוש שנאספים מקבוצת המופעים יציבים.
- למנוע מצב שבו כלי לשינוי גודל אוטומטי מוסיף או מסיר באופן רציף מופעים בקצב מוגזם.
- הסרה בטוחה של מופעים על ידי קביעה שגודל הקבוצה הקטן יותר מספיק לתמיכה בעומס שיא מתקופת הייצוב.
יכול להיות שתקופת הייצוב תיראה כמו עיכוב בהגדלת הקיבולת, אבל היא למעשה תכונה מובנית של התאמה אוטומטית לעומס. בנוסף, תקופת הייצוב מבטיחה שאם מופע חדש יתווסף לקבוצת מופעי מכונה מנוהלים, המופע יפעל למשך תקופת הייצוב לפני שהוא יהיה כשיר למחיקה.
כשמחליטים אם לצמצם את מספר המכונות בקבוצה, המערכת מתעלמת מתקופות האתחול של מכונות חדשות.
עיכובים בגלל זמן להשלמת תהליך (connection draining)
אם הקבוצה היא חלק משירות לקצה העורפי שהפעלתם בו זמן להשלמת תהליך (connection draining), יכול להיות שיחלפו עד 60 שניות נוספות אחרי שמשך הזמן של זמן להשלמת תהליך (connection draining) יסתיים, לפני שהמכונה הווירטואלית תוסר או תימחק.
אמצעי בקרה לצמצום קנה המידה
כשמגדירים את אמצעי הבקרה של התאמה לעומס (autoscaling), אפשר לשלוט במהירות של הקטנת הקיבולת. השינוי האוטומטי של גודל הקבוצה אף פעם לא מתבצע מהר יותר מהקצב שהגדרתם:
- כשהעומס יורד, הכלי לשינוי גודל אוטומטי שומר על הגודל של הקבוצה ברמה הנדרשת כדי לטפל בעומס השיא שנצפה בתקופת הייצוב. הפעולה הזו זהה גם עם וגם בלי אמצעי בקרה להקטנת התצוגה.
- במערכת לשינוי גודל אוטומטי שאין בה אמצעי בקרה להקטנת הקיבולת, נשמרים רק מספיק מופעים שנדרשים לטיפול בעומס שנצפה לאחרונה. אחרי תקופת הייצוב, הכלי לשינוי גודל הקבוצה באופן אוטומטי מסיר את כל המופעים שלא נחוצים בשלב אחד. אם יש ירידה פתאומית בעומס, זה יכול להוביל לצמצום דרמטי בגודל של קבוצת המופעים.
- אמצעי בקרת צמצום של קבוצת מופעים במאזן עומסים אוטומטי מגבילים את מספר המכונות הווירטואליות שאפשר להסיר בפרק זמן מוגדר (בדוגמה הזו, 10 מכונות וירטואליות ב-20 דקות). הפעולה הזו מאטה את קצב צמצום המופעים.
- אם יש עלייה פתאומית בעומס, המערכת להגדלת הקיבולת מוסיפה מופעים חדשים כדי לטפל בעומס. עם זאת, בגלל זמן אתחול ארוך, המכונות הווירטואליות החדשות לא מוכנות לטפל בעומס. באמצעות אמצעי בקרה להקטנת הקיבולת, הקיבולת הקודמת נשמרה, כך שמכונות וירטואליות קיימות יכולות לטפל בעלייה החדה.
אתם שולטים בקצב ההקטנה על ידי הגדרת ההפחתה המקסימלית המותרת של Autoscaler בחלון זמן נגרר, באופן הבא:
- ההפחתה המקסימלית המותרת (
maxScaledInReplicas: מספר או אחוז של מכונות וירטואליות). מספר המקרים שעומס העבודה יכול להרשות לעצמו לאבד (מתוך הגודל המקסימלי של הקבוצה) בחלון הזמן האחרון שצוין. משתמשים בפרמטר הזה כדי להגביל את מידת ההקטנה של הקבוצה, כך שעד שעוד מופעים יתחילו להציג מודעות, עדיין תוכלו להציג מודעות במקרה של עלייה פתאומית בעומס. ככל שההפחתה המקסימלית המותרת נמוכה יותר, כך קצב ההגדלה איטי יותר. - חלון זמן נגרר (
timeWindowSec: שניות). הזמן שבו סביר להניח שעלייה פתאומית בעומס תתרחש אחרי ירידה זמנית, ושבמהלכו לא רוצים שהגודל של הקבוצה יצטמצם מתחת לצמצום המקסימלי המותר. הפרמטר הזה מאפשר להגדיר את חלון הזמן שבו הכלי להתאמת גודל הקבוצה יחפש את הגודל המקסימלי שנדרש כדי לטפל בעומס היסטורי. הכלי לשינוי גודל אוטומטי לא ישנה את הגודל מתחת להפחתה המקסימלית המותרת, שמופחתת מהגודל המקסימלי שנצפה בחלון הזמן האחרון. חלון זמן ארוך יותר מאפשר למנגנון להתאמה לעומס (autoscaler) להתחשב בעומס השיא ההיסטורי, וכך ההתאמה לעומס מתבצעת בצורה שמרנית ויציבה יותר.
כשמגדירים אמצעי בקרה לצמצום, המערכת להגדלה אוטומטית מגבילה את פעולות הצמצום להפחתה המקסימלית המותרת מהגודל המקסימלי שנצפה בחלון הזמן האחרון. הכלי לשינוי גודל אוטומטי פועל לפי השלבים הבאים:
- עוקב ברציפות אחרי הגודל המקסימלי ההיסטורי שנצפה בחלון הזמן האחרון.
- החישוב של גודל ההקטנה המוגבל (גודל שיא:
maxScaledInReplicas) מתבצע על סמך ההפחתה המקסימלית המותרת - מגדיר את הגודל המומלץ של הקבוצה לגודל המצומצם של הקטנת קנה המידה. לדוגמה, אם מנגנון לשינוי גודל אוטומטי ישנה את הגודל של קבוצת מכונות ל-20 מכונות וירטואליות, אבל אילוצי הקטנת הקיבולת מאפשרים רק הקטנה ל-40 מכונות וירטואליות, אז הגודל המומלץ יהיה 40 מכונות וירטואליות.
באמצעות אמצעי בקרה לצמצום קנה המידה, הכלי להתאמה אוטומטית לעומס עוקב באופן רציף אחרי הגודל המקסימלי של קבוצת מופעים בחלון הזמן האחרון שהוגדר, כדי לזהות את הגודל המספיק לטיפול בעומס היסטורי. התכונה לשינוי גודל אוטומטי לא מקטינה את הגודל מעבר להפחתה המקסימלית המותרת, שנמדדת מהגודל המקסימלי שנצפה:
לדוגמה, בתרשים הקודם, אמצעי הבקרה להקטנת הקיבולת מוגדרים להפחתה מקסימלית של 20 מכונות וירטואליות בחלון זמן של 30 דקות:
- כשהעומס יורד, הכלי להתאמה אוטומטית לעומס מסיר 20 מכונות וירטואליות, שזה מספר המכונות המקסימלי שאפשר להסיר לפי ההגדרות של אמצעי הבקרה להקטנת הקיבולת.
- ככל שהעומס עולה ויורד, הכלי לשינוי גודל אוטומטי עוקב כל הזמן אחרי חלון הזמן של 30 הדקות האחרונות כדי לזהות את הגודל המקסימלי שנדרש כדי לטפל בעומס היסטורי. הגודל המקסימלי הזה משמש כבסיס לאמצעי בקרה של הקטנת הקיבולת, כדי להגביל את קצב הקטנת הקיבולת. אם במהלך 30 הדקות האחרונות, הגודל המקסימלי היה 70 מכונות וירטואליות וההפחתה המקסימלית המותרת מוגדרת ל-20 מכונות וירטואליות, המערכת להתאמה אוטומטית לעומס יכולה להקטין את מספר המכונות הווירטואליות ל-50. אם הגודל הנוכחי הוא 65 מכונות וירטואליות, המערכת לשינוי גודל אוטומטי יכולה להסיר רק 15 מכונות וירטואליות.
- כשהעומס יורד, הכלי להתאמה אוטומטית לעומס ממשיך להסיר מכונות וירטואליות, אבל מגביל את הקצב ל-20 מכונות וירטואליות לכל היותר מהגודל המקסימלי של קבוצת המכונות שנמדד ב-30 הדקות האחרונות.
יכול להיות שההפחתה המקסימלית המותרת בגודל הקבוצה תתרחש בבת אחת, ולכן כדאי להגדיר את ההפחתה המקסימלית המותרת כך שהאפליקציה תוכל להרשות לעצמה לאבד כל כך הרבה מופעים בבת אחת. משתמשים בפרמטר של ההפחתה המקסימלית המותרת כדי לציין את מידת ההפחתה בקיבולת ההצגה שהאפליקציה יכולה לסבול.
הגבלת מספר המכונות הווירטואליות שאפשר להסיר באמצעות התאמה אוטומטית לעומס והגדלת חלון הזמן הנצפה מאפשרות לשפר את הזמינות של אפליקציות עם עליות פתאומיות בעומס וזמני אתחול ארוכים. בפרט, גודל קבוצת המופעים לא יורד בפתאומיות בתגובה לירידה משמעותית בעומס, אלא יורד בהדרגה לאורך זמן. אם העומס עולה במהירות אחרי הקטנת הקיבולת, מספר המכונות הווירטואליות שנותר צריך להיות מסוגל לספוג את העלייה במסגרת הסבילות שהגדרתם. בנוסף, צריך להפעיל פחות מכונות וירטואליות כדי לתת מענה מספק לעלייה החדה.
אתם יכולים להגדיר אמצעי בקרה לצמצום אופקי (scale in) בהתאמה אוטומטית לעומס של MIGs אזוריים ואזוריים. התצורה זהה בשני המקרים. אמצעי הבקרה להקטנת התצוגה פועלים בכל גודל קבוצה.
הבדלים בין אמצעי בקרה של הקטנת הקיבולת לבין ייצוב של כלי להתאמה אוטומטית של הקיבולת
הגדרת אמצעי בקרה לצמצום הקיבולת לא משביתה את מנגנון הייצוב של התכונה לשינוי אוטומטי של הקיבולת. הכלי לשינוי גודל קבוצת המופעים תמיד שומר על גודל קבוצת המופעים ברמה הנדרשת כדי לטפל בעומס שיא, שנצפה במהלך תקופת הייצוב. אמצעי הבקרה להקטנת קנה מידה מספקים מנגנון נוסף לשליטה בקצב שבו משנים את הגודל של קבוצת מופעים.
| תקופת ייצוב | אמצעי בקרה להקטנת התצוגה: חלון זמן נגרר |
|
|---|---|---|
| ניתן להגדרה? | כן, אפשר להגדיר | כן, אפשר להגדיר |
| מה נבדק? | מנטר את עומס השיא במהלך התקופה הקודמת שהוגדרה על ידי תקופת הייצוב. | מנטר את הגודל המקסימלי של קבוצת המופעים בתקופה הקודמת שהוגדרה על ידי חלון הזמן האחרון. |
| איך זה עוזר? | ההגדרה הזו מבטיחה שגודל קבוצת המופעים יישאר מספיק כדי לשרת את עומס השיא שנצפה במהלך תקופת הייצוב. | ההגדרה הזו מבטיחה שגודל קבוצת המכונות לא יקטן ביותר מכונות וירטואליות ממה שעומס העבודה יכול לשאת כשמטפלים בעליות פתאומיות בעומס במהלך חלון זמן מוגדר. |
אמצעי בקרה לצמצום היקף הפעילות במצב של שינוי גודל אוטומטי
יש שני תרחישים דומים אך שונים במקצת שבהם קבוצת ה-MIG לא עוברת שינוי גודל אוטומטי ואתם רוצים להפעיל את שינוי הגודל האוטומטי. השלבים האלה משתנים בהתאם למצב: האם אתם מגדירים את ההתאמה האוטומטית לעומס בפעם הראשונה, או שההתאמה האוטומטית לעומס מוגדרת אבל מוגבלת או מושבתת באופן זמני.
הגדרה של שינוי גודל אוטומטי בפעם הראשונה
אם יש לכם קבוצת MIG שלא מוגדרת בה קנה מידה אוטומטי, ואתם מגדירים קנה מידה אוטומטי מאפס, הכלי לקביעת קנה מידה אוטומטי משתמש בגודל הנוכחי של קבוצת ה-MIG כנקודת התחלה. לפני הקטנת הקיבולת, המערכת להגדלה אוטומטית משתמשת בתקופת הייצוב, ולאחר מכן היא משתמשת באמצעי בקרה להקטנת הקיבולת כדי להגביל את קצב הקטנת הקיבולת:
שינוי מצב של קנה מידה אוטומטי
במצב התאמה אוטומטית לעומס, אתם יכולים להשבית או להגביל באופן זמני את הפעילויות של התאמה אוטומטית לעומס. ההגדרה של שינוי הגודל האוטומטי נשמרת, והוא ממשיך לבצע חישובים ברקע גם כשהוא מושבת או מוגבל. הכלי להתאמת קנה מידה אוטומטית לוקח בחשבון את אמצעי הבקרה של הקטנת קנה המידה בחישובים שלו ברקע, כשהוא במצב מושבת או מוגבל. כל הפעילויות של שינוי הגודל האוטומטי יחזרו לפעול באמצעות החישובים האחרונים כשתפעילו שוב את שינוי הגודל האוטומטי או כשתסירו את ההגבלה:
- התנהגות של Autoscaler כשהוא מופעל היא כרגיל (עם אמצעי בקרה של הקטנת הקיבולת במקרה הזה).
- כשמשביתים את התכונה לשינוי גודל אוטומטי, היא עדיין מחשבת את הגודל המומלץ של קבוצת המופעים על סמך העומס. החישובים של Autoscaler עדיין מתחשבים באמצעי הבקרה של הקטנת הקיבולת. עם זאת, המערכת להגדלת קיבולת משאבים לא מבצעת חישובי גודל כשהיא מושבתת. גודל קבוצת המופעים נשאר קבוע עד שהמערכת להגדלת קיבולת משאבים מופעלת שוב.
- כשמפעילים מחדש את התכונה לשינוי גודל אוטומטי, הגודל שחושב קודם מוחל באופן מיידי. כך אפשר לשנות את הגודל מהר יותר לגודל הנכון. הפעלה מחדש של הכלי לשינוי גודל אוטומטי עלולה לגרום לשינוי גודל פתאומי (כאן מ-80 ל-40 מופעי מכונות וירטואליות). החישובים האלה בטוחים כי הם כבר לוקחים בחשבון את אמצעי הבקרה של הקטנת הקיבולת.
שינוי גודל אוטומטי של קבוצת מופעי מכונה מנוהלים (MIG) לאפס מופעים
התאמה אוטומטית לעומס יכולה להקטין את קבוצת ה-MIG לאפס מופעים, בהתאם לשדה minNumReplicas, לאותות של התאמה אוטומטית לעומס ולתזמונים שאתם מגדירים במדיניות ההתאמה האוטומטית לעומס.
תנאים לביצוע הקטנה אוטומטית של קבוצת MIG לאפס
מנגנון לשינוי גודל קבוצת MIG יכול להקטין את מספר המופעים בקבוצת MIG לאפס אם כל התנאים הבאים מתקיימים:
מספר המכונות המינימלי (
autoscalingPolicy.minNumReplicas) מוגדר כ-0.אין לוחות זמנים פעילים שנדרשים בהם יותר מאפס מופעים.
במדיניות של התאמה אוטומטית לעומס אסור להשתמש באף אחד מהמדדים הבאים שתלויים במכונות פעילות. אם המדיניות כוללת את המדדים האלה, המערכת האוטומטית לשינוי גודל הקבוצה דורשת לפחות מופע אחד בקבוצה כדי לקבל אות, והקבוצה לא תצטמצם לאפס מופעים.
- ממוצע ניצול המעבד
- קיבולת של מאזן עומסים מסוג HTTP
- מדדים של Cloud Monitoring שנאספים מכל מופע ב-MIG
אפשר גם לשנות את הגודל של קבוצת מופעי מכונה מנוהלים (MIG) באופן ידני לאפס מופעים, גם אם מדיניות התאמה אוטומטית לעומס כוללת מדדים שנאספים מכל מופע בקבוצת ה-MIG. כדי לשנות את הגודל של ה-MIG באופן ידני, אפשר לעיין במאמר בנושא הגדרה ידנית של הגודל של MIG.
תנאי למידרוג אוטומטי של קבוצת מופעים מנוהלת מאפס
כשגודל היעד של קבוצת ה-MIG הוא אפס, בין אם הוא מוגדר על ידי קנה מידה אוטומטי או משנה גודל באופן ידני, קנה המידה האוטומטי יכול להגדיל את קבוצת ה-MIG רק כשאות שינוי גודל או לוח זמנים פעיל דורשים יותר מאפס מופעים.
אם אות הגידול היחיד במדיניות מבוסס על מדדים שנאספים מכל מופע, אז ה-MIG לא יכול להגדיל את הקיבולת מאפס כי אין מופעים בקבוצה שיכולים ליצור את המדדים. במקרים כאלה, כדי להגדיל את גודל היעד של ה-MIG, צריך להגדיר את הגודל של ה-MIG באופן ידני.
התאמה אוטומטית לעומס (autoscaling) מבוססת-חיזוי
כדי לקבל מידע על התאמה אוטומטית לעומס מבוססת-תחזיות, כולל אופן הפעולה, אפשר לעיין במאמר התאמה לעומס על סמך תחזיות.
הכלי לשינוי גודל אוטומטי מתכונן להפסקת המכונות
כשכלי ההתאמה האוטומטית לעומס מצמצם את מספר המכונות הווירטואליות בקבוצת MIG, הקבוצה קובעת אילו מכונות וירטואליות למחוק. קבוצת ה-MIG מתעדפת את המכונות הווירטואליות למחיקה על סמך כמה גורמים. מידע נוסף על הגורמים האלה זמין במאמר גורמים שמשפיעים על מחיקה של מופעי מכונות וירטואליות.
לפני שמפסיקים מופע, כדאי לוודא שהמופעים האלה מבצעים משימות מסוימות, כמו סגירה של חיבורים קיימים, כיבוי מסודר של אפליקציות או שרתי אפליקציות והעלאה של יומנים. אתם יכולים להנחות את המופע לבצע את המשימות האלה באמצעות סקריפט כיבוי. סקריפט כיבוי מופעל על בסיס המאמץ המרבי, בתקופה הקצרה שבין שליחת בקשת העצירה לבין העצירה בפועל של המופע. במהלך התקופה הזו, מערכת Compute Engine מנסה להריץ את סקריפט הכיבוי כדי לבצע את המשימות שציינתם בסקריפט.
האפשרות הזו שימושית במיוחד אם אתם משתמשים באיזון עומסים עם קבוצת המופעים המנוהלת שלכם. אם המופע לא תקין, יכול להיות שיעבור זמן עד שמאזן העומסים יזהה שהמופע לא תקין, ולכן מאזן העומסים ימשיך לשלוח בקשות חדשות למופע. באמצעות סקריפט להשבתה, המופע יכול לדווח שהוא לא תקין בזמן ההשבתה, כדי שמאזן העומסים יוכל להפסיק לשלוח תנועה למופע. מידע נוסף על בדיקות תקינות של איזון עומסים זמין במאמר סקירה כללית על בדיקות תקינות.
מידע נוסף על סקריפטים של כיבוי זמין במאמר סקריפטים של כיבוי.
מידע נוסף על השבתת מופע זמין במאמרים בנושא עצירה או מחיקה של מופע.
מעקב אחרי תרשימים ויומנים של התאמה אוטומטית לעומס
ב-Compute Engine יש כמה תרשימים ויומנים שמאפשרים לכם לעקוב אחרי ההתנהגות של קבוצת המופעים המנוהלת בכל נקודת זמן.
אפשר לגשת לתרשימים וליומנים במסוף Cloud de Confiance .
נכנסים לדף Instance groups במסוף Cloud de Confiance .
לוחצים על השם של קבוצת מופעי מכונה מנוהלים שרוצים להציג.
בדף של קבוצת מופעי מכונה מנוהלים, לוחצים על הכרטיסייה Monitoring (מעקב).
בכרטיסייה Monitoring מוצגים תרשימים ויומנים באופן הבא:
בתרשימים מוצגים השינויים במדדים הבאים:
- גודל הקבוצה
- ניצול המשאבים של הכלי להתאמה אוטומטית לעומס
- ניצול יחידת העיבוד המרכזית (CPU)
- קלט/פלט של דיסק (בייטים)
- קלט/פלט (פעולות) בדיסק
- בייטים ברשת
- חבילות מידע ברשת
כדי לראות פרטים נוספים על ההקשר של המדד שמוצג בתרשים, מעבירים את העכבר מעל סמל העזרה שליד שם התרשים.
בחלונית Logs שבתחתית הדף מוצגת רשימה של יומני אירועים עבור קבוצת מופעי מכונה מנוהלים. כדי לראות את היומנים, בחלונית הזו, לוחצים על הסמל keyboard_capslock החלפת החלונית 'יומנים'.
כל התרשימים והיומנים קשורים לפרק זמן יחיד. כדי לנתח את התרשימים והיומנים של אירוע מסוים או טווח זמן ספציפי:
כדי להתקרב לאירוע מסוים, גוררים בתרשים כלשהו. גם החלונית 'יומנים' מתרעננת כדי להציג את היומנים מטווח הזמן שנבחר בתרשים.
כדי להציג את התרשימים והיומנים בטווח זמן מסוים, משתמשים בבורר טווח הזמן.
מעקב אחר גודל הקבוצה
בתרשים גודל הקבוצה אפשר לעקוב אחרי מספר המכונות הפעילות בקבוצת מופעי מכונה מנוהלים (MIG). בתרשים הזה, הקו Instances מציין את מספר המופעים הפעילים.
אם הגדרתם התאמה אוטומטית לעומס, בתרשים יוצגו גם הגדלים הבאים:
- הגודל המינימלי שהוגדר: המספר המינימלי של המופעים (
minNumReplicas) שהגדרתם במדיניות ההתאמה האוטומטית לעומס. - גודל מקסימלי שהוגדר: המספר המקסימלי של מכונות (
maxNumReplicas) שהגדרתם במדיניות ההתאמה האוטומטית לעומס. - גודל מומלץ: גודל היעד המומלץ שמחושב על ידי שירות ההתאמה האוטומטית של קנה המידה.
מידע נוסף על מדיניות של התאמה אוטומטית לעומס (automatic scaling) זמין במאמר בנושא התאמה אוטומטית לעומס (automatic scaling) של קבוצות מכונות.
מעקב אחרי אירועים של התאמה אוטומטית לעומס
התרשים Group size (גודל הקבוצה) כולל ציר זמן של Group size events (אירועים של גודל הקבוצה). ציר הזמן הזה מציג אירועים כמו שינוי הגודל של הקבוצה על ידי התכונה לשינוי גודל קבוצות באופן אוטומטי. כשמעבירים את העכבר מעל בלוק של אירוע בציר הזמן, מוצג כרטיס עם פרטי האירוע הרלוונטי, כולל:
Timestamp: חותמת הזמן של האירוע.
סוג האירוע והגדלים: הגדלה או הקטנה של נפח האירועים. לצד סוג האירוע מופיע הגודל הקודם והגודל החדש אחרי האירוע – לדוגמה,
6 VMs 1 VM.אות קנה מידה: האות שהפעיל את האירוע – לדוגמה, ניצול CPU.
ערך האות: הערך בפועל של אות ההתאמה.
יעד האות: ערך היעד של אות ההתאמה.
גודל מחושב: מספר המכונות שהתאמה אוטומטית לעומס חישבה כדי להשיג את יעד האות.
Limited by: כל הגדרה של התאמה אוטומטית לעומס שהגבילה את הגודל החדש – לדוגמה, המספר המינימלי או המקסימלי של המכונות ב-MIG. אם הכלי להתאמת קנה מידה אוטומטית לא מחיל אילוצים על הגודל החדש, הפרט הזה לא מוצג בכרטיס.
באיור הבא מוצגת דוגמה לציר זמן של אירועים של קנה מידה אוטומטי. בדוגמה הזו, הכרטיס מציג שינוי בגודל הקבוצה מ-4 מכונות וירטואליות ל-1 מכונות וירטואליות.

איור 1. תרשים של גודל הקבוצה שמציג את ציר הזמן של האירועים.
בהתאם לטווח הזמן שמוצג, יכול להיות שאירועים שקרו בהפרש קצר אחד מהשני יקובצו בציר הזמן. במקרה הזה, התרשים מציג את מספר האירועים המקובצים. לדוגמה, אם בכרטיס מוצג 5 אירועים, זה אומר שחמישה אירועים של התאמה אוטומטית לעומס התרחשו בטווח הזמן הזה. כדי לראות את האירועים האלה כבלוקים נפרדים בציר הזמן, צריך להגדיל את התרשים. אפשר גם ללחוץ על הצגת אירועים בכרטיס כדי לראות את הפרטים של האירועים המקובצים.
מעקב אחרי התאמה אוטומטית לעומס (Predictive Autoscaling)
ב-Compute Engine יש תרשים שמאפשר לעקוב אחרי התחזיות של שינוי הגודל האוטומטי. כדי לראות את התרשים הזה, לוחצים על הכותרת גודל הקבוצה בתרשים הראשון ובוחרים באפשרות שינוי גודל אוטומטי חזוי.
אם המידרוג האוטומטי מופעל, אפשר לראות איך התחזיות של המידרוג האוטומטי קובעות את הגודל של קבוצת המכונות. גם אם המידרוג האוטומטי לא מופעל, עדיין אפשר לראות את התחזיות של המידרוג האוטומטי ולהשתמש בהן כדי לקבל החלטות לגבי גודל הקבוצה.
המידע הבא יעזור לכם להבין את התרשים הזה.
- הקו הכחול מציין את מספר המופעים בקבוצת מופעי המכונה המנוהלים.
- הקו הירוק מראה את מספר המקרים שצפויים לפי קנה המידה האוטומטי.
- אם הקו הירוק נמצא מתחת לקו הכחול, יש כמות גדולה של קיבולת זמינה, וסביר להניח שמופעי ה-VM לא מנוצלים מספיק.
- אם הקו הירוק נמצא מעל הקו הכחול, המשמעות היא שיש מעט קיבולת פנויה, אם בכלל, ולכן כדאי להוסיף עוד מופעים לקבוצת המופעים.
- הקווים האופקיים האדומים המקווקווים מציינים את המספר המינימלי והמקסימלי של מופעים שמותרים בקבוצת המופעים.
איך רואים את הודעות הסטטוס
אם יש בעיה בהתאמת הגודל האוטומטית, מוצגת אזהרה או הודעת שגיאה. יש שתי דרכים לבדוק את הודעות הסטטוס האלה.
הצגת הודעות סטטוס בדף Instance groups
אפשר לראות את הודעות הסטטוס ישירות בדף Instance groups ב-Cloud de Confiance console.
- נכנסים לדף Instance groups במסוף Cloud de Confiance .
מחפשים קבוצות של מופעים שמופיע לפניהן סמל האזהרה.
כדי לקבל פרטים על הודעת הסטטוס, מעבירים את הסמן מעל סמל הסטטוס.
הצגת הודעות סטטוס בדף הסקירה הכללית של קבוצת המופעים
אתם יכולים לעבור ישירות לדף הסקירה הכללית של קבוצת מופעים ספציפית כדי לראות הודעות סטטוס רלוונטיות.
- נכנסים לדף Instance groups במסוף Cloud de Confiance .
- לוחצים על קבוצת המכונות שרוצים לראות את הודעות הסטטוס שלה.
- בדף של קבוצת המופעים, בודקים את הודעת הסטטוס מתחת לשם של קבוצת המופעים.
הודעות סטטוס נפוצות שמוחזרות
אם יש בעיה בהתאמת הגודל האוטומטית, מוצגת אזהרה או הודעת שגיאה. ריכזנו כאן כמה מההודעות הנפוצות שמוחזרות ומה המשמעות שלהן.
All instances in the instance group are unhealthy (not in RUNNING state). If this is an error, check the instances.- לכל המופעים בקבוצת המופעים יש מצב שהוא לא
RUNNING. אם זה נעשה בכוונה, אפשר להתעלם מההודעה הזו. אם זה לא מכוון, צריך לפתור את הבעיה בקבוצת המופעים. The number of instances has reached the maxNumReplicas. The autoscaler cannot add more instances.- כשיוצרים את הכלי לשינוי גודל אוטומטי, מציינים את המספר המקסימלי של מופעים שיכולים להיות בקבוצת המופעים. הכלי לשינוי גודל אוטומטי מנסה להרחיב את קבוצת המכונות כדי לעמוד בביקוש, אבל הגיע ל
maxNumReplicas. מידע על עדכוןmaxNumReplicasלמספר גדול יותר זמין במאמר עדכון של קנה מידה אוטומטי. The monitoring metric that was specified does not exist or does not have the required labels. Check the metric.אתם משתמשים בהתאמה אוטומטית לעומס על סמך מדד של Cloud Monitoring, אבל המדד שסיפקתם לא קיים, חסרות לו התוויות הנדרשות או שאין ל-Compute Engine Service Agent גישה אליו.
- בהתאם לסוג המדד (סטנדרטי או מותאם אישית), נדרשות תוויות שונות. מידע נוסף זמין במאמר בנושא שינוי גודל על סמך מדד של Monitoring.
- מוודאים שלסוכן השירות של Compute Engine מוקצה התפקיד
compute.serviceAgentב-IAM. כדי להוסיף אותו, אפשר לעיין במאמר בנושא דרישות מוקדמות לשימוש בתכונה לשינוי גודל אוטומטי.
- מוודאים שלסוכן השירות של Compute Engine מוקצה התפקיד
Quota for some resources is exceeded. Increase the quota or delete resources to free up more quota.אפשר לראות את המכסה הזמינה בדף המכסה במסוף Cloud de Confiance .
Autoscaling does not work with an HTTP/S load balancer configured for maxRate.קבוצת המופעים עוברת איזון עומסים באמצעות ההגדרה
maxRate, אבל שינוי הגודל האוטומטי לא תומך במצב הזה. אפשר לשנות את ההגדרה או להשבית את שינוי הגודל האוטומטי. מידע נוסף עלmaxRateזמין במאמר הגבלות והנחיות בתיעוד בנושא איזון עומסים.The autoscaler is configured to scale based on a load balancing signal but the instance group has not received any queries from the load balancer. Check that the load balancing configuration is working.מתבצע איזון עומסים בקבוצת המכונות, אבל הקבוצה לא מקבלת שאילתות נכנסות. יכול להיות שהשירות לא פעיל כרגע, ובמקרה כזה אין סיבה לדאגה. עם זאת, יכול להיות שההודעה הזו מופיעה גם בגלל הגדרה שגויה. לדוגמה, יכול להיות שקבוצת מופעים עם התאמה אוטומטית לעומס היא היעד של יותר ממאזן עומסים אחד, וזה לא נתמך. רשימה מלאה של ההנחיות מופיעה במאמר הגבלות והנחיות במסמכי העזרה בנושא איזון עומסים.