Slurm, gang scheduling, MPI, טופולוגיה מיטבית
מחשוב אינטנסיבי בלי תורים ובלי חיוב אטום
הסימולציות שלכם ראויות ליותר ממחשב-על משותף רווי או חשבון ענן בלתי צפוי. אשכול HPC ייעודי שם את הכוח איפה שהצוותים שלכם, עם תזמון בשליטתכם.
מקרי שימוש
- סימולציה נומרית: CFD, אלמנטים סופיים, דינמיקה מולקולרית
- מחקר: גנומיקה, כימיה חישובית, אקלים
- הנדסה: מבחני ריסוק וירטואליים, אופטימיזציה, רינדור
- Batch מסיבי: סיכון פיננסי, מונטה-קרלו, אופטימיזציה לוגיסטית
ארכיטקטורת ייחוס
- תזמון
- Slurm עם gang scheduling, מחיצות, QOS ו-fair-share: משימות רב-צמתיות מתחילות יחד, קרוב ל-fabric.
- חיבוריות
- InfiniBand או RoCEv2 עם הצבה מודעת-טופולוגיה לקולקטיבים של MPI ו-NCCL.
- אחסון
- Scratch מקבילי (Lustre, BeeGFS) ל-I/O אינטנסיבי, tiering לאחסון קיבולת.
- סביבות
- מודולים, קונטיינרים Apptainer / Enroot ותמונות הדירות לכל צוות מחקר.
מה תקבלו
- 01
אשכול Slurm מוגדר: מחיצות, QOS, חשבונאות שעות מחשוב
- 02
Fabric מאומת בבדיקות MPI ו-NCCL
- 03
אחסון scratch וקיבולת מבצעיים
- 04
תיעוד משתמשים והדרכת מנהלים
שאלות נפוצות
- Slurm או Kubernetes ל-HPC?
- Slurm נשאר הסטנדרט למשימות רב-צמתיות עם gang scheduling וחשבונאות שעות מדויקת. Kubernetes מצטיין בשירותים ארוכים והסקה. שניהם חיים יחד מצוין: זו לרוב ההמלצה שלנו.
- אפשר להעביר אשכול קיים?
- כן: אבחון הקיים, תוכנית העברה בשלבים ומעבר בלי להפריע לקמפיינים רצים.