
Senior Performance Engineer - LLM Inference Frameworks
תיאור
מהנדס/ת ביצועים בכיר/ה בצוות TensorRT-LLM של NVIDIA, אחראי/ת לתכנון ואופטימיזציה של מערכות inference עבור מודלים שפה גדולים על GPU. התפקיד כולל פרופיילינג וכיוונון ביצועים, ניהול זיכרון חכם, וטיפול בטכניקות מתקדמות כמו Speculative Decoding וכימות. דרוש רקע אקדמי בהנדסה או מדעי מחשב, 5+ שנות ניסיון בפיתוח תוכנה, שליטה חזקה ב-Python ופריימוורקים כמו PyTorch, וכושר עמוק בפרופיילינג וביצועי GPU. עדיפות לתרומות קודמות לפרויקטים כמו vLLM או SGLang ולהכרות עם כלים מקצועיים של NVIDIA. מיקום: יקנעם · משרה מלאה להגשת מועמדות: באתר החברה, דרך הכפתור למטה
פרטים
מיקום
false
מיקום
יקנעם
Senior Performance Engineer - LLM Inference Frameworks
המשרה מתפרסמת ישירות באתר של NVIDIA. ההגשה נעשית שם; אנחנו רק עוזרים לה להגיע אליכם.
להגשת מועמדות באתר החברהשאלו על המודעהמקור המודעה
מודעה זו נאספה ממקור ציבורי חיצוני. ליצירת קשר עם המפרסם, פנו ישירות לפוסט המקורי.
לעמוד המקורי באתר nvidia.wd5.myworkdayjobs.com