ארבע שאלות שחוזרות בראיונות למשרת מהנדס/ת למידת מכונה, ומה כדאי לענות עליהן.
משווה את התפלגות הנתונים הנכנסים והתחזיות לאורך זמן מול baseline מתקופת האימון.
online מחזיר תחזית בזמן אמת לבקשה בודדת, offline מריץ batch על כמות גדולה של נתונים מראש.
מגדיר trigger לפי זמן או ירידת ביצועים, ומוודא בדיקות איכות לפני שהמודל החדש מוחלף בפרודקשן.
משתמש בטכניקות כמו quantization, batching של בקשות או הרצה על GPU ייעודי.