ארבע שאלות שחוזרות בראיונות למשרת מהנדס/ת למידת מכונה (ML Engineer), ומה כדאי לענות עליהן.
משווה התפלגות features ותוצאות המודל לאורך זמן מול baseline האימון, ומתריע כשיש סטייה משמעותית.
משתמש בquantization או distillation ומריץ batching חכם לבקשות דומות.
מפצל תעבורה בין המודלים באופן אקראי ובודק מדד עסקי, לא רק דיוק סטטיסטי.
batch מתאים לתחזיות מרוכזות שלא דורשות תשובה מיידית, real-time דורש שירות זמין תמיד עם latency נמוך.