הסקה (Inference)
יסודות בינה מלאכותית
הסקה (Inference) היא הרגע שבו מודל AI כבר מאומן ומשתמשים בו בפועל — לענות על שאלה, לזהות תמונה, לתרגם משפט — בניגוד לשלב האימון, שבו המודל עדיין לומד ומתעדכן.
ההבדל חשוב כלכלית: אימון הוא תהליך חד-פעמי ויקר במיוחד, בעוד הסקה קורית בכל פעם שמישהו שולח הודעה ל-ChatGPT או Claude — מיליוני פעמים ביום — ולכן העלות והמהירות שלה, לא רק של האימון, קריטיות לכלכלת המוצר.
"זמן הסקה" (inference time) — כמה זמן לוקח למודל לייצר תשובה — הוא אחד המדדים המרכזיים שמפתחי AI עובדים על שיפורו, כי הוא משפיע ישירות על חוויית המשתמש בזמן אמת.