טנסורים דחוסים
term_id: compressed_tensors
Category: basic_concepts
Definition
טנסורים דחוסים הם מערכים רב-ממדיים המשמשים בלמידה עמוקה, שבהם הדיוק המספרי (למשל, מ-float32 ל-int8) או הצפיפות הוקטנו. טכניקה זו, הידועה בשם כמותנה (Quantization) או דחיסה, מאפשרת הפחתת צריכת הזיכרון.
Summary
טנסורים שבהם דיוק הנתונים או גודלם הוקטנו כדי לייעל אחסון ויעילות חישובית.
Key Concepts
- כמותנה (Quantization)
- דלילות (Sparsity)
- אופטימיזציית זיכרון
- מהירות מסקנה (Inference Speed)
Use Cases
- הטמעת אפליקציות AI בסלולר
- עיבוד על התקני קצה (Edge devices)
- אופטימיזציה של שרתים לדגמי שפה גדולים (LLM)
Code Example
| |