انتقل إلى المحتوى
العودة إلى القاموس
التقنيات

Quantization

التعريف

A model compression technique that reduces the numerical precision of model weights—for example, from 32-bit floats to 8-bit integers—shrinking memory requirements and accelerating inference with minimal accuracy loss. Quantization is essential for deploying LLMs on-premise or at the edge.

خدمات ذات صلة

تحتاج مساعدة في فهم الذكاء الاصطناعي؟

احجز مكالمة تقييم ملاءمة Physical AI لمناقشة كيفية تطبيق مفاهيم الذكاء الاصطناعي هذه على قطاعك وتحدياتك.

Quantization | مسرد مصطلحات AI — LLM وRAG والضبط الدقيق والمفاهيم الرئيسية