Aller au contenu
Retour au Glossaire
Déploiement

Inference

Définition

The process of running a trained model on new data to produce predictions or generated outputs. Inference cost and latency are the dominant operational concerns in production AI, particularly for large generative models that can cost cents per request at scale.

Besoin d'Aide pour Comprendre l'IA?

Réservez un appel de cadrage Physical AI pour discuter de l'application de ces concepts IA à votre secteur et vos défis métier.

Inference | Glossaire IA — LLM, RAG, Fine-Tuning & Concepts Clés