Ga naar inhoud
Terug naar Woordenlijst
Deployment

Inference

Definitie

The process of running a trained model on new data to produce predictions or generated outputs. Inference cost and latency are the dominant operational concerns in production AI, particularly for large generative models that can cost cents per request at scale.

Hulp Nodig bij het Begrijpen van AI?

Boek een Physical AI-kennismaking om te bespreken hoe deze AI-concepten op uw branche en uitdagingen van toepassing zijn.

Inference | AI-Woordenlijst — LLM, RAG, Fine-Tuning & Kernbegrippen