Aller au contenu
Retour au Glossaire
Déploiement

Triton Inference Server

Définition

NVIDIA's open-source inference serving software that supports multiple frameworks (TensorRT, ONNX, PyTorch, TensorFlow) on GPU infrastructure. Triton is widely used in enterprise deployments requiring maximum throughput from GPU hardware.

Besoin d'Aide pour Comprendre l'IA?

Réservez un appel de cadrage Physical AI pour discuter de l'application de ces concepts IA à votre secteur et vos défis métier.

Triton Inference Server | Glossaire IA — LLM, RAG, Fine-Tuning & Concepts Clés