Μετάβαση στο περιεχόμενο
Επιστροφή στο Γλωσσάριο
Ανάπτυξη

Triton Inference Server

Ορισμός

NVIDIA's open-source inference serving software that supports multiple frameworks (TensorRT, ONNX, PyTorch, TensorFlow) on GPU infrastructure. Triton is widely used in enterprise deployments requiring maximum throughput from GPU hardware.

Χρειάζεστε Βοήθεια για να Κατανοήσετε το AI;

Κλείστε μια κλήση καταλληλότητας Physical AI για να συζητήσετε πώς αυτές οι έννοιες AI εφαρμόζονται στον κλάδο και τις προκλήσεις σας.

Triton Inference Server | Γλωσσάρι AI — LLM, RAG, Fine-Tuning & Βασικές Έννοιες