Zum Inhalt springen
Zurück zum Glossar
Bereitstellung

Triton Inference Server

Definition

NVIDIA's open-source inference serving software that supports multiple frameworks (TensorRT, ONNX, PyTorch, TensorFlow) on GPU infrastructure. Triton is widely used in enterprise deployments requiring maximum throughput from GPU hardware.

Hilfe beim Verständnis von KI Benötigt?

Buchen Sie ein Physical-AI-Eignungsgespräch, um zu besprechen, wie diese KI-Konzepte auf Ihre Branche und Ihre Herausforderungen anwendbar sind.

Triton Inference Server | KI-Glossar — LLM, RAG, Fine-Tuning & Kernbegriffe