Open source
Triton Inference Server
Reference entryTriton Inference Server
NVIDIA Triton Inference Server serves models from multiple frameworks with batching, model management and HTTP or gRPC endpoints.
Where it sits
NVIDIA Triton Inference Server serves models from multiple frameworks with batching, model management and HTTP or gRPC endpoints.