Triton Inference Server ·
Open Collection
Triton Inference Server NVIDIA Triton Inference Server HTTP/REST CUDA Shared Memory Statistics API
3
Requests
1
Folders
2.0
Version
View on GitHub
Raw JSON
Artificial IntelligenceDeep LearningInferenceMachine-LearningModel ServingNVIDIAOpen-SourceOpen Collection
Overview
Triton Inference Server NVIDIA Triton Inference Server HTTP/REST CUDA Shared Memory Statistics API is a Open Collection published by Triton Inference Server on the APIs.io network, version 2.0.
The collection contains 3 requests organised into 1 folder.
Tagged areas include Artificial Intelligence, Deep Learning, Inference, Machine-Learning, and Model Serving.
Requests & Folders
Statistics
Related API Specs
Triton Inference Server CUDA Shared Memory API (OpenAPI)
Triton Inference Server Health API (OpenAPI)
Triton Inference Server Inference API (OpenAPI)
Triton Inference Server Logging API (OpenAPI)
Triton Inference Server Metrics API (OpenAPI)
Triton Inference Server Model Metadata API (OpenAPI)
Triton Inference Server Model Repository API (OpenAPI)
Triton Inference Server Server Metadata API (OpenAPI)
Triton Inference Server Statistics API (OpenAPI)
Triton Inference Server System Shared Memory API (OpenAPI)
Triton Inference Server Trace API (OpenAPI)
Work with this as data
Every collection here is available over the APIs.io API and to AI agents over MCP.