# NVIDIA Run:ai Distributed Inferences API

**Canonical:** https://apis.io/apis/runai/runai-distributed-inferences-api/  
**Provider:** NVIDIA Run:ai — https://apis.io/providers/runai/  
**Base URL:** https://app.run.ai  
**Documentation:** https://run-ai-docs.nvidia.com/api/readme.md

NVIDIA Run:ai Distributed Inferences API is one of 62 APIs that [NVIDIA Run:ai](https://apis.io/providers/runai/) publishes on the [APIs.io](https://apis.io/) network, described by a machine-readable OpenAPI specification. Tagged areas include Distributed Inferences. The published artifact set on APIs.io includes an OpenAPI specification, API documentation, and authentication docs.

Distributed inference enables running inference workloads across multiple pods, typically to scale model serving beyond a single container or node. This approach is useful when a single instance cannot meet resource requirements.NVIDIA Run:ai supports this model using Leader Worker Set (LWS). Each pod plays a specific role, either as a leader or worker, and together they form a coordinated service. NVIDIA Run:ai manages the orchestration and configuration of these pods to ensure efficient and scalable inference execution

## Machine-readable artifacts (3)

- **OpenAPI** — https://raw.githubusercontent.com/api-evangelist/runai/refs/heads/main/openapi/runai-distributed-inferences-api-openapi.yml
- **Documentation** — https://run-ai-docs.nvidia.com/api/getting-started/about-the-rest-api.md
- **Authentication** — https://raw.githubusercontent.com/api-evangelist/runai/refs/heads/main/authentication/runai-authentication.yml

## Other NVIDIA Run:ai APIs (12)

- [NVIDIA Run:ai Access Keys API](https://apis.io/apis/runai/runai-access-keys-api/)
- [NVIDIA Run:ai Access rules API](https://apis.io/apis/runai/runai-access-rules-api/)
- [NVIDIA Run:ai Administrator Command Line Interface API](https://apis.io/apis/runai/runai-administrator-command-line-interface-api/)
- [NVIDIA Run:ai AI Applications API](https://apis.io/apis/runai/runai-ai-applications-api/)
- [NVIDIA Run:ai Applications API](https://apis.io/apis/runai/runai-applications-api/)
- [NVIDIA Run:ai AuditLogs API](https://apis.io/apis/runai/runai-auditlogs-api/)
- [NVIDIA Run:ai Clusters API](https://apis.io/apis/runai/runai-clusters-api/)
- [NVIDIA Run:ai Compute API](https://apis.io/apis/runai/runai-compute-api/)
- [NVIDIA Run:ai ConfigMap API](https://apis.io/apis/runai/runai-configmap-api/)
- [NVIDIA Run:ai Credentials API](https://apis.io/apis/runai/runai-credentials-api/)
- [NVIDIA Run:ai Datasources API](https://apis.io/apis/runai/runai-datasources-api/)
- [NVIDIA Run:ai Datavolumes API](https://apis.io/apis/runai/runai-datavolumes-api/)

## Tags

Distributed Inferences

---

Profiled by [API Evangelist](https://apievangelist.com) and published on [APIs.io](https://apis.io/apis/runai/runai-distributed-inferences-api/). The API's provider profile, Kin Score and agent-readiness rating are at https://apis.io/providers/runai/.
