Elastic Stack (ELK Stack) Inference API

The inference API from Elastic Stack (ELK Stack) — 40 operation(s) for inference.

Business capability
Artificial Intelligence Management BC-610.60

Operations 48

POST /_inference/chat_completion/{inference_id}/_stream Perform chat completion inference on the service #
POST /_inference/completion/{inference_id} Perform completion inference on the service #
GET /_inference/{inference_id} Get an inference endpoint #
PUT /_inference/{inference_id} Create an inference endpoint #
POST /_inference/{inference_id} Perform inference on the service #
DELETE /_inference/{inference_id} Delete an inference endpoint #
GET /_inference/{task_type}/{inference_id} Get an inference endpoint #
PUT /_inference/{task_type}/{inference_id} Create an inference endpoint #
POST /_inference/{task_type}/{inference_id} Perform inference on the service #
DELETE /_inference/{task_type}/{inference_id} Delete an inference endpoint #
GET /_inference/_region_policy Get the inference region policy #
PUT /_inference/_region_policy Create or update the inference region policy #
DELETE /_inference/_region_policy Delete the inference region policy #
POST /_inference/embedding/{inference_id} Perform dense embedding inference on the service #
GET /_inference Get an inference endpoint #
GET /_inference/{task_type}/_all Get an inference endpoint #
PUT /_inference/{task_type}/{ai21_inference_id} Create a AI21 inference endpoint #
PUT /_inference/{task_type}/{alibabacloud_inference_id} Create an AlibabaCloud AI Search inference endpoint #
PUT /_inference/{task_type}/{amazonbedrock_inference_id} Create an Amazon Bedrock inference endpoint #
PUT /_inference/{task_type}/{amazonsagemaker_inference_id} Create an Amazon SageMaker inference endpoint #
PUT /_inference/{task_type}/{anthropic_inference_id} Create an Anthropic inference endpoint #
PUT /_inference/{task_type}/{azureaistudio_inference_id} Create an Azure AI studio inference endpoint #
PUT /_inference/{task_type}/{azureopenai_inference_id} Create an Azure OpenAI inference endpoint #
PUT /_inference/{task_type}/{cohere_inference_id} Create a Cohere inference endpoint #
PUT /_inference/{task_type}/{contextualai_inference_id} Create an Contextual AI inference endpoint #
PUT /_inference/{task_type}/{custom_inference_id} Create a custom inference endpoint #
PUT /_inference/{task_type}/{deepseek_inference_id} Create a DeepSeek inference endpoint #
PUT /_inference/{task_type}/{elasticsearch_inference_id} Create an Elasticsearch inference endpoint #
PUT /_inference/{task_type}/{elser_inference_id} Create an ELSER inference endpoint #
PUT /_inference/{task_type}/{fireworksai_inference_id} Create a Fireworks AI inference endpoint #
PUT /_inference/{task_type}/{googleaistudio_inference_id} Create an Google AI Studio inference endpoint #
PUT /_inference/{task_type}/{googlevertexai_inference_id} Create a Google Vertex AI inference endpoint #
PUT /_inference/{task_type}/{groq_inference_id} Create a Groq inference endpoint #
PUT /_inference/{task_type}/{huggingface_inference_id} Create a Hugging Face inference endpoint #
PUT /_inference/{task_type}/{jinaai_inference_id} Create an JinaAI inference endpoint #
PUT /_inference/{task_type}/{llama_inference_id} Create a Llama inference endpoint #
PUT /_inference/{task_type}/{mistral_inference_id} Create a Mistral inference endpoint #
PUT /_inference/{task_type}/{nvidia_inference_id} Create an Nvidia inference endpoint #
PUT /_inference/{task_type}/{openai_inference_id} Create an OpenAI inference endpoint #
PUT /_inference/{task_type}/{openshiftai_inference_id} Create an OpenShift AI inference endpoint #
PUT /_inference/{task_type}/{voyageai_inference_id} Create a VoyageAI inference endpoint #
PUT /_inference/{task_type}/{watsonx_inference_id} Create a Watsonx inference endpoint #
POST /_inference/rerank/{inference_id} Perform reranking inference on the service #
POST /_inference/sparse_embedding/{inference_id} Perform sparse embedding inference on the service #
POST /_inference/completion/{inference_id}/_stream Perform streaming completion inference on the service #
POST /_inference/text_embedding/{inference_id} Perform text embedding inference on the service #
PUT /_inference/{inference_id}/_update Update an inference endpoint #
PUT /_inference/{task_type}/{inference_id}/_update Update an inference endpoint #

Work with this as data

Every API here is available over the APIs.io API and to AI agents over MCP.

MCP server

One button, every client — Claude, Cursor, VS Code and the rest.

https://apis.io/mcp

Tools for apis

7 MCP tools reach this
  • find_apisBrowse and filter every API in the catalog.
  • get_api_artifactsOne API's artifacts, grouped by type.
  • get_openapiThe primary OpenAPI for this API.
  • find_similar_apisAPIs that look like this one.
  • apis_io_searchSTART HERE — APIs, providers and tags for one query, each with its total.
  • resolveTurn a domain, URL or GitHub org into the provider it belongs to.
  • find_cohortsEvery scored population of providers in the catalog.
All 92 tools →

Call it yourself

curl for this page
This API
curl "https://apis.io/api/v1/apis/elk-stack-inference-api"
All apis
curl "https://apis.io/api/v1/apis?limit=25"

Discovery needs no key. Ratings and market analysis are Pro.

Get an API key

Free tier, no form to fill in. Signing in shares your email address with us — we store it to create your key and to recognise you if you sign in with another provider. See our Privacy Policy and Terms.

A second provider on the same verified email joins the account you already have.

OpenAPI Specification

elk-stack-inference-api-openapi.yml Raw ↑
openapi: 3.2.0
info:
  title: Elasticsearch Request & Response Specification Inference API
  license:
    name: Apache 2.0
    url: https://github.com/elastic/elasticsearch-specification/blob/main/LICENSE
  version: ''
tags:


# --- truncated at 32 KB (379 KB total) ---
# Full source: https://raw.githubusercontent.com/api-evangelist/elk-stack/refs/heads/main/openapi/elk-stack-inference-api-openapi.yml