Claix Document Intelligence API

REST API (Claix API 1.8.2) with 20 operations: six schema-driven conversions (Excel/CSV, PDF, Word/text, image and raw text to JSON; JSON to Excel), five Agent-mode variants that add a reasoning layer, schema management, and the context layer - persisted documents you can read, ask and delete, and knowledge spaces you can query across. API key in x-api-key or Bearer; multipart uploads in, typed JSON out.

Operations 20

POST /excel-json Convierte un archivo Excel o CSV a JSON según un schema #
POST /json-excel Convierte uno o varios documentos JSON a un archivo Excel #
POST /pdf-json Extrae datos estructurados de un archivo PDF según un schema #
POST /doc-json Extrae datos estructurados de un documento de texto según un schema #
POST /img-json Extrae datos estructurados de una imagen según un schema #
POST /txt-json Extrae datos estructurados de Txt / HTML / XML según un schema #
GET /get-document/{document_id} Devuelve el contenido bruto de un documento procesado #
POST /document-context/{document_id} Responde preguntas sobre un documento persistido #
POST /space-context/{space_id} Responde preguntas cruzando todos los documentos de un espacio #
POST /create-space Crea un espacio de conocimiento en la cuenta del API key #
DELETE /delete-space/{space_id} Elimina un espacio de conocimiento #
DELETE /delete-document/{document_id} Elimina un documento persistido #
POST /agent/excel-json Excel/CSV a JSON con extracción y razonamiento Modo Agente #
POST /agent/pdf-json PDF a JSON con extracción y razonamiento Modo Agente #
POST /agent/doc-json Documento a JSON con extracción y razonamiento Modo Agente #
POST /agent/img-json Imagen a JSON con extracción y razonamiento Modo Agente #
POST /agent/txt-json Txt / HTML / XML a JSON con extracción y razonamiento Modo Agente #
GET /schemas Devuelve todos los schemas de la cuenta asociada al API key #
POST /create-schema Crea un schema en la cuenta asociada al API key #
POST /delete-schema Elimina un schema de la cuenta asociada al API key #

Documentation

Specifications

SDKs

Other Resources

Work with this as data

Every API here is available over the APIs.io API and to AI agents over MCP.

MCP server

One button, every client — Claude, Cursor, VS Code and the rest.

https://apis.io/mcp

Tools for apis

7 MCP tools reach this
  • find_apisBrowse and filter every API in the catalog.
  • get_api_artifactsOne API's artifacts, grouped by type.
  • get_openapiThe primary OpenAPI for this API.
  • find_similar_apisAPIs that look like this one.
  • apis_io_searchSTART HERE — APIs, providers and tags for one query, each with its total.
  • resolveTurn a domain, URL or GitHub org into the provider it belongs to.
  • find_cohortsEvery scored population of providers in the catalog.
All 92 tools →

Call it yourself

curl for this page
This API
curl "https://apis.io/api/v1/apis/claix-document-intelligence-api"
All apis
curl "https://apis.io/api/v1/apis?limit=25"

Discovery needs no key. Ratings and market analysis are Pro.

Get an API key

Free tier, no form to fill in. Signing in shares your email address with us — we store it to create your key and to recognise you if you sign in with another provider. See our Privacy Policy and Terms.

A second provider on the same verified email joins the account you already have.

OpenAPI Specification

claix-dev-openapi.yml Raw ↑
openapi: 3.0.3
info:
  title: Claix API
  description: >
    Claix es una API de conversión de datos tabulares, JSON y documentos
    (PDF, Word, texto plano, imágenes) pensada para integraciones server-to-server
    (backends, scripts, herramientas de automatización como n8n, Zapier o
    Make). Expone seis endpoints principales de conversión:

    - **Excel/CSV → JSON**: recibe un archivo Excel o CSV y lo transforma en
      JSON según la estructura definida en un "schema" previamente creado.
    - **JSON → Excel**: recibe uno o varios documentos JSON y devuelve un
      archivo Excel (.xlsx) binario, según la estructura definida en un
      "schema" previamente creado.
    - **PDF → JSON**: recibe un archivo PDF (de texto o escaneado) y devuelve
      un objeto JSON con los datos extraídos del documento, según la
      estructura definida en un "schema" previamente creado.
    - **Documento → JSON**: recibe un archivo de documento (.docx, .txt, .md
      o .rtf) y devuelve un objeto JSON con los datos extraídos, según la
      estructura definida en un "schema" previamente creado.
    - **Imagen → JSON**: recibe una imagen (.jpeg, .jpg, .png, .webp, .heic
      o .heif) y devuelve un objeto JSON con los datos extraídos del
      contenido visible, según la estructura definida en un "schema"
      previamente creado.
    - **Txt / HTML / XML → JSON**: recibe el campo `content` (texto plano,
      HTML o XML ya procesado, sin archivo) y devuelve un objeto JSON con los
      datos extraídos, según un schema de tipo txt-json. Máximo 300.000
      caracteres. Tarifa fija €0,10 por llamada exitosa tras el free tier.

    Además, expone endpoints para consultar y gestionar los schemas
    de la cuenta:

    - **Listar schemas**: dado un API key, devuelve todos los schemas de esa
      cuenta con su información completa (id, nombre, tipo y definición).
    - **Crear schema**: crea un schema con `name`, `type`, `schema_definition`
      y, opcionalmente, Modo Agente (`is_agent_mode`, `agent_definition`,
      `resumen_agent`).
    - **Borrar schema**: elimina un schema de la cuenta por `schema_id`.

    **Ventana de Contexto** — Tras una extracción con `window_context`
    activo, el `document_id` devuelto permite consultar el contenido bruto,
    preguntar al markdown persistido o eliminar el documento:

    - **GET https://claix.dev/get-document/{document_id}**: devuelve el
      contenido bruto y metadatos del documento (`content`, `file_name`,
      `schema_id`, `processed_at`). Llamada gratuita.
    - **POST https://claix.dev/document-context/{document_id}**: body
      `{ "questions": ["..."] }` (máximo 5 preguntas, 400 caracteres cada una).
      Respuesta `{ user_ask, ia_response }`.
    - **DELETE https://claix.dev/delete-document/{document_id}**: elimina el
      documento persistido por `document_id`. Sin body ni query params.
      Respuesta `{ document_id }`. Llamada gratuita.

    **Espacios de Conocimiento** — Los documentos persistidos se pueden agrupar
    en espacios (`space_id` opcional en los endpoints de extracción). Una vez
    agrupados, se puede preguntar al espacio completo en lugar de a un único
    documento:

    - **POST https://claix.dev/create-space**: body `{ "name": "..." }`.
      Crea un espacio y devuelve `{ success, space: { space_id, name,
      created_at } }`. Llamada gratuita.
    - **DELETE https://claix.dev/delete-space/{space_id}**: elimina el espacio.
      Sin body ni query params. Respuesta `{ space_id }`. Llamada gratuita.
    - **POST https://claix.dev/space-context/{space_id}**: body
      `{ "questions": ["..."] }` (máximo 5 preguntas, 400 caracteres cada una),
      exactamente igual que document-context. La diferencia es el alcance: la
      respuesta se construye cruzando el `markdown_content` de todos los
      documentos vigentes del espacio, no de uno solo.
      Respuesta `{ user_ask, ia_response }`.

    Los seis endpoints de conversión usan reconocimiento automático de sinónimos,
    abreviaturas, traducciones y variantes de nombre entre las
    columnas/claves/campos de entrada y las propiedades definidas en el
    schema correspondiente.

    **Modo Agente** — Cinco endpoints adicionales bajo `/agent/*-json` ejecutan
    la misma extracción estructurada que sus equivalentes `/api/*-json` y, a
    continuación, una fase de razonamiento semántico según `agent_definition`
    del schema. La respuesta HTTP 200 incluye los campos habituales de
    extracción más `agent_data` (objeto tipado con booleanos, enteros, strings
    u opciones cerradas). El schema debe tener `is_agent_mode` activado.
  version: "1.8.2"
servers:
  - url: https://claix.dev/api
    description: Producción (dominio público Claix)

security:
  - ApiKeyAuth: []
  - BearerAuth: []

tags:
  - name: Excel a JSON
    description: Conversión de archivos Excel/CSV a JSON estructurado
  - name: JSON a Excel
    description: Conversión de datos JSON a archivos Excel binarios
  - name: PDF a JSON
    description: Extracción de datos estructurados a partir de archivos PDF
  - name: Documento a JSON
    description: >
      Extracción de datos estructurados a partir de documentos de texto
      (.docx, .txt, .md, .rtf)
  - name: Imagen a JSON
    description: >
      Extracción de datos estructurados a partir de imágenes
      (.jpeg, .jpg, .png, .webp, .heic, .heif)
  - name: Texto a JSON
    description: >
      Extracción de datos estructurados a partir de texto plano, HTML o XML
      ya procesado (campo content, sin archivo)
  - name: Ventana de Contexto
    description: >
      Consulta de contenido bruto, preguntas o borrado de un documento persistido
      (markdown_content) identificado por document_id. URLs públicas: GET
      https://claix.dev/get-document/{document_id}; POST
      https://claix.dev/document-context/{document_id}; DELETE
      https://claix.dev/delete-document/{document_id}.
  - name: Espacios de Conocimiento
    description: >
      Creación y borrado de espacios de conocimiento, y preguntas cruzadas
      sobre todos los documentos vigentes agrupados en uno de ellos. El formato
      de entrada y salida de las preguntas es el mismo que en la ventana de
      contexto. URLs públicas: POST https://claix.dev/create-space; DELETE
      https://claix.dev/delete-space/{space_id}; POST
      https://claix.dev/space-context/{space_id}.
  - name: Schemas
    description: Consulta de los schemas creados en la cuenta


# --- truncated at 32 KB (89 KB total) ---
# Full source: https://raw.githubusercontent.com/api-evangelist/claix-dev/refs/heads/main/openapi/claix-dev-openapi.yml