FlexAI · Pricing Plans

Flexai Plans

FlexAI is usage-priced. Token Factory (serverless) is billed per model by usage (per million tokens for text/vision, per image, per generated video, per minute of audio, per million characters for TTS). Dedicated endpoints are priced per GPU-hour metered per second. New accounts receive $10 free credit; request rate limits are tiered free (10 rpm) vs. paid (100 rpm).

Flexai Plans is the machine-readable pricing-plan profile for FlexAI on the APIs.io network, conforming to the API Commons Plans specification.

It defines 3 plans, covering usage-based and custom tiers, with named plans including Token Factory (Serverless), Dedicated Endpoints, AI Factory (Private Cloud).

Tagged areas include Inference, Usage Based, and GPU Compute.

3 Plans API Commons Plans
View Source
InferenceUsage BasedGPU Compute

Plans

Token Factory (Serverless) usage-based

Pay-per-use serverless inference across open models, priced per model.

Text / chat / reasoning input (tokens · usage) per-model (per million input tokens) USD
Text / chat / reasoning output (tokens · usage) per-model (per million output tokens) USD
Embeddings (tokens · usage) per-model (per million input tokens) USD
Image generation (image · usage) per image USD
Video generation (video · usage) per generated video USD
Speech-to-text (minute · usage) per minute USD
Text-to-speech (character · usage) per million characters USD
Dedicated Endpoints usage-based

Reserved GPU throughput for your models and fine-tunes, priced per GPU-hour metered per second.

Dedicated GPU (gpu_hour · usage) per GPU-hour (metered per second) USD
AI Factory (Private Cloud) custom

FlexAI platform on your own hardware — VPC, on-prem, or air-gapped. Custom pricing; contact sales.

Custom private-cloud tier (contract · usage) contact sales USD