Need help with your APIs? I offer API discovery, governance & evangelism services. Explore services →
API Evangelist API Evangelist
Discovery
Learnings
Guidance
Toolbox
Alignment
API Evangelist LLC

QuantCDN AI Inference API

Chat inference, embeddings, and image generation services

QuantCDN AI Inference API is one of 38 APIs that QuantCDN publishes on the APIs.io network, described by a machine-readable OpenAPI specification.

Tagged areas include AI Inference. The published artifact set on APIs.io includes an OpenAPI specification, API documentation, and a getting-started guide.

This API exposes 6 operations across 6 paths, and defines 54 schemas. It is described by OpenAPI 3.0.0, at version 4.15.8.

Requests are made against 2 base URLs: https://dashboard.quantcdn.io, https://dash.quantgov.cloud.

6 operations 6 paths 54 schemas 1 GET5 POST

Metadata

The identity and technical contract details declared by the specification.

Specification
OpenAPI 3.0.0
API Version
4.15.8
Base URL
https://dashboard.quantcdn.io
Authentication
HTTP Bearer
Resource Areas
1

Authentication & Security 1

QuantCDN AI Inference API declares 1 security scheme for authenticating requests. It accepts HTTP bearer tokens (JWT) (BearerAuth). By default, every request must be authenticated.

  • BearerAuth — Enter your Bearer token in the format: Bearer . Obtain your API token from the QuantCDN dashboard under Profile API Tokens.

Paths & Operations 6

Across 6 paths, the API surfaces 6 operations — 1 GET, 5 POST. Each is listed below with its method, path, parameters, and response codes.

AI Inference 6

Chat inference, embeddings, and image generation services

POST
/api/v3/organizations/{organisation}/ai/chat
Chat inference via API Gateway (buffered responses) with multimodal support
chatInference 1 param body → 200202500
POST
/api/v3/organizations/{organisation}/ai/chat/stream
Chat inference via streaming endpoint (true HTTP streaming) with multimodal support
chatInferenceStream 1 param body → 200202500
POST
/api/v3/organizations/{organisation}/ai/embeddings
Generate text embeddings for semantic search and RAG applications
embeddings 1 param body → 200400403500
POST
/api/v3/organizations/{organisation}/ai/image-generation
Generate images with Amazon Nova Canvas
imageGeneration 1 param body → 200400403500
GET
/api/v3/organizations/{organisation}/ai/chat/executions/{identifier}
Get Durable Execution Status
getDurableExecutionStatus 2 params → 200404403500
POST
/api/v3/organizations/{organisation}/ai/chat/callback
Submit Client Tool Results (Callback)
submitToolCallback 1 param body → 200400404403500

Schemas 54

The contract defines 54 schemas that model the data the API accepts and returns. The most detailed are chatInference_request (15 properties), chatInferenceStream_request (14 properties), imageGeneration_request (11 properties), getDurableExecutionStatus_200_response (8 properties). Each schema is shown below with its type and property counts.

chatInference_request_toolConfig
object
Function calling configuration (Claude 3+, Nova Pro)
3 properties
imageGeneration_request_colorGuidedGenerationParams
object
Parameters for COLORGUIDEDGENERATION task
4 properties
chatInference_200_response
object
5 properties
getDurableExecutionStatus_200_response_error
object
Present when status is failed
2 properties
embeddings_200_response_embeddings
Vector embeddings for the input text(s). Single array for string input, array of arrays for batch input.
imageGeneration_200_response
object
3 properties 1 required
imageGeneration_request_imageVariationParams
object
Parameters for IMAGEVARIATION task
4 properties
chatInferenceStream_request_messages_inner_content
chatInference_request_messages_inner
object
2 properties 2 required
chatInference_request_messages_inner_content_oneOf_inner
chatInference_request_messages_inner_content_oneOf_inner_oneOf_2_video
object
2 properties 2 required
chatInference_request_messages_inner_content_oneOf_inner_oneOf_3_document_source
object
1 property 1 required
chatInference_request_toolConfig_tools_inner_toolSpec
object
3 properties
chatInference_request_messages_inner_content_oneOf_inner_oneOf_2_video_source
object
1 property 1 required
getDurableExecutionStatus_200_response_result
object
Present when status is complete
3 properties
imageGeneration_request_textToImageParams
object
Parameters for TEXTIMAGE task
6 properties
imageGeneration_request
object
11 properties 1 required
chatInference_request_messages_inner_content_oneOf_inner_oneOf_1_image
object
2 properties 2 required
getDurableExecutionStatus_200_response_result_usage
object
Token usage and cost for the final synthesis turn
4 properties
getDurableExecutionStatus_200_response
object
8 properties
chatInference_request_messages_inner_content
chatInference_request_messages_inner_content_oneOf_inner_oneOf_3
object
1 property 1 required
chatInference_request_messages_inner_content_oneOf_inner_oneOf
object
1 property 1 required
chatInferenceStream_request
object
14 properties 2 required
imageGeneration_request_imageGenerationConfig
object
General image generation configuration
6 properties
embeddings_200_response_usage
object
2 properties 2 required
chatInference_request_guardrails
object
AWS Bedrock guardrails configuration for content filtering and safety.
3 properties
chatInference_request_toolConfig_tools_inner_toolSpec_inputSchema
object
1 property
embeddings_200_response
object
4 properties 4 required
chatInference_request_messages_inner_content_oneOf_inner_oneOf_1_image_source
object
1 property 1 required
embeddings_request
object
4 properties 1 required
chatInference_request
object
15 properties 2 required
chatInference_200_response_response_toolUse
Tool use request(s). Can be a single object or array of objects. Only present when AI requests tools.
chatInference_202_response
object
5 properties 3 required
submitToolCallback_request
object
2 properties 2 required
chatInference_request_messages_inner_content_oneOf_inner_oneOf_3_document
object
3 properties 3 required
chatInference_200_response_response_toolUse_oneOf
object
Single tool request
6 properties
chatInference_200_response_response_toolUse_oneOf_1_inner
object
6 properties
chatInference_request_responseFormat
object
Structured JSON output (Claude 3.5 Sonnet v1/v2, Nova Pro)
2 properties
imageGeneration_request_inPaintingParams
object
Parameters for INPAINTING task
5 properties
chatInference_200_response_usage
object
Token usage and cost for this inference call
4 properties
chatInference_request_toolConfig_tools_inner
object
1 property
getDurableExecutionStatus_200_response_result_response
object
2 properties
chatInference_request_messages_inner_content_oneOf_inner_oneOf_1
object
1 property 1 required
imageGeneration_request_backgroundRemovalParams
object
Parameters for BACKGROUNDREMOVAL task
1 property
imageGeneration_request_outPaintingParams
object
Parameters for OUTPAINTING task
6 properties
chatInference_200_response_response
object
Assistant's response message. May contain text content and/or tool use requests.
3 properties
chatInferenceStream_request_messages_inner
object
2 properties 2 required
submitToolCallback_request_toolResults_inner
object
2 properties 2 required
embeddings_request_input
Single text string or array of text strings to embed
chatInference_request_messages_inner_content_oneOf_inner_oneOf_2
object
1 property 1 required
chatInference_200_response_response_toolUse_oneOf_result
object
Tool execution result (only present when status='complete' for sync auto-executed tools). For async tools, poll /tools/executions/{executionId}
2 properties
submitToolCallback_200_response
object
3 properties
getDurableExecutionStatus_200_response_pendingTools_inner
object
3 properties

Specification

The full machine-readable OpenAPI contract behind this narrative.

Source

quantcdn-ai-inference-api-openapi.yml Raw ↑

Other APIs QuantCDN publishes across the network.

QuantCDN AI Agents API
QuantCDN AI Custom Tools API
QuantCDN AI File Storage API
QuantCDN AI Filter Policies API
QuantCDN AI Governance API
QuantCDN AI Models API
QuantCDN AI Monitoring API
QuantCDN AI Orchestrations API
QuantCDN AI Sessions API
QuantCDN AI Skills API
QuantCDN AI Slack Bots API
QuantCDN AI Task Management API