Documentação da API
Uma única API compatível com OpenAI para acessar modelos de texto, código, imagem, vídeo, áudio e transcrição — de provedores diretos e de mídia. Pague só pelo uso, com créditos pré-pagos.
1. Base URL e autenticação
Base URL: https://apexglobalai.com/v1
Autenticação: envie a chave no header Authorization: Bearer sk-apex-.... Crie sua chave em Minha conta. Essa chave é a única credencial — ela identifica sua conta, seu saldo e seu histórico de uso.
Formato do ID de modelo: provedor/modelo. Ex.: deepseek/deepseek-v4-flash, minimax/MiniMax-M3, anthropic/claude-opus-4.5, fal-ai/flux/dev, fal-ai/kling-video/v1.
2. Instalação e primeiro acesso
Você não precisa instalar nada no seu servidor — a Apex Cloud é 100% hospedada. Você só troca a URL e a chave no seu SDK/cliente existente.
Python (SDK oficial da OpenAI):
from openai import OpenAI
client = OpenAI(api_key="sk-apex-...", base_url="https://apexglobalai.com/v1")
resp = client.chat.completions.create(
model="deepseek/deepseek-v4-flash",
messages=[{"role":"user","content":"Olá!"}],
)
Node.js:
import OpenAI from 'openai';
const client = new OpenAI({ apiKey: 'sk-apex-...', baseURL: 'https://apexglobalai.com/v1' });
const r = await client.chat.completions.create({
model: 'deepseek/deepseek-v4-flash',
messages: [{ role: 'user', content: 'Olá!' }]
});
3. Listar modelos
GET /v1/models retorna o catálogo completo com IDs, nomes e preços por 1M tokens (chat) ou por geração (mídia).
-H "Authorization: Bearer sk-apex-..."
Cada modelo tem id, name e pricing (prompt/completion para chat, per_generation para mídia).
4. Chat (OpenAI-compatível)
POST /v1/chat/completions segue exatamente o formato da API da OpenAI. Suporta stream, max_tokens, temperature, messages com papéis system/user/assistant/tool.
-H "Authorization: Bearer sk-apex-..." \
-H "Content-Type: application/json" \
-d '{"model":"deepseek/deepseek-v4-flash","messages":[{"role":"user","content":"Oi!"}]}'
Streaming (resposta em tempo real):
-H "Authorization: Bearer sk-apex-..." \
-H "Content-Type: application/json" \
-d '{"model":"deepseek/deepseek-v4-flash","stream":true,"stream_options":{"include_usage":true},"messages":[{"role":"user","content":"Oi!"}]}'
O streaming retorna eventos SSE (data: {...}) e encerra com data: [DONE]. Com include_usage: true, um chunk final traz o consumo real de tokens.
5. Roteamento entre provedores (fallback e prioridade)
Por padrão, DeepSeek e MiniMax são tentados primeiro (melhor custo). Você pode controlar o roteamento no corpo da requisição com provider e models:
"only":["deepseek","minimax"],
"order":["deepseek"],
"sort":"price",
"max_price":0.01,
"allow_fallbacks":true
},
"messages":[{"role":"user","content":"Oi!"}]}'
only restringe os provedores · ignore exclui · order define a sequência · sort: "price"|"throughput"|"latency" ordena a cadeia · max_price corta acima do teto. E models: [...] (array) cria fallback entre modelos inteiros: tenta o primeiro, se falhar vai para o segundo.
6. Imagens, vídeo, voz e transcrição
POST /v1/images/generations gera mídia (imagem, vídeo, voz) via FAL, Replicate, ElevenLabs, Ideogram, Black Forest Labs e MiniMax H3. Preço por geração.
-H "Authorization: Bearer sk-apex-..." \
-H "Content-Type: application/json" \
-d '{"model":"fal-ai/flux/dev","prompt":"um castelo medieval ao pôr do sol","n":1}'
A resposta retorna a(s) URL(s) do resultado. Para vídeos longos, a geração é assíncrona: você recebe um task_id e consulta o progresso em GET /v1/video/status/<task_id> (ou cancela com PUT /v1/video/cancel/<task_id>).
7. Preço, créditos e recarga
Recarga pré-paga a partir de $2 via Stripe (cartão, PayPal ou Google Pay). Cada chamada debita o custo real do modelo; o preço de venda é transparente no catálogo.
No horário de pico (APEX_CLOUD_PEAK_HOURS) o preço fica no valor mínimo — máxima economia.
O saldo e o histórico por chave aparecem em tempo real no painel Minha conta.
8. Erros comuns
401 — chave inválida ou ausente · 402 — saldo insuficiente (recarregue) · 404 — modelo não encontrado · 429 — limite de taxa (aguarde e tente novamente) · 500/502 — erro do provedor (o gateway tenta outro automaticamente).
9. Compatibilidade
Funciona com qualquer cliente que fale /v1/chat/completions: SDK oficial da OpenAI (Python/Node), LangChain, LlamaIndex, Vercel AI SDK, OpenWebUI, LiteLLM, Cursor e outros. Basta trocar o base_url.
10. Exemplo completo (Python com streaming)
import json
client = OpenAI(api_key="sk-apex-...", base_url="https://apexglobalai.com/v1")
stream = client.chat.completions.create(
model="miniMAX/MiniMax-M3",
messages=[{"role":"user","content":"Escreva um haiku."}],
stream=True,
)
for chunk in stream:
if chunk.choices:
print(chunk.choices[0].delta.content or "", end="")
Alternativas de implementação: langchain (set openai_api_base), vercel-ai-sdk (set baseURL), open-webui (adicionar conexão OpenAI com a URL da Apex).
