Apex AI

API de IA com melhor custo e faturamento automático

Tenha os melhores modelos do mundo (ApexAI 2.0 Engine / Claude / OpenAI / DeepSeek / Gemini / Image Gen) em um único painel em reais, com +2.000 agentes e skills profissionais prontos para uso, sem pagar em dólar e sem complexidade técnica.

24 modelos Apex Global AI
DeepSeek · MiniMax · MiniMax H3 · Apex Engine (GGUF) — hospedados por nós
214
modelos na API
14
provedores conectados
BRL
planos em Reais
+2.000
skills & agentes
/v1
OpenAI-compatível
Stripe
pagamento seguro
Ancoragem de Custo & Substituição de Ferramentas

Tudo em um único painel por uma fração do custo

Para ter acesso a IA de ponta hoje, você paga assinaturas isoladas em dólar com IOF e spread bancário. Selecione as ferramentas que você ou sua equipe assinam atualmente:

Seu gasto atual com assinaturas isoladas:
R$ 455,00/mês
R$ 5.460,00 por ano
No Apex Cloud Pro (Executivo):
R$ 99,00/mês*
Sua economia: R$ 4.272,00 / ano
Planos e Precificação

Escolha o plano ideal para sua operação

Tenha os melhores modelos do mundo em um único painel em reais, com +2.000 agentes e skills profissionais prontos para uso, sem pagar em dólar e sem complexidade técnica.

Faturamento:
Apex Cloud Starter
Chat unificado multi-modelo, agentes de produtividade básica, redação, pesquisa rápida e templates prontos.
R$ 49 /mês (R$ 597/ano)
  • Chat unificado multi-modelo
  • Agentes de produtividade básica
  • Pesquisa rápida e redação de conteúdo
  • Cota mensal de US$ 8.00 em créditos incluída
  • Acesso à API /v1 OpenAI-compatível
Assinar Starter
Enterprise & Business
Agentes verticais de alta precisão (Jurídico, Contábil, Fiscal, SINAPI/Engenharia), análise de documentos pesados e múltiplos assentos.
R$ 297 /mês (R$ 3.564/ano)
  • Agentes verticais executáveis (Engenharia/SINAPI, Jurídico, Contábil)
  • Análise de PDFs, contratos e relatórios pesados
  • Até 5 assentos para equipe incluídos
  • Cota máxima de alta performance (US$ 60.00)
  • Suporte prioritário com Agente IA & Auto-Fix contínuo
💳 Faturamento Transparente em Reais (BRL) · Sem Dólar · Sem IOF
Ambiente Seguro PCI-DSS Stripe
Assinaturas Recorrentes (Planos):

Processadas com cobrança recorrente automática via Cartão de Crédito ou Débito Nacional (Visa, Mastercard, Elo, Hipercard). Cancele quando quiser com 1 clique.

Recargas Avulsas via Pix:

Prefere pagar com Pix Instantâneo? Crie sua conta grátis e recarregue créditos a partir de R$ 20 via QR Code no painel, sem assinar plano!

Empresas & Conformidade:

Faturamento com emissão de Nota Fiscal automática para dedução como despesa operacional de TI e Engenharia.

O modelo que você quer usar já está aqui?

Digite o nome (ex.: gpt, claude, deepseek, flux, whisper, wan, veo) e confira se está disponível na API — com preço transparente por uso.

Inteligência Vertical & Algoritmos Proprietários

+2.000 Agentes e Skills Verticais Prontos para Execução

Diferente de prompts genéricos de internet, nossos agentes são pacotes de raciocínio profundo treinados para as verticais mais exigentes do mercado. Eles operam em ambiente protegido no servidor da Apex, prontos para uso via API /v1 ou no nosso Playground.

🔒
Proteção de Propriedade Intelectual & Cloud Inference: Todos os agentes, heurísticas e instruções-mestre operam em ambiente seguro na nuvem Apex (Zero Exposure). Não há disponibilização para download ou extração de código-fonte sem licença corporativa específica — você consome as análises e entregáveis com precisão milimétrica via API ou Painel Web sem vazamento de ativos. (Licença On-Premise sob consulta).
🏗️

Engenharia Civil & Obras (SINAPI / TCPO)

Orçamentos paramétricos e analíticos, Diário de Obras (RDO), auditoria de composições, compatibilização técnica e cronograma físico-financeiro.

Cloud Inference Conhecer →
⚖️

Jurídico, Contratos & Compliance

Análise minuciosa de minutas contratuais, compliance imobiliário, identificação de cláusulas abusivas e redação de pareceres fundamentados.

Cloud Inference Conhecer →
📊

Contábil, Fiscal & Financeiro (CRC)

Conciliação contábil automatizada, apuração tributária (Simples Nacional, Presumido, Real), DRE gerencial e governança de custos.

Cloud Inference Conhecer →
🎯

Marketing, VSLs & Infoprodutos

Roteiros de VSL de alta conversão, copys magnéticas para páginas de vendas, funis para infoprodutos (incluindo eBook Seu Imóvel sem Arrependimento) e criativos.

Cloud Inference Conhecer →
💻

Arquitetura de Software & Fullstack

Análise estática implacável, design de APIs RESTful, refatoração de código legado e testes unitários/integrados automatizados.

Cloud Inference Conhecer →
Explorar Biblioteca de Agentes & Skills →
Infraestrutura Multi-Provedor Global

19 provedores diretos conectados — O Poder dos Maiores Laboratórios de IA

Acesso unificado a 19 provedores conectados com alta disponibilidade, failover automático e faturamento consolidado em Reais (BRL).

🎬

Vídeo Cinematográfico

Geração de vídeo de alta definição a partir de texto e imagens com renderização física hiper-realista:

  • • Alibaba Wan 2.1 (14B T2V & I2V 720p)
  • • Google Veo 2 (60fps cinematográfico)
  • • MiniMax Hailuo / H3 (Física fluida)
  • • Kling & LTX Video (Ultra-rápido)
POST /v1/images/generations
🎨

Imagem & Arte Fotorrealista

Controle apurado de iluminação, texturas, tipografia nítida e proporções milimétricas:

  • • FLUX.1 Pro / Dev (Black Forest Labs)
  • • Google Imagen 3 (Fast & High-Res)
  • • OpenAI DALL-E 3 & Midjourney API
  • • Recraft V3 & Ideogram (Tipografia e Vetor)
FAL.ai · Replicate · Direct
🧠

Raciocínio & LLMs de Fronteira

Modelos de raciocínio profundo, programação sênior e análise multimodal com janelas massivas:

  • • OpenAI GPT-4o & GPT-4o-mini
  • • Anthropic Claude 3.5 Sonnet / 3.7
  • • DeepSeek V3 & R1 (671B MoE)
  • • Google Gemini 2.0 Flash / Pro (2M ctx)
POST /v1/chat/completions
🎙️

Voz Humana & Áudio Studio

Clonagem vocal, narrações expressivas emocionais e transcrição com precisão cirúrgica:

  • • ElevenLabs Multilingual V2
  • • ElevenLabs Voice Isolator & SFX
  • • MiniMax Speech 01 & Music 01
  • • OpenAI Whisper-1 HD (Timestamps)
Áudio & Transcrição
Catálogo Unificado & Multi-Provedor Apex Cloud

Catálogo de modelos — 14 Provedores Conectados (214 Modelos)

Cada provedor conectado com a sua própria infraestrutura e preço independente. Modelos separados por categorias com suporte a BYOK ($0 taxa de revenda).

Ir para o Playground ⚡
💡
Transparência Total de Preços: Todos os preços de modelos de Texto, Conversação e Código são cotados em Dólares por 1M (1 Milhão) de tokens de contexto (padrão mundial da indústria de inteligência artificial). Modelos de mídia (imagens, vídeos e clonagem vocal) têm valores cobrados por geração individual.
Filtrar por Provedor Conectado:

214 modelo(s) disponível(is)

💬 Texto, Código & Conversação

124 modelos disponíveis

Modelos de ponta para conversação, raciocínio lógico, programação e agentes.

🔷 DeepSeek
6 modelos
🔷
DeepSeek R1 (deepseek-reasoner)
deepseek/deepseek-reasoner
Preço (por 1M tokens)$1.200 in / $4.500 out /1M
Latência1.8 s
T⚙️🧠
65k ctx
🔷
DeepSeek V3 (deepseek-chat)
deepseek/deepseek-chat
Preço (por 1M tokens)$0.500 in / $1.000 out /1M
Latência0.8 s
T⚙️
65k ctx
🔷
DeepSeek V4 Flash Vision ⚡ Fast
deepseek/deepseek-v4-flash-vision-exp
Preço (por 1M tokens)$0.300 in / $0.900 out /1M
Latência0.5 s
T👁️⚙️
131k ctx
🔷
+3 modelos DeepSeek

Prontos na API /v1.

Ver catálogo ↗
🟢 OpenAI
41 modelos
🟢
gpt-3.5-turbo
openai/gpt-3.5-turbo
Preço (por 1M tokens)$3.000 in / $12.000 out /1M
Latência—
T
🟢
gpt-4
openai/gpt-4
Preço (por 1M tokens)$3.000 in / $12.000 out /1M
Latência—
T
🟢
gpt-4-turbo
openai/gpt-4-turbo
Preço (por 1M tokens)$3.000 in / $12.000 out /1M
Latência—
T
🟢
+38 modelos OpenAI

Prontos na API /v1.

Ver catálogo ↗
🟠 Anthropic
16 modelos
🟠
Anthropic Claude 3.5 Haiku
anthropic/claude-3-5-haiku-20241022
Preço (por 1M tokens)$1.000 in / $5.000 out /1M
Latência0.6 s
T👁️⚙️
200k ctx
🟠
Anthropic Claude 3.5 Sonnet v2
anthropic/claude-3-5-sonnet-20241022
Preço (por 1M tokens)$3.500 in / $18.000 out /1M
Latência1.5 s
T👁️⚙️
200k ctx
🟠
Anthropic Claude 3.7 Sonnet (Hybrid)
anthropic/claude-3-7-sonnet-20250219
Preço (por 1M tokens)$3.500 in / $18.000 out /1M
Latência1.8 s
T👁️⚙️🧠
200k ctx
🟠
+13 modelos Anthropic

Prontos na API /v1.

Ver catálogo ↗
🔵 Google Gemini
4 modelos
🔵
Google Gemini 2.0 Flash Realtime (áudio e voz) Free25% off
gemini/gemini-2.0-flash-realtime
Preço (por 1M tokens)GRÁTIS / BYOK
Latência2.0 s
T⚙️🎤
🔵
Google Gemini 2.5 Pro 25% off
gemini/gemini-2.5-pro
Preço (por 1M tokens)$1.600 in / $6.500 out /1M
Latência1.5 s
T👁️⚙️🧠+1
2097k ctx
🔵
Google Gemini 3.5 Transcribe Free25% off
gemini/gemini-3.5-transcribe
Preço (por 1M tokens)GRÁTIS / BYOK
Latência0.8 s
T🎤
524k ctx
🔵
+1 modelos Google Gemini

Prontos na API /v1.

Ver catálogo ↗
⚡ Groq
14 modelos
⚡
ALLaM-2-7b Free
groq/allam-2-7b
Preço (por 1M tokens)GRÁTIS / BYOK
Latência—
T
⚡
Canopy Labs Orpheus Arabic Saudi Free
groq/canopylabs/orpheus-arabic-saudi
Preço (por 1M tokens)GRÁTIS / BYOK
Latência—
T
⚡
Canopy Labs Orpheus V1 English Free
groq/canopylabs/orpheus-v1-english
Preço (por 1M tokens)GRÁTIS / BYOK
Latência—
T
⚡
+11 modelos Groq

Prontos na API /v1.

Ver catálogo ↗
🔴 MiniMax
8 modelos
🔴
MiniMax M2 ⚡ Fast
minimax/MiniMax-M2
Preço (por 1M tokens)$0.080 in / $0.250 out /1M
Latência0.4 s
T⚙️
128k ctx
🔴
MiniMax M2.1 ⚡ Fast
minimax/MiniMax-M2.1
Preço (por 1M tokens)$0.090 in / $0.300 out /1M
Latência0.4 s
T⚙️
128k ctx
🔴
MiniMax M2.5 (direto) ⚡ Fast
minimax/MiniMax-M2.5
Preço (por 1M tokens)$0.110 in / $0.400 out /1M
Latência0.5 s
T⚙️
250k ctx
🔴
+5 modelos MiniMax

Prontos na API /v1.

Ver catálogo ↗
👑 Apex Engine
3 modelos
👑
Apex AI (GGUF) · nosso modelo ⚡ Fast
apexengine/Apex-AI
Preço (por 1M tokens)$0.100 in / $0.300 out /1M
Latência0.4 s
T⚙️
32k ctx
👑
Apex Architecture (GGUF)
apexengine/Apex-Architecture-GGUF
Preço (por 1M tokens)$0.150 in / $0.450 out /1M
Latência0.6 s
T⚙️
32k ctx
👑
Qwen 2.5 Omni (GGUF) ⚡ Fast
apexengine/Qwen2.5-Omni
Preço (por 1M tokens)$0.120 in / $0.360 out /1M
Latência0.5 s
T👁️🎤
32k ctx
🌐 OpenRouter
30 modelos
🌐
OpenRouter — Anthropic: Claude Opus 5.5
openrouter/anthropic/claude-opus-5.5
Preço (por 1M tokens)$4.800 in / $24.000 out /1M
Latência0.8 s
T👁️⚙️
1000k ctx
🌐
OpenRouter — Anthropic: Claude Opus 5.5 (batch)
openrouter/anthropic/claude-opus-5.5:batch
Preço (por 1M tokens)$2.400 in / $12.000 out /1M
Latência0.8 s
T👁️⚙️
1000k ctx
🌐
OpenRouter — Cohere: Command R+ (08-2024)
openrouter/cohere/command-r-plus-08-2024
Preço (por 1M tokens)$3.000 in / $12.000 out /1M
Latência0.8 s
T⚙️
128k ctx
🌐
+27 modelos OpenRouter

Prontos na API /v1.

Ver catálogo ↗
🤝 Pollinations (Parceiro)
2 modelos
🤝
Pollinations AI (Rede Comunitária) — openai-fast ⚡ FastFree🤝 Parceiro
pollinations/openai-fast
Preço (por 1M tokens)GRÁTIS / BYOK
Latência0.5 s
T⚙️
🤝
Pollinations Open Text (Público) Free🤝 Parceiro
pollinations/openai
Preço (por 1M tokens)GRÁTIS / BYOK
Latência1.2 s
T⚙️
128k ctx

👁️ Visão & Multimodal

38 modelos disponíveis

Interpretação e extração de dados de fotos, diagramas, plantas e documentos visuais.

🔷 DeepSeek
2 modelos
🔷
DeepSeek V4 Flash Vision ⚡ Fast
deepseek/deepseek-v4-flash-vision-exp
Preço (por 1M tokens)$0.300 in / $0.900 out /1M
Latência0.5 s
T👁️⚙️
131k ctx
🔷
DeepSeek V4.1 Flash (Preview) ⚡ Fast
deepseek/deepseek-v4-flash
Preço (por 1M tokens)$0.200 in / $0.700 out /1M
Latência0.3 s
T👁️⚙️
131k ctx
🟢 OpenAI
6 modelos
🟢
OpenAI GPT-4.1 Mini ⚡ Fast
openai/gpt-4.1-mini
Preço (por 1M tokens)$0.500 in / $2.000 out /1M
Latência0.4 s
T👁️⚙️
128k ctx
🟢
OpenAI GPT-4o
openai/gpt-4o
Preço (por 1M tokens)$3.000 in / $12.000 out /1M
Latência1.2 s
T👁️⚙️
128k ctx
🟢
OpenAI GPT-4o Mini ⚡ Fast
openai/gpt-4o-mini
Preço (por 1M tokens)$0.200 in / $0.800 out /1M
Latência0.5 s
T👁️⚙️
128k ctx
🟢
+3 modelos OpenAI

Prontos na API /v1.

Ver catálogo ↗
🟠 Anthropic
4 modelos
🟠
Anthropic Claude 3.5 Haiku
anthropic/claude-3-5-haiku-20241022
Preço (por 1M tokens)$1.000 in / $5.000 out /1M
Latência0.6 s
T👁️⚙️
200k ctx
🟠
Anthropic Claude 3.5 Sonnet v2
anthropic/claude-3-5-sonnet-20241022
Preço (por 1M tokens)$3.500 in / $18.000 out /1M
Latência1.5 s
T👁️⚙️
200k ctx
🟠
Anthropic Claude 3.7 Sonnet (Hybrid)
anthropic/claude-3-7-sonnet-20250219
Preço (por 1M tokens)$3.500 in / $18.000 out /1M
Latência1.8 s
T👁️⚙️🧠
200k ctx
🟠
+1 modelos Anthropic

Prontos na API /v1.

Ver catálogo ↗
🔵 Google Gemini
2 modelos
🔵
Google Gemini 2.5 Pro 25% off
gemini/gemini-2.5-pro
Preço (por 1M tokens)$1.600 in / $6.500 out /1M
Latência1.5 s
T👁️⚙️🧠+1
2097k ctx
🔵
Google Gemini 3.6 Flash Free25% off
gemini/gemini-3.6-flash
Preço (por 1M tokens)GRÁTIS / BYOK
Latência0.6 s
T👁️⚙️🎤
1048k ctx
👑 Apex Engine
1 modelos
👑
Qwen 2.5 Omni (GGUF) ⚡ Fast
apexengine/Qwen2.5-Omni
Preço (por 1M tokens)$0.120 in / $0.360 out /1M
Latência0.5 s
T👁️🎤
32k ctx
🌐 OpenRouter
23 modelos
🌐
OpenRouter — Anthropic: Claude Opus 5.5
openrouter/anthropic/claude-opus-5.5
Preço (por 1M tokens)$4.800 in / $24.000 out /1M
Latência0.8 s
T👁️⚙️
1000k ctx
🌐
OpenRouter — Anthropic: Claude Opus 5.5 (batch)
openrouter/anthropic/claude-opus-5.5:batch
Preço (por 1M tokens)$2.400 in / $12.000 out /1M
Latência0.8 s
T👁️⚙️
1000k ctx
🌐
OpenRouter — DeepSeek: DeepSeek Flash Latest
openrouter/~deepseek/deepseek-flash-latest
Preço (por 1M tokens)$0.042 in / $0.348 out /1M
Latência0.8 s
T👁️⚙️
1048k ctx
🌐
+20 modelos OpenRouter

Prontos na API /v1.

Ver catálogo ↗

🎨 Imagem & Design

47 modelos disponíveis

Geração fotorrealista, edição profissional, design e arte digital.

🟢 OpenAI
1 modelos
🟢
OpenAI DALL-E 3 (imagem HD)
openai/dall-e-3
Preço (por 1M tokens)$0.048 /img
Latência2.0 s
🔵 Google Gemini
2 modelos
🔵
Google Imagen 3 (imagem Ultra HD) 25% off
gemini/imagen-3.0-generate-002
Preço (por 1M tokens)$0.036 /img
Latência2.0 s
🔵
Google Imagen 3 Fast (imagem rápida) ⚡ Fast25% off
gemini/imagen-3.0-fast-generate-001
Preço (por 1M tokens)$0.018 /img
Latência2.0 s
🟣 fal.ai
21 modelos
🟣
FAL AI — Chatterbox TTS Multilingual (voz)
fal-ai/chatterbox
Preço (por 1M tokens)$0.024 /img
Latência2.0 s
🟣
FAL AI — DreamShaper (imagem)
fal-ai/dreamshaper
Preço (por 1M tokens)$0.018 /img
Latência2.0 s
🟣
FAL AI — Fast SDXL (imagem) ⚡ Fast
fal-ai/fast-sdxl
Preço (por 1M tokens)$0.002 /img
Latência2.0 s
🟣
+18 modelos fal.ai

Prontos na API /v1.

Ver catálogo ↗
🔘 Replicate
22 modelos
🔘
MiniMax Hailuo 02 (vídeo)
minimax/hailuo-02
Preço (por 1M tokens)$0.480 /img
Latência2.0 s
🔘
Replicate — Bria RMBG (remoção de fundo)
bria/rmbg-1.4
Preço (por 1M tokens)$0.006 /img
Latência2.0 s
🔘
Replicate — CodeFormer (restauração facial)
sczhou/codeformer
Preço (por 1M tokens)$0.018 /img
Latência2.0 s
🔘
+19 modelos Replicate

Prontos na API /v1.

Ver catálogo ↗
🤝 Pollinations (Parceiro)
1 modelos
🤝
Pollinations Flux Fast (Público) Free🤝 Parceiro
pollinations/flux
Preço (por 1M tokens)GRÁTIS / BYOK
Latência1.8 s

▶️ Vídeo & Animação

32 modelos disponíveis

Criação de vídeos cinematográficos a partir de texto e imagens.

🔵 Google Gemini
1 modelos
🔵
Google Veo 2 (vídeo cinematográfico HD) 25% off
gemini/veo-2.0-generate-001
Preço (por 1M tokens)$0.600 /sec
Latência2.0 s
▶️
🎬 MiniMax H3 (vídeo)
5 modelos
🎬
MiniMax H3 (vídeo 768P)
minimaxh3/MiniMax-H3
Preço (por 1M tokens)$0.450 /sec
Latência3.5 s
▶️
🎬
MiniMax H3 2K (vídeo)
minimaxh3/MiniMax-H3-2K
Preço (por 1M tokens)$0.780 /sec
Latência5.0 s
▶️
🎬
MiniMax H3 Max (vídeo ultra)
minimaxh3/minimax-h3-max
Preço (por 1M tokens)$0.550 /sec
Latência4.0 s
▶️
🎬
+2 modelos MiniMax H3 (vídeo)

Prontos na API /v1.

Ver catálogo ↗
🟣 fal.ai
14 modelos
🟣
FAL AI — Google Veo 2 (vídeo)
fal-ai/veo2
Preço (por 1M tokens)$0.720 /sec
Latência4.0 s
▶️
🟣
FAL AI — Hailuo Video (vídeo)
fal-ai/hailuo/video
Preço (por 1M tokens)$0.420 /sec
Latência4.0 s
▶️
🟣
FAL AI — Kling V1 (vídeo)
fal-ai/kling-video/v1
Preço (por 1M tokens)$0.600 /sec
Latência4.0 s
▶️
🟣
+11 modelos fal.ai

Prontos na API /v1.

Ver catálogo ↗
🔘 Replicate
11 modelos
🔘
MiniMax Hailuo 02 (vídeo)
minimax/hailuo-02
Preço (por 1M tokens)$0.480 /img
Latência2.0 s
🔘
MiniMax video-01 (clone humano / Hailuo)
minimax/video-01
Preço (por 1M tokens)$0.540 /sec
Latência3.0 s
▶️
🔘
Replicate — CogVideoX 5B (vídeo)
lucataco/cogvideox-5b
Preço (por 1M tokens)$0.300 /sec
Latência3.0 s
▶️
🔘
+8 modelos Replicate

Prontos na API /v1.

Ver catálogo ↗
🎥 Sora
1 modelos
🎥
OpenAI Sora 2.0 (vídeo)
sora/sora-2.0
Preço (por 1M tokens)$0.480 /sec
Latência4.5 s
▶️

🎤 Áudio, Voz & Transcrição

25 modelos disponíveis

Clonagem de voz, text-to-speech ultrarrealista e transcrição Whisper.

🟢 OpenAI
6 modelos
🟢
gpt-4o-mini-tts
openai/gpt-4o-mini-tts
Preço (por 1M tokens)$0.180 in / $0.720 out /1M
Latência—
T
🟢
gpt-4o-mini-tts-2025-03-20
openai/gpt-4o-mini-tts-2025-03-20
Preço (por 1M tokens)$0.180 in / $0.720 out /1M
Latência—
T
🟢
gpt-4o-mini-tts-2025-12-15
openai/gpt-4o-mini-tts-2025-12-15
Preço (por 1M tokens)$0.180 in / $0.720 out /1M
Latência—
T
🟢
+3 modelos OpenAI

Prontos na API /v1.

Ver catálogo ↗
🔵 Google Gemini
4 modelos
🔵
Google Gemini 2.0 Flash Realtime (áudio e voz) Free25% off
gemini/gemini-2.0-flash-realtime
Preço (por 1M tokens)GRÁTIS / BYOK
Latência2.0 s
T⚙️🎤
🔵
Google Gemini 2.5 Pro 25% off
gemini/gemini-2.5-pro
Preço (por 1M tokens)$1.600 in / $6.500 out /1M
Latência1.5 s
T👁️⚙️🧠+1
2097k ctx
🔵
Google Gemini 3.5 Transcribe Free25% off
gemini/gemini-3.5-transcribe
Preço (por 1M tokens)GRÁTIS / BYOK
Latência0.8 s
T🎤
524k ctx
🔵
+1 modelos Google Gemini

Prontos na API /v1.

Ver catálogo ↗
⚡ Groq
2 modelos
⚡
Whisper Large V3 Turbo Free
groq/whisper-large-v3-turbo
Preço (por 1M tokens)GRÁTIS / BYOK
Latência—
T
⚡
Groq Whisper Large V3 (ultra-rápido) ⚡ Fast
groq/whisper-large-v3
Preço (por 1M tokens)$0.004 /img
Latência0.5 s
🎤
🔴 MiniMax
2 modelos
🔴
MiniMax Music 01 (geração musical completa)
minimax/music-01
Preço (por 1M tokens)$0.042 /img
Latência1.5 s
🎤
🔴
MiniMax Speech 01 (voz e áudio)
minimax/speech-01
Preço (por 1M tokens)$0.024 /img
Latência1.5 s
🎤
🟣 fal.ai
5 modelos
🟣
FAL AI — ElevenLabs Speech (voz)
fal-ai/elevenlabs/speech
Preço (por 1M tokens)$0.078 /img
Latência1.0 s
🎤
🟣
FAL AI — ElevenLabs TTS (voz)
fal-ai/elevenlabs/tts
Preço (por 1M tokens)$0.072 /img
Latência1.0 s
🎤
🟣
FAL AI — F5-TTS Voice Clone (voz/áudio)
fal-ai/f5-tts
Preço (por 1M tokens)$0.018 /img
Latência1.0 s
🎤
🟣
+2 modelos fal.ai

Prontos na API /v1.

Ver catálogo ↗
🔘 Replicate
1 modelos
🔘
Replicate — Whisper Fast (transcrição) ⚡ Fast
vaibhavs10/incredibly-fast-whisper
Preço (por 1M tokens)$0.006 /img
Latência2.0 s
🔊 ElevenLabs
4 modelos
🔊
ElevenLabs Eleven v3 (voz)
elevenlabs/eleven-v3
Preço (por 1M tokens)$0.078 /img
Latência1.0 s
🎤
🔊
ElevenLabs Multilingual v2 (voz)
elevenlabs/eleven-multilingual-v2
Preço (por 1M tokens)$0.072 /img
Latência1.0 s
🎤
🔊
ElevenLabs Sound Effects (efeitos sonoros)
elevenlabs/sound-effects
Preço (por 1M tokens)$0.036 /img
Latência1.0 s
🎤
🔊
+1 modelos ElevenLabs

Prontos na API /v1.

Ver catálogo ↗
👑 Apex Engine
1 modelos
👑
Qwen 2.5 Omni (GGUF) ⚡ Fast
apexengine/Qwen2.5-Omni
Preço (por 1M tokens)$0.120 in / $0.360 out /1M
Latência0.5 s
T👁️🎤
32k ctx

🧠 Raciocínio Avançado & Math

20 modelos disponíveis

Modelos com reflexão interna profunda e resolução de problemas complexos.

🔷 DeepSeek
2 modelos
🔷
DeepSeek R1 (deepseek-reasoner)
deepseek/deepseek-reasoner
Preço (por 1M tokens)$1.200 in / $4.500 out /1M
Latência1.8 s
T⚙️🧠
65k ctx
🔷
DeepSeek V4 Pro
deepseek/deepseek-v4-pro
Preço (por 1M tokens)$1.300 in / $4.800 out /1M
Latência1.5 s
T⚙️🧠
131k ctx
🟢 OpenAI
10 modelos
🟢
o1-2024-12-17
openai/o1-2024-12-17
Preço (por 1M tokens)$6.000 in / $18.000 out /1M
Latência—
T
🟢
o1-pro
openai/o1-pro
Preço (por 1M tokens)$6.000 in / $18.000 out /1M
Latência—
T
🟢
o1-pro-2025-03-19
openai/o1-pro-2025-03-19
Preço (por 1M tokens)$6.000 in / $18.000 out /1M
Latência—
T
🟢
+7 modelos OpenAI

Prontos na API /v1.

Ver catálogo ↗
🟠 Anthropic
2 modelos
🟠
Anthropic Claude 3.7 Sonnet (Hybrid)
anthropic/claude-3-7-sonnet-20250219
Preço (por 1M tokens)$3.500 in / $18.000 out /1M
Latência1.8 s
T👁️⚙️🧠
200k ctx
🟠
Anthropic Claude Fable 5.1 (Frontier)
anthropic/claude-fable-5.1
Preço (por 1M tokens)$12.000 in / $60.000 out /1M
Latência3.3 s
T👁️⚙️🧠
500k ctx
🔵 Google Gemini
1 modelos
🔵
Google Gemini 2.5 Pro 25% off
gemini/gemini-2.5-pro
Preço (por 1M tokens)$1.600 in / $6.500 out /1M
Latência1.5 s
T👁️⚙️🧠+1
2097k ctx
⚡ Groq
1 modelos
⚡
Groq DeepSeek R1 Distill 70B ⚡ Fast
groq/deepseek-r1-distill-llama-70b
Preço (por 1M tokens)$0.900 in / $1.200 out /1M
Latência0.4 s
T⚙️🧠
128k ctx
🟣 fal.ai
1 modelos
🟣
FAL AI — Veo 3 / Sora-class (vídeo)
fal-ai/veo3
Preço (por 1M tokens)$0.840 /sec
Latência4.0 s
▶️
🌐 OpenRouter
3 modelos
🌐
OpenRouter — DeepSeek: R1
openrouter/deepseek/deepseek-r1
Preço (por 1M tokens)$0.840 in / $3.000 out /1M
Latência0.8 s
T⚙️🧠
64k ctx
🌐
OpenRouter — OpenAI: o1
openrouter/openai/o1
Preço (por 1M tokens)$18.000 in / $72.000 out /1M
Latência0.8 s
T👁️⚙️🧠
200k ctx
🌐
OpenRouter — OpenAI: o3 Mini
openrouter/openai/o3-mini
Preço (por 1M tokens)$1.320 in / $5.280 out /1M
Latência0.8 s
T⚙️🧠
200k ctx

🤝 Públicos, Gratuitos & BYOK

20 modelos disponíveis

Modelos com camada gratuita ou compatíveis com BYOK ($0 taxa de revenda).

🟢 OpenAI
4 modelos
🟢
text-embedding-3-large Free
openai/text-embedding-3-large
Preço (por 1M tokens)GRÁTIS / BYOK
Latência—
T
🟢
text-embedding-3-small Free
openai/text-embedding-3-small
Preço (por 1M tokens)GRÁTIS / BYOK
Latência—
T
🟢
text-embedding-ada-002 Free
openai/text-embedding-ada-002
Preço (por 1M tokens)GRÁTIS / BYOK
Latência—
T
🟢
+1 modelos OpenAI

Prontos na API /v1.

Ver catálogo ↗
🔵 Google Gemini
3 modelos
🔵
Google Gemini 2.0 Flash Realtime (áudio e voz) Free25% off
gemini/gemini-2.0-flash-realtime
Preço (por 1M tokens)GRÁTIS / BYOK
Latência2.0 s
T⚙️🎤
🔵
Google Gemini 3.5 Transcribe Free25% off
gemini/gemini-3.5-transcribe
Preço (por 1M tokens)GRÁTIS / BYOK
Latência0.8 s
T🎤
524k ctx
🔵
Google Gemini 3.6 Flash Free25% off
gemini/gemini-3.6-flash
Preço (por 1M tokens)GRÁTIS / BYOK
Latência0.6 s
T👁️⚙️🎤
1048k ctx
⚡ Groq
6 modelos
⚡
ALLaM-2-7b Free
groq/allam-2-7b
Preço (por 1M tokens)GRÁTIS / BYOK
Latência—
T
⚡
Canopy Labs Orpheus Arabic Saudi Free
groq/canopylabs/orpheus-arabic-saudi
Preço (por 1M tokens)GRÁTIS / BYOK
Latência—
T
⚡
Canopy Labs Orpheus V1 English Free
groq/canopylabs/orpheus-v1-english
Preço (por 1M tokens)GRÁTIS / BYOK
Latência—
T
⚡
+3 modelos Groq

Prontos na API /v1.

Ver catálogo ↗
🔴 MiniMax
1 modelos
🔴
MiniMax-M2.1-highspeed Free
minimax/MiniMax-M2.1-highspeed
Preço (por 1M tokens)GRÁTIS / BYOK
Latência—
T
👑 Apex Engine
3 modelos
👑
Apex AI (GGUF) · nosso modelo ⚡ Fast
apexengine/Apex-AI
Preço (por 1M tokens)$0.100 in / $0.300 out /1M
Latência0.4 s
T⚙️
32k ctx
👑
Apex Architecture (GGUF)
apexengine/Apex-Architecture-GGUF
Preço (por 1M tokens)$0.150 in / $0.450 out /1M
Latência0.6 s
T⚙️
32k ctx
👑
Qwen 2.5 Omni (GGUF) ⚡ Fast
apexengine/Qwen2.5-Omni
Preço (por 1M tokens)$0.120 in / $0.360 out /1M
Latência0.5 s
T👁️🎤
32k ctx
🤝 Pollinations (Parceiro)
3 modelos
🤝
Pollinations AI (Rede Comunitária) — openai-fast ⚡ FastFree🤝 Parceiro
pollinations/openai-fast
Preço (por 1M tokens)GRÁTIS / BYOK
Latência0.5 s
T⚙️
🤝
Pollinations Open Text (Público) Free🤝 Parceiro
pollinations/openai
Preço (por 1M tokens)GRÁTIS / BYOK
Latência1.2 s
T⚙️
128k ctx
🤝
Pollinations Flux Fast (Público) Free🤝 Parceiro
pollinations/flux
Preço (por 1M tokens)GRÁTIS / BYOK
Latência1.8 s
Live Playground • Console de Execução

Seletor de Modelos & Teste ao Vivo

Selecione qualquer modelo do catálogo e execute uma chamada de completions em tempo real para testar latência, qualidade e tokens.

Aguardando execução
// O retorno da API aparecerá aqui após o envio...
⏱️ Latência: — 🔤 Tokens In/Out: — 💰 Custo da Chamada: —
Onboarding Descomplicado

Comece a usar em 4 passos simples

Nada de contratos longos ou burocracia bancária. Planos em reais, créditos flexíveis e API 100% compatível com OpenAI. Clique em qualquer passo para ver o guia completo.

1

Crie sua conta

Cadastre-se grátis com e-mail e senha em menos de 30 segundos. Sem cartão de crédito obrigatório.

/cadastrar Ver explicação →
2

Gere sua chave de API

No painel Minha conta, gere seu token seguro sk-apex-… imediatamente.

sk-apex-… Ver explicação →
3

Ative seu plano ou créditos

Escolha seu plano mensal/anual ou recarregue créditos avulsos via Stripe com pagamento seguro.

Stripe Checkout Ver explicação →
4

Aponte e consuma /v1

Altere o base_url no SDK OpenAI para https://apexglobalai.com/v1 e comece a rodar.

POST /v1/chat/completions Ver explicação →
Criar minha conta grátis → 📖 Guia Completo dos 4 Passos
Suporte Autônomo 24/7

Atendimento em Tempo Real por IA com Diagnóstico & Auto-Fix

Esqueça filas de espera e suporte manual. Nossa plataforma conta com Agentes de Diagnóstico de IA ativos 24 horas por dia. Se alguma chamada retornar erro de quota, rota ou token, o agente autônomo analisa a requisição em tempo real, sugere o modelo alternativo ideal ou reconfigura o roteamento automaticamente.

Docs & Referência
Perguntas Frequentes & Governança

Dúvidas Frequentes sobre a Apex Cloud

O que é a Apex Cloud e como ela unifica tudo em Reais (BRL)?
A Apex Cloud é o gateway unificado de Inteligência Artificial da Apex Global AI. Em vez de contratar dezenas de assinaturas individuais em dólar sujeitas a variações cambiais e IOF de 4,38%, você acessa mais de 230 modelos mundiais (OpenAI, Anthropic, DeepSeek, Google, Alibaba, FAL, ElevenLabs) e +2.000 agentes verticais em uma fatura consolidada e faturamento automático.
Por que os preços de texto são cotados por 1 Milhão (1M) de tokens?
O padrão mundial de toda a indústria de IA (OpenAI, Anthropic, DeepSeek, Google) adota a cotação por 1.000.000 de tokens de contexto. Adotamos esse padrão para proporcionar máxima transparência e comparabilidade honesta. Você paga frações proporcionais ao que consome com precisão de até 6 casas decimais.
Como funciona a proteção dos Agentes & Skills e posso baixá-los?
Os agentes e skills especializados da Apex operam sob o modelo Cloud Inference. Isso significa que suas regras de negócio, heurísticas, códigos-fonte e prompts mestre permanecem protegidos nos servidores da Apex. Não é permitido download ou cópia não autorizada do código-fonte. O cliente usufrui do resultado final de alta precisão via API ou Playground. Para empresas que exigem implantação On-Premise dedicada, consulte nossos planos Enterprise.
Como funciona o suporte 24/7 autônomo por IA?
Nosso suporte técnico é 100% automatizado por Agentes Especialistas Apex com capacidade de auto-fix. Eles inspecionam logs de conexão, analisam payloads com erro, validam rotas de provedores e corrigem falhas de roteamento instantaneamente, sem necessidade de filas humanas ou intervenção manual.
Quais modelos de vídeo de ponta estão disponíveis?
Disponibilizamos os principais motores mundiais de vídeo: Alibaba Wan 2.1 (14B Text-to-Video e Image-to-Video em 720p), Google Veo 2 (vídeos cinematográficos fluidos de até 60fps), MiniMax Hailuo / H3 (física fluida e movimentos de câmera dinâmicos), além de Kling e LTX Video. Todos acessíveis via endpoint assíncrono de geração de mídia.
É 100% compatível com a API da OpenAI?
Sim. O endpoint /v1/chat/completions segue rigorosamente a especificação oficial da OpenAI. Basta trocar a base_url no SDK oficial de Python, Node.js, LangChain, LlamaIndex ou Cursor para https://apexglobalai.com/v1 e informar sua chave sk-apex-…. Suporta streaming em tempo real (SSE) com contagem de tokens.
Como funciona o pagamento e a segurança com o Stripe?
Todas as transações financeiras são processadas diretamente pela infraestrutura global do Stripe, certificada com PCI-DSS Level 1 (o mais alto padrão de segurança bancária do mundo). Aceitamos cartões de crédito, débito, Google Pay, Apple Pay e métodos locais.
E se um provedor externo estiver fora do ar?
A Apex Cloud possui arquitetura resiliente com failover automático inteligente. Caso um provedor (ex.: Anthropic ou DeepSeek) apresente lentidão ou indisponibilidade, o roteador encaminha a requisição instantaneamente para o próximo provedor ou cluster compatível, garantindo que seu sistema não sofra interrupções.
Como é garantida a privacidade dos meus dados (LGPD / ZDR)?
Operamos sob a política estrita de Zero Data Retention (ZDR) e conformidade integral com a LGPD e GDPR. Seus prompts, dados de entrada e saídas de modelo nunca são utilizados para treinar redes neurais de terceiros.
Ecossistema Aberto & Provedores Comunitários

Programa de Provedores Parceiros & BYOK ($0 Custo de Intermediação)

Conecte seus clusters GPU, APIs de IA parceiras, modelos open-source (vLLM, Ollama, Hugging Face, Pollinations) ou use suas próprias chaves de API sem taxa de intermediação. Conectividade direta e federação de infraestrutura com zero custos para você.

Conhecer Programa de Parceiros →