Beta aberto — créditos grátis pra testar

Um endpoint.
Qualquer modelo.

API unificada, compatível com OpenAI, para rodar os modelos open-source que ninguém mais serve. Troque a base_url. Pronto.

Funciona com qualquer SDK OpenAI · streaming SSE · tool_calls · sem cartão pra começar

app.py
# o mesmo SDK que você já usa from openai import OpenAI client = OpenAI( base_url="https://api.qualquermodelo.com/v1", api_key="qm_sua_chave", ) resp = client.chat.completions.create( model="deepseek-ai/DeepSeek-V3", # ou qualquer outro * messages=[{"role": "user", "content": "e aí"}], stream=True, )
deepseek-ai/DeepSeek-V3meta-llama/Llama-4-MaverickQwen/Qwen3-235Bmistralai/Mistral-Largegoogle/gemma-3-27b-itmicrosoft/phi-4CohereLabs/command-aaquele-modelo/obscuro-7b-que-voce-precisa deepseek-ai/DeepSeek-V3meta-llama/Llama-4-MaverickQwen/Qwen3-235Bmistralai/Mistral-Largegoogle/gemma-3-27b-itmicrosoft/phi-4CohereLabs/command-aaquele-modelo/obscuro-7b-que-voce-precisa

// por que existe

Aquele modelo que ninguém serve? A gente serve.

Milhares de modelos open-source não têm nenhum provedor de inferência. Você não tem GPU, não quer gerenciar servidor e não quer pagar em dólar. É pra isso que a gente existe.

*

Cauda longa de verdade

Modelo sem provedor? A gente sobe ele sob demanda e você chama pelo mesmo endpoint. Do Llama gigante ao fine-tune obscuro de 7B.

Fallback automático

Provedor caiu ou devolveu 429? A request re-roteia pra outro backend do mesmo modelo. Transparente. Seu app nem fica sabendo.

R$

Pague em real, via PIX

Créditos pré-pagos, cobrança por token, nota fiscal. Sem cartão internacional, sem IOF, sem surpresa na fatura.

{}

Compatível com OpenAI

Endpoint /v1/chat/completions padrão. LangChain, Vercel AI SDK, LlamaIndex, cursor da sua IDE — tudo funciona só trocando a URL.

Streaming e tools

SSE de ponta a ponta, tool_calls, JSON mode. O que o modelo suporta, a API repassa — sem gambiarra no meio.

Dashboard sem mistério

Uso por chave, custo por modelo, latência por provedor. Você vê exatamente pra onde cada centavo de token foi.

// como funciona

Três passos. Sem reunião de onboarding.

01

Crie sua chave

Cadastro com e-mail ou GitHub. Créditos grátis pra testar sem colocar cartão.

02

Troque a base_url

Aponte seu SDK OpenAI pra api.qualquermodelo.com/v1. Uma linha de diff.

03

Chame qualquer modelo

Passe o ID do modelo no campo model. Se não estiver de pé, a gente sobe pra você.

// preços

Pré-pago, por token, em real.

Sem mensalidade, sem mínimo, sem plano enterprise escondido atrás de "fale com vendas".

Créditos

Deposite quanto quiser, gaste por token. O preço de cada modelo fica público na página dele — o que o provedor cobra, mais nossa margem. Simples assim.

  • Créditos grátis no cadastro
  • Preço por modelo transparente, em R$ por milhão de tokens
  • Rate limit generoso desde o primeiro depósito
  • Saldo nunca vira surpresa: sem pós-pago, sem fatura
a partir de
R$ 10

depósito mínimo · créditos não expiram

Começar agora ◆ pagamento via PIX na hora

Roda qualquer modelo*

*qualquer modelo mesmo.