Agent com modelos grátis + 100 tokens no cadastro

Um endpoint.
Qualquer modelo.

API unificada, compatível com OpenAI, para rodar os modelos open-source que ninguém mais serve. Troque a base_url. Pronto.

Funciona com qualquer SDK OpenAI · streaming SSE · tool_calls · sem cartão pra começar

app.py
# o mesmo SDK que você já usa from openai import OpenAI client = OpenAI( base_url="https://api.qualquermodelo.com/v1", api_key="qm_sua_chave", ) resp = client.chat.completions.create( model="deepseek-ai/DeepSeek-V3", # ou qualquer outro * messages=[{"role": "user", "content": "e aí"}], stream=True, )
deepseek-ai/DeepSeek-V3meta-llama/Llama-4-MaverickQwen/Qwen3-235Bmistralai/Mistral-Largegoogle/gemma-3-27b-itmicrosoft/phi-4CohereLabs/command-aaquele-modelo/obscuro-7b-que-voce-precisa deepseek-ai/DeepSeek-V3meta-llama/Llama-4-MaverickQwen/Qwen3-235Bmistralai/Mistral-Largegoogle/gemma-3-27b-itmicrosoft/phi-4CohereLabs/command-aaquele-modelo/obscuro-7b-que-voce-precisa

// por que existe

Aquele modelo que ninguém serve? A gente serve.

Milhares de modelos open-source não têm nenhum provedor de inferência. Você não tem GPU, não quer gerenciar servidor e não quer pagar em dólar. É pra isso que a gente existe.

*

Cauda longa de verdade

Modelo sem provedor? A gente sobe ele sob demanda e você chama pelo mesmo endpoint. Do Llama gigante ao fine-tune obscuro de 7B.

Fallback automático

Provedor caiu ou devolveu 429? A request re-roteia pra outro backend do mesmo modelo. Transparente. Seu app nem fica sabendo.

100

Pague em real, via PIX

Créditos pré-pagos, cobrança por token, nota fiscal. Sem cartão internacional, sem IOF, sem surpresa na fatura.

{}

Compatível com OpenAI

Endpoint /v1/chat/completions padrão. LangChain, Vercel AI SDK, LlamaIndex, cursor da sua IDE — tudo funciona só trocando a URL.

Streaming e tools

SSE de ponta a ponta, tool_calls, JSON mode. O que o modelo suporta, a API repassa — sem gambiarra no meio.

Dashboard sem mistério

Uso por chave, custo por modelo, latência por provedor. Você vê exatamente pra onde cada centavo de token foi.

// como funciona

Três passos. Sem reunião de onboarding.

01

Crie sua chave

Cadastro com e-mail ou GitHub. Você recebe 100 tokens e ainda pode usar as cotas grátis do Agent.

02

Troque a base_url

Aponte seu SDK OpenAI pra api.qualquermodelo.com/v1. Uma linha de diff.

03

Chame qualquer modelo

Passe o ID do modelo no campo model. Se não estiver de pé, a gente sobe pra você.

// agent no terminal

Seu projeto. Seu contexto. Sua memória.

Um agente de código com TUI, tools verificadas e um vault Markdown privado que preserva decisões entre sessões.

  • Qwen3, GLM-4.7 Flash e Gemma com cota grátis
  • Memória local estilo Obsidian, isolada por projeto
  • MCP interno para tools e clientes externos
  • Aprovação antes de comandos e alterações
qm · ~/projetos/minha-api
relembre a arquitetura e corrija os testes ◆ memory_search arquitetura decisões testes ◆ search_files TODO|FIXME ◆ read_file src/service.ts Encontrei a decisão registrada para este workspace. Vou manter a fronteira do serviço e corrigir o teste sem alterar o contrato público. ◆ replace_in_file aguardando aprovação…
qm:minha-api · Qwen3-4B:nscale · grátis · mem 7 · pronto

// preços

Pré-pago em tokens, indexado ao dólar.

Sem mensalidade, sem mínimo, sem plano enterprise escondido atrás de "fale com vendas".

Créditos

Pague via PIX e receba tokens pela cotação vigente. O preço de cada modelo fica público — o que o provedor cobra em dólar, mais nossa margem. Simples assim.

  • 100 tokens de bônus para todo novo cadastro
  • Preço por modelo transparente em tokens
  • Rate limit generoso desde o primeiro depósito
  • Crédito nunca vira surpresa: sem pós-pago, sem fatura
a partir de
R$ 10

depósito mínimo · 100 tokens = US$ 1 · tokens não expiram

Começar agora ◆ pagamento via PIX na hora

Roda qualquer modelo*

*qualquer modelo mesmo.