Preços transparentes de proxy LLM
O preço do nosso proxy LLM é transparente e direto: pague apenas pelos tokens que usar, sem taxas ocultas ou compromissos de assinatura. Este modelo de API compatível com OpenAI garante que seus custos aumentem linearmente conforme o volume real de inferência.
Sem assinatura. Crédito pré-pago nunca expira.
Calculadora de custos
Exemplos práticos
Teste de desenvolvimento em pequena escala
Um desenvolvedor executa 100 requisições com média de 2.000 tokens de entrada e 500 tokens de saída por requisição. Total de entrada: 200.000 tokens ($0,25 * 0,2 = $0,05). Total de saída: 50.000 tokens ($1,00 * 0,05 = $0,05). Custo total: $0,10.
Processamento em lote médio
Um engenheiro processa um conjunto de dados com 10.000 documentos. Cada documento tem em média 10.000 tokens de entrada e 500 tokens de saída. Total de entrada: 100.000.000 tokens ($0,25 * 100 = $25,00). Total de saída: 5.000.000 tokens ($1,00 * 5 = $5,00). Custo total: $30,00.
Carga de trabalho de inferência em alta escala
Um aplicativo de produção lida com 1.000.000 de requisições. Média de 500 tokens de entrada e 200 tokens de saída por requisição. Total de entrada: 500.000.000 tokens ($0,25 * 500 = $125,00). Total de saída: 200.000.000 tokens ($1,00 * 200 = $200,00). Custo total: $325,00.
Tarifas pagamento por uso
Cobramos estritamente por token consumido, sem taxa base mensal. Tokens de entrada custam $0,25 por milhão de tokens, enquanto tokens de saída custam $1,00 por milhão de tokens. Essa estrutura reflete o maior custo computacional de gerar texto em comparação ao processá-lo. Como operamos como um proxy LLM independente, essas taxas se aplicam uniformemente, independentemente do seu volume. Não há descontos por nível nem taxas ocultas de egresso. Você pode monitorar seu uso exato em tempo real pelo painel. Esse modelo funciona bem para desenvolvedores que preferem custos previsíveis por unidade a contratos empresariais complexos. Se você precisa de uma alternativa simples ao OpenRouter para inferência sem censura, este modelo de preços mantém sua sobrecarga baixa e seu faturamento simples.
Recarga e Créditos Bônus
O crédito pré-pago é a base do nosso sistema de faturamento. Quando você recarrega, adiciona fundos ao saldo da sua conta. Oferecemos créditos bônus para recompensar depósitos maiores: um bônus de 5% é aplicado a recargas de $50 ou mais, e um bônus de 10% é aplicado a recargas de $100 ou mais. Esses bônus são creditados imediatamente e podem ser usados para inferência exatamente como seus fundos base. Os créditos bônus não expiram e são consumidos proporcionalmente ao seu saldo principal. Esse mecanismo permite reduzir seu custo efetivo por token enquanto mantém total flexibilidade. É uma maneira eficiente de gerenciar o fluxo de caixa dos seus projetos de IA sem travá-lo em um compromisso de longo prazo.
Sem Expiração
Seu crédito pré-pago nunca expira. Seja recarregando $10 ou $1.000, o saldo permanece disponível até que você o use. Isso é crítico para projetos com padrões de uso esporádicos ou necessidades de arquivamento de longo prazo. Você não precisa se preocupar com renovações mensais ou interrupções de serviço devido a créditos expirados. O único limite é o limite de requisições de 300 requisições por minuto por chave. Essa permanência permite que você escale o uso do seu proxy LLM para cima ou para baixo sem penalidade financeira. Também simplifica o orçamento para gerentes de engenharia que desejam evitar a sobrecarga administrativa de rastrear datas de expiração de assinaturas.
Limites e o que está incluído
Mesmo preço para tudo — chamada de funções e modo JSON sem custo extra.
| Item | Valor |
|---|---|
| Chamada de funções | sim — tools, tool_choice; resposta com tool_calls, inclusive em streaming; resultados como role: tool |
| Saída máxima | até o restante da janela de 64.000 tokens; max_tokens opcional (sem limite separado) |
| Janela de contexto | 64.000 tokens (entrada + saída) |
| Modo JSON | response_format: {"type": "json_object"} |
| Limite de taxa | 300 requisições por minuto por chave |
| Concorrência | 8 requisições ao mesmo tempo por chave |
| Validade | crédito pago não expira, sem assinatura |
| Recarga | USDT (TRC20) ou USDC (Base), qualquer valor inteiro de $10 a $500 |
| Teste grátis | $0,50 por 7 dias, sem cartão · Chave de teste: 2 requisições paralelas, 60 por minuto; limites totais (8 e 300) após a primeira recarga |
| Preço | $0,25 por 1M tokens de entrada · $1,00 por 1M de saída |
| Bônus | +5% a partir de $50, +10% a partir de $100 |
Especificações completas e códigos de erro estão na documentação.
Perguntas e respostas
Preciso de cartão de crédito para começar?
Não. Você pode criar uma conta apenas com e-mail e senha. Novas contas recebem $0,50 em crédito de teste válido por 7 dias, permitindo testar a API sem inserir dados de pagamento. Você só precisa adicionar um método de pagamento quando o crédito de teste se esgotar ou quando desejar recarregar.
Como os créditos bônus são consumidos?
Os créditos bônus são consumidos proporcionalmente junto com seu crédito base. Ao processar uma requisição, uma fração tanto dos seus fundos base quanto dos fundos bônus é utilizada. Isso garante que seus créditos bônus sejam usados de forma justa e eficaz ao longo do tempo. Você não precisa selecionar manualmente qual tipo de crédito usar.
Existe um valor mínimo para recarga?
O valor mínimo de recarga é $10. Você pode pagar usando criptomoedas principais (USDT ou USDC). Assim que a recarga for processada, seu saldo é atualizado imediatamente e você pode começar a fazer requisições na hora.
O que acontece se eu exceder meu saldo?
As requisições falharão se seu saldo for insuficiente para cobrir o custo dos tokens. Recomendamos monitorar seu uso pelo painel para evitar interrupções inesperadas. Como não há assinatura, você não é cobrado por requisições falhas e paga apenas pelos tokens realmente consumidos.
Sua chave está a um formulário de distância
Crie uma conta, copie a chave, altere a URL base. Essa é toda a configuração.