Precios transparentes del proxy LLM
Los precios de nuestro proxy llm son transparentes y sencillos: paga solo por los tokens que uses sin tarifas ocultas ni compromisos de suscripción. Este modelo de api compatible con openai asegura que tus costos escalen linealmente con tu volumen real de inferencia.
Sin suscripción. El crédito prepago no caduca.
Calculadora de costes
Ejemplos prácticos
Pruebas de desarrollo a pequeña escala
Un desarrollador ejecuta 100 peticiones con un promedio de 2.000 tokens de entrada y 500 tokens de salida por petición. Total de entrada: 200.000 tokens ($0,25 * 0,2 = $0,05). Total de salida: 50.000 tokens ($1,00 * 0,05 = $0,05). Costo total: $0,10.
Procesamiento de lotes medianos
Un ingeniero procesa un conjunto de datos de 10.000 documentos. Cada documento tiene un promedio de 10.000 tokens de entrada y 500 tokens de salida. Entrada total: 100.000.000 tokens ($0,25 * 100 = $25,00). Salida total: 5.000.000 tokens ($1,00 * 5 = $5,00). Costo total: $30,00.
Carga de trabajo de inferencia de alto volumen
Una aplicación en producción maneja 1.000.000 de peticiones. Promedio de 500 tokens de entrada y 200 tokens de salida por petición. Entrada total: 500.000.000 tokens ($0,25 * 500 = $125,00). Salida total: 200.000.000 tokens ($1,00 * 200 = $200,00). Costo total: $325,00.
Tarifas de pago por uso
Cobramos estrictamente por token consumido, sin cuota base mensual. Los tokens de entrada cuestan $0,25 por millón de tokens, mientras que los tokens de salida tienen un precio de $1,00 por millón de tokens. Esta estructura refleja el mayor costo computacional de generar texto en comparación con procesarlo. Como operamos como un proxy llm independiente, estas tarifas se aplican uniformemente independientemente de tu volumen. No hay descuentos por niveles ni tarifas ocultas de egress. Puedes monitorear tu uso exacto en tiempo real a través del panel. Este modelo funciona bien para desarrolladores que prefieren costos predecibles por unidad en lugar de contratos empresariales complejos. Si necesitas una alternativa simple de openrouter para inferencia sin censura, este modelo de precios mantiene tu sobrecosto bajo y tu facturación sencilla.
Recarga y créditos bonus
El crédito prepago es la base de nuestro sistema de facturación. Cuando recargas, agregas fondos al saldo de tu cuenta. Ofrecemos créditos adicionales para recompensar depósitos más grandes: se aplica un bono del 5% a las recargas de $50 o más, y un bono del 10% a las recargas de $100 o más. Estos bonos se acreditan de inmediato y se pueden usar para inferencia al igual que tus fondos base. Los créditos de bono no caducan y se consumen de forma proporcional con tu saldo principal. Este mecanismo te permite reducir tu costo efectivo por token manteniendo toda la flexibilidad. Es una forma eficiente de gestionar el flujo de caja de tus proyectos de IA sin comprometerte a largo plazo.
Sin vencimiento
Tu crédito prepago nunca caduca. Ya sea que recargues $10 o $1.000, el saldo permanece disponible hasta que lo uses. Esto es crítico para proyectos con patrones de uso esporádico o necesidades de archivo a largo plazo. No necesitas preocuparte por renovaciones mensuales o interrupciones del servicio debido a créditos vencidos. La única limitación es el límite de peticiones de 300 por minuto por clave. Esta permanencia te permite escalar el uso de tu proxy llm al alza o a la baja sin penalización financiera. También simplifica la planificación presupuestaria para gerentes de ingeniería que desean evitar la sobrecarga administrativa de rastrear fechas de vencimiento de suscripciones.
Límites e incluido
Mismo precio para todo: las llamadas a funciones y el modo JSON no cuestan más.
| Elemento | Valor |
|---|---|
| Llamadas a funciones | sí: tools, tool_choice; la respuesta trae tool_calls, también en streaming; resultados como role: tool |
| Salida máxima | hasta el resto de la ventana de 64.000 tokens; max_tokens opcional (sin límite aparte) |
| Ventana de contexto | 64.000 tokens (entrada + salida) |
| Modo JSON | response_format: {"type": "json_object"} |
| Límite de peticiones | 300 por minuto por clave |
| Concurrencia | 8 peticiones a la vez por clave |
| Caducidad | el crédito pagado no caduca, sin suscripción |
| Recarga | USDT (TRC20) o USDC (Base), cualquier importe entero de $10 a $500 |
| Prueba gratis | $0,50 durante 7 días, sin tarjeta · Clave de prueba: 2 solicitudes paralelas, 60 por minuto; límites completos (8 y 300) tras la primera recarga |
| Precio | $0,25 por 1M tokens de entrada · $1,00 por 1M de salida |
| Bono | +5 % desde $50, +10 % desde $100 |
Las especificaciones completas y los códigos de error están en la documentación.
Preguntas y respuestas
¿Necesito una tarjeta de crédito para empezar?
No. Puedes crear una cuenta solo con un correo electrónico y una contraseña. Las cuentas nuevas reciben $0,50 en crédito de prueba válido por 7 días, lo que te permite probar la API sin ingresar datos de pago. Solo necesitas agregar un método de pago cuando se agote tu crédito de prueba o cuando desees recargar.
¿Cómo se consumen los créditos bonus?
Los créditos bonus se consumen de forma proporcional junto con tu crédito base. Cuando se procesa una petición, se utiliza una fracción tanto de tus fondos base como de tus fondos bonus. Esto garantiza que tus créditos bonus se utilicen de manera justa y efectiva con el tiempo. No necesitas seleccionar manualmente qué tipo de crédito usar.
¿Existe un monto mínimo de recarga?
El monto mínimo de recarga es de $10. Puedes pagar con criptomonedas principales (USDT o USDC). Una vez que se procesa la recarga, tu saldo se actualiza inmediatamente y puedes empezar a hacer peticiones de inmediato.
¿Qué sucede si excedo mi saldo?
Las peticiones fallarán si tu saldo no es suficiente para cubrir el costo de los tokens. Recomendamos monitorear tu uso a través del panel para evitar interrupciones inesperadas. Como no hay suscripción, no se te cobra por las peticiones fallidas y solo pagas por los tokens realmente consumidos.
Tu clave está a un formulario de distancia
Crea una cuenta, copia la clave, cambia la URL base. Eso es toda la configuración.