LLM Inference APIPrecios
API de inferencia: Precios simples y transparentes
Los créditos prepago alimentan cada petición en nuestra API de inferencia de pago por uso, con tarifas transparentes por token y sin cuotas de suscripción ocultas. Tu saldo cubre el uso exactamente, asegurando costos predecibles desde el primer token hasta el último.
Sin suscripción. El crédito prepago no caduca.
Calculadora de costes
Ejemplos prácticos
Resumen de un documento técnico largo
Procesar un prompt de 50,000 tokens para generar un resumen de 1,000 tokens cuesta $0.0125 por entrada y $0.001 por salida, sumando $0.0135. Esta carga de trabajo se ajusta bien en nuestra ventana de contexto de 100k y demuestra un procesamiento por lotes de bajo costo.
Sesión de chat de usuario avanzado
Una sesión que usa una ventana de contexto de 10,000 tokens con 2,000 tokens de salida cuesta $0.0025 por entrada y $0.002 por salida. El total es $0.0045, lo que muestra que incluso con un contexto sustancial, el modelo por token sigue siendo económico para el uso interactivo.
Generación de contenido a gran escala
Generar 50,000 tokens de salida a partir de un prompt pequeño de 1,000 tokens cuesta $0.00025 por entrada y $0.05 por salida. El total es $0.05025, lo que ilustra que los tokens de salida impulsan la mayor parte del costo en flujos de trabajo intensivos en contenido.
Precios por token
Nuestra API de inferencia cobra estrictamente por volumen de tokens, con tokens de entrada a $0.25 por millón y tokens de salida a $1.00 por millón. Esta estructura refleja la diferencia computacional entre leer contexto y generar texto. Los tokens de entrada cubren la ventana de contexto de 100,000 tokens, permitiéndote pasar prompts grandes o historiales de conversación. Los tokens de salida se facturan por la generación del modelo. Como no agrupamos funciones como generación de imágenes o audio, solo pagas por el texto que realmente procesas. Este modelo de API de IA de pago por uso asegura que los usuarios de alto volumen no paguen de más por capacidades no utilizadas. La tarifa es transparente, sin sobrecosto por petición ni cargos mínimos. Puedes calcular tu costo exacto multiplicando tus recuentos de tokens por estas tarifas. Este enfoque mantiene los costos predecibles tanto para interacciones cortas como para escenarios de alojamiento de LLM de larga duración.
Créditos prepago
Cada petición se descuenta de tu saldo prepago, que no caduca. Recargas con un mínimo de $10 usando cripto (USDT o USDC). Este modelo asegura que tu uso nunca exceda lo que has cargado, proporcionando un control estricto del presupuesto. A diferencia de los servicios de suscripción, pagas solo por lo que consumes, lo que lo convierte en un proxy de LLM eficiente para cargas de trabajo variables. Los créditos se aplican de inmediato, permitiendo acceso instantáneo a la API. No hay tarifas mensuales ni cargos recurrentes, por lo que puedes recargar solo cuando sea necesario. Esta flexibilidad apoya a los desarrolladores que necesitan capacidad de ráfaga o quieren probar el LLM sin censura sin comprometerse con un contrato a largo plazo. Tu saldo permanece disponible indefinidamente, por lo que puedes pausar el uso sin perder tus fondos.
Créditos adicionales
Recompensamos las recargas más grandes con créditos adicionales para extender aún más tu uso. Agregar $50 otorga un bono del 5%, mientras que $100 añade un bono del 10% a tu cuenta. Estos bonos se aplican a tu saldo prepago y se usan para el consumo estándar de tokens. Esta función reduce el costo efectivo por token para usuarios avanzados que mantienen un saldo más alto. Los créditos de bono no caducan y están sujetos a las mismas reglas de uso que tus fondos principales. Esta estructura apoya un uso constante del gateway de LLM sin la fricción de transacciones pequeñas frecuentes. También hace que la API de inferencia sea más rentable para equipos o individuos con necesidades continuas y predecibles. Los créditos de bono se agregan automáticamente tras una recarga exitosa.
Límites e incluido
Mismo precio para todo: las llamadas a funciones y el modo JSON no cuestan más.
| Elemento | Valor |
|---|---|
| Llamadas a funciones | sí: tools, tool_choice; la respuesta trae tool_calls, también en streaming; resultados como role: tool |
| Salida máxima | hasta el resto de la ventana de 64.000 tokens; max_tokens opcional (sin límite aparte) |
| Ventana de contexto | 64.000 tokens (entrada + salida) |
| Modo JSON | response_format: {"type": "json_object"} |
| Concurrencia | 8 peticiones a la vez por clave |
| Límite de peticiones | 300 por minuto por clave |
| Recarga | USDT (TRC20) o USDC (Base), cualquier importe entero de $10 a $500 |
| Precio | $0,25 por 1M tokens de entrada · $1,00 por 1M de salida |
| Prueba gratis | $0,50 durante 7 días, sin tarjeta · Clave de prueba: 2 solicitudes paralelas, 60 por minuto; límites completos (8 y 300) tras la primera recarga |
| Bono | +5 % desde $50, +10 % desde $100 |
| Caducidad | el crédito pagado no caduca, sin suscripción |
Las especificaciones completas y los códigos de error están en la documentación.
Preguntas y respuestas
¿Caducan los créditos prepago?
No, tus créditos prepago nunca caducan. Puedes recargar tu cuenta en cualquier momento y el saldo permanece disponible indefinidamente hasta que lo uses para peticiones a la API.
¿Qué pasa si supero mi límite de peticiones?
Si superas el límite de 300 peticiones por minuto, recibirás un error estándar de límite de peticiones. Tu saldo prepago no se ve afectado por los límites de velocidad; simplemente debes esperar a que se restablezca la ventana antes de enviar más peticiones.
¿Puedo usar la API con fines comerciales?
Sí, nuestro <strong>LLM sin censura</strong> está disponible para uso adulto legal, incluidas aplicaciones comerciales. Mientras el contenido no involucre contenido sexual con menores, puedes usar la API para cualquier propósito legal, incluido negocios, investigación o entretenimiento.
¿Cómo rastreo el uso de tokens?
Puedes monitorizar el uso de tokens directamente en el panel de tu cuenta. Cada respuesta de la API incluye recuentos de tokens tanto de entrada como de salida, lo que te permite verificar tus costos. También puedes consultar tu saldo restante en cualquier momento para asegurarte de tener créditos suficientes para tu próxima petición.
Tu clave está a un formulario de distancia
Crea una cuenta, copia la clave, cambia la URL base. Eso es toda la configuración.
Obtener clave de API