ES ▾
Obtener clave de API

LLM Inference APIPrecios

API de inferencia: Precios simples y transparentes

Los créditos prepago alimentan cada petición en nuestra API de inferencia de pago por uso, con tarifas transparentes por token y sin cuotas de suscripción ocultas. Tu saldo cubre el uso exactamente, asegurando costos predecibles desde el primer token hasta el último.

$0,25por 1M de tokens de entrada
$1,00Tokens de salida / 1M
100,000contexto de tokens
$0,50crédito de prueba
300peticiones por minuto

Sin suscripción. El crédito prepago no caduca.

Calculadora de costes

$0.00

Ejemplos prácticos

Resumen de un documento técnico largo

Procesar un prompt de 50,000 tokens para generar un resumen de 1,000 tokens cuesta $0.0125 por entrada y $0.001 por salida, sumando $0.0135. Esta carga de trabajo se ajusta bien en nuestra ventana de contexto de 100k y demuestra un procesamiento por lotes de bajo costo.

Sesión de chat de usuario avanzado

Una sesión que usa una ventana de contexto de 10,000 tokens con 2,000 tokens de salida cuesta $0.0025 por entrada y $0.002 por salida. El total es $0.0045, lo que muestra que incluso con un contexto sustancial, el modelo por token sigue siendo económico para el uso interactivo.

Generación de contenido a gran escala

Generar 50,000 tokens de salida a partir de un prompt pequeño de 1,000 tokens cuesta $0.00025 por entrada y $0.05 por salida. El total es $0.05025, lo que ilustra que los tokens de salida impulsan la mayor parte del costo en flujos de trabajo intensivos en contenido.

Precios por token

Nuestra API de inferencia cobra estrictamente por volumen de tokens, con tokens de entrada a $0.25 por millón y tokens de salida a $1.00 por millón. Esta estructura refleja la diferencia computacional entre leer contexto y generar texto. Los tokens de entrada cubren la ventana de contexto de 100,000 tokens, permitiéndote pasar prompts grandes o historiales de conversación. Los tokens de salida se facturan por la generación del modelo. Como no agrupamos funciones como generación de imágenes o audio, solo pagas por el texto que realmente procesas. Este modelo de API de IA de pago por uso asegura que los usuarios de alto volumen no paguen de más por capacidades no utilizadas. La tarifa es transparente, sin sobrecosto por petición ni cargos mínimos. Puedes calcular tu costo exacto multiplicando tus recuentos de tokens por estas tarifas. Este enfoque mantiene los costos predecibles tanto para interacciones cortas como para escenarios de alojamiento de LLM de larga duración.

Créditos prepago

Cada petición se descuenta de tu saldo prepago, que no caduca. Recargas con un mínimo de $10 usando cripto (USDT o USDC). Este modelo asegura que tu uso nunca exceda lo que has cargado, proporcionando un control estricto del presupuesto. A diferencia de los servicios de suscripción, pagas solo por lo que consumes, lo que lo convierte en un proxy de LLM eficiente para cargas de trabajo variables. Los créditos se aplican de inmediato, permitiendo acceso instantáneo a la API. No hay tarifas mensuales ni cargos recurrentes, por lo que puedes recargar solo cuando sea necesario. Esta flexibilidad apoya a los desarrolladores que necesitan capacidad de ráfaga o quieren probar el LLM sin censura sin comprometerse con un contrato a largo plazo. Tu saldo permanece disponible indefinidamente, por lo que puedes pausar el uso sin perder tus fondos.

Créditos adicionales

Recompensamos las recargas más grandes con créditos adicionales para extender aún más tu uso. Agregar $50 otorga un bono del 5%, mientras que $100 añade un bono del 10% a tu cuenta. Estos bonos se aplican a tu saldo prepago y se usan para el consumo estándar de tokens. Esta función reduce el costo efectivo por token para usuarios avanzados que mantienen un saldo más alto. Los créditos de bono no caducan y están sujetos a las mismas reglas de uso que tus fondos principales. Esta estructura apoya un uso constante del gateway de LLM sin la fricción de transacciones pequeñas frecuentes. También hace que la API de inferencia sea más rentable para equipos o individuos con necesidades continuas y predecibles. Los créditos de bono se agregan automáticamente tras una recarga exitosa.

Límites e incluido

Mismo precio para todo: las llamadas a funciones y el modo JSON no cuestan más.

ElementoValor
Llamadas a funcionessí: tools, tool_choice; la respuesta trae tool_calls, también en streaming; resultados como role: tool
Salida máximahasta el resto de la ventana de 64.000 tokens; max_tokens opcional (sin límite aparte)
Ventana de contexto64.000 tokens (entrada + salida)
Modo JSONresponse_format: {"type": "json_object"}
Concurrencia8 peticiones a la vez por clave
Límite de peticiones300 por minuto por clave
RecargaUSDT (TRC20) o USDC (Base), cualquier importe entero de $10 a $500
Precio$0,25 por 1M tokens de entrada · $1,00 por 1M de salida
Prueba gratis$0,50 durante 7 días, sin tarjeta · Clave de prueba: 2 solicitudes paralelas, 60 por minuto; límites completos (8 y 300) tras la primera recarga
Bono+5 % desde $50, +10 % desde $100
Caducidadel crédito pagado no caduca, sin suscripción

Las especificaciones completas y los códigos de error están en la documentación.

Preguntas y respuestas

¿Caducan los créditos prepago?

No, tus créditos prepago nunca caducan. Puedes recargar tu cuenta en cualquier momento y el saldo permanece disponible indefinidamente hasta que lo uses para peticiones a la API.

¿Qué pasa si supero mi límite de peticiones?

Si superas el límite de 300 peticiones por minuto, recibirás un error estándar de límite de peticiones. Tu saldo prepago no se ve afectado por los límites de velocidad; simplemente debes esperar a que se restablezca la ventana antes de enviar más peticiones.

¿Puedo usar la API con fines comerciales?

Sí, nuestro <strong>LLM sin censura</strong> está disponible para uso adulto legal, incluidas aplicaciones comerciales. Mientras el contenido no involucre contenido sexual con menores, puedes usar la API para cualquier propósito legal, incluido negocios, investigación o entretenimiento.

¿Cómo rastreo el uso de tokens?

Puedes monitorizar el uso de tokens directamente en el panel de tu cuenta. Cada respuesta de la API incluye recuentos de tokens tanto de entrada como de salida, lo que te permite verificar tus costos. También puedes consultar tu saldo restante en cualquier momento para asegurarte de tener créditos suficientes para tu próxima petición.

Tu clave está a un formulario de distancia

Crea una cuenta, copia la clave, cambia la URL base. Eso es toda la configuración.

Obtener clave de API