ES ▾
Obtener clave de API

Inferencia LLM sin censura

API de inferencia sin censura para desarrolladores

Una API de inferencia compatible con OpenAI lista para usar que sirve un único modelo de pesos abiertos sin censura. Cambia tu base_url y clave, mantén el código.

  • Un modelo sin censura
  • Sin cuotas mensuales
  • Los créditos no caducan

Pruébalo con una sola petición

curl https://api.llminferenceapi.com/v1/chat/completions \
  -H "Authorization: Bearer $API_KEY" \
  -H "Content-Type: application/json" \
  -d '{
    "model": "uncensored",
    "messages": [{"role": "user", "content": "Write a blunt product review of a cheap VPN."}]
  }'

Lo que obtienes

Compatibilidad lista para usar

Funciona con los SDK oficiales de OpenAI y cualquier cliente compatible. Solo actualiza tu base_url a https://api.llminferenceapi.com/v1 y cambia tu clave de API.

Salida sin censura

El modelo responde sin rechazos por contenido para temas adultos legítimos, ficticios o controvertidos. Solo se bloquea el contenido sexual que involucre a menores.

Alojamiento directo de GPU

Ejecutamos el modelo en nuestros propios servidores, no como revendedor. Sin enrutamiento de proveedores, sin capas ocultas, solo inferencia directa.

Precios transparentes

Paga solo por lo que usas. Los tokens de entrada cuestan $0.25/1M, los tokens de salida cuestan $1.00/1M. Sin suscripciones ni fechas de caducidad en los créditos.

Streaming y herramientas

Admite eventos enviados por el servidor (SSE) para respuestas en streaming y endpoints estándar de llamadas a funciones/herramientas.

Privacidad primero

Los prompts no se utilizan para entrenar tu modelo. Crear una cuenta solo requiere un correo electrónico y una contraseña.

Cómo funciona

  1. Crear cuenta

    Regístrate con un correo electrónico y una contraseña para obtener tu clave de API al instante.

  2. Añadir crédito

    Recarga con criptomonedas (USDT o USDC) para comenzar a usar el servicio.

  3. Iniciar inferencia

    Apunta tu código de cliente existente a nuestra base_url y envía peticiones.

Lo que la gente construye con ello

Escritura creativa

Genera historias y guiones sin moralización no deseada ni filtros de contenido que restrinjan tus opciones narrativas. Perfecto para ficción para adultos o humor atrevido.

Extracción de datos

Analiza documentos grandes usando la ventana de contexto de 100k para extraer datos estructurados de textos largos sin perder el contexto.

Investigación y análisis

Obtén respuestas sin filtros sobre temas controversos o de nicho sin que el modelo se niegue a participar debido a las pautas de seguridad estándar.

Aplicaciones de chat

Construye interfaces de chat que se sientan naturales y receptivas, admitiendo respuestas en streaming para una mejor experiencia de usuario.

Compatibilidad con OpenAI lista para usar

Deja de reescribir tu código de integración para cada nuevo modelo. Nuestra API implementa el endpoint estándar /v1/chat/completions, lo que significa que puedes cambiar a nuestro modelo sin censura simplemente cambiando la base_url y la api_key en tus clientes SDK de OpenAI existentes. Admitimos streaming mediante Server-Sent Events (SSE) y llamadas a funciones, por lo que tu lógica existente para manejar salidas de herramientas o generación de texto en tiempo real funciona de inmediato.

Esto no es un gateway de múltiples modelos ni un proxy complejo que añade latencia. Es una conexión directa a nuestros servidores GPU que ejecutan un único modelo de pesos abiertos optimizado. Obtienes el rendimiento de un endpoint dedicado con la familiaridad del formato de OpenAI.

Sin censura y sin filtros

Nuestro modelo está ajustado para responder sin rechazos por contenido para uso adulto legítimo, narrativas ficticias, investigación de seguridad o temas controvertidos. Mientras que la mayoría de los modelos estándar rehusarán amablemente discutir temas sensibles o generar contenido maduro, nuestro modelo proporcionará una respuesta directa.

Existe un límite estricto que siempre se aplica: se bloquean las peticiones que contienen contenido sexual que involucre a menores. Todo lo demás es válido. Esto lo hace ideal para aplicaciones donde deseas control creativo total sobre la salida sin que el modelo actúe como un guardián de las peticiones legítimas de tus usuarios.

Precios transparentes de pago por uso

No te encasillamos en suscripciones mensuales o planes escalonados. Pagas exactamente por los tokens que consumes. Los tokens de entrada cuestan $0,25 por millón, y los de salida $1,00 por millón. Cuando añades fondos, esos créditos no caducan, así que puedes recargar cuando tenga sentido para tu presupuesto.

Ofrecemos bonificaciones por depósitos más grandes: +5% de crédito en depósitos de $50 y +10% en depósitos de $100. Las cuentas nuevas comienzan con $0,50 de crédito de prueba válido por 7 días, sin necesidad de tarjeta de crédito. Esta estructura asegura que solo gastes lo que usas, sin tarifas ocultas para streaming o uso de herramientas.

Para quién NO es esto

Si necesitas generación de imágenes, procesamiento de audio o embeddings, esta API no es para ti. Solo ofrecemos texto. Si necesitas enrutamiento de modelos entre varios proveedores (como GPT-4, Claude y Llama en una sola llamada), no lo ofrecemos. Nos enfocamos en ofrecer la mejor experiencia posible para un modelo sin censura específico. Si necesitas garantías de SLA estrictas, certificaciones SOC2 o cumplimiento de HIPAA de forma predeterminada, deberías buscar proveedores de grado empresarial. Somos un endpoint de inferencia directo, pensado para desarrolladores.

Preguntas y respuestas

¿Es un proxy de OpenAI?

No. No revendemos los modelos de OpenAI. Hospedamos nuestro propio modelo de pesos abiertos en nuestros propios servidores GPU. Es compatible con OpenAI en formato, lo que significa que acepta las mismas estructuras JSON y comandos de SDK, pero el modelo subyacente es nuestro.

¿Cuál es el tamaño de la ventana de contexto?

Nuestro modelo admite una ventana de contexto de 100.000 tokens, contando tanto el prompt como el completado. Esto permite procesar documentos grandes o mantener historiales de conversación largos.

¿Se usan mis prompts para el entrenamiento?

No. No utilizamos tus datos de prompt para entrenar nuestro modelo. Tus datos permanecen privados para tus peticiones de inferencia.

¿Cómo empiezo?

Regístrate con un correo electrónico y una contraseña en la página Obtener clave de API. Recibirás una clave de API de inmediato. Puedes empezar a usar el crédito de prueba gratis de $0.50 sin añadir una tarjeta de crédito.

¿Qué pasa si supero el límite de peticiones?

Permitimos 300 peticiones por minuto por clave de API. Si excedes este límite, recibirás un error 429. Puedes regenerar tu clave de API en cualquier momento para restablecer el contador si es necesario.

Tu clave está a un formulario de distancia

Crea una cuenta, copia la clave, cambia la URL base. Eso es toda la configuración.

Obtener clave de API