Inferencia LLM sin censura
API de inferencia sin censura para desarrolladores
Una API de inferencia compatible con OpenAI lista para usar que sirve un único modelo de pesos abiertos sin censura. Cambia tu base_url y clave, mantén el código.
- Un modelo sin censura
- Sin cuotas mensuales
- Los créditos no caducan
Pruébalo con una sola petición
curl https://api.llminferenceapi.com/v1/chat/completions \
-H "Authorization: Bearer $API_KEY" \
-H "Content-Type: application/json" \
-d '{
"model": "uncensored",
"messages": [{"role": "user", "content": "Write a blunt product review of a cheap VPN."}]
}'from openai import OpenAI
client = OpenAI(base_url="https://api.llminferenceapi.com/v1", api_key="YOUR_KEY")
resp = client.chat.completions.create(
model="uncensored",
messages=[{"role": "user", "content": "Summarise this thread without softening it."}],
)
print(resp.choices[0].message.content)import OpenAI from "openai";
const client = new OpenAI({ baseURL: "https://api.llminferenceapi.com/v1", apiKey: process.env.API_KEY });
const resp = await client.chat.completions.create({
model: "uncensored",
messages: [{ role: "user", content: "Draft a villain monologue for my game." }],
});
console.log(resp.choices[0].message.content);Lo que obtienes
Compatibilidad lista para usar
Funciona con los SDK oficiales de OpenAI y cualquier cliente compatible. Solo actualiza tu base_url a https://api.llminferenceapi.com/v1 y cambia tu clave de API.
Salida sin censura
El modelo responde sin rechazos por contenido para temas adultos legítimos, ficticios o controvertidos. Solo se bloquea el contenido sexual que involucre a menores.
Alojamiento directo de GPU
Ejecutamos el modelo en nuestros propios servidores, no como revendedor. Sin enrutamiento de proveedores, sin capas ocultas, solo inferencia directa.
Precios transparentes
Paga solo por lo que usas. Los tokens de entrada cuestan $0.25/1M, los tokens de salida cuestan $1.00/1M. Sin suscripciones ni fechas de caducidad en los créditos.
Streaming y herramientas
Admite eventos enviados por el servidor (SSE) para respuestas en streaming y endpoints estándar de llamadas a funciones/herramientas.
Privacidad primero
Los prompts no se utilizan para entrenar tu modelo. Crear una cuenta solo requiere un correo electrónico y una contraseña.
Cómo funciona
Crear cuenta
Regístrate con un correo electrónico y una contraseña para obtener tu clave de API al instante.
Añadir crédito
Recarga con criptomonedas (USDT o USDC) para comenzar a usar el servicio.
Iniciar inferencia
Apunta tu código de cliente existente a nuestra base_url y envía peticiones.
Lo que la gente construye con ello
Escritura creativa
Genera historias y guiones sin moralización no deseada ni filtros de contenido que restrinjan tus opciones narrativas. Perfecto para ficción para adultos o humor atrevido.
Extracción de datos
Analiza documentos grandes usando la ventana de contexto de 100k para extraer datos estructurados de textos largos sin perder el contexto.
Investigación y análisis
Obtén respuestas sin filtros sobre temas controversos o de nicho sin que el modelo se niegue a participar debido a las pautas de seguridad estándar.
Aplicaciones de chat
Construye interfaces de chat que se sientan naturales y receptivas, admitiendo respuestas en streaming para una mejor experiencia de usuario.
Compatibilidad con OpenAI lista para usar
Deja de reescribir tu código de integración para cada nuevo modelo. Nuestra API implementa el endpoint estándar /v1/chat/completions, lo que significa que puedes cambiar a nuestro modelo sin censura simplemente cambiando la base_url y la api_key en tus clientes SDK de OpenAI existentes. Admitimos streaming mediante Server-Sent Events (SSE) y llamadas a funciones, por lo que tu lógica existente para manejar salidas de herramientas o generación de texto en tiempo real funciona de inmediato.
Esto no es un gateway de múltiples modelos ni un proxy complejo que añade latencia. Es una conexión directa a nuestros servidores GPU que ejecutan un único modelo de pesos abiertos optimizado. Obtienes el rendimiento de un endpoint dedicado con la familiaridad del formato de OpenAI.
Sin censura y sin filtros
Nuestro modelo está ajustado para responder sin rechazos por contenido para uso adulto legítimo, narrativas ficticias, investigación de seguridad o temas controvertidos. Mientras que la mayoría de los modelos estándar rehusarán amablemente discutir temas sensibles o generar contenido maduro, nuestro modelo proporcionará una respuesta directa.
Existe un límite estricto que siempre se aplica: se bloquean las peticiones que contienen contenido sexual que involucre a menores. Todo lo demás es válido. Esto lo hace ideal para aplicaciones donde deseas control creativo total sobre la salida sin que el modelo actúe como un guardián de las peticiones legítimas de tus usuarios.
Precios transparentes de pago por uso
No te encasillamos en suscripciones mensuales o planes escalonados. Pagas exactamente por los tokens que consumes. Los tokens de entrada cuestan $0,25 por millón, y los de salida $1,00 por millón. Cuando añades fondos, esos créditos no caducan, así que puedes recargar cuando tenga sentido para tu presupuesto.
Ofrecemos bonificaciones por depósitos más grandes: +5% de crédito en depósitos de $50 y +10% en depósitos de $100. Las cuentas nuevas comienzan con $0,50 de crédito de prueba válido por 7 días, sin necesidad de tarjeta de crédito. Esta estructura asegura que solo gastes lo que usas, sin tarifas ocultas para streaming o uso de herramientas.
Para quién NO es esto
Si necesitas generación de imágenes, procesamiento de audio o embeddings, esta API no es para ti. Solo ofrecemos texto. Si necesitas enrutamiento de modelos entre varios proveedores (como GPT-4, Claude y Llama en una sola llamada), no lo ofrecemos. Nos enfocamos en ofrecer la mejor experiencia posible para un modelo sin censura específico. Si necesitas garantías de SLA estrictas, certificaciones SOC2 o cumplimiento de HIPAA de forma predeterminada, deberías buscar proveedores de grado empresarial. Somos un endpoint de inferencia directo, pensado para desarrolladores.
Preguntas y respuestas
¿Es un proxy de OpenAI?
No. No revendemos los modelos de OpenAI. Hospedamos nuestro propio modelo de pesos abiertos en nuestros propios servidores GPU. Es compatible con OpenAI en formato, lo que significa que acepta las mismas estructuras JSON y comandos de SDK, pero el modelo subyacente es nuestro.
¿Cuál es el tamaño de la ventana de contexto?
Nuestro modelo admite una ventana de contexto de 100.000 tokens, contando tanto el prompt como el completado. Esto permite procesar documentos grandes o mantener historiales de conversación largos.
¿Se usan mis prompts para el entrenamiento?
No. No utilizamos tus datos de prompt para entrenar nuestro modelo. Tus datos permanecen privados para tus peticiones de inferencia.
¿Cómo empiezo?
Regístrate con un correo electrónico y una contraseña en la página Obtener clave de API. Recibirás una clave de API de inmediato. Puedes empezar a usar el crédito de prueba gratis de $0.50 sin añadir una tarjeta de crédito.
¿Qué pasa si supero el límite de peticiones?
Permitimos 300 peticiones por minuto por clave de API. Si excedes este límite, recibirás un error 429. Puedes regenerar tu clave de API en cualquier momento para restablecer el contador si es necesario.
Tu clave está a un formulario de distancia
Crea una cuenta, copia la clave, cambia la URL base. Eso es toda la configuración.
Obtener clave de API