Inferência LLM Sem Censura
API de Inferência Sem Censura para Desenvolvedores
Uma API de inferência compatível com OpenAI pronta para usar, servindo um único modelo de pesos abertos sem censura. Altere seu base_url e chave, mantenha o código.
- Um modelo sem censura
- Sem mensalidades
- Créditos nunca expiram
Teste com uma única requisição
curl https://api.llminferenceapi.com/v1/chat/completions \
-H "Authorization: Bearer $API_KEY" \
-H "Content-Type: application/json" \
-d '{
"model": "uncensored",
"messages": [{"role": "user", "content": "Write a blunt product review of a cheap VPN."}]
}'from openai import OpenAI
client = OpenAI(base_url="https://api.llminferenceapi.com/v1", api_key="YOUR_KEY")
resp = client.chat.completions.create(
model="uncensored",
messages=[{"role": "user", "content": "Summarise this thread without softening it."}],
)
print(resp.choices[0].message.content)import OpenAI from "openai";
const client = new OpenAI({ baseURL: "https://api.llminferenceapi.com/v1", apiKey: process.env.API_KEY });
const resp = await client.chat.completions.create({
model: "uncensored",
messages: [{ role: "user", content: "Draft a villain monologue for my game." }],
});
console.log(resp.choices[0].message.content);O que você recebe
Compatibilidade Pronta para Usar
Funciona com SDKs oficiais da OpenAI e qualquer cliente compatível. Basta atualizar seu base_url para https://api.llminferenceapi.com/v1 e trocar sua chave de API.
Saída Sem Censura
O modelo responde sem recusas de conteúdo para assuntos adultos lícitos, ficcionais ou controversos. Apenas conteúdo sexual envolvendo menores é bloqueado.
Hospedagem Direta de GPU
Executamos o modelo em nossos próprios servidores, não como revendedor. Sem roteamento de fornecedor, sem camadas ocultas, apenas inferência direta.
Preços Transparentes
Pague apenas pelo que usar. Tokens de entrada custam $0.25/1M, tokens de saída custam $1.00/1M. Sem assinaturas ou datas de expiração para os créditos.
Streaming e Ferramentas
Suporta Server-Sent Events (SSE) para respostas em streaming e endpoints padrão de chamada de funções/ferramentas.
Privacidade em Primeiro Lugar
Os prompts não são usados para treinar seu modelo. A criação de conta requer apenas um e-mail e uma senha.
Como funciona
Criar conta
Registre-se com um e-mail e senha para obter sua chave de API instantaneamente.
Adicionar crédito
Recarregue com criptomoedas (USDT ou USDC) para começar a usar o serviço.
Iniciar Inferência
Aponte seu código de cliente existente para nosso base_url e envie requisições.
O que as pessoas constroem com isso
Escrita Criativa
Gere histórias e roteiros sem moralização indesejada ou filtros de conteúdo restringindo suas escolhas narrativas. Perfeito para ficção adulta ou humor ousado.
Extração de Dados
Analise grandes documentos usando a janela de contexto de 100k para extrair dados estruturados de textos longos sem perder o contexto.
Pesquisa e Análise
Obtenha respostas sem filtros para tópicos controversos ou de nicho sem que o modelo se recuse a interagir devido a diretrizes padrão de segurança.
Aplicativos de Chat
Crie interfaces de chat que pareçam naturais e responsivas, suportando respostas em streaming para uma melhor experiência do usuário.
Compatibilidade OpenAI Pronta para Usar
Pare de reescrever o código de integração para cada novo modelo. Nossa API implementa o endpoint padrão /v1/chat/completions, o que significa que você pode alternar para nosso modelo sem censura apenas alterando o base_url e o api_key nos seus clientes existentes do SDK OpenAI. Suportamos streaming via Server-Sent Events (SSE) e chamada de funções, para que sua lógica existente para lidar com saídas de ferramentas ou geração de texto em tempo real funcione pronta para uso.
Este não é um gateway multi-modelo ou um proxy complexo que adiciona latência. É uma conexão direta com nossos servidores GPU executando um único modelo de pesos abertos otimizado. Você obtém o desempenho de um endpoint dedicado com a familiaridade do formato OpenAI.
Sem Censura e Sem Filtros
Nosso modelo é ajustado para responder sem recusa de conteúdo para uso adulto lícito, narrativas fictícias, pesquisa de segurança ou tópicos controversos. Embora a maioria dos modelos padrão se recuse educadamente a discutir assuntos sensíveis ou gerar conteúdo maduro, nosso modelo fornecerá uma resposta direta.
Há um limite rígido que sempre se aplica: requisições contendo conteúdo sexual envolvendo menores são bloqueadas. Tudo o mais é permitido. Isso o torna ideal para aplicativos onde você deseja controle total criativo sobre a saída sem que o modelo atue como um guardião das requisições legítimas dos seus usuários.
Preços Transparentes de Pagamento por Uso
Não travamos você em assinaturas mensais ou planos por camadas. Você paga exatamente pelos tokens que consome. Tokens de entrada custam $0.25 por milhão, e tokens de saída custam $1.00 por milhão. Ao adicionar fundos, esses créditos nunca expiram, então você pode recarregar quando fizer sentido para seu orçamento.
Oferecemos bônus para depósitos maiores: +5% de crédito em depósitos de $50 e +10% em depósitos de $100. Contas novas começam com $0.50 em crédito de teste válido por 7 dias, sem necessidade de cartão de crédito. Essa estrutura garante que você gaste apenas o que usar, sem taxas ocultas para streaming ou uso de ferramentas.
Para Quem Isso NÃO É IDEAL
Se você precisa de geração de imagens, processamento de áudio ou embeddings, esta API não é para você. Servimos apenas texto. Se você precisa de roteamento de modelo entre vários fornecedores (como GPT-4, Claude e Llama em uma única chamada), não oferecemos isso. Focamos em oferecer a melhor experiência possível para um modelo sem censura específico. Se você precisa de garantias de SLA rigorosas, certificações SOC2 ou conformidade HIPAA pronta para uso, você deve procurar provedores de nível empresarial. Somos um endpoint de inferência direto e feito para desenvolvedores.
Perguntas e respostas
Isso é um proxy da OpenAI?
Não. Não estamos revendendo os modelos da OpenAI. Hospedamos nosso próprio modelo de pesos abertos em nossos próprios servidores GPU. É compatível com o formato da OpenAI, o que significa que aceita as mesmas estruturas JSON e comandos de SDK, mas o modelo subjacente é nosso.
Qual é o tamanho da janela de contexto?
Nosso modelo suporta uma janela de contexto de 100.000 tokens, contando tanto o prompt quanto a completion. Isso permite processar documentos grandes ou manter históricos de conversas longas.
Meus prompts são usados para treinamento?
Não. Não usamos seus dados de prompt para treinar nosso modelo. Seus dados permanecem privados para suas requisições de inferência.
Como começar?
Crie uma conta com e-mail e senha na página Obter Chave de API. Você receberá uma chave de API imediatamente. Você pode começar a usar o crédito de teste grátis de $0,50 sem precisar de cartão de crédito.
O que acontece se eu atingir o limite de requisições?
Permitimos 300 requisições por minuto por chave de API. Se você exceder isso, receberá um erro 429. Você pode regenerar sua chave de API a qualquer momento para redefinir o contador, se necessário.
Sua chave está a um formulário de distância
Crie uma conta, copie a chave, altere a URL base. Essa é toda a configuração.
Obter chave de API