Inferenza LLM senza censura
API di inferenza senza censura per gli sviluppatori
Un'API di inferenza compatibile con OpenAI pronta all'uso che serve un singolo modello a pesi aperti senza censura. Cambia il tuo base_url e la chiave, mantieni il codice.
- Un modello senza censura
- Nessun canone mensile
- I crediti non scadono mai
Provalo con una sola richiesta
curl https://api.llminferenceapi.com/v1/chat/completions \
-H "Authorization: Bearer $API_KEY" \
-H "Content-Type: application/json" \
-d '{
"model": "uncensored",
"messages": [{"role": "user", "content": "Write a blunt product review of a cheap VPN."}]
}'from openai import OpenAI
client = OpenAI(base_url="https://api.llminferenceapi.com/v1", api_key="YOUR_KEY")
resp = client.chat.completions.create(
model="uncensored",
messages=[{"role": "user", "content": "Summarise this thread without softening it."}],
)
print(resp.choices[0].message.content)import OpenAI from "openai";
const client = new OpenAI({ baseURL: "https://api.llminferenceapi.com/v1", apiKey: process.env.API_KEY });
const resp = await client.chat.completions.create({
model: "uncensored",
messages: [{ role: "user", content: "Draft a villain monologue for my game." }],
});
console.log(resp.choices[0].message.content);Cosa ottieni
Compatibilità pronta all’uso
Funziona con gli SDK ufficiali di OpenAI e qualsiasi client compatibile. Aggiorna solo il tuo base_url a https://api.llminferenceapi.com/v1 e scambia la tua chiave API.
Output senza censura
Il modello risponde senza rifiuti di contenuto per argomenti adulti leciti, fiction o controversi. Viene bloccato solo il contenuto sessuale che coinvolge minori.
Hosting GPU diretto
Eseguiamo il modello sui nostri server, non come rivenditore. Nessun routing del vendor, nessun livello nascosto, solo inferenza diretta.
Prezzi trasparenti
Paga solo per quello che usi. I token di input sono $0,25/1M, i token di output sono $1,00/1M. Nessuna abbonamento o date di scadenza sui crediti.
Streaming e strumenti
Supporta gli eventi inviati dal server (SSE) per le risposte in streaming e gli endpoint standard per la chiamata di funzioni.
Privacy prima di tutto
I prompt non vengono utilizzati per addestrare il tuo modello. La creazione dell'account richiede solo un'email e una password.
Come funziona
Crea account
Registrati con un'email e una password per ottenere la tua chiave API istantaneamente.
Aggiungi credito
Ricarica con criptovalute (USDT o USDC) per iniziare a utilizzare il servizio.
Avvia inferenza
Indirizza il tuo codice client esistente al nostro base_url e invia richieste.
Cosa costruiscono le persone con esso
Scrittura creativa
Genera storie e sceneggiature senza moralizzazione indesiderata o filtri sui contenuti che limitano le tue scelte narrative. Perfetto per la narrativa per adulti o l'umorismo spinto.
Estrazione di dati
Analizza documenti di grandi dimensioni sfruttando la finestra di contesto da 100k per estrarre dati strutturati da testi lunghi senza perdere il contesto.
Ricerca e analisi
Ottieni risposte non filtrate su argomenti controversi o di nicchia senza che il modello rifiuti di interagire a causa delle normali linee guida di sicurezza.
Applicazioni chat
Crea interfacce chat che sembrano naturali e reattive, supportando le risposte in streaming per una migliore esperienza utente.
Compatibilità OpenAI pronta all’uso
Smetti di riscrivere il codice di integrazione per ogni nuovo modello. La nostra API implementa l'endpoint standard /v1/chat/completions, il che significa che puoi passare al nostro modello senza censura modificando semplicemente il base_url e api_key nei tuoi client SDK OpenAI esistenti. Supportiamo lo streaming tramite Server-Sent Events (SSE) e la chiamata di funzioni, quindi la tua logica esistente per la gestione degli output degli strumenti o la generazione di testo in tempo reale funziona già.
Questa non è un gateway multi-modello o un proxy complesso che aggiunge latenza. È una connessione diretta ai nostri server GPU che eseguono un singolo modello a pesi aperti ottimizzato. Ottieni le prestazioni di un endpoint dedicato con la familiarità del formato OpenAI.
Senza censura e senza filtri
Il nostro modello è ottimizzato per rispondere senza rifiuti di contenuto per usi adulti leciti, narrazioni fiction, ricerca sulla sicurezza o argomenti controversi. Mentre la maggior parte dei modelli standard rifiuterà educatamente di discutere argomenti sensibili o generare contenuti maturi, il nostro modello fornirà una risposta diretta.
C'è un limite rigido che si applica sempre: le richieste contenenti contenuti sessuali che coinvolgono minori vengono bloccate. Tutto il resto è lecito. Questo lo rende ideale per le applicazioni in cui si desidera un controllo creativo completo sull'output senza che il modello agisca come guardiano per le richieste legittime degli utenti.
Prezzi trasparenti a consumo
Non ti blocchiamo in abbonamenti mensili o piani a livelli. Paghi esattamente per i token che consumi. I token di input costano $0,25 per milione, e i token di output costano $1,00 per milione. Quando aggiungi fondi, quei crediti non scadono mai, quindi puoi ricaricare quando ha senso per il tuo budget.
Offriamo bonus per depositi più grandi: +5% di credito su depositi di $50 e +10% su depositi di $100. I nuovi account iniziano con $0,50 di credito di prova valido per 7 giorni, senza necessità di carta di credito. Questa struttura garantisce che tu spenda solo ciò che usi, senza costi nascosti per lo streaming o l'uso di strumenti.
Per chi NON è adatto
Se ti servono generazione di immagini, elaborazione audio o embedding, questa API non fa per te. Forniamo solo testo. Se hai bisogno di instradamento del modello tra più fornitori (come GPT-4, Claude e Llama in una sola chiamata), non lo offriamo. Ci concentriamo sull'offrire l'esperienza migliore per un singolo modello senza censura. Se ti servono garanzie SLA rigorose, certificazioni SOC2 o conformità HIPAA pronto all’uso, dovresti valutare provider di livello enterprise. Siamo un endpoint di inferazione diretto, pensato per gli sviluppatori.
Domande e risposte
È un proxy di OpenAI?
No. Non rivendiamo i modelli di OpenAI. Ospitiamo il nostro modello a pesi aperti sui nostri server GPU. È compatibile con OpenAI nel formato, il che significa che accetta le stesse strutture JSON e comandi SDK, ma il modello sottostante è nostro.
Qual è la dimensione della finestra di contesto?
Il nostro modello supporta una finestra di contesto di 100.000 token, che include sia il prompt che il completamento. Questo permette di elaborare documenti di grandi dimensioni o di mantenere cronologie di conversazioni lunghe.
I miei prompt vengono usati per l'addestramento?
No. Non utilizziamo i dati del tuo prompt per addestrare il nostro modello. I tuoi dati rimangono privati e sono associati alle tue richieste di inferenza.
Come iniziare?
Registrati con email e password nella pagina Ottieni chiave API. Riceverai immediatamente una chiave API. Puoi iniziare a utilizzare il credito di prova gratuito da $0,50 senza aggiungere una carta di credito.
Cosa succede se superi il limite di richieste?
Consentiamo 300 richieste al minuto per chiave API. Se superi questo limite, riceverai un errore 429. Puoi rigenerare la tua chiave API in qualsiasi momento per azzerare il contatore, se necessario.
La tua chiave è a un modulo di distanza
Crea un account, copia la chiave, modifica l'URL di base. È tutta qui la configurazione.
Ottieni la chiave API