IT ▾
Ottieni la chiave API

Inferenza LLM senza censura

API di inferenza senza censura per gli sviluppatori

Un'API di inferenza compatibile con OpenAI pronta all'uso che serve un singolo modello a pesi aperti senza censura. Cambia il tuo base_url e la chiave, mantieni il codice.

  • Un modello senza censura
  • Nessun canone mensile
  • I crediti non scadono mai

Provalo con una sola richiesta

curl https://api.llminferenceapi.com/v1/chat/completions \
  -H "Authorization: Bearer $API_KEY" \
  -H "Content-Type: application/json" \
  -d '{
    "model": "uncensored",
    "messages": [{"role": "user", "content": "Write a blunt product review of a cheap VPN."}]
  }'

Cosa ottieni

Compatibilità pronta all’uso

Funziona con gli SDK ufficiali di OpenAI e qualsiasi client compatibile. Aggiorna solo il tuo base_url a https://api.llminferenceapi.com/v1 e scambia la tua chiave API.

Output senza censura

Il modello risponde senza rifiuti di contenuto per argomenti adulti leciti, fiction o controversi. Viene bloccato solo il contenuto sessuale che coinvolge minori.

Hosting GPU diretto

Eseguiamo il modello sui nostri server, non come rivenditore. Nessun routing del vendor, nessun livello nascosto, solo inferenza diretta.

Prezzi trasparenti

Paga solo per quello che usi. I token di input sono $0,25/1M, i token di output sono $1,00/1M. Nessuna abbonamento o date di scadenza sui crediti.

Streaming e strumenti

Supporta gli eventi inviati dal server (SSE) per le risposte in streaming e gli endpoint standard per la chiamata di funzioni.

Privacy prima di tutto

I prompt non vengono utilizzati per addestrare il tuo modello. La creazione dell'account richiede solo un'email e una password.

Come funziona

  1. Crea account

    Registrati con un'email e una password per ottenere la tua chiave API istantaneamente.

  2. Aggiungi credito

    Ricarica con criptovalute (USDT o USDC) per iniziare a utilizzare il servizio.

  3. Avvia inferenza

    Indirizza il tuo codice client esistente al nostro base_url e invia richieste.

Cosa costruiscono le persone con esso

Scrittura creativa

Genera storie e sceneggiature senza moralizzazione indesiderata o filtri sui contenuti che limitano le tue scelte narrative. Perfetto per la narrativa per adulti o l'umorismo spinto.

Estrazione di dati

Analizza documenti di grandi dimensioni sfruttando la finestra di contesto da 100k per estrarre dati strutturati da testi lunghi senza perdere il contesto.

Ricerca e analisi

Ottieni risposte non filtrate su argomenti controversi o di nicchia senza che il modello rifiuti di interagire a causa delle normali linee guida di sicurezza.

Applicazioni chat

Crea interfacce chat che sembrano naturali e reattive, supportando le risposte in streaming per una migliore esperienza utente.

Compatibilità OpenAI pronta all’uso

Smetti di riscrivere il codice di integrazione per ogni nuovo modello. La nostra API implementa l'endpoint standard /v1/chat/completions, il che significa che puoi passare al nostro modello senza censura modificando semplicemente il base_url e api_key nei tuoi client SDK OpenAI esistenti. Supportiamo lo streaming tramite Server-Sent Events (SSE) e la chiamata di funzioni, quindi la tua logica esistente per la gestione degli output degli strumenti o la generazione di testo in tempo reale funziona già.

Questa non è un gateway multi-modello o un proxy complesso che aggiunge latenza. È una connessione diretta ai nostri server GPU che eseguono un singolo modello a pesi aperti ottimizzato. Ottieni le prestazioni di un endpoint dedicato con la familiarità del formato OpenAI.

Senza censura e senza filtri

Il nostro modello è ottimizzato per rispondere senza rifiuti di contenuto per usi adulti leciti, narrazioni fiction, ricerca sulla sicurezza o argomenti controversi. Mentre la maggior parte dei modelli standard rifiuterà educatamente di discutere argomenti sensibili o generare contenuti maturi, il nostro modello fornirà una risposta diretta.

C'è un limite rigido che si applica sempre: le richieste contenenti contenuti sessuali che coinvolgono minori vengono bloccate. Tutto il resto è lecito. Questo lo rende ideale per le applicazioni in cui si desidera un controllo creativo completo sull'output senza che il modello agisca come guardiano per le richieste legittime degli utenti.

Prezzi trasparenti a consumo

Non ti blocchiamo in abbonamenti mensili o piani a livelli. Paghi esattamente per i token che consumi. I token di input costano $0,25 per milione, e i token di output costano $1,00 per milione. Quando aggiungi fondi, quei crediti non scadono mai, quindi puoi ricaricare quando ha senso per il tuo budget.

Offriamo bonus per depositi più grandi: +5% di credito su depositi di $50 e +10% su depositi di $100. I nuovi account iniziano con $0,50 di credito di prova valido per 7 giorni, senza necessità di carta di credito. Questa struttura garantisce che tu spenda solo ciò che usi, senza costi nascosti per lo streaming o l'uso di strumenti.

Per chi NON è adatto

Se ti servono generazione di immagini, elaborazione audio o embedding, questa API non fa per te. Forniamo solo testo. Se hai bisogno di instradamento del modello tra più fornitori (come GPT-4, Claude e Llama in una sola chiamata), non lo offriamo. Ci concentriamo sull'offrire l'esperienza migliore per un singolo modello senza censura. Se ti servono garanzie SLA rigorose, certificazioni SOC2 o conformità HIPAA pronto all’uso, dovresti valutare provider di livello enterprise. Siamo un endpoint di inferazione diretto, pensato per gli sviluppatori.

Domande e risposte

È un proxy di OpenAI?

No. Non rivendiamo i modelli di OpenAI. Ospitiamo il nostro modello a pesi aperti sui nostri server GPU. È compatibile con OpenAI nel formato, il che significa che accetta le stesse strutture JSON e comandi SDK, ma il modello sottostante è nostro.

Qual è la dimensione della finestra di contesto?

Il nostro modello supporta una finestra di contesto di 100.000 token, che include sia il prompt che il completamento. Questo permette di elaborare documenti di grandi dimensioni o di mantenere cronologie di conversazioni lunghe.

I miei prompt vengono usati per l'addestramento?

No. Non utilizziamo i dati del tuo prompt per addestrare il nostro modello. I tuoi dati rimangono privati e sono associati alle tue richieste di inferenza.

Come iniziare?

Registrati con email e password nella pagina Ottieni chiave API. Riceverai immediatamente una chiave API. Puoi iniziare a utilizzare il credito di prova gratuito da $0,50 senza aggiungere una carta di credito.

Cosa succede se superi il limite di richieste?

Consentiamo 300 richieste al minuto per chiave API. Se superi questo limite, riceverai un errore 429. Puoi rigenerare la tua chiave API in qualsiasi momento per azzerare il contatore, se necessario.

La tua chiave è a un modulo di distanza

Crea un account, copia la chiave, modifica l'URL di base. È tutta qui la configurazione.

Ottieni la chiave API