Unzensierte LLM-Inferenz
Unzensierte Inference-API für Entwickler
Eine sofort einsetzbare OpenAI-kompatible Inference-API, die ein einzelnes unzensiertes Open-Weight-Modell bereitstellt. Ändere deine base_url und deinen Schlüssel, behalte den Code.
- Ein unzensiertes Modell
- Keine monatlichen Gebühren
- Guthaben verfällt nie
Probiere es mit einer einzigen Anfrage aus
curl https://api.llminferenceapi.com/v1/chat/completions \
-H "Authorization: Bearer $API_KEY" \
-H "Content-Type: application/json" \
-d '{
"model": "uncensored",
"messages": [{"role": "user", "content": "Write a blunt product review of a cheap VPN."}]
}'from openai import OpenAI
client = OpenAI(base_url="https://api.llminferenceapi.com/v1", api_key="YOUR_KEY")
resp = client.chat.completions.create(
model="uncensored",
messages=[{"role": "user", "content": "Summarise this thread without softening it."}],
)
print(resp.choices[0].message.content)import OpenAI from "openai";
const client = new OpenAI({ baseURL: "https://api.llminferenceapi.com/v1", apiKey: process.env.API_KEY });
const resp = await client.chat.completions.create({
model: "uncensored",
messages: [{ role: "user", content: "Draft a villain monologue for my game." }],
});
console.log(resp.choices[0].message.content);Was du bekommst
Sofortige Kompatibilität
Funktioniert mit offiziellen OpenAI-SDKs und jedem kompatiblen Client. Aktualisiere einfach deine base_url auf https://api.llminferenceapi.com/v1 und tausche deinen API-Schlüssel aus.
Unzensierte Ausgabe
Das Modell antwortet ohne Inhaltsablehnungen für rechtmäßige erwachsene, fiktive oder kontroverse Themen. Nur sexuelle Inhalte mit Minderjährigen werden blockiert.
Direktes GPU-Hosting
Wir betreiben das Modell auf unseren eigenen Servern, nicht als Weiterverkäufer. Kein Vendor-Routing, keine versteckten Schichten, nur direkte Inferenz.
Transparente Preisgestaltung
Bezahle nur für das, was du nutzt. Input-Token kosten $0,25/1M, Output-Token kosten $1,00/1M. Keine Abonnements oder Verfallsdaten für Guthaben.
Streaming & Tools
Unterstützt Server-Sent Events (SSE) für Streaming-Antworten und standardmäßige Tool-/Function-Calling-Endpunkte.
Datenschutz zuerst
Prompts werden nicht zum Trainieren deines Modells verwendet. Die Kontoregistrierung erfordert nur eine E-Mail und ein Passwort.
So funktioniert es
Konto erstellen
Melde dich mit E-Mail und Passwort an, um deinen API-Schlüssel sofort zu erhalten.
Guthaben aufladen
Lade mit Krypto (USDT oder USDC) auf, um den Dienst zu nutzen.
Inferenz starten
Leite deinen bestehenden Client-Code auf unsere base_url um und sende Anfragen.
Was Menschen damit bauen
Kreatives Schreiben
Generiere Geschichten und Skripte ohne unerwünschte Moralpredigten oder Inhaltsfilter, die deine narrativen Entscheidungen einschränken. Perfekt für erwachsene Fiktion oder pointierten Humor.
Datenextraktion
Analysiere große Dokumente über das 100k-Kontextfenster, um strukturierte Daten aus langen Texten zu extrahieren, ohne den Kontext zu verlieren.
Forschung & Analyse
Erhalte unzensierte Antworten zu kontroversen oder Nischenthemen, ohne dass das Modell aufgrund standardmäßiger Sicherheitsrichtlinien die Interaktion verweigert.
Chat-Anwendungen
Erstelle Chat-Oberflächen, die natürlich und reaktionsschnell wirken, mit Unterstützung für Streaming-Antworten für ein besseres Benutzererlebnis.
Sofortige OpenAI-Kompatibilität
Hör auf, deinen Integrationscode für jedes neue Modell neu zu schreiben. Unsere API implementiert den Standard-/v1/chat/completions-Endpunkt, sodass du durch einfaches Ändern der base_url und api_key in deinen bestehenden OpenAI-SDK-Clients auf unser unzensiertes Modell wechseln kannst. Wir unterstützen Streaming über Server-Sent Events (SSE) und Function Calling, damit deine bestehende Logik zur Verarbeitung von Tool-Ausgaben oder Echtzeit-Textgenerierung sofort funktioniert.
Dies ist kein Multi-Modell-Gateway oder ein komplexer Proxy, der Latenz hinzufügt. Es ist eine direkte Verbindung zu unseren GPU-Servern, die ein einzelnes, optimiertes Open-Weight-Modell betreiben. Du erhältst die Leistung eines dedizierten Endpunkts mit der Vertrautheit des OpenAI-Formats.
Unzensiert & Ungefiltert
Unser Modell ist darauf abgestimmt, bei rechtmäßiger Erwachsennutzung, fiktiven Erzählungen, Sicherheitsforschung oder kontroversen Themen ohne Inhaltsverweigerung zu antworten. Während die meisten Standardmodelle sensiblen Themen höflich ausweichen oder erwachsenen Inhalt ablehnen, liefert unser Modell eine direkte Antwort.
Es gibt eine harte Grenze, die immer gilt: Anfragen, die sexuelle Inhalte mit Minderjährigen enthalten, werden blockiert. Alles andere ist erlaubt. Dies macht es ideal für Anwendungen, bei denen du die volle kreative Kontrolle über die Ausgabe haben möchtest, ohne dass das Modell als Torwächter für die legitimen Anfragen deiner Benutzer agiert.
Transparente Pay-As-You-Go-Preisgestaltung
Wir binden dich nicht in monatliche Abonnements oder gestaffelte Pläne ein. Du zahlst genau für die Token, die du verbrauchst. Input-Token kosten $0,25 pro Million, Output-Token kosten $1,00 pro Million. Wenn du Guthaben auflädst, verfällt dieses nie, sodass du aufladen kannst, wenn es für dein Budget sinnvoll ist.
Wir bieten Boni für höhere Einzahlungen: +5% Guthaben bei $50-Einzahlungen und +10% bei $100-Einzahlungen. Neue Konten starten mit $0,50 Testguthaben, das 7 Tage gültig ist und keine Kreditkarte erfordert. Diese Struktur stellt sicher, dass du nur das ausgibst, was du nutzt, ohne versteckte Gebühren für Streaming oder Tool-Nutzung.
Wer dies NICHT braucht
Wenn du Bildgenerierung, Audioverarbeitung oder Embeddings benötigst, ist diese API nichts für dich. Wir bieten ausschließlich Text. Wenn du Modell-Routing über mehrere Anbieter hinweg (wie GPT-4, Claude und Llama in einem Aufruf) benötigst, bieten wir das nicht an. Wir konzentrieren uns darauf, das bestmögliche Erlebnis für ein spezifisches unzensiertes Modell zu liefern. Wenn du strenge SLA-Garantien, SOC2-Zertifizierungen oder HIPAA-Konformität benötigst, solltest du Anbieter im Enterprise-Bereich prüfen. Wir sind ein unkomplizierter, auf Entwickler ausgerichteter Inference-Endpunkt.
Fragen und Antworten
Ist dies ein OpenAI-Proxy?
Nein. Wir verkaufen keine OpenAI-Modelle weiter. Wir hosten unser eigenes Open-Weight-Modell auf eigenen GPU-Servern. Es ist im Format OpenAI-kompatibel, akzeptiert also dieselben JSON-Strukturen und SDK-Befehle, aber das zugrunde liegende Modell ist unseres.
Wie groß ist das Kontextfenster?
Unser Modell unterstützt ein Kontextfenster mit 100.000 Token, das sowohl den Prompt als auch die Completion umfasst. Dies ermöglicht die Verarbeitung großer Dokumente oder die Aufrechterhaltung langer Gesprächsverläufe.
Werden meine Prompts zum Training verwendet?
Nein. Wir verwenden deine Prompt-Daten nicht zum Trainieren unseres Modells. Deine Daten bleiben privat und werden nur für deine Inferenz-Anfragen verwendet.
Wie fange ich an?
Melde dich mit E-Mail und Passwort auf der Seite „API-Schlüssel erhalten“ an. Du erhältst sofort deinen API-Schlüssel. Du kannst das kostenlose Testguthaben in Höhe von 0,50 $ nutzen, ohne eine Kreditkarte anzugeben.
Was passiert, wenn ich das Ratenlimit erreiche?
Wir erlauben 300 Anfragen pro Minute pro API-Schlüssel. Wenn du dieses Limit überschreitest, erhältst du einen 429-Fehler. Du kannst deinen API-Schlüssel jederzeit neu generieren, um den Zähler bei Bedarf zurückzusetzen.
Dein Schlüssel ist nur ein Formular entfernt
Erstelle ein Konto, kopiere den Schlüssel, ändere die Base URL. Das ist die gesamte Einrichtung.
API-Schlüssel erhalten