DE ▾
API-Schlüssel erhalten

Unzensierte LLM-Inferenz

Unzensierte Inference-API für Entwickler

Eine sofort einsetzbare OpenAI-kompatible Inference-API, die ein einzelnes unzensiertes Open-Weight-Modell bereitstellt. Ändere deine base_url und deinen Schlüssel, behalte den Code.

  • Ein unzensiertes Modell
  • Keine monatlichen Gebühren
  • Guthaben verfällt nie

Probiere es mit einer einzigen Anfrage aus

curl https://api.llminferenceapi.com/v1/chat/completions \
  -H "Authorization: Bearer $API_KEY" \
  -H "Content-Type: application/json" \
  -d '{
    "model": "uncensored",
    "messages": [{"role": "user", "content": "Write a blunt product review of a cheap VPN."}]
  }'

Was du bekommst

Sofortige Kompatibilität

Funktioniert mit offiziellen OpenAI-SDKs und jedem kompatiblen Client. Aktualisiere einfach deine base_url auf https://api.llminferenceapi.com/v1 und tausche deinen API-Schlüssel aus.

Unzensierte Ausgabe

Das Modell antwortet ohne Inhaltsablehnungen für rechtmäßige erwachsene, fiktive oder kontroverse Themen. Nur sexuelle Inhalte mit Minderjährigen werden blockiert.

Direktes GPU-Hosting

Wir betreiben das Modell auf unseren eigenen Servern, nicht als Weiterverkäufer. Kein Vendor-Routing, keine versteckten Schichten, nur direkte Inferenz.

Transparente Preisgestaltung

Bezahle nur für das, was du nutzt. Input-Token kosten $0,25/1M, Output-Token kosten $1,00/1M. Keine Abonnements oder Verfallsdaten für Guthaben.

Streaming & Tools

Unterstützt Server-Sent Events (SSE) für Streaming-Antworten und standardmäßige Tool-/Function-Calling-Endpunkte.

Datenschutz zuerst

Prompts werden nicht zum Trainieren deines Modells verwendet. Die Kontoregistrierung erfordert nur eine E-Mail und ein Passwort.

So funktioniert es

  1. Konto erstellen

    Melde dich mit E-Mail und Passwort an, um deinen API-Schlüssel sofort zu erhalten.

  2. Guthaben aufladen

    Lade mit Krypto (USDT oder USDC) auf, um den Dienst zu nutzen.

  3. Inferenz starten

    Leite deinen bestehenden Client-Code auf unsere base_url um und sende Anfragen.

Was Menschen damit bauen

Kreatives Schreiben

Generiere Geschichten und Skripte ohne unerwünschte Moralpredigten oder Inhaltsfilter, die deine narrativen Entscheidungen einschränken. Perfekt für erwachsene Fiktion oder pointierten Humor.

Datenextraktion

Analysiere große Dokumente über das 100k-Kontextfenster, um strukturierte Daten aus langen Texten zu extrahieren, ohne den Kontext zu verlieren.

Forschung & Analyse

Erhalte unzensierte Antworten zu kontroversen oder Nischenthemen, ohne dass das Modell aufgrund standardmäßiger Sicherheitsrichtlinien die Interaktion verweigert.

Chat-Anwendungen

Erstelle Chat-Oberflächen, die natürlich und reaktionsschnell wirken, mit Unterstützung für Streaming-Antworten für ein besseres Benutzererlebnis.

Sofortige OpenAI-Kompatibilität

Hör auf, deinen Integrationscode für jedes neue Modell neu zu schreiben. Unsere API implementiert den Standard-/v1/chat/completions-Endpunkt, sodass du durch einfaches Ändern der base_url und api_key in deinen bestehenden OpenAI-SDK-Clients auf unser unzensiertes Modell wechseln kannst. Wir unterstützen Streaming über Server-Sent Events (SSE) und Function Calling, damit deine bestehende Logik zur Verarbeitung von Tool-Ausgaben oder Echtzeit-Textgenerierung sofort funktioniert.

Dies ist kein Multi-Modell-Gateway oder ein komplexer Proxy, der Latenz hinzufügt. Es ist eine direkte Verbindung zu unseren GPU-Servern, die ein einzelnes, optimiertes Open-Weight-Modell betreiben. Du erhältst die Leistung eines dedizierten Endpunkts mit der Vertrautheit des OpenAI-Formats.

Unzensiert & Ungefiltert

Unser Modell ist darauf abgestimmt, bei rechtmäßiger Erwachsennutzung, fiktiven Erzählungen, Sicherheitsforschung oder kontroversen Themen ohne Inhaltsverweigerung zu antworten. Während die meisten Standardmodelle sensiblen Themen höflich ausweichen oder erwachsenen Inhalt ablehnen, liefert unser Modell eine direkte Antwort.

Es gibt eine harte Grenze, die immer gilt: Anfragen, die sexuelle Inhalte mit Minderjährigen enthalten, werden blockiert. Alles andere ist erlaubt. Dies macht es ideal für Anwendungen, bei denen du die volle kreative Kontrolle über die Ausgabe haben möchtest, ohne dass das Modell als Torwächter für die legitimen Anfragen deiner Benutzer agiert.

Transparente Pay-As-You-Go-Preisgestaltung

Wir binden dich nicht in monatliche Abonnements oder gestaffelte Pläne ein. Du zahlst genau für die Token, die du verbrauchst. Input-Token kosten $0,25 pro Million, Output-Token kosten $1,00 pro Million. Wenn du Guthaben auflädst, verfällt dieses nie, sodass du aufladen kannst, wenn es für dein Budget sinnvoll ist.

Wir bieten Boni für höhere Einzahlungen: +5% Guthaben bei $50-Einzahlungen und +10% bei $100-Einzahlungen. Neue Konten starten mit $0,50 Testguthaben, das 7 Tage gültig ist und keine Kreditkarte erfordert. Diese Struktur stellt sicher, dass du nur das ausgibst, was du nutzt, ohne versteckte Gebühren für Streaming oder Tool-Nutzung.

Wer dies NICHT braucht

Wenn du Bildgenerierung, Audioverarbeitung oder Embeddings benötigst, ist diese API nichts für dich. Wir bieten ausschließlich Text. Wenn du Modell-Routing über mehrere Anbieter hinweg (wie GPT-4, Claude und Llama in einem Aufruf) benötigst, bieten wir das nicht an. Wir konzentrieren uns darauf, das bestmögliche Erlebnis für ein spezifisches unzensiertes Modell zu liefern. Wenn du strenge SLA-Garantien, SOC2-Zertifizierungen oder HIPAA-Konformität benötigst, solltest du Anbieter im Enterprise-Bereich prüfen. Wir sind ein unkomplizierter, auf Entwickler ausgerichteter Inference-Endpunkt.

Fragen und Antworten

Ist dies ein OpenAI-Proxy?

Nein. Wir verkaufen keine OpenAI-Modelle weiter. Wir hosten unser eigenes Open-Weight-Modell auf eigenen GPU-Servern. Es ist im Format OpenAI-kompatibel, akzeptiert also dieselben JSON-Strukturen und SDK-Befehle, aber das zugrunde liegende Modell ist unseres.

Wie groß ist das Kontextfenster?

Unser Modell unterstützt ein Kontextfenster mit 100.000 Token, das sowohl den Prompt als auch die Completion umfasst. Dies ermöglicht die Verarbeitung großer Dokumente oder die Aufrechterhaltung langer Gesprächsverläufe.

Werden meine Prompts zum Training verwendet?

Nein. Wir verwenden deine Prompt-Daten nicht zum Trainieren unseres Modells. Deine Daten bleiben privat und werden nur für deine Inferenz-Anfragen verwendet.

Wie fange ich an?

Melde dich mit E-Mail und Passwort auf der Seite „API-Schlüssel erhalten“ an. Du erhältst sofort deinen API-Schlüssel. Du kannst das kostenlose Testguthaben in Höhe von 0,50 $ nutzen, ohne eine Kreditkarte anzugeben.

Was passiert, wenn ich das Ratenlimit erreiche?

Wir erlauben 300 Anfragen pro Minute pro API-Schlüssel. Wenn du dieses Limit überschreitest, erhältst du einen 429-Fehler. Du kannst deinen API-Schlüssel jederzeit neu generieren, um den Zähler bei Bedarf zurückzusetzen.

Dein Schlüssel ist nur ein Formular entfernt

Erstelle ein Konto, kopiere den Schlüssel, ändere die Base URL. Das ist die gesamte Einrichtung.

API-Schlüssel erhalten