DE ▾
API-Schlüssel erhalten

LLM Inference APIPreise

Inference-API: Einfache, transparente Preise

Prepaid-Guthaben speist jede Anfrage unserer Pay as you go Inference-API mit transparenten Token-Preisen und ohne versteckte Abonnementgebühren. Dein Saldo deckt die Nutzung genau ab und sorgt für kalkulierbare Kosten vom ersten bis zum letzten Token.

$0,25pro 1 Mio. Input-Token
$1,00Output-Token / 1 Mio.
100.000Token-Kontext
$0,50Testguthaben
300Anfragen pro Minute

Kein Abonnement. Prepaid-Guthaben verfällt nie.

Kostenrechner

$0.00

Rechenbeispiele

Zusammenfassung eines langen technischen Dokuments

Die Verarbeitung eines Prompts mit 50.000 Token zur Generierung einer Zusammenfassung mit 1.000 Token kostet $0,0125 für Input und $0,001 für Output, insgesamt $0,0135. Diese Arbeitslast passt gut in unser Kontextfenster mit 100k Token und zeigt kostengünstige Batch-Verarbeitung.

Chat-Sitzung für Power-User

Eine Sitzung mit einem Kontextfenster von 10.000 Token und 2.000 Output-Token kostet $0,0025 für Input und $0,002 für Output. Insgesamt $0,0045, was zeigt, dass das Token-Modell auch bei umfangreichem Kontext für interaktive Nutzung wirtschaftlich bleibt.

Generierung großer Textmengen

Die Generierung von 50.000 Output-Token aus einem kleinen 1.000-Token-Prompt kostet $0,00025 für Input und $0,05 für Output. Insgesamt $0,05025, was zeigt, dass Output-Token den Großteil der Kosten in inhaltsintensiven Workflows verursachen.

Token-Preise

Unsere Inferenz-API berechnet strikt nach Token-Volumen, Input-Token kosten $0,25 pro Million und Output-Token kosten $1,00 pro Million. Diese Struktur spiegelt den Rechenunterschied zwischen dem Lesen von Kontext und dem Generieren von Text wider. Input-Token decken das Kontextfenster mit 100.000 Token ab, sodass du große Prompts oder Konversationsverläufe übergeben kannst. Output-Token werden für die Generierung des Modells abgerechnet. Da wir Funktionen wie Bild- oder Audiogenerierung nicht bündeln, zahlst du nur für den Text, den du tatsächlich verarbeitest. Dieses Pay-as-you-go-Modell stellt sicher, dass Nutzer mit hohem Volumen nicht mehr für ungenutzte Fähigkeiten bezahlen. Die Preisgestaltung ist transparent, ohne Kosten pro Anfrage oder Mindestgebühren. Du kannst deine genauen Kosten berechnen, indem du deine Token-Anzahlen mit diesen Sätzen multiplizierst. Dieser Ansatz hält die Kosten sowohl für kurze Interaktionen als auch für langlaufende LLM-Hosting-Szenarien vorhersehbar.

Prepaid-Guthaben

Jede Anfrage wird von deinem Prepaid-Guthaben abgezogen, das verfällt nie. Du lädst mit einem Minimum von $10 mit Krypto (USDT oder USDC) auf. Dieses Modell stellt sicher, dass deine Nutzung niemals das überschreitet, was du geladen hast, und bietet strenge Budgetkontrolle. Im Gegensatz zu Abonnementdiensten zahlst du nur für das, was du verbrauchst, was es zu einem effizienten LLM-Proxy für variable Arbeitslasten macht. Credits werden sofort angewendet, sodass du sofortigen Zugriff auf die API hast. Es gibt keine monatlichen Gebühren oder wiederkehrenden Kosten, sodass du nur bei Bedarf aufladen kannst. Diese Flexibilität unterstützt Entwickler, die Burst-Kapazität benötigen oder das unzensierte LLM testen möchten, ohne sich an einen langfristigen Vertrag zu binden. Dein Guthaben bleibt unbegrenzt verfügbar, sodass du die Nutzung pausieren kannst, ohne dein Geld zu verlieren.

Bonus-Guthaben

Wir belohnen größere Aufladungen mit Bonusguthaben, um deine Nutzung weiter zu verlängern. Das Hinzufügen von $50 gewährt einen Bonus von 5 %, während $100 einen Bonus von 10 % auf dein Konto hinzufügen. Diese Boni werden auf dein Prepaid-Guthaben angewendet und für den Standard-Token-Verbrauch verwendet. Diese Funktion senkt die effektiven Kosten pro Token für Power-User, die ein höheres Guthaben halten. Das Bonusguthaben verfällt nicht und unterliegt denselben Nutzungsregeln wie dein Hauptguthaben. Diese Struktur unterstützt eine konstante LLM-Gateway-Nutzung ohne die Reibung häufiger kleiner Transaktionen. Sie macht auch die Inferenz-API für Teams oder Einzelpersonen mit vorhersehbaren, anhaltenden Anforderungen kostengünstiger. Bonusguthaben werden automatisch nach erfolgreicher Aufladung hinzugefügt.

Limits und Leistungen

Alle Funktionen zum gleichen Preis – Function Calling und JSON-Modus ohne Aufpreis.

MerkmalWert
Function Callingja – tools, tool_choice; Antworten mit tool_calls, auch im Stream; Ergebnisse als role: tool
Max. Ausgabebis zum Rest des 64.000-Token-Fensters; max_tokens optional (kein separates Limit)
Kontextfenster64.000 Tokens (Eingabe + Ausgabe)
JSON-Modusresponse_format: {"type": "json_object"}
Parallelität8 gleichzeitige Anfragen pro Schlüssel
Ratenlimit300 Anfragen pro Minute und Schlüssel
AufladenUSDT (TRC20) oder USDC (Base), jeder ganze Betrag von $10 bis $500
Preis$0,25 pro 1 Mio. Eingabe-Tokens · $1,00 pro 1 Mio. Ausgabe-Tokens
Testguthaben$0,50 für 7 Tage, ohne Karte · Testschlüssel: 2 parallele Anfragen, 60 pro Minute; volle Limits (8 und 300) nach erster Aufladung
Bonus+5 % ab $50, +10 % ab $100
Gültigkeitbezahltes Guthaben verfällt nie, kein Abo

Alle technischen Daten und Fehlercodes stehen in der Dokumentation.

Fragen und Antworten

Verfallen Prepaid-Guthaben?

Nein, dein Prepaid-Guthaben verfällt nie. Du kannst dein Konto jederzeit aufladen, und der Saldo bleibt unbegrenzt verfügbar, bis du ihn für API-Anfragen verwendest.

Was passiert, wenn ich mein Ratenlimit überschreite?

Wenn du das Limit von 300 Anfragen pro Minute überschreitest, erhältst du einen normalen Ratenlimit-Fehler. Dein Prepaid-Guthaben wird durch Ratenlimits nicht beeinträchtigt; du musst einfach warten, bis sich das Zeitfenster zurücksetzt, bevor du weitere Anfragen sendest.

Kann ich die API für kommerzielle Zwecke nutzen?

Ja, unser <strong>unzensiertes LLM</strong> ist für die legale Erwachsenenverwendung verfügbar, einschließlich kommerzieller Anwendungen. Solange der Inhalt keine sexuelle Darstellung von Minderjährigen beinhaltet, kannst du die API für jeden legalen Zweck nutzen, einschließlich Geschäft, Forschung oder Unterhaltung.

Wie kann ich meine Token-Nutzung verfolgen?

Du kannst deine Token-Nutzung direkt in deinem Konto-Dashboard überwachen. Jede API-Antwort enthält Token-Anzahlen für Input und Output, sodass du deine Kosten überprüfen kannst. Du kannst auch jederzeit deinen verbleibenden Saldo prüfen, um sicherzustellen, dass du für deine nächste Anfrage über ausreichende Guthaben verfügst.

Dein Schlüssel ist nur ein Formular entfernt

Erstelle ein Konto, kopiere den Schlüssel, ändere die Basis-URL. Das ist die gesamte Einrichtung.

API-Schlüssel erhalten