LLM Inference APICennik
API Inference: Prosty, przejrzysty cennik
Kredyty przedpłacone obsługują każde zapytanie w naszym API inferencji z opłatą za użycie, z przejrzystymi stawkami za token i bez ukrytych opłat subskrypcyjnych. Twoje saldo pokrywa zużycie dokładnie.
Brak subskrypcji. Kredyty przedpłacone nigdy nie wygasają.
Kalkulator kosztów
Przykładowe wyliczenia
Podsumowanie długiego dokumentu technicznego
Przetworzenie promptu o długości 50 000 tokenów i wygenerowanie podsumowania o długości 1 000 tokenów kosztuje $0,0125 za dane wejściowe i $0,001 za dane wyjściowe, co daje łącznie $0,0135. Takie obciążenie mieści się w naszym oknie kontekstu 100k i pokazuje niskokosztowe przetwarzanie wsadowe.
Sesja czatu dla zaawansowanych użytkowników
Sesja z oknem kontekstu 10 000 tokenów i 2 000 tokenami wyjściowymi kosztuje $0,0025 za dane wejściowe i $0,002 za dane wyjściowe. Łącznie daje to $0,0045, co pokazuje, że nawet przy dużym kontekście model oparty na tokenach pozostaje ekonomiczny w użyciu interaktywnym.
Generowanie treści w dużym zakresie
Wygenerowanie 50 000 tokenów wyjściowych z małego promptu 1 000 tokenów kosztuje $0,00025 za dane wejściowe i $0,05 za dane wyjściowe. Łącznie daje to $0,05025, co ilustruje, że tokeny wyjściowe generują większość kosztów w przepływach pracy wymagających dużej ilości treści.
Cennik tokenów
Nasz API do wnioskowania nalicza opłaty ściśle według liczby tokenów: dane wejściowe kosztują $0,25 za milion tokenów, a dane wyjściowe $1,00 za milion tokenów. Taka struktura odzwierciedla różnicę obliczeniową między odczytywaniem kontekstu a generowaniem tekstu. Tokeny wejściowe obejmują okno kontekstu 100 000 tokenów, pozwalając na przekazanie dużych promptów lub historii rozmów. Tokeny wyjściowe są rozliczane za generowanie przez model. Ponieważ nie pakujemy funkcji takich jak generowanie obrazu czy audio, płacisz tylko za tekst, który faktycznie przetwarzasz. Ten model API AI typu pay-as-you-go zapewnia, że użytkownicy o dużym wolumenie nie przepłacają za nieużywane możliwości. Ceny są przejrzyste, bez opłat za każde zapytanie ani minimalnych opłat. Możesz obliczyć dokładny koszt, mnożąc liczbę tokenów przez te stawki. Takie podejście utrzymuje koszty przewidywalne zarówno dla krótkich interakcji, jak i długotrwałych scenariuszy hostingu LLM.
Kredyty przedpłacone
Każde zapytanie jest odliczane od Twojego salda przedpłaconego, które nigdy nie wygasa. Doładowujesz je kwotą minimalną $10 za pomocą kryptowalut (USDT lub USDC). Model ten zapewnia, że zużycie nigdy nie przekroczy załadowanej kwoty, co zapewnia ścisłą kontrolę budżetu. W przeciwieństwie do usług subskrypcyjnych, płacisz tylko za zużycie, co czyni go efektywnym proxy LLM dla zmiennych obciążeń. Kredyty są naliczane natychmiast, zapewniając natychmiastowy dostęp do API. Brak opłat miesięcznych lub cyklicznych, więc doładowujesz tylko wtedy, gdy jest to potrzebne. Ta elastyczność wspiera deweloperów potrzebujących pojemności szczytowej lub chcących przetestować model LLM bez cenzury bez zobowiązań długoterminowych. Twoje saldo pozostaje dostępne bezterminowo, więc możesz wstrzymać użycie bez utraty środków.
Kredyty bonusowe
Nagradzamy większe doładowania bonusowymi kredytami, które wydłużą Twoje użycie. Dodanie $50 daje bonus 5%, a $100 — bonus 10%. Bonusy są naliczane na saldo przedpłacone i używane do standardowego pobierania tokenów. Funkcja ta obniża efektywny koszt tokena dla użytkowników zaawansowanych utrzymujących wyższe saldo. Kredyty bonusowe nie wygasają i podlegają tym samym zasadom użycia co środki główne. Struktura ta wspiera stałe użycie bramy LLM bez tarcia wynikającego z częstych małych transakcji. Ułatwia to również inference API dla zespołów lub osób z przewidywalnymi, ciągłymi potrzebami. Kredyty bonusowe są dodawane automatycznie po udanym doładowaniu.
Limity i co jest w cenie
Jedna cena za wszystko — wywoływanie funkcji i tryb JSON bez dopłat.
| Element | Wartość |
|---|---|
| Wywoływanie funkcji | tak — tools, tool_choice; odpowiedź zawiera tool_calls, także w strumieniu; wyniki jako role: tool |
| Maks. odpowiedź | do reszty okna 64 000 tokenów; max_tokens opcjonalne (bez osobnego limitu) |
| Okno kontekstu | 64 000 tokenów (wejście + odpowiedź) |
| Tryb JSON | response_format: {"type": "json_object"} |
| Równoległe zapytania | do 8 jednocześnie na klucz |
| Limit zapytań | 300 zapytań na minutę na klucz |
| Doładowanie | USDT (TRC20) lub USDC (Base), dowolna pełna kwota od $10 do $500 |
| Cena | $0,25 za 1 mln tokenów wejścia · $1,00 za 1 mln tokenów wyjścia |
| Darmowy kredyt | $0,50 na 7 dni, bez karty · Klucz próbny: 2 równoległe żądania, 60 na minutę; pełne limity (8 i 300) po pierwszym doładowaniu |
| Bonus | +5% od $50, +10% od $100 |
| Ważność | opłacony kredyt nie wygasa, bez subskrypcji |
Pytania i odpowiedzi
Czy kredyty przedpłacone wygasają?
Nie, Twoje kredyty przedpłacone nigdy nie wygasają. Możesz doładować konto w dowolnym momencie, a saldo pozostaje dostępne do wykorzystania w zapytaniach API.
Co się stanie, jeśli przekroczę limit zapytań?
Jeśli przekroczysz limit 300 zapytań na minutę, otrzymasz standardowy błąd limitu zapytań. Twój przedpłacony kredyt nie jest ograniczany przez limity zapytań; po prostu musisz poczekać, aż okno czasu się zresetuje, zanim wyślesz kolejne zapytania.
Czy mogę używać API w celach komercyjnych?
Tak, nasz <strong>LLM bez cenzury</strong> jest dostępny do prawnego użytku dla dorosłych, w tym zastosowań komercyjnych. O ile treść nie dotyczy treści erotycznych z udziałem małoletnich, możesz używać API do dowolnego prawnego celu, w tym biznesowego, badawczego lub rozrywkowego.
Jak śledzić zużycie tokenów?
Możesz monitorować zużycie tokenów bezpośrednio w panelu konta. Każda odpowiedź API zawiera liczbę tokenów wejściowych i wyjściowych, pozwalając na weryfikację kosztów. Możesz również sprawdzić pozostałe saldo w dowolnym momencie, aby upewnić się, że masz wystarczające kredyty na kolejne zapytanie.
Twój klucz jest o jeden formularz stąd
Utwórz konto, skopiuj klucz, zmień bazowy URL. To cały proces konfiguracji.
Pobierz klucz API