PL ▾
Pobierz klucz API

Wnioskowanie LLM bez cenzury

API wnioskowania bez cenzury dla programistów

API wnioskowania typu drop-in kompatybilne z OpenAI obsługujące pojedynczy model bez cenzury o otwartych wagach. Zmień base_url i klucz, zachowaj kod.

  • Jeden model bez cenzury
  • Brak opłat miesięcznych
  • Kredyty nigdy nie wygasają

Wypróbuj jednym zapytaniem

curl https://api.llminferenceapi.com/v1/chat/completions \
  -H "Authorization: Bearer $API_KEY" \
  -H "Content-Type: application/json" \
  -d '{
    "model": "uncensored",
    "messages": [{"role": "user", "content": "Write a blunt product review of a cheap VPN."}]
  }'

Co otrzymujesz

Kompatybilność typu drop-in

Działa z oficjalnymi SDK OpenAI i dowolnym kompatybilnym klientem. Wystarczy zaktualizować base_url do https://api.llminferenceapi.com/v1 i zamienić klucz API.

Wynik bez cenzury

Model odpowiada bez odmów treści dla legalnych tematów dla dorosłych, fikcyjnych lub kontrowersyjnych. Blokowane są tylko treści seksualne z udziałem małoletnich.

Bezpośredni hosting GPU

Uruchamiamy model na własnych serwerach, nie jako odsprzedawca. Bez routingu dostawcy, bez ukrytych warstw, tylko bezpośrednie wnioskowanie.

Przejrzysty cennik

Płacisz tylko za to, czego używasz. Tokeny wejściowe kosztują $0.25/1M, tokeny wyjściowe $1.00/1M. Bez subskrypcji ani dat wygaśnięcia kredytów.

Strumieniowanie i narzędzia

Obsługuje zdarzenia wysyłane przez serwer (SSE) dla strumieniowania odpowiedzi oraz standardowe endpointy wywoływania funkcji.

Prywatność przede wszystkim

Prompty nie są używane do trenowania Twojego modelu. Rejestracja konta wymaga tylko adresu e-mail i hasła.

Jak to działa

  1. Utwórz konto

    Zarejestruj się, podając adres e-mail i hasło, aby natychmiast uzyskać klucz API.

  2. Doładuj kredyt

    Doładuj kryptowalutą (USDT lub USDC), aby rozpocząć korzystanie z usługi.

  3. Rozpocznij wnioskowanie

    Wskaż istniejący kod klienta na nasz base_url i wysyłaj zapytania.

Co ludzie z tym budują

Pisanie twórcze

Generuj opowieści i scenariusze bez niechcianego moralizatorstwa lub filtrów treści ograniczających wybory narracyjne. Idealne do literatury dla dorosłych lub ostrego humoru.

Ekstrakcja danych

Przetwarzaj duże dokumenty za pomocą okna kontekstu 100k, aby wyodrębnić dane strukturalne z długich tekstów bez utraty kontekstu.

Badania i analiza

Otrzymuj niefiltrowane odpowiedzi na kontrowersyjne lub niszowe tematy bez odmowy modelu do angażowania się ze względu na standardowe wytyczne bezpieczeństwa.

Aplikacje czatu

Buduj interfejsy czatu, które są naturalne i responsywne, obsługujące strumieniowanie odpowiedzi dla lepszych doświadczeń użytkownika.

Kompatybilność z OpenAI typu drop-in

Przestań przepisywać kod integracji dla każdego nowego modelu. Nasze API implementuje standardowy endpoint /v1/chat/completions, co oznacza, że możesz przełączyć się na nasz model bez cenzury, po prostu zmieniając base_url i api_key w istniejących klientach SDK OpenAI. Obsługujemy strumieniowanie za pomocą Server-Sent Events (SSE) i wywoływanie funkcji, więc Twoja istniejąca logika obsługi wyników narzędzi lub generowania tekstu w czasie rzeczywistym działa od razu.

To nie jest bramka wielomodelowa ani złożone proxy, które dodaje opóźnienia. To bezpośrednie połączenie z naszymi serwerami GPU uruchamiającymi pojedynczy, zoptymalizowany model o otwartych wagach. Otrzymujesz wydajność dedykowanego endpointu z znajomością formatu OpenAI.

Bez cenzury i niefiltrowany

Nasz model jest dostrojony do odpowiadania bez odrzucania treści przy legalnym użyciu dla dorosłych, narracjach fikcyjnych, badaniach bezpieczeństwa lub kontrowersyjnych tematach. Podczas gdy większość standardowych modeli uprzejmie odmówi dyskusji na tematy wrażliwe lub generowania treści dla dorosłych, nasz model udzieli bezpośredniej odpowiedzi.

Istnieje jeden ścisły limit, który zawsze obowiązuje: zapytania zawierające treści seksualne z udziałem małoletnich są blokowane. Wszystko inne jest dozwolone. Dzięki temu jest idealny do aplikacji, w których chcesz mieć pełną kontrolę twórczą nad wynikiem bez działania modelu jako bramkarza dla legalnych żądań użytkowników.

Przejrzysty cennik pay-as-you-go

Nie wiążemy Cię miesięcznymi subskrypcjami ani planami warstwowymi. Płacisz dokładnie za zużyte tokeny. Tokeny wejściowe kosztują $0.25 za milion, a tokeny wyjściowe kosztują $1.00 za milion. Gdy doładujesz środki, ten kredyt nigdy nie wygasa, więc możesz doładować go, gdy pasuje to do Twojego budżetu.

Oferujemy bonusy za większe wpłaty: +5% kredytu przy wpłacie $50 i +10% przy wpłacie $100. Nowe konta rozpoczynają się z $0.50 kredytu próbnego ważnego przez 7 dni, bez konieczności podania karty kredytowej. Taka struktura zapewnia, że wydajesz tylko to, czego używasz, bez ukrytych opłat za strumieniowanie czy użycie narzędzi.

Dla kogo to NIE jest

Jeśli potrzebujesz generowania obrazów, przetwarzania audio lub wektorów cech, ten endpoint API nie jest dla Ciebie. Obsługujemy tylko tekst. Jeśli potrzebujesz routingu modeli między wieloma dostawcami (np. GPT-4, Claude i Llama w jednym zapytaniu), nie oferujemy tego. Skupiamy się na dostarczaniu najlepszego możliwego doświadczenia dla jednego konkretnego modelu bez cenzury. Jeśli potrzebujesz gwarancji SLA, certyfikatów SOC2 lub zgodności z HIPAA od razu po instalacji, powinieneś zwrócić się do dostawców klasy enterprise. Jesteśmy prostym, nastawionym na deweloperów endpointem do wnioskowania.

Pytania i odpowiedzi

Czy to jest proxy OpenAI?

Nie. Nie odsprzedajemy modeli OpenAI. Utrzymujemy własny model o otwartych wagach na własnych serwerach GPU. Jest kompatybilny z OpenAI w formacie, co oznacza, że akceptuje te same struktury JSON i polecenia SDK, ale podstawowy model należy do nas.

Jaki jest rozmiar okna kontekstu?

Nasz model obsługuje okno kontekstu 100 000 tokenów, licząc zarówno prompt, jak i uzupełnienie. Pozwala to na przetwarzanie dużych dokumentów lub utrzymywanie długich historii rozmów.

Czy moje prompty są wykorzystywane do trenowania?

Nie. Nie wykorzystujemy Twoich danych z promptów do trenowania naszego modelu. Twoje dane pozostają prywatne i są używane wyłącznie w ramach Twoich zapytań o wnioskowanie.

Jak zacząć?

Zarejestruj się, podając adres e-mail i hasło na stronie Pobierz klucz API. Otrzymasz klucz API natychmiast. Możesz zacząć korzystać z darmowego kredytu próbnego w wysokości 0,50 USD bez konieczności dodawania karty kredytowej.

Co się stanie, gdy przekroczę limit zapytań?

Dozwolone jest 300 zapytań na minutę na klucz API. Jeśli przekroczysz ten limit, otrzymasz błąd 429. Możesz wygenerować klucz API ponownie w dowolnym momencie, aby zresetować licznik, jeśli jest to konieczne.

Twój klucz jest o jeden formularz stąd

Utwórz konto, skopiuj klucz, zmień adres URL bazowy. To cała konfiguracja.

Pobierz klucz API