무검열 LLM 추론
무검열 개발자용 추론 API
단일 무검열 오픈 웨이트 모델을 제공하는 교체형 OpenAI 호환 추론 API입니다. base_url과 키만 변경하면 코드는 그대로 유지됩니다.
- 단일 무검열 모델
- 월 구독료 없음
- 크레딧은 만료되지 않음
요청 한 번으로 시험해 보세요
curl https://api.llminferenceapi.com/v1/chat/completions \
-H "Authorization: Bearer $API_KEY" \
-H "Content-Type: application/json" \
-d '{
"model": "uncensored",
"messages": [{"role": "user", "content": "Write a blunt product review of a cheap VPN."}]
}'from openai import OpenAI
client = OpenAI(base_url="https://api.llminferenceapi.com/v1", api_key="YOUR_KEY")
resp = client.chat.completions.create(
model="uncensored",
messages=[{"role": "user", "content": "Summarise this thread without softening it."}],
)
print(resp.choices[0].message.content)import OpenAI from "openai";
const client = new OpenAI({ baseURL: "https://api.llminferenceapi.com/v1", apiKey: process.env.API_KEY });
const resp = await client.chat.completions.create({
model: "uncensored",
messages: [{ role: "user", content: "Draft a villain monologue for my game." }],
});
console.log(resp.choices[0].message.content);제공 기능
교체 가능성
공식 OpenAI SDK 및 호환 클라이언트와 함께 작동합니다. base_url을 https://api.llminferenceapi.com/v1로 업데이트하고 API 키만 교체하면 됩니다.
무검열 출력
모델은 합법적인 성인, 픽션, 논쟁적 주제에 대해 콘텐츠 거부 없이 답변합니다. 미성년자 관련 성적 콘텐츠만 차단됩니다.
직접 GPU 호스팅
당사는 재판매자가 아닌 자체 서버에서 모델을 실행합니다. 벤더 라우팅이나 숨겨진 레이어 없이 직접 추론을 제공합니다.
투명한 요금제
사용한 만큼만 지불하세요. 입력 토큰은 1M당 $0.25, 출력 토큰은 1M당 $1.00입니다. 구독이나 크레딧 만료일이 없습니다.
스트리밍 및 도구
스트리밍 응답을 위한 서버 전송 이벤트(SSE)와 표준 도구/함수 호출 엔드포인트를 지원합니다.
최우선 프라이버시
프롬프트는 모델 학습에 사용되지 않습니다. 계정 생성에는 이메일과 비밀번호만 필요합니다.
작동 방식
계정 만들기
이메일과 비밀번호로 회원가입하여 즉시 API 키를 받으세요.
크레딧 충전
암호화폐(USDT 또는 USDC)로 충전하여 서비스를 시작하세요.
추론 시작
기존 클라이언트 코드를 당사 base_url로 지정하고 요청을 보내세요.
사용 사례
창의적 글쓰기
원치 않는 도덕적 판단이나 콘텐츠 필터 없이 스토리와 대본을 생성하세요. 성인 소설이나 과감한 유머에 적합합니다.
데이터 추출
100k 컨텍스트 창을 사용하여 긴 텍스트에서 구조화된 데이터를 추출하며 컨텍스트 손실 없이 대용량 문서를 구문 분석하세요.
연구 및 분석
표준 안전 가이드라인으로 인해 참여를 거부하는 대신, 논쟁적이거나 니치한 주제에 대한 필터링 없는 답변을 얻으세요.
채팅 애플리케이션
스트리밍 응답을 지원하여 더 나은 사용자 경험을 제공하는 자연스럽고 반응이 빠른 채팅 인터페이스를 구축하세요.
교체 가능한 OpenAI 호환성
새로운 모델마다 통합 코드를 다시 작성하지 마세요. 당사 API는 표준 /v1/chat/completions 엔드포인트를 구현하므로, 기존 OpenAI SDK 클라이언트의 base_url과 api_key만 변경하면 무검열 모델로 전환할 수 있습니다. 서버 전송 이벤트(SSE)를 통한 스트리밍과 함수 호출을 지원하므로, 도구 출력 또는 실시간 텍스트 생성을 처리하는 기존 로직은 바로 작동합니다.
이는 지연 시간을 추가하는 다중 모델 게이트웨이 또는 복잡한 프록시가 아닙니다. 단일 최적화 오픈 웨이트 모델을 실행하는 당사 GPU 서버로의 직접 연결입니다. OpenAI 형식의 익숙함과 전용 엔드포인트의 성능을 모두 얻으세요.
무검열 및 필터 없음
당사 모델은 합법적인 성인 사용, 픽션 서사, 보안 연구 또는 논쟁적 주제에 대해 콘텐츠 거부 없이 답변하도록 조정되었습니다. 대부분의 표준 모델은 민감한 주제를 논의하거나 성숙한 콘텐츠를 생성하는 것을 정중히 거절하지만, 당사 모델은 직접적인 답변을 제공합니다.
항상 적용되는 하나의 엄격한 제한이 있습니다: 미성년자 관련 성적 콘텐츠가 포함된 요청은 차단됩니다. 나머지는 모두 가능합니다. 이는 모델이 사용자의 정당한 요청에 대해 게이트키퍼 역할을 하지 않고 완전한 창작 제어를 원하는 애플리케이션에 이상적입니다.
투명한 종량제 요금제
월 구독이나 계층형 플랜에 갇히지 않습니다. 소비한 토큰만큼 정확히 지불합니다. 입력 토큰은 100만 토큰당 $0.25, 출력 토큰은 100만 토큰당 $1.00입니다. 자금을 추가하면 해당 크레딧은 만료되지 않으므로 예산에 맞춰 충전할 수 있습니다.
더 큰 충전 시 보너스를 제공합니다: $50 충전 시 +5%, $100 충전 시 +10% 크레딧. 신규 계정은 신용카드 없이 7일 유효한 $0.50 무료 체험 크레딧으로 시작합니다. 이 구조는 스트리밍이나 도구 사용에 숨겨진 요금 없이 사용한 만큼만 지불함을 보장합니다.
이 API가 적합하지 않은 경우
이미지 생성, 오디오 처리 또는 임베딩이 필요하면 이 API는 적합하지 않습니다. 우리는 텍스트만 제공합니다. 여러 벤더의 모델을 한 호출로 라우팅해야 한다면(GPT-4, Claude, Llama 등) 저희는 해당 기능을 제공하지 않습니다. 우리는 특정 무검열 모델에 최적화된 경험을 제공합니다. 엄격한 SLA 보장, SOC2 인증 또는 기본 HIPAA 준수가 필요하면 엔터프라이즈급 제공업체를 확인하세요. 당사는 단순하고 개발자 중심의 추론 엔드포인트입니다.
질문과 답변
이것은 OpenAI 프록시인가요?
아니요. 당사는 OpenAI 모델을 재판매하지 않습니다. 자체 GPU 서버에서 자체 오픈 웨이트 모델을 호스팅합니다. 형식은 OpenAI 호환이지만, 기반 모델은 당사 소유입니다.
컨텍스트 창 크기는 어떻게 되나요?
당사의 모델은 프롬프트와 생성 결과를 모두 포함해 100,000 토큰의 컨텍스트 창을 지원합니다. 이는 대용량 문서 처리 또는 긴 대화 기록 유지에 적합합니다.
프롬프트가 학습에 사용되나요?
아니요. 우리는 프롬프트 데이터를 모델 학습에 사용하지 않습니다. 귀하의 데이터는 추론 요청에 대해 비공개로 유지됩니다.
시작하는 방법은 무엇인가요?
API 키 발급 페이지에서 이메일과 비밀번호로 계정을 생성하세요. 즉시 API 키가 발급됩니다. 신용카드 추가 없이 무료 체험 크레딧 $0.50을 바로 사용할 수 있습니다.
속도 제한에 도달하면 어떻게 되나요?
API 키당 분당 300개의 요청을 허용합니다. 이를 초과하면 429 오류가 발생합니다. 필요시 API 키를 재생성하여 카운터를 초기화할 수 있습니다.
키는 양식 하나만 작성하면 받을 수 있습니다
계정을 생성하고 키를 복사한 후 기본 URL을 변경하세요. 설정은 이것으로 끝입니다.
API 키 받기