बिना सेंसर LLM इन्फरेंस
बिना सेंसर डेवलपर्स के लिए इन्फरेंस API
एकल बिना सेंसर ओपन-वेट मॉडल को सर्व करने वाला एक ड्रॉप-इन OpenAI-संगत इन्फरेंस API। अपना base_url और कुंजी बदलें, कोड वही रखें।
- एक बिना सेंसर मॉडल
- कोई मासिक शुल्क नहीं
- क्रेडिट कभी खत्म नहीं होते
एक ही अनुरोध में आज़माएँ
curl https://api.llminferenceapi.com/v1/chat/completions \
-H "Authorization: Bearer $API_KEY" \
-H "Content-Type: application/json" \
-d '{
"model": "uncensored",
"messages": [{"role": "user", "content": "Write a blunt product review of a cheap VPN."}]
}'from openai import OpenAI
client = OpenAI(base_url="https://api.llminferenceapi.com/v1", api_key="YOUR_KEY")
resp = client.chat.completions.create(
model="uncensored",
messages=[{"role": "user", "content": "Summarise this thread without softening it."}],
)
print(resp.choices[0].message.content)import OpenAI from "openai";
const client = new OpenAI({ baseURL: "https://api.llminferenceapi.com/v1", apiKey: process.env.API_KEY });
const resp = await client.chat.completions.create({
model: "uncensored",
messages: [{ role: "user", content: "Draft a villain monologue for my game." }],
});
console.log(resp.choices[0].message.content);आपको क्या मिलता है
ड्रॉप-इन संगतता
आधिकारिक OpenAI SDK और किसी भी संगत क्लाइंट के साथ काम करता है। बस अपना base_url https://api.llminferenceapi.com/v1 पर अपडेट करें और अपनी API कुंजी बदलें।
बिना सेंसर आउटपुट
मॉडल कानूनी वयस्क, काल्पनिक या विवादास्पद विषयों पर बिना सामग्री अस्वीकृति के उत्तर देता है। केवल किशोरों से संबंधित यौन सामग्री ब्लॉक की जाती है।
सीधा GPU होस्टिंग
हम मॉडल को रीसेलर के रूप में नहीं, बल्कि अपने खुद के सर्वर पर चलाते हैं। कोई वेंडर रूटिंग नहीं, कोई छिपी हुई परत नहीं, केवल सीधा इन्फरेंस।
पारदर्शी मूल्य निर्धारण
केवल उसी के लिए भुगतान करें जिसका आप उपयोग करते हैं। इनपुट टोकन $0.25/1M हैं, आउटपुट टोकन $1.00/1M हैं। क्रेडिट पर कोई सब्सक्रिप्शन या समाप्ति तिथि नहीं है।
स्ट्रीमिंग और टूल्स
स्ट्रीमिंग प्रतिक्रियाओं के लिए सर्वर-सेंट इवेंट्स (SSE) और मानक टूल/फ़ंक्शन कॉलिंग एंडपॉइंट का समर्थन करता है।
प्राइवेसी पहले
प्रॉम्प्ट को आपके मॉडल को ट्रेन करने के लिए उपयोग नहीं किया जाता है। खाता बनाने के लिए केवल ईमेल और पासवर्ड की आवश्यकता होती है।
यह कैसे काम करता है
खाता बनाएँ
तुरंत अपनी API कुंजी प्राप्त करने के लिए ईमेल और पासवर्ड के साथ साइन अप करें।
क्रेडिट जोड़ें
सेवा का उपयोग शुरू करने के लिए क्रिप्टो (USDT या USDC) के साथ टॉप-अप करें।
इन्फरेंस शुरू करें
अपने मौजूदा क्लाइंट कोड को हमारे base_url की ओर इशारा करें और अनुरोध भेजें।
लोग इसके साथ क्या बनाते हैं
रचनात्मक लेखन
अवांछित नैतिकता या कंटेंट फ़िल्टर्स के बिना कहानियां और स्क्रिप्ट जनरेट करें। वयस्क कथाओं या तीखे हास्य के लिए उत्तम।
डेटा एक्सट्रैक्शन
100k कॉन्टेक्स्ट विंडो का उपयोग करके बड़े दस्तावेज़ों को पार्स करें और लंबे टेक्स्ट से संरचित डेटा निकालें बिना कॉन्टेक्स्ट खोए।
शोध और विश्लेषण
विवादास्पद या विशेष विषयों के लिए बिना फ़िल्टर वाले उत्तर प्राप्त करें, बिना मॉडल के सामान्य सुरक्षा दिशानिर्देशों के कारण संवाद करने से इनकार किए।
चैट एप्लिकेशन
नेचरल और रिस्पॉन्सिव चैट इंटरफ़ेस बनाएं, बेहतर उपयोगकर्ता अनुभव के लिए स्ट्रीमिंग प्रतिक्रियाओं का समर्थन करें।
ड्रॉप-इन OpenAI संगतता
हर नए मॉडल के लिए अपनी इंटीग्रेशन कोड फिर से लिखें नहीं। हमारा API मानक /v1/chat/completions एंडपॉइंट लागू करता है, जिसका अर्थ है कि आप अपने मौजूदा OpenAI SDK क्लाइंट में base_url और api_key बदलकर हमारे बिना सेंसर मॉडल पर स्विच कर सकते हैं। हम Server-Sent Events (SSE) के माध्यम से स्ट्रीमिंग और फ़ंक्शन कॉलिंग का समर्थन करते हैं, इसलिए टूल आउटपुट या रियल-टाइम टेक्स्ट जनरेशन को हैंडल करने के लिए आपकी मौजूदा लॉजिक बॉक्स के बाहर काम करती है।
यह एक मल्टी-मॉडल गेटवे या जटिल प्रॉक्सी नहीं है जो लेटेंसी जोड़ता है। यह हमारे GPU सर्वर पर चलने वाले एकल, ऑप्टिमाइज्ड ओपन-वेट मॉडल तक एक सीधा कनेक्शन है। आपको समर्पित एंडपॉइंट की प्रदर्शन क्षमता और OpenAI फॉर्मेट की परिचितता मिलती है।
बिना सेंसर और अनफिल्टर्ड
हमारा मॉडल कानूनी वयस्क उपयोग, काल्पनिक कथाओं, सुरक्षा शोध या विवादास्पद विषयों के लिए बिना कंटेंट रिफ्यूजल के उत्तर देने के लिए ट्यून्ड है। जबकि अधिकांश मानक मॉडल संवेदनशील विषयों पर चर्चा करने या परिपक्व सामग्री जनरेट करने से विनम्रतापूर्वक इनकार कर देंगे, हमारा मॉडल एक सीधा उत्तर प्रदान करेगा।
एक कड़ा नियम हमेशा लागू होता है: किशोरों से संबंधित यौन सामग्री वाले अनुरोध ब्लॉक किए जाते हैं। बाकी सब कुछ खेल का विषय है। यह उन एप्लिकेशन के लिए आदर्श है जहां आप आउटपुट पर पूर्ण रचनात्मक नियंत्रण चाहते हैं बिना मॉडल के अपने उपयोगकर्ताओं के वैध अनुरोधों के लिए गेटकीपर के रूप में कार्य करने के।
पारदर्शी पे-एज़-यू-गो मूल्य निर्धारण
हम आपको मासिक सब्सक्रिप्शन या स्तरित योजनाओं में नहीं फंसाते हैं। आप बिल्कुल उन्हीं टोकन के लिए भुगतान करते हैं जिनका आप उपभोग करते हैं। इनपुट टोकन की लागत प्रति मिलियन $0.25 है, और आउटपुट टोकन की लागत प्रति मिलियन $1.00 है। जब आप धन जोड़ते हैं, तो वे क्रेडिट कभी खत्म नहीं होते, इसलिए आप अपने बजट के अनुसार टॉप-अप कर सकते हैं।
हम बड़े जमा राशि के लिए बोनस प्रदान करते हैं: $50 के जमा पर +5% क्रेडिट और $100 के जमा पर +10%। नए खातों में $0.50 का ट्रायल क्रेडिट होता है जो 7 दिनों के लिए मान्य होता है, जिसके लिए क्रेडिट कार्ड की आवश्यकता नहीं होती है। यह संरचना सुनिश्चित करती है कि आप केवल उसी पर खर्च करें जिसका आप उपयोग करते हैं, स्ट्रीमिंग या टूल उपयोग के लिए कोई छिपे शुल्क नहीं।
यह किसके लिए नहीं है
यदि आपको इमेज जनरेशन, ऑडियो प्रोसेसिंग या एम्बेडिंग्स की आवश्यकता है, तो यह API आपके लिए नहीं है। हम केवल टेक्स्ट सर्व करते हैं। यदि आपको एक ही कॉल में कई वेंडर (जैसे GPT-4, Claude, और Llama) के बीच मॉडल रूटिंग की आवश्यकता है, तो हम वह प्रदान नहीं करते हैं। हम एक विशिष्ट बिना सेंसर मॉडल के लिए सर्वोतम अनुभव प्रदान करने पर केंद्रित हैं। यदि आपको सख्त SLA गारंटी, SOC2 प्रमाणपत्र या HIPAA अनुपालन की आवश्यकता है, तो आपको एंटरप्राइज़-ग्रेड प्रदाताओं की ओर देखना चाहिए। हम एक सरल, डेवलपर-फर्स्ट इन्फरेंस एंडपॉइंट हैं।
प्रश्न और उत्तर
क्या यह एक OpenAI प्रॉक्सी है?
नहीं। हम OpenAI के मॉडल रीसेल नहीं कर रहे हैं। हम अपने खुद के GPU सर्वर पर अपने ओपन-वेट मॉडल को होस्ट करते हैं। यह फॉर्मेट में OpenAI-संगत है, जिसका अर्थ है कि यह समान JSON संरचनाएं और SDK कमांड स्वीकार करता है, लेकिन अंडरलाइंग मॉडल हमारा है।
कॉन्टेक्स्ट विंडो का आकार क्या है?
हमारा मॉडल 100,000 टोकन की कॉन्टेक्स्ट विंडो का समर्थन करता है, जिसमें प्रॉम्प्ट और कम्पलीशन दोनों शामिल हैं। इससे बड़े दस्तावेज़ों को प्रोसेस करने या लंबी बातचीत के इतिहास को बनाए रखने की सुविधा मिलती है।
क्या मेरे प्रॉम्प्ट को ट्रेनिंग के लिए इस्तेमाल किया जाता है?
नहीं। हम अपने मॉडल को ट्रेन करने के लिए आपके प्रॉम्प्ट डेटा का उपयोग नहीं करते हैं। आपका डेटा आपके इन्फरेंस अनुरोधों तक ही सीमित रहता है।
मैं शुरुआत कैसे करूं?
Get API Key पेज पर ईमेल और पासवर्ड के साथ साइन अप करें। आपको तुरंत एक API कुंजी मिल जाएगी। आप बिना क्रेडिट कार्ड जोड़े $0.50 के मुफ़्त ट्रायल क्रेडिट का उपयोग शुरू कर सकते हैं।
अगर मैं रेट लिमिट पर पहुंच जाता हूं तो क्या होता है?
हम प्रति API कुंजी प्रति मिनट 300 अनुरोध की अनुमति देते हैं। यदि आप इससे अधिक करते हैं, तो आपको 429 त्रुटि मिलेगी। यदि आवश्यक हो, तो आप गिनती रीसेट करने के लिए अपनी API कुंजी को किसी भी समय रीजेनरेट कर सकते हैं।
आपकी कुंजी बस एक फ़ॉर्म दूर है
एक खाता बनाएं, कुंजी कॉपी करें, बेस URL बदलें। सेटअप यहीं खत्म हो जाता है।
API कुंजी पाएँ