LLM Inference แบบไม่เซ็นเซอร์
API Inference แบบไม่เซ็นเซอร์ สำหรับนักพัฒนา
API Inference แบบ Drop-in ที่เข้ากันได้กับ OpenAI ซึ่งให้บริการโมเดล open-weight แบบไม่เซ็นเซอร์เพียงโมเดลเดียว เปลี่ยน base_url และ key ของคุณ เก็บโค้ดไว้เหมือนเดิม
- โมเดลไม่เซ็นเซอร์หนึ่งโมเดล
- ไม่มีค่าธรรมเนียมรายเดือน
- เครดิตไม่หมดอายุ
ลองด้วยคำขอเพียงครั้งเดียว
curl https://api.llminferenceapi.com/v1/chat/completions \
-H "Authorization: Bearer $API_KEY" \
-H "Content-Type: application/json" \
-d '{
"model": "uncensored",
"messages": [{"role": "user", "content": "Write a blunt product review of a cheap VPN."}]
}'from openai import OpenAI
client = OpenAI(base_url="https://api.llminferenceapi.com/v1", api_key="YOUR_KEY")
resp = client.chat.completions.create(
model="uncensored",
messages=[{"role": "user", "content": "Summarise this thread without softening it."}],
)
print(resp.choices[0].message.content)import OpenAI from "openai";
const client = new OpenAI({ baseURL: "https://api.llminferenceapi.com/v1", apiKey: process.env.API_KEY });
const resp = await client.chat.completions.create({
model: "uncensored",
messages: [{ role: "user", content: "Draft a villain monologue for my game." }],
});
console.log(resp.choices[0].message.content);สิ่งที่คุณได้รับ
ความเข้ากันได้แบบ Drop-in
ทำงานกับ SDK ทางการของ OpenAI และไคลเอนต์ที่เข้ากันได้ทั้งหมด เพียงอัปเดต base_url ของคุณเป็น https://api.llminferenceapi.com/v1 และเปลี่ยน API key ของคุณ
ผลลัพธ์แบบไม่เซ็นเซอร์
โมเดลตอบคำถามโดยไม่มีการปฏิเสธเนื้อหาสำหรับหัวข้อผู้ใหญ่ที่ชอบด้วยกฎหมาย เรื่องแต่ง หรือหัวข้อที่ถกเถียงกัน มีเพียงเนื้อหาทางเพศที่เกี่ยวข้องกับเด็กเท่านั้นที่ถูกบล็อก
การโฮสต์ GPU โดยตรง
เรารันโมเดลบนเซิร์ฟเวอร์ของเราเอง ไม่ใช่ในฐานะผู้ขายต่อ ไม่มีเส้นทางของผู้ขายรายอื่น ไม่มีชั้นที่ซ่อนอยู่ เพียงแค่ inference โดยตรง
ราคาโปร่งใส
จ่ายเฉพาะสิ่งที่คุณใช้ input tokens ราคา $0.25/1M output tokens ราคา $1.00/1M ไม่มีสมาชิกหรือวันที่หมดอายุบนเครดิต
สตรีมมิง & เครื่องมือ
รองรับ server-sent events (SSE) สำหรับการตอบสนองแบบสตรีมมิงและเอนด์พอยต์การเรียกใช้ฟังก์ชัน/เครื่องมือมาตรฐาน
ความเป็นส่วนตัวเป็นอันดับแรก
พรอมต์ไม่ถูกนำไปใช้ฝึกโมเดลของคุณ การสร้างบัญชีต้องการเพียงอีเมลและรหัสผ่าน
วิธีการทำงาน
สร้างบัญชี
สมัครสมาชิกด้วยอีเมลและรหัสเพื่อรับ API key ของคุณทันที
เพิ่มเครดิต
เติมเงินด้วยคริปโต (USDT หรือ USDC) เพื่อเริ่มใช้บริการ
เริ่ม Inference
ชี้โค้ดไคลเอนต์ที่มีอยู่ของคุณไปยัง base_url ของเราและส่งคำขอ
สิ่งที่ผู้คนสร้างด้วยสิ่งนี้
การเขียนเชิงสร้างสรรค์
สร้างเรื่องราวและสคริปต์โดยไม่ต้องมีการสั่งสอนศีลธรรมที่ไม่จำเป็นหรือตัวกรองเนื้อหาที่จำกัดการเลือกเล่าเรื่องของคุณ เหมาะสำหรับนวนิยายสำหรับผู้ใหญ่หรือมุกตลกที่เฉียบคม
การสกัดข้อมูล
แยกวิเคราะห์เอกสารขนาดใหญ่โดยใช้หน้าต่างบริบท 100k เพื่อดึงข้อมูลที่มีโครงสร้างจากข้อความยาวโดยไม่สูญเสียบริบท
การวิจัย & การวิเคราะห์
รับคำตอบที่ไม่มีการกรองสำหรับหัวข้อที่ถกเถียงกันหรือเฉพาะทาง โดยที่โมเดลจะไม่ปฏิเสธการมีส่วนร่วมเนื่องจากแนวทางความปลอดภัยมาตรฐาน
แอปพลิเคชันแชท
สร้างอินเทอร์เฟซแชทที่รู้สึกเป็นธรรมชาติและตอบสนอง รองรับการตอบสนองแบบสตรีมมิงเพื่อประสบการณ์ผู้ใช้ที่ดีขึ้น
ความเข้ากันได้กับ OpenAI แบบ Drop-in
ไม่ต้องเขียนโค้ดอินทิเกรชันใหม่สำหรับโมเดลใหม่ API ของเราใช้เอนด์พอยต์มาตรฐาน /v1/chat/completions คุณสามารถสลับไปใช้โมเดลที่ไม่เซ็นเซอร์ของเราได้โดยการเปลี่ยน base_url และ api_key ในไคลเอนต์ OpenAI SDK ที่มีอยู่ เราสนับสนุนสตรีมมิงผ่าน Server-Sent Events (SSE) และการเรียกใช้ฟังก์ชัน ทำให้ลอจิกที่มีอยู่สำหรับการจัดการผลลัพธ์ของเครื่องมือหรือการสร้างข้อความแบบเรียลไทม์ทำงานได้ทันที
นี่ไม่ใช่เกตเวย์หลายโมเดลหรือพร็อกซีที่ซับซ้อนซึ่งเพิ่มเวลาแฝง เป็นการเชื่อมต่อโดยตรงไปยังเซิร์ฟเวอร์ GPU ของเราที่รันโมเดล open-weight ที่ได้รับการปรับแต่งเพียงโมเดลเดียว คุณได้รับประสิทธิภาพของเอนด์พอยต์เฉพาะที่มีความคุ้นเคยของรูปแบบ OpenAI
ไม่เซ็นเซอร์ & ไม่มีการกรอง
โมเดลของเราถูกปรับแต่งให้ตอบคำถามโดยไม่มีการปฏิเสธเนื้อหาสำหรับการใช้งานผู้ใหญ่ที่ชอบด้วยกฎหมาย เรื่องแต่ง การวิจัยด้านความปลอดภัย หรือหัวข้อที่ถกเถียงกัน ในขณะที่โมเดลมาตรฐานส่วนใหญ่จะปฏิเสธอย่างสุภาพที่จะพูดคุยเกี่ยวกับหัวข้อที่ละเอียดอ่อนหรือสร้างเนื้อหาสำหรับผู้ใหญ่ โมเดลของเราจะให้คำตอบที่ตรงไปตรงมา
มีข้อจำกัดหนึ่งข้อที่ใช้เสมอ: คำขอที่มีเนื้อหาทางเพศที่เกี่ยวข้องกับเด็กจะถูกบล็อก ทุกอย่างอื่นเป็นเป้าหมายที่ถูกต้อง สิ่งนี้ทำให้เหมาะสำหรับแอปพลิเคชันที่คุณต้องการควบคุมผลลัพธ์อย่างเต็มที่โดยที่โมเดลไม่ได้ทำหน้าที่เป็นประตูสำหรับคำขอที่ถูกต้องตามกฎหมายของผู้ใช้
ราคาแบบจ่ายตามการใช้งานที่โปร่งใส
เราไม่ล็อกคุณไว้กับการสมัครสมาชิกแบบรายเดือนหรือแผนแบบชั้น คุณจ่ายตามโทเคนที่คุณใช้จริง input tokens มีราคา $0.25 ต่อล้าน และ output tokens มีราคา $1.00 ต่อล้าน เมื่อคุณเติมเงิน เครดิตเหล่านั้นจะไม่หมดอายุ ดังนั้นคุณสามารถเติมเงินเมื่อเหมาะสมกับงบประมาณของคุณ
เราเสนอโบนัสสำหรับการฝากเงินจำนวนมากขึ้น: +5% เครดิตสำหรับการฝาก $50 และ +10% สำหรับการฝาก $100 บัญชีใหม่เริ่มต้นด้วยเครดิตทดลองใช้ $0.50 ที่มีอายุ 7 วัน โดยไม่ต้องใช้บัตรเครดิต โครงสร้างนี้รับประกันว่าคุณใช้จ่ายเฉพาะสิ่งที่ใช้ โดยไม่มีค่าธรรมเนียมที่ซ่อนอยู่สำหรับการสตรีมมิงหรือการใช้งานเครื่องมือ
ใครที่ไม่เหมาะกับสิ่งนี้
หากคุณต้องการการสร้างภาพ การประมวลผลเสียง หรือ embeddings API นี้ไม่เหมาะกับคุณ เราให้บริการเฉพาะข้อความเท่านั้น หากคุณต้องการการกำหนดเส้นทางโมเดลข้ามผู้ขายหลายราย (เช่น GPT-4, Claude และ Llama ในหนึ่งคำขอ) เราไม่เสนอสิ่งนั้น เรามุ่งเน้นการมอบประสบการณ์ที่ดีที่สุดสำหรับโมเดลไม่เซ็นเซอร์เฉพาะตัวหนึ่ง หากต้องการการรับประกัน SLA ที่เข้มงวด ใบรับรอง SOC2 หรือการปฏิบัติตาม HIPAA แบบพร้อมใช้งาน คุณควรดูผู้ให้บริการระดับองค์กร เราเป็นเอนด์พอยต์ inference ที่ตรงไปตรงมาและเน้นผู้พัฒนาเป็นสำคัญ
ถาม-ตอบ
นี่คือพร็อกซี OpenAI หรือไม่?
ไม่ใช่ เราไม่ได้ขายต่อโมเดลของ OpenAI เราโฮสต์โมเดล open-weight ของเราเองบนเซิร์ฟเวอร์ GPU ของเราเอง มันเข้ากันได้กับ OpenAI ในแง่ของรูปแบบ หมายความว่ารองรับโครงสร้าง JSON และคำสั่ง SDK เดียวกัน แต่โมเดลพื้นฐานเป็นของเรา
ขนาดของหน้าต่างบริบทคือเท่าใด
โมเดลของเรารองรับหน้าต่างบริบทขนาด 100,000 โทเคน โดยนับทั้งพรอมต์และการสร้างข้อความ completion ซึ่งช่วยให้สามารถประมวลผลเอกสารขนาดใหญ่หรือรักษาประวัติการสนทนาที่ยาวนานได้
พรอมต์ของฉันถูกนำไปใช้ในการฝึกโมเดลหรือไม่
ไม่ เราไม่ใช้ข้อมูลพรอมต์ของคุณเพื่อฝึกโมเดลของเรา ข้อมูลของคุณยังคงเป็นส่วนตัวสำหรับคำขอ inference ของคุณ
ฉันจะเริ่มใช้งานอย่างไร
สมัครสมาชิกโดยใช้อีเมลและรหัสผ่านในหน้ารับคีย์ API คุณจะได้รับคีย์ API ทันที คุณสามารถเริ่มใช้เครดิตทดลองใช้ฟรีมูลค่า $0.50 ได้โดยไม่ต้องเพิ่มบัตรเครดิต
เกิดอะไรขึ้นเมื่อฉันถึงขีดจำกัดอัตรา
เราอนุญาตคำขอ 300 requests per minute ต่อคีย์ API หากเกินขีดจำกัดนี้ คุณจะรับข้อผิดพลาด 429 คุณสามารถสร้างคีย์ API ใหม่ได้ทุกเมื่อเพื่อรีเซ็ตตัวนับหากจำเป็น
คีย์ของคุณอยู่ห่างแค่แบบฟอร์มเดียว
สร้างบัญชี คัดลอกคีย์ เปลี่ยน URL พื้นฐาน นั่นคือการตั้งค่าทั้งหมด
รับคีย์ API