TH ▾
รับคีย์ API

LLM Inference แบบไม่เซ็นเซอร์

API Inference แบบไม่เซ็นเซอร์ สำหรับนักพัฒนา

API Inference แบบ Drop-in ที่เข้ากันได้กับ OpenAI ซึ่งให้บริการโมเดล open-weight แบบไม่เซ็นเซอร์เพียงโมเดลเดียว เปลี่ยน base_url และ key ของคุณ เก็บโค้ดไว้เหมือนเดิม

  • โมเดลไม่เซ็นเซอร์หนึ่งโมเดล
  • ไม่มีค่าธรรมเนียมรายเดือน
  • เครดิตไม่หมดอายุ

ลองด้วยคำขอเพียงครั้งเดียว

curl https://api.llminferenceapi.com/v1/chat/completions \
  -H "Authorization: Bearer $API_KEY" \
  -H "Content-Type: application/json" \
  -d '{
    "model": "uncensored",
    "messages": [{"role": "user", "content": "Write a blunt product review of a cheap VPN."}]
  }'

สิ่งที่คุณได้รับ

ความเข้ากันได้แบบ Drop-in

ทำงานกับ SDK ทางการของ OpenAI และไคลเอนต์ที่เข้ากันได้ทั้งหมด เพียงอัปเดต base_url ของคุณเป็น https://api.llminferenceapi.com/v1 และเปลี่ยน API key ของคุณ

ผลลัพธ์แบบไม่เซ็นเซอร์

โมเดลตอบคำถามโดยไม่มีการปฏิเสธเนื้อหาสำหรับหัวข้อผู้ใหญ่ที่ชอบด้วยกฎหมาย เรื่องแต่ง หรือหัวข้อที่ถกเถียงกัน มีเพียงเนื้อหาทางเพศที่เกี่ยวข้องกับเด็กเท่านั้นที่ถูกบล็อก

การโฮสต์ GPU โดยตรง

เรารันโมเดลบนเซิร์ฟเวอร์ของเราเอง ไม่ใช่ในฐานะผู้ขายต่อ ไม่มีเส้นทางของผู้ขายรายอื่น ไม่มีชั้นที่ซ่อนอยู่ เพียงแค่ inference โดยตรง

ราคาโปร่งใส

จ่ายเฉพาะสิ่งที่คุณใช้ input tokens ราคา $0.25/1M output tokens ราคา $1.00/1M ไม่มีสมาชิกหรือวันที่หมดอายุบนเครดิต

สตรีมมิง & เครื่องมือ

รองรับ server-sent events (SSE) สำหรับการตอบสนองแบบสตรีมมิงและเอนด์พอยต์การเรียกใช้ฟังก์ชัน/เครื่องมือมาตรฐาน

ความเป็นส่วนตัวเป็นอันดับแรก

พรอมต์ไม่ถูกนำไปใช้ฝึกโมเดลของคุณ การสร้างบัญชีต้องการเพียงอีเมลและรหัสผ่าน

วิธีการทำงาน

  1. สร้างบัญชี

    สมัครสมาชิกด้วยอีเมลและรหัสเพื่อรับ API key ของคุณทันที

  2. เพิ่มเครดิต

    เติมเงินด้วยคริปโต (USDT หรือ USDC) เพื่อเริ่มใช้บริการ

  3. เริ่ม Inference

    ชี้โค้ดไคลเอนต์ที่มีอยู่ของคุณไปยัง base_url ของเราและส่งคำขอ

สิ่งที่ผู้คนสร้างด้วยสิ่งนี้

การเขียนเชิงสร้างสรรค์

สร้างเรื่องราวและสคริปต์โดยไม่ต้องมีการสั่งสอนศีลธรรมที่ไม่จำเป็นหรือตัวกรองเนื้อหาที่จำกัดการเลือกเล่าเรื่องของคุณ เหมาะสำหรับนวนิยายสำหรับผู้ใหญ่หรือมุกตลกที่เฉียบคม

การสกัดข้อมูล

แยกวิเคราะห์เอกสารขนาดใหญ่โดยใช้หน้าต่างบริบท 100k เพื่อดึงข้อมูลที่มีโครงสร้างจากข้อความยาวโดยไม่สูญเสียบริบท

การวิจัย & การวิเคราะห์

รับคำตอบที่ไม่มีการกรองสำหรับหัวข้อที่ถกเถียงกันหรือเฉพาะทาง โดยที่โมเดลจะไม่ปฏิเสธการมีส่วนร่วมเนื่องจากแนวทางความปลอดภัยมาตรฐาน

แอปพลิเคชันแชท

สร้างอินเทอร์เฟซแชทที่รู้สึกเป็นธรรมชาติและตอบสนอง รองรับการตอบสนองแบบสตรีมมิงเพื่อประสบการณ์ผู้ใช้ที่ดีขึ้น

ความเข้ากันได้กับ OpenAI แบบ Drop-in

ไม่ต้องเขียนโค้ดอินทิเกรชันใหม่สำหรับโมเดลใหม่ API ของเราใช้เอนด์พอยต์มาตรฐาน /v1/chat/completions คุณสามารถสลับไปใช้โมเดลที่ไม่เซ็นเซอร์ของเราได้โดยการเปลี่ยน base_url และ api_key ในไคลเอนต์ OpenAI SDK ที่มีอยู่ เราสนับสนุนสตรีมมิงผ่าน Server-Sent Events (SSE) และการเรียกใช้ฟังก์ชัน ทำให้ลอจิกที่มีอยู่สำหรับการจัดการผลลัพธ์ของเครื่องมือหรือการสร้างข้อความแบบเรียลไทม์ทำงานได้ทันที

นี่ไม่ใช่เกตเวย์หลายโมเดลหรือพร็อกซีที่ซับซ้อนซึ่งเพิ่มเวลาแฝง เป็นการเชื่อมต่อโดยตรงไปยังเซิร์ฟเวอร์ GPU ของเราที่รันโมเดล open-weight ที่ได้รับการปรับแต่งเพียงโมเดลเดียว คุณได้รับประสิทธิภาพของเอนด์พอยต์เฉพาะที่มีความคุ้นเคยของรูปแบบ OpenAI

ไม่เซ็นเซอร์ & ไม่มีการกรอง

โมเดลของเราถูกปรับแต่งให้ตอบคำถามโดยไม่มีการปฏิเสธเนื้อหาสำหรับการใช้งานผู้ใหญ่ที่ชอบด้วยกฎหมาย เรื่องแต่ง การวิจัยด้านความปลอดภัย หรือหัวข้อที่ถกเถียงกัน ในขณะที่โมเดลมาตรฐานส่วนใหญ่จะปฏิเสธอย่างสุภาพที่จะพูดคุยเกี่ยวกับหัวข้อที่ละเอียดอ่อนหรือสร้างเนื้อหาสำหรับผู้ใหญ่ โมเดลของเราจะให้คำตอบที่ตรงไปตรงมา

มีข้อจำกัดหนึ่งข้อที่ใช้เสมอ: คำขอที่มีเนื้อหาทางเพศที่เกี่ยวข้องกับเด็กจะถูกบล็อก ทุกอย่างอื่นเป็นเป้าหมายที่ถูกต้อง สิ่งนี้ทำให้เหมาะสำหรับแอปพลิเคชันที่คุณต้องการควบคุมผลลัพธ์อย่างเต็มที่โดยที่โมเดลไม่ได้ทำหน้าที่เป็นประตูสำหรับคำขอที่ถูกต้องตามกฎหมายของผู้ใช้

ราคาแบบจ่ายตามการใช้งานที่โปร่งใส

เราไม่ล็อกคุณไว้กับการสมัครสมาชิกแบบรายเดือนหรือแผนแบบชั้น คุณจ่ายตามโทเคนที่คุณใช้จริง input tokens มีราคา $0.25 ต่อล้าน และ output tokens มีราคา $1.00 ต่อล้าน เมื่อคุณเติมเงิน เครดิตเหล่านั้นจะไม่หมดอายุ ดังนั้นคุณสามารถเติมเงินเมื่อเหมาะสมกับงบประมาณของคุณ

เราเสนอโบนัสสำหรับการฝากเงินจำนวนมากขึ้น: +5% เครดิตสำหรับการฝาก $50 และ +10% สำหรับการฝาก $100 บัญชีใหม่เริ่มต้นด้วยเครดิตทดลองใช้ $0.50 ที่มีอายุ 7 วัน โดยไม่ต้องใช้บัตรเครดิต โครงสร้างนี้รับประกันว่าคุณใช้จ่ายเฉพาะสิ่งที่ใช้ โดยไม่มีค่าธรรมเนียมที่ซ่อนอยู่สำหรับการสตรีมมิงหรือการใช้งานเครื่องมือ

ใครที่ไม่เหมาะกับสิ่งนี้

หากคุณต้องการการสร้างภาพ การประมวลผลเสียง หรือ embeddings API นี้ไม่เหมาะกับคุณ เราให้บริการเฉพาะข้อความเท่านั้น หากคุณต้องการการกำหนดเส้นทางโมเดลข้ามผู้ขายหลายราย (เช่น GPT-4, Claude และ Llama ในหนึ่งคำขอ) เราไม่เสนอสิ่งนั้น เรามุ่งเน้นการมอบประสบการณ์ที่ดีที่สุดสำหรับโมเดลไม่เซ็นเซอร์เฉพาะตัวหนึ่ง หากต้องการการรับประกัน SLA ที่เข้มงวด ใบรับรอง SOC2 หรือการปฏิบัติตาม HIPAA แบบพร้อมใช้งาน คุณควรดูผู้ให้บริการระดับองค์กร เราเป็นเอนด์พอยต์ inference ที่ตรงไปตรงมาและเน้นผู้พัฒนาเป็นสำคัญ

ถาม-ตอบ

นี่คือพร็อกซี OpenAI หรือไม่?

ไม่ใช่ เราไม่ได้ขายต่อโมเดลของ OpenAI เราโฮสต์โมเดล open-weight ของเราเองบนเซิร์ฟเวอร์ GPU ของเราเอง มันเข้ากันได้กับ OpenAI ในแง่ของรูปแบบ หมายความว่ารองรับโครงสร้าง JSON และคำสั่ง SDK เดียวกัน แต่โมเดลพื้นฐานเป็นของเรา

ขนาดของหน้าต่างบริบทคือเท่าใด

โมเดลของเรารองรับหน้าต่างบริบทขนาด 100,000 โทเคน โดยนับทั้งพรอมต์และการสร้างข้อความ completion ซึ่งช่วยให้สามารถประมวลผลเอกสารขนาดใหญ่หรือรักษาประวัติการสนทนาที่ยาวนานได้

พรอมต์ของฉันถูกนำไปใช้ในการฝึกโมเดลหรือไม่

ไม่ เราไม่ใช้ข้อมูลพรอมต์ของคุณเพื่อฝึกโมเดลของเรา ข้อมูลของคุณยังคงเป็นส่วนตัวสำหรับคำขอ inference ของคุณ

ฉันจะเริ่มใช้งานอย่างไร

สมัครสมาชิกโดยใช้อีเมลและรหัสผ่านในหน้ารับคีย์ API คุณจะได้รับคีย์ API ทันที คุณสามารถเริ่มใช้เครดิตทดลองใช้ฟรีมูลค่า $0.50 ได้โดยไม่ต้องเพิ่มบัตรเครดิต

เกิดอะไรขึ้นเมื่อฉันถึงขีดจำกัดอัตรา

เราอนุญาตคำขอ 300 requests per minute ต่อคีย์ API หากเกินขีดจำกัดนี้ คุณจะรับข้อผิดพลาด 429 คุณสามารถสร้างคีย์ API ใหม่ได้ทุกเมื่อเพื่อรีเซ็ตตัวนับหากจำเป็น

คีย์ของคุณอยู่ห่างแค่แบบฟอร์มเดียว

สร้างบัญชี คัดลอกคีย์ เปลี่ยน URL พื้นฐาน นั่นคือการตั้งค่าทั้งหมด

รับคีย์ API