無検閲LLM推論
無検閲 開発者向け推論API
単一の無検閲オープンウェイトモデルを提供する、そのまま置き換え可能なOpenAI互換推論API。base_urlとキーを変更し、コードはそのまま維持します。
- 1つの無検閲モデル
- 月額料金なし
- クレジットは期限切れになりません
1 回のリクエストで試す
curl https://api.llminferenceapi.com/v1/chat/completions \
-H "Authorization: Bearer $API_KEY" \
-H "Content-Type: application/json" \
-d '{
"model": "uncensored",
"messages": [{"role": "user", "content": "Write a blunt product review of a cheap VPN."}]
}'from openai import OpenAI
client = OpenAI(base_url="https://api.llminferenceapi.com/v1", api_key="YOUR_KEY")
resp = client.chat.completions.create(
model="uncensored",
messages=[{"role": "user", "content": "Summarise this thread without softening it."}],
)
print(resp.choices[0].message.content)import OpenAI from "openai";
const client = new OpenAI({ baseURL: "https://api.llminferenceapi.com/v1", apiKey: process.env.API_KEY });
const resp = await client.chat.completions.create({
model: "uncensored",
messages: [{ role: "user", content: "Draft a villain monologue for my game." }],
});
console.log(resp.choices[0].message.content);提供される機能
ドロイン互換性
公式のOpenAI SDKおよび互換クライアントと動作します。base_urlをhttps://api.llminferenceapi.com/v1に更新し、APIキーを入れ替えるだけです。
無検閲出力
このモデルは、法的な大人向け、フィクション、または論争的なトピックに対してコンテンツ拒否なしで応答します。未成年者との性的コンテンツのみがブロックされます。
直接GPUホスティング
再販売業者ではなく、自前のサーバーでモデルを実行しています。ベンダーのルーティングや隠れたレイヤーはなく、直接推論を行います。
透明な価格設定
使用した分だけお支払いください。入力トークンは100万トークンあたり$0.25、出力トークンは100万トークンあたり$1.00。サブスクリプションやクレジットの有効期限はありません。
ストリーミングとツール
ストリーミング応答のためのサーバー送信イベント(SSE)と、標準的なツール/関数呼び出しエンドポイントをサポートします。
プライバシーファースト
プロンプトはモデルのトレーニングには使用されません。アカウント作成にはメールアドレスとパスワードのみが必要です。
仕組み
アカウントを作成
メールアドレスとパスワードでサインアップし、APIキーを即座に取得してください。
クレジットを追加
暗号通貨(USDTまたはUSDC)でチャージしてサービスを使用開始します。
推論を開始
既存のクライアントコードを当社のbase_urlに指し、リクエストを送信します。
これを使って何ができるか
クリエイティブライティング
物語やスクリプトを生成する際、不要な道徳的説教やナラティブの選択を制限するコンテンツフィルターがありません。大人向けのフィクションやエッジの効いたユーモアに最適です。
データ抽出
100kコンテキストウィンドウを使用して大規模なドキュメントを解析し、コンテキストを失うことなく長いテキストから構造化データを抽出します。
研究と分析
標準的な安全ガイドラインによりモデルが応答を拒否することなく、論争的またはニッチなトピックに対するフィルターなしの回答を取得します。
チャットアプリケーション
ストリーミング応答をサポートし、自然でレスポンシブなチャットインターフェースを構築して、より良いユーザーエクスペリエンスを提供します。
ドロインOpenAI互換性
新しいモデルごとに統合コードを書き換える必要はありません。当APIは標準の/v1/chat/completionsエンドポイントを実装しており、既存のOpenAI SDKクライアントのbase_urlとapi_keyを変更するだけで、無検閲モデルに切り替えることができます。Server-Sent Events (SSE) によるストリーミングと関数呼び出しをサポートしており、ツール出力やリアルタイムテキスト生成を処理する既存のロジックはそのまま利用できます。
これはレイテンシーを追加するマルチモデルゲートウェイや複雑なプロキシではありません。単一の最適化されたオープンウェイトモデルを実行する当社のGPUサーバーへの直接接続です。OpenAIフォーマットの親しみやすさと、専用エンドポイントのパフォーマンスが得られます。
無検閲&フィルターなし
当モデルは、合法な大人向け利用、フィクション、セキュリティ調査、または論争的なトピックについて、コンテンツ拒否なしで回答するようにチューニングされています。多くの標準モデルは、機密性の高いトピックの議論や大人向けコンテンツの生成を丁寧に断りますが、当モデルは直接的な回答を提供します。
常に適用される厳格な制限が1つあります:未成年者への性的コンテンツを含むリクエストはブロックされます。それ以外はすべて対象となります。これは、ユーザーの正当なリクエストに対してモデルがゲートキーパーとして振る舞うことなく、出力に対する完全なクリエイティブコントロールを望むアプリケーションに最適です。
透明な従量課金制価格設定
月額サブスクリプションや階層プランに縛りません。消費したトークンのみに対して正確に課金されます。入力トークンは100万トークンあたり$0.25、出力トークンは100万トークンあたり$1.00です。資金を追加すると、そのクレジットは期限切れにならないため、予算に合わせてチャージできます。
大口入金にはボーナスを提供しています:$50の入金で+5%クレジット、$100の入金で+10%クレジット。新規アカウントは、クレジットカード不要で7日間有効な$0.50のトライアルクレジットで開始します。この構造により、ストリーミングやツール使用に隠れた料金がかかることなく、使用分のみを支出することが保証されます。
このAPIに適さない人
画像生成、音声処理、または埋め込みが必要な場合は、このAPIは適していません。テキストのみを提供します。複数のベンダー(GPT-4、Claude、Llamaなど)にわたるモデルルーティングを1つの呼び出しで行う必要がある場合、当社はそれを提供していません。当社は、特定の無検閲モデルに対する最高の体験提供に注力しています。厳格なSLA保証、SOC2認証、または標準的なHIPAA準拠が必要な場合は、エンタープライズグレードのプロバイダーをご覧ください。当社は、開発者ファーストの推論エンドポイントです。
質問と回答
これはOpenAIのプロキシですか?
いいえ。私たちはOpenAIのモデルを再販売していません。独自のGPUサーバー上で独自のオープンウェイトモデルをホストしています。フォーマットはOpenAI互換で、同じJSON構造とSDKコマンドを受け付けますが、基盤となるモデルは当社製です。
コンテキストウィンドウのサイズはどのくらいですか?
当モデルは、プロンプトと補完の両方を含めて100,000トークンのコンテキストウィンドウをサポートしています。これにより、大規模なドキュメントの処理や、長い会話履歴の維持が可能になります。
私のプロンプトはトレーニングに使用されますか?
いいえ。プロンプトデータを使用してモデルを学習することはありません。あなたのデータは推論リクエストにのみ非公開のままです。
始め方は?
Get API Keyページでメールアドレスとパスワードでサインアップしてください。APIキーが即座に発行されます。クレジットカードを追加せずに、無料の$0.50トライアルクレジットの利用を開始できます。
レート制限に達するとどうなりますか?
API キーあたり1分間に300リクエストを許可しています。これを超えると、429エラーが発生します。必要に応じてAPI キーを再生成してカウンターをリセットできます。
キーはフォーム 1 つで手に入ります
アカウントを作成し、キーをコピーし、ベースURLを変更するだけです。これでセットアップは完了です。
API キーを取得