中文 ▾
获取 API 密钥

无审查 LLM 推理

无审查开发者推理 API

即插即用兼容 OpenAI 的推理 API,提供单一无审查开放权重模型。更改 base_url 和密钥,保留代码。

  • 单一无审查模型
  • 无月费
  • 额度永不过期

一个请求即可试用

curl https://api.llminferenceapi.com/v1/chat/completions \
  -H "Authorization: Bearer $API_KEY" \
  -H "Content-Type: application/json" \
  -d '{
    "model": "uncensored",
    "messages": [{"role": "user", "content": "Write a blunt product review of a cheap VPN."}]
  }'

你将获得

即插即用兼容性

适用于官方 OpenAI SDK 和任何兼容客户端。只需将 base_url 更新为 https://api.llminferenceapi.com/v1 并替换 API 密钥。

无审查输出

模型对合法的成人、虚构或争议性主题不进行内容拒绝。仅屏蔽涉及未成年人的性内容。

直接 GPU 托管

我们在自己的服务器上运行模型,而非转售商。无供应商路由,无隐藏层,直接推理。

透明定价

仅按使用付费。输入 token 为 $0.25/1M,输出 token 为 $1.00/1M。无订阅,额度无过期日期。

流式输出与工具

支持服务器发送事件 (SSE) 进行流式输出响应,以及标准工具/函数调用接口。

隐私优先

提示词不用于训练我们的模型。创建账户只需邮箱和密码。

工作原理

  1. 创建账户

    使用电子邮件和密码注册,即时获取 API 密钥。

  2. 充值

    使用加密货币 (USDT 或 USDC) 充值以开始使用服务。

  3. 开始推理

    将现有客户端代码指向我们的 base_url 并发送请求。

人们用它构建什么

创意写作

生成故事和剧本,无需不必要的说教或限制叙事选择的内容过滤器。非常适合成人小说或犀利幽默。

数据提取

使用 100k 上下文窗口解析大型文档,从长文本中提取结构化数据而不丢失上下文。

研究与分析

获取对争议性或小众主题的无过滤答案,模型不会因标准安全准则而拒绝参与。

聊天应用

构建感觉自然且响应迅速的聊天界面,支持流式输出以获得更好的用户体验。

即插即用 OpenAI 兼容性

停止为每个新模型重写集成代码。我们的 API 实现了标准的 /v1/chat/completions 接口,这意味着您只需更改现有 OpenAI SDK 客户端中的 base_url 和 api_key 即可切换到我们的无审查模型。我们支持通过服务器发送事件 (SSE) 进行流式输出和函数调用,因此您现有的处理工具输出或实时文本生成的逻辑开箱即用。

这不是添加延迟的多模型网关或复杂代理。它是直接连接到运行单一优化开放权重模型的 GPU 服务器。您获得专用接口的性能以及 OpenAI 格式的熟悉感。

无审查与无过滤

我们的模型经过调整,可对合法的成人用途、虚构叙事、安全研究或争议性主题进行无内容拒绝的回答。虽然大多数标准模型会礼貌地拒绝讨论敏感主题或生成成熟内容,但我们的模型会提供直接答案。

有一个硬性限制始终适用:包含涉及未成年人性内容的请求将被屏蔽。其他一切皆有可能。这使其非常适合希望完全控制输出且不希望模型作为用户合法请求守门人的应用程序。

透明的按量付费定价

我们不会将你锁定在月度订阅或分层计划中。你只需为消耗的 token 付费。输入 token 每百万 token 费用为 $0.25,输出 token 每百万 token 费用为 $1.00。充值后,预付额度永不过期,你可以根据预算随时充值。

大额充值享额外额度:充值 $50 获得额外 5% 额度,充值 $100 获得额外 10% 额度。新账户初始获得 $0.50 免费试用额度,有效期 7 天,无需信用卡。这种结构确保你只支付实际使用的费用,流式输出或函数调用无隐藏费用。

不适合谁

如果你需要图像生成、音频处理或嵌入功能,此 API 不适合你。我们仅提供文本。如果你需要在单次调用中跨多个供应商路由模型(如 GPT-4、Claude 和 Llama),我们不提供。我们专注于为单一特定的无审查模型提供最佳体验。如果你需要严格的 SLA 保证、SOC2 认证或开箱即用的 HIPAA 合规,请查看企业级供应商。我们是一个直接、开发者优先的推理接口。

问答

这是 OpenAI 代理吗?

不是。我们不转售 OpenAI 的模型。我们在自己的 GPU 服务器上托管自己的开放权重模型。它在格式上兼容 OpenAI,意味着它接受相同的 JSON 结构和 SDK 命令,但底层模型是我们的。

上下文窗口的大小是多少?

我们的模型支持 100,000 token 的上下文窗口,包含提示词和补全部分。这允许处理大型文档或保持长对话历史。

我的提示词会被用于训练吗?

不会。我们不使用你的提示词数据来训练模型。你的数据对你的推理请求保持私密。

如何开始使用?

在获取 API 密钥页面使用电子邮件和密码注册。你将立即获得 API 密钥。你可以直接使用 $0.50 的免费试用额度,无需添加信用卡。

如果达到速率限制会怎样?

每个 API 密钥允许每分钟 300 次请求。如果超出此限制,你将收到 429 错误。如果需要,你可以随时重新生成 API 密钥以重置计数器。

只差一张表单,即可获得密钥

创建账户,复制密钥,更改基础 URL。这就是全部设置。

获取 API 密钥