RU ▾
Получить API-ключ

Инференс LLM без цензуры

API инференса без цензуры для разработчиков

Готовая замена API инференса, совместимая с OpenAI, обслуживающая одну модель без цензуры с открытыми весами. Измените base_url и ключ, код остаётся прежним.

  • Одна модель без цензуры
  • Без ежемесячных платежей
  • Кредиты не сгорают

Попробуйте одним запросом

curl https://api.llminferenceapi.com/v1/chat/completions \
  -H "Authorization: Bearer $API_KEY" \
  -H "Content-Type: application/json" \
  -d '{
    "model": "uncensored",
    "messages": [{"role": "user", "content": "Write a blunt product review of a cheap VPN."}]
  }'

Что вы получаете

Совместимость «подключи и работай»

Работает с официальными SDK OpenAI и любыми совместимыми клиентами. Просто обновите base_url до https://api.llminferenceapi.com/v1 и замените API-ключ.

Вывод без цензуры

Модель отвечает без отказов по контенту для законных взрослых, вымышленных или спорных тем. Блокируется только контент сексуального характера с участием несовершеннолетних.

Прямой хостинг на GPU

Мы запускаем модель на собственных серверах, а не как перепродавец. Без маршрутизации поставщиков, без скрытых слоёв — только прямой инференс.

Прозрачное ценообразование

Платите только за то, что используете. Входные токены стоят $0.25/1 млн, выходные токены — $1.00/1 млн. Без подписок и сроков действия кредитов.

Потоковая передача и инструменты

Поддерживает события, отправляемые сервером (SSE) для потоковой передачи ответов и стандартные эндпоинты вызова функций.

Приватность в первую очередь

Промпты не используются для обучения моделей. Для создания аккаунта нужны только адрес электронной почты и пароль.

Как это работает

  1. Создать аккаунт

    Зарегистрируйтесь по электронной почте и паролю, чтобы мгновенно получить API-ключ.

  2. Пополнить баланс

    Пополните баланс криптовалютой (USDT или USDC), чтобы начать использовать сервис.

  3. Начать инференс

    Направьте существующий клиентский код на наш base_url и отправляйте запросы.

Что создают пользователи

Художественное письмо

Генерируйте истории и сценарии без нежелательного морализаторства или фильтров контента, ограничивающих ваш выбор. Идеально для взрослой прозы или острого юмора.

Извлечение данных

Анализируйте большие документы с помощью контекстного окна на 100k токенов, чтобы извлекать структурированные данные из длинных текстов без потери контекста.

Исследования и анализ

Получайте нефильтруемые ответы на спорные или узкоспециализированные темы без отказов модели от взаимодействия из-за стандартных правил безопасности.

Чат-приложения

Создавайте интерфейсы чата, которые кажутся естественными и отзывчивыми, поддерживая потоковую передачу ответов для улучшения пользовательского опыта.

Совместимость с OpenAI «подключи и работай»

Перестаньте переписывать код интеграции для каждой новой модели. Наш API реализует стандартный эндпоинт /v1/chat/completions, что позволяет перейти на нашу модель без цензуры, просто изменив base_url и api_key в существующих клиентах SDK OpenAI. Мы поддерживаем потоковую передачу через Server-Sent Events (SSE) и вызов функций, поэтому ваша существующая логика обработки вывода инструментов или генерации текста в реальном времени работает из коробки.

Это не шлюз с несколькими моделями или сложный прокси, добавляющий задержки. Это прямое подключение к нашим GPU-серверам, запускающим одну оптимизированную модель с открытыми весами. Вы получаете производительность выделенного эндпоинта с привычностью формата OpenAI.

Без цензуры и фильтров

Наша модель настроена на ответы без отказов по контенту для законного использования взрослыми, вымышленных повествований, исследований в области безопасности или спорных тем. В то время как большинство стандартных моделей вежливо откажутся обсуждать чувствительные темы или генерировать контент для взрослых, наша модель предоставит прямой ответ.

Существует одно строгое ограничение, которое действует всегда: запросы с сексуальным контентом с участием несовершеннолетних блокируются. Всё остальное — в открытом доступе. Это делает API идеальным для приложений, где вам нужен полный творческий контроль над результатом без того, чтобы модель выступала в роли контролёра законных запросов ваших пользователей.

Прозрачное ценообразование по факту использования

Мы не привязываем вас к ежемесячным подпискам или тарифным планам. Вы платите ровно за потреблённые токены. Входные токены стоят $0,25 за миллион, выходные токены — $1,00 за миллион. Когда вы пополняете баланс, эти средства не сгорают, поэтому вы можете пополнять его, когда это удобно для вашего бюджета.

Мы предлагаем бонусы за крупные пополнения: +5% средств на депозиты от $50 и +10% на депозиты от $100. Новые аккаунты получают $0,50 в виде пробных средств, действительных в течение 7 дней, без привязки кредитной карты. Такая структура гарантирует, что вы тратите только то, что используете, без скрытых комиссий за потоковую передачу или использование инструментов.

Кому это НЕ подходит

Если вам нужна генерация изображений, обработка аудио или эмбеддинги, этот API не для вас. Мы предоставляем только текст. Если вам нужна маршрутизация моделей между несколькими поставщиками (например, GPT-4, Claude и Llama в одном вызове), мы этого не предлагаем. Мы фокусируемся на предоставлении наилучшего опыта для одной конкретной модели без цензуры. Если вам нужны строгие гарантии SLA, сертификаты SOC2 или соответствие HIPAA из коробки, вам стоит обратиться к корпоративным поставщикам. Мы — простой, созданный для разработчиков эндпоинт инференса.

Вопросы и ответы

Это прокси OpenAI?

Нет. Мы не перепродаём модели OpenAI. Мы размещаем собственную модель с открытыми весами на собственных GPU-серверах. Она совместима с OpenAI по формату: принимает те же JSON-структуры и команды SDK, но базовая модель — наша.

Какой размер контекстного окна?

Наша модель поддерживает контекстное окно на 100 000 токенов, включая как промпт, так и ответ. Это позволяет обрабатывать большие документы или поддерживать длинные истории разговоров.

Используются ли мои промпты для обучения?

Нет. Мы не используем данные ваших промптов для обучения нашей модели. Ваши данные остаются закрытыми для ваших запросов на инференс.

Как начать работу?

Зарегистрируйтесь с адресом электронной почты и паролем на странице получения API-ключа. Вы сразу получите API-ключ. Вы можете начать использовать бесплатный пробный баланс в размере $0,50 без привязки кредитной карты.

Что произойдет, если я превышу лимит запросов?

Мы разрешаем 300 запросов в минуту на один API-ключ. Если вы превысите этот лимит, вы получите ошибку 429. Вы можете сгенерировать новый API-ключ в любое время, чтобы сбросить счетчик лимита запросов, если это необходимо.

Ваш ключ — в одной форме от вас

Создайте аккаунт, скопируйте ключ, измените базовый URL. Вот и вся настройка.

Получить API-ключ