RU ▾

LLM без цензуры для постобработки OCRhttps://api.llmocrapi.com/v1

llmocrapi.comДокументация

Быстрый старт: Интеграция LLM без цензуры в ваше OCR-приложение

Интегрируйте нашу LLM без цензуры в конвейер OCR для извлечения, очистки и суммаризации исходного текста из документов без влияния фильтров контента на ваши данные. Это руководство охватывает основные шаги подключения, аутентификации и потоковой передачи ответов через API, совместимый с OpenAI.

Необходимые условия: API-ключ и базовый URL

Перед тем как отправлять запросы, вам нужен API-ключ и правильный базовый URL. Зарегистрируйтесь на странице Получить API-ключ, указав только адрес электронной почты и пароль. Ваш ключ отображается сразу после регистрации, а для пробного периода не требуется привязка кредитной карты.

Базовый URL для этого API — https://api.llmocrapi.com/v1. Этот эндпоинт совместим со стандартными SDK OpenAI. Вы должны настроить ваш клиент на использование этого базового URL и включить ваш API-ключ в заголовок Authorization. Идентификатор модели, который вы будете использовать во всех запросах — uncensored. Она работает на наших собственных GPU-серверах и предназначена для извлечения сырого текста без отказа от законного контента для взрослых или спорного контента.

Базовый запрос на извлечение текста

Начните с отправки простого запроса на завершение чата для проверки соединения. Этот эндпоинт принимает текстовый ввод и возвращает извлеченный или очищенный текст. Используйте эндпоинт POST /v1/chat/completions с моделью uncensored. Убедитесь, что тело запроса включает содержание сообщения и идентификатор модели.

Этот базовый запрос проверяет, что ваш API-ключ работает и что нецензурная модель отвечает ожидаемым образом. Это первый шаг в построении вашего конвейера постобработки OCR.

curl https://api.llmocrapi.com/v1/chat/completions \
  -H "Authorization: Bearer $API_KEY" \
  -H "Content-Type: application/json" \
  -d '{
    "model": "uncensored",
    "messages": [{"role": "user", "content": "Write a blunt product review of a cheap VPN."}]
  }'

Если вы получили ответ с choices, содержащим текст, ваша интеграция успешна. Если вы получили ошибку 401, проверьте API-ключ. Если вы получили ошибку 402, возможно, вам нужно пополнить предоплаченный баланс.

Интеграция с Python SDK

Для разработчиков на Python рекомендуется использовать официальный SDK OpenAI. Установите пакет openai и настройте базовый URL на указание нашего API. Это позволяет вам использовать знакомые методы, такие как chat.completions.create().

Установите параметр base_url в значение https://api.llmocrapi.com/v1 и передайте ваш API-ключ. Это гарантирует, что все запросы будут правильно маршрутизированы к нашей модели без цензуры. Затем вы можете отправить извлеченный OCR-текст как сообщение пользователя и определить системный промпт, чтобы инструктировать модель, как очищать или суммаризовать данные.

from openai import OpenAI

client = OpenAI(base_url="https://api.llmocrapi.com/v1", api_key="YOUR_KEY")

resp = client.chat.completions.create(
    model="uncensored",
    messages=[{"role": "user", "content": "Summarise this thread without softening it."}],
)
print(resp.choices[0].message.content)

Этот метод идеален для пакетной обработки документов, где потоковая передача не требуется. Он предоставляет простой способ интеграции LLM в ваши существующие скрипты Python OCR.

Интеграция с Node SDK

Разработчики Node.js также могут использовать SDK OpenAI для взаимодействия с API. Установите пакет openai для Node и настройте базовый URL аналогично настройке Python. Это позволяет вам использовать тот же эндпоинт chat.completions с знакомым синтаксисом JavaScript.

Настройте клиент с вашим API-ключом и базовым URL https://api.llmocrapi.com/v1. Это обеспечивает совместимость с вашими существующими приложениями Node.js. Затем вы можете отправлять запросы для извлечения или суммаризации текста из вашего конвейера OCR.

import OpenAI from "openai";

const client = new OpenAI({ baseURL: "https://api.llmocrapi.com/v1", apiKey: process.env.API_KEY });

const resp = await client.chat.completions.create({
  model: "uncensored",
  messages: [{ role: "user", content: "Draft a villain monologue for my game." }],
});
console.log(resp.choices[0].message.content);

Этот подход подходит для обработки на стороне сервера в средах Node, позволяя эффективно обрабатывать выходные данные OCR, не выходя из экосистемы Node.

Потоковая передача ответов для больших документов

При обработке больших документов потоковая передача ответов может улучшить пользовательский опыт, доставляя текст частями по мере его генерации. Используйте параметр stream: true в вашем запросе, чтобы включить Server-Sent Events (SSE). Это позволяет вам обрабатывать текст в реальном времени, что полезно для дливых выходных данных OCR или при отображении прогресса пользователям.

Потоковая передача помогает управлять использованием памяти, не требуя удержания всего ответа в памяти перед обработкой. Это особенно полезно для документов с большим объемом текста, которые в противном случае могут вызвать проблемы с задержкой.

stream = client.chat.completions.create(
    model="uncensored",
    messages=[{"role": "user", "content": "Tell the story in second person."}],
    stream=True,
)
for chunk in stream:
    if chunk.choices and chunk.choices[0].delta.content:
        print(chunk.choices[0].delta.content, end="", flush=True)

Убедитесь, что ваш клиент правильно обрабатывает события SSE для разбора инкрементальных текстовых фрагментов. Этот метод идеален для приложений, требующих обратной связи в реальном времени на этапе постобработки OCR.

Лимиты запросов, ошибки и контекстное окно

Обратите внимание на лимиты API, чтобы избежать прерывания службы. Вам доступно 300 запросов в минуту на каждый API-ключ. Тело каждого запроса не должно превышать 8 МБ. Если вы превысите лимит запросов, вы получите ошибку 429. Убедитесь, что ваше приложение реализует экспоненциальное замедление для обработки этих ошибок.

Контекстное окно составляет 100 000 токенов для промпта и ответа в сумме. Если вывод OCR превышает этот лимит, вам, возможно, придется разделить документ или обрезать предыдущие части. Распространенные ошибки: 401 для недействительных ключей, 402 для недостаточного баланса и 429 для лимитов запросов. Отслеживайте использование и добавляйте предоплаченный баланс по мере необходимости для поддержания бесперебойной работы.

Технические характеристики

Все реальные лимиты и возможности API в одном месте — сверьте их до пополнения.

ПараметрЗначение
Формат APIсовместим с OpenAI: любой OpenAI SDK работает — замените base URL и ключ
Base URLhttps://api.llmocrapi.com/v1
АвторизацияAuthorization: Bearer YOUR_KEY
ID моделиuncensored
ЭндпоинтыPOST /v1/chat/completions · GET /v1/models
Максимум ответадо остатка окна в 64 000 токенов; max_tokens необязателен (отдельного лимита нет)
Вызов функцийда — tools, tool_choice; ответ содержит tool_calls, в том числе в потоке; результат — сообщением role: tool
Параметрыtemperature, top_p, stop, seed, presence_penalty, frequency_penalty
JSON-режимresponse_format: {"type": "json_object"}
Потоковая передачада — server-sent events, последний фрагмент содержит расход токенов
Контекстное окно64 000 токенов (вход и ответ вместе)
Размер запросадо 8 МБ
Заголовки ответаX-Request-Id, X-Balance-USD, X-RateLimit-Limit-Requests, X-RateLimit-Limit-Concurrency
Лимит запросов300 запросов в минуту на ключ
Параллельные запросыдо 8 одновременно на ключ
ПополнениеUSDT (TRC20) или USDC (Base), любая целая сумма от $10 до $500
Пробный баланс$0,50 на 7 дней, без карты · Пробный ключ: 2 параллельных запроса, 60 в минуту; полные лимиты (8 и 300) после первого пополнения
Срок действияоплаченный баланс не сгорает, без подписки
Цена$0,25 за 1 млн входных токенов · $1,00 за 1 млн выходных
Оплатапредоплаченный баланс по фактическому расходу; ошибки и отказы бесплатны
Бонус+5% от $50, +10% от $100
Ключиодин активный ключ на аккаунт; новый заменяет старый
ВходGoogle или e-mail и пароль
Контентконтент для взрослых разрешён; сексуальный контент с несовершеннолетними запрещён

Коды ошибок

Ошибки приходят в JSON с постоянным type; неудачные и отклонённые запросы не оплачиваются.

КодТипЧто значит
400bad_requestневерный JSON, пустые сообщения, неверный параметр или превышено окно контекста
401missing_key · invalid_key · key_revokedнет ключа, ключ неверный или заменён новым
402no_creditбаланс пуст — пополните, работа продолжится сразу
403content_blockedсексуальный контент с несовершеннолетними — отказ, без оплаты
404not_foundнеизвестный эндпоинт
413request_too_largeтело запроса больше 8 МБ
429rate_limited · concurrencyбольше 300/мин или 8 параллельно — подождите и повторите
503upstream_busyмодель занята — повторите через несколько секунд

Вопросы и ответы

Является ли нецензурная модель такой же, как GPT или Claude?

Нет. Модель <code>uncensored</code> — это модель с открытыми весами, работающая на наших GPU-серверах. Она настроена на ответы без отказов по контенту для законного использования взрослыми. Это не GPT, Claude, Gemini, Grok или модель другого поставщика.

Что произойдет, если закончится мой предоплаченный баланс?

Если ваш предоплаченный баланс закончится, вы получите ошибку 402 при последующих запросах. Вы можете добавить больше кредита через криптовалюту (USDT или USDC) начиная с $10. Ваш пробный баланс истекает через 7 дней, но предоплаченный баланс не сгорает.

Могу ли я использовать этот API для генерации изображений или видео?

Нет. Этот API — API текстовых чат-завершений. Он не поддерживает генерацию изображений, аудио или видео. Он предназначен для ввода и вывода текста, например, для постобработки текста OCR, суммаризации или извлечения.

Ваш ключ — в одной форме от вас

Создайте аккаунт, скопируйте ключ, измените базовый URL. Вот и вся настройка.

Получить API-ключ