llmocrapi.comДокументация
Быстрый старт: Интеграция LLM без цензуры в ваше OCR-приложение
Интегрируйте нашу LLM без цензуры в конвейер OCR для извлечения, очистки и суммаризации исходного текста из документов без влияния фильтров контента на ваши данные. Это руководство охватывает основные шаги подключения, аутентификации и потоковой передачи ответов через API, совместимый с OpenAI.
Необходимые условия: API-ключ и базовый URL
Перед тем как отправлять запросы, вам нужен API-ключ и правильный базовый URL. Зарегистрируйтесь на странице Получить API-ключ, указав только адрес электронной почты и пароль. Ваш ключ отображается сразу после регистрации, а для пробного периода не требуется привязка кредитной карты.
Базовый URL для этого API — https://api.llmocrapi.com/v1. Этот эндпоинт совместим со стандартными SDK OpenAI. Вы должны настроить ваш клиент на использование этого базового URL и включить ваш API-ключ в заголовок Authorization. Идентификатор модели, который вы будете использовать во всех запросах — uncensored. Она работает на наших собственных GPU-серверах и предназначена для извлечения сырого текста без отказа от законного контента для взрослых или спорного контента.
Базовый запрос на извлечение текста
Начните с отправки простого запроса на завершение чата для проверки соединения. Этот эндпоинт принимает текстовый ввод и возвращает извлеченный или очищенный текст. Используйте эндпоинт POST /v1/chat/completions с моделью uncensored. Убедитесь, что тело запроса включает содержание сообщения и идентификатор модели.
Этот базовый запрос проверяет, что ваш API-ключ работает и что нецензурная модель отвечает ожидаемым образом. Это первый шаг в построении вашего конвейера постобработки OCR.
curl https://api.llmocrapi.com/v1/chat/completions \
-H "Authorization: Bearer $API_KEY" \
-H "Content-Type: application/json" \
-d '{
"model": "uncensored",
"messages": [{"role": "user", "content": "Write a blunt product review of a cheap VPN."}]
}'Если вы получили ответ с choices, содержащим текст, ваша интеграция успешна. Если вы получили ошибку 401, проверьте API-ключ. Если вы получили ошибку 402, возможно, вам нужно пополнить предоплаченный баланс.
Интеграция с Python SDK
Для разработчиков на Python рекомендуется использовать официальный SDK OpenAI. Установите пакет openai и настройте базовый URL на указание нашего API. Это позволяет вам использовать знакомые методы, такие как chat.completions.create().
Установите параметр base_url в значение https://api.llmocrapi.com/v1 и передайте ваш API-ключ. Это гарантирует, что все запросы будут правильно маршрутизированы к нашей модели без цензуры. Затем вы можете отправить извлеченный OCR-текст как сообщение пользователя и определить системный промпт, чтобы инструктировать модель, как очищать или суммаризовать данные.
from openai import OpenAI
client = OpenAI(base_url="https://api.llmocrapi.com/v1", api_key="YOUR_KEY")
resp = client.chat.completions.create(
model="uncensored",
messages=[{"role": "user", "content": "Summarise this thread without softening it."}],
)
print(resp.choices[0].message.content)Этот метод идеален для пакетной обработки документов, где потоковая передача не требуется. Он предоставляет простой способ интеграции LLM в ваши существующие скрипты Python OCR.
Интеграция с Node SDK
Разработчики Node.js также могут использовать SDK OpenAI для взаимодействия с API. Установите пакет openai для Node и настройте базовый URL аналогично настройке Python. Это позволяет вам использовать тот же эндпоинт chat.completions с знакомым синтаксисом JavaScript.
Настройте клиент с вашим API-ключом и базовым URL https://api.llmocrapi.com/v1. Это обеспечивает совместимость с вашими существующими приложениями Node.js. Затем вы можете отправлять запросы для извлечения или суммаризации текста из вашего конвейера OCR.
import OpenAI from "openai";
const client = new OpenAI({ baseURL: "https://api.llmocrapi.com/v1", apiKey: process.env.API_KEY });
const resp = await client.chat.completions.create({
model: "uncensored",
messages: [{ role: "user", content: "Draft a villain monologue for my game." }],
});
console.log(resp.choices[0].message.content);Этот подход подходит для обработки на стороне сервера в средах Node, позволяя эффективно обрабатывать выходные данные OCR, не выходя из экосистемы Node.
Потоковая передача ответов для больших документов
При обработке больших документов потоковая передача ответов может улучшить пользовательский опыт, доставляя текст частями по мере его генерации. Используйте параметр stream: true в вашем запросе, чтобы включить Server-Sent Events (SSE). Это позволяет вам обрабатывать текст в реальном времени, что полезно для дливых выходных данных OCR или при отображении прогресса пользователям.
Потоковая передача помогает управлять использованием памяти, не требуя удержания всего ответа в памяти перед обработкой. Это особенно полезно для документов с большим объемом текста, которые в противном случае могут вызвать проблемы с задержкой.
stream = client.chat.completions.create(
model="uncensored",
messages=[{"role": "user", "content": "Tell the story in second person."}],
stream=True,
)
for chunk in stream:
if chunk.choices and chunk.choices[0].delta.content:
print(chunk.choices[0].delta.content, end="", flush=True)Убедитесь, что ваш клиент правильно обрабатывает события SSE для разбора инкрементальных текстовых фрагментов. Этот метод идеален для приложений, требующих обратной связи в реальном времени на этапе постобработки OCR.
Лимиты запросов, ошибки и контекстное окно
Обратите внимание на лимиты API, чтобы избежать прерывания службы. Вам доступно 300 запросов в минуту на каждый API-ключ. Тело каждого запроса не должно превышать 8 МБ. Если вы превысите лимит запросов, вы получите ошибку 429. Убедитесь, что ваше приложение реализует экспоненциальное замедление для обработки этих ошибок.
Контекстное окно составляет 100 000 токенов для промпта и ответа в сумме. Если вывод OCR превышает этот лимит, вам, возможно, придется разделить документ или обрезать предыдущие части. Распространенные ошибки: 401 для недействительных ключей, 402 для недостаточного баланса и 429 для лимитов запросов. Отслеживайте использование и добавляйте предоплаченный баланс по мере необходимости для поддержания бесперебойной работы.
Технические характеристики
Все реальные лимиты и возможности API в одном месте — сверьте их до пополнения.
| Параметр | Значение |
|---|---|
| Формат API | совместим с OpenAI: любой OpenAI SDK работает — замените base URL и ключ |
| Base URL | https://api.llmocrapi.com/v1 |
| Авторизация | Authorization: Bearer YOUR_KEY |
| ID модели | uncensored |
| Эндпоинты | POST /v1/chat/completions · GET /v1/models |
| Максимум ответа | до остатка окна в 64 000 токенов; max_tokens необязателен (отдельного лимита нет) |
| Вызов функций | да — tools, tool_choice; ответ содержит tool_calls, в том числе в потоке; результат — сообщением role: tool |
| Параметры | temperature, top_p, stop, seed, presence_penalty, frequency_penalty |
| JSON-режим | response_format: {"type": "json_object"} |
| Потоковая передача | да — server-sent events, последний фрагмент содержит расход токенов |
| Контекстное окно | 64 000 токенов (вход и ответ вместе) |
| Размер запроса | до 8 МБ |
| Заголовки ответа | X-Request-Id, X-Balance-USD, X-RateLimit-Limit-Requests, X-RateLimit-Limit-Concurrency |
| Лимит запросов | 300 запросов в минуту на ключ |
| Параллельные запросы | до 8 одновременно на ключ |
| Пополнение | USDT (TRC20) или USDC (Base), любая целая сумма от $10 до $500 |
| Пробный баланс | $0,50 на 7 дней, без карты · Пробный ключ: 2 параллельных запроса, 60 в минуту; полные лимиты (8 и 300) после первого пополнения |
| Срок действия | оплаченный баланс не сгорает, без подписки |
| Цена | $0,25 за 1 млн входных токенов · $1,00 за 1 млн выходных |
| Оплата | предоплаченный баланс по фактическому расходу; ошибки и отказы бесплатны |
| Бонус | +5% от $50, +10% от $100 |
| Ключи | один активный ключ на аккаунт; новый заменяет старый |
| Вход | Google или e-mail и пароль |
| Контент | контент для взрослых разрешён; сексуальный контент с несовершеннолетними запрещён |
Коды ошибок
Ошибки приходят в JSON с постоянным type; неудачные и отклонённые запросы не оплачиваются.
| Код | Тип | Что значит |
|---|---|---|
400 | bad_request | неверный JSON, пустые сообщения, неверный параметр или превышено окно контекста |
401 | missing_key · invalid_key · key_revoked | нет ключа, ключ неверный или заменён новым |
402 | no_credit | баланс пуст — пополните, работа продолжится сразу |
403 | content_blocked | сексуальный контент с несовершеннолетними — отказ, без оплаты |
404 | not_found | неизвестный эндпоинт |
413 | request_too_large | тело запроса больше 8 МБ |
429 | rate_limited · concurrency | больше 300/мин или 8 параллельно — подождите и повторите |
503 | upstream_busy | модель занята — повторите через несколько секунд |
Вопросы и ответы
Является ли нецензурная модель такой же, как GPT или Claude?
Нет. Модель <code>uncensored</code> — это модель с открытыми весами, работающая на наших GPU-серверах. Она настроена на ответы без отказов по контенту для законного использования взрослыми. Это не GPT, Claude, Gemini, Grok или модель другого поставщика.
Что произойдет, если закончится мой предоплаченный баланс?
Если ваш предоплаченный баланс закончится, вы получите ошибку 402 при последующих запросах. Вы можете добавить больше кредита через криптовалюту (USDT или USDC) начиная с $10. Ваш пробный баланс истекает через 7 дней, но предоплаченный баланс не сгорает.
Могу ли я использовать этот API для генерации изображений или видео?
Нет. Этот API — API текстовых чат-завершений. Он не поддерживает генерацию изображений, аудио или видео. Он предназначен для ввода и вывода текста, например, для постобработки текста OCR, суммаризации или извлечения.
Ваш ключ — в одной форме от вас
Создайте аккаунт, скопируйте ключ, измените базовый URL. Вот и вся настройка.