中文 ▾

用于 OCR 后处理的无审查 LLMhttps://api.llmocrapi.com/v1

llmocrapi.com文档

快速入门:将无审查 LLM 集成到你的 OCR 应用中

将我们的无审查 LLM 集成到 OCR 管道中,从文档中提取、清理和摘要原始文本,且内容过滤器不会干扰你的数据。本指南涵盖连接、认证和使用 OpenAI 兼容 API 进行流式响应的必要步骤。

前提条件:API 密钥和基础 URL

在发起任何请求之前,你需要 API 密钥和正确的基础 URL。只需邮箱和密码即可在获取 API 密钥页面注册。注册后立即显示密钥,试用无需信用卡。

此 API 的基础 URL 为https://api.llmocrapi.com/v1。该接口兼容标准 OpenAI SDK。你必须将客户端配置为使用此基础 URL,并在Authorization标头中包含 API 密钥。所有请求使用的模型标识符为uncensored,它在自有 GPU 服务器上运行,专为处理原始文本提取而设计,不会拒绝合法的成人或争议性内容。

基本文本提取请求

首先发送一个简单的聊天补全请求以测试连接。此接口接受文本输入并返回提取或清理后的文本。使用POST /v1/chat/completions接口和uncensored模型。确保请求正文包含消息内容和模型 ID。

此基本请求验证 API 密钥是否有效,以及无审查模型是否按预期响应。这是构建 OCR 后处理管道的第一步。

curl https://api.llmocrapi.com/v1/chat/completions \
  -H "Authorization: Bearer $API_KEY" \
  -H "Content-Type: application/json" \
  -d '{
    "model": "uncensored",
    "messages": [{"role": "user", "content": "Write a blunt product review of a cheap VPN."}]
  }'

如果收到包含choices且带有文本的响应,则集成成功。如果收到 401 错误,请检查 API 密钥。如果收到 402 错误,可能需要添加预付额度。

Python SDK 集成

对于 Python 开发者,推荐使用官方 OpenAI SDK。安装openai包并将基础 URL 配置指向我们的 API。这允许你使用熟悉的方法如chat.completions.create()。

将base_url参数设置为https://api.llmocrapi.com/v1并传入 API 密钥。这确保所有请求正确路由到我们的无审查模型。然后你可以将 OCR 提取的文本作为用户消息发送,并定义系统提示词以指导模型如何清理或摘要数据。

from openai import OpenAI

client = OpenAI(base_url="https://api.llmocrapi.com/v1", api_key="YOUR_KEY")

resp = client.chat.completions.create(
    model="uncensored",
    messages=[{"role": "user", "content": "Summarise this thread without softening it."}],
)
print(resp.choices[0].message.content)

此方法非常适合不需要流式处理的文档批处理。它为将 LLM 集成到现有 Python OCR 脚本提供了一种直接方式。

Node SDK 集成

Node.js 开发者也可以使用 OpenAI SDK 与 API 交互。为 Node 安装openai包,并像 Python 设置一样配置基础 URL。这允许你利用相同的chat.completions接口,使用熟悉的 JavaScript 语法。

使用 API 密钥和基础 URLhttps://api.llmocrapi.com/v1配置客户端。这确保与你现有的 Node.js 应用兼容。然后你可以发送请求,从 OCR 管道中提取或摘要文本。

import OpenAI from "openai";

const client = new OpenAI({ baseURL: "https://api.llmocrapi.com/v1", apiKey: process.env.API_KEY });

const resp = await client.chat.completions.create({
  model: "uncensored",
  messages: [{ role: "user", content: "Draft a villain monologue for my game." }],
});
console.log(resp.choices[0].message.content);

此方法适合 Node 环境中的服务器端处理,允许你在不离开 Node 生态系统的情况下高效处理 OCR 输出。

大文档的流式响应

处理大文档时,流式响应可以通过分块生成文本来改善用户体验。在请求中使用stream: true参数启用服务器发送事件 (SSE)。这允许你实时处理文本,适用于长 OCR 输出或向用户显示进度。

流式处理有助于管理内存使用,因为不需要在处理前将整个响应保留在内存中。这对于包含大量文本的文档特别有用,否则可能导致延迟问题。

stream = client.chat.completions.create(
    model="uncensored",
    messages=[{"role": "user", "content": "Tell the story in second person."}],
    stream=True,
)
for chunk in stream:
    if chunk.choices and chunk.choices[0].delta.content:
        print(chunk.choices[0].delta.content, end="", flush=True)

确保客户端正确处理 SSE 事件以解析增量文本块。此方法非常适合需要在 OCR 后处理阶段获得实时反馈的应用。

速率限制、错误和上下文窗口

注意 API 限制以避免服务中断。每个 API 密钥每分钟限制 300 次请求。每个请求正文不得超过 8 MB。如果超出速率限制,将收到 429 错误。确保应用实现指数退避以优雅处理这些错误。

上下文窗口为 100,000 token,提示词和补全合计。如果 OCR 输出超过此限制,可能需要拆分文档或截断较早部分。常见错误包括:401 表示密钥无效,402 表示额度不足,429 表示速率限制。监控使用情况并根据需要添加预付额度以保持服务不间断。

技术规格

所有限制、功能与价格一览。

项目说明
接口格式兼容 OpenAI:任何 OpenAI SDK 或客户端只需更换 base URL 和密钥
Base URLhttps://api.llmocrapi.com/v1
认证Authorization: Bearer YOUR_KEY
模型 IDuncensored
接口POST /v1/chat/completions · GET /v1/models
最大输出不单独限制输出;提示+回复共 64,000 个 token 窗口内,max_tokens 可选
函数调用支持 tools、tool_choice;回复包含 tool_calls(流式同样支持),结果以 role: tool 消息返回
采样参数temperature、top_p、stop、seed、presence_penalty、frequency_penalty
JSON 模式response_format: {"type": "json_object"}
流式输出支持 SSE,最后一块包含 token 用量
上下文窗口64,000 tokens(输入与输出合计)
请求大小每次请求不超过 8 MB
响应头X-Request-Id、X-Balance-USD、X-RateLimit-Limit-Requests、X-RateLimit-Limit-Concurrency
速率限制每个密钥每分钟 300 次请求
并发每个密钥同时最多 8 个请求
充值USDT(TRC20)或 USDC(Base),$10–$500 任意整数金额
免费试用$0.50,有效期 7 天,无需银行卡 · 试用密钥:2 个并发请求,每分钟 60 次;首次充值后恢复完整限额(8 和 300)
额度有效期付费额度永不过期,无订阅
价格输入 $0.25 / 百万 tokens · 输出 $1.00 / 百万 tokens
计费预付额度,按实际 token 用量扣费;错误和拒绝不收费
赠送额度满 $50 送 5%,满 $100 送 10%
密钥每个账户一个有效密钥;生成新密钥后旧密钥失效
登录Google 或邮箱 + 密码
内容政策允许成人内容;涉及未成年人的性内容一律拒绝

错误代码

错误以 JSON 返回,type 字段固定;失败或被拒绝的请求不计费。

状态码类型含义
400bad_requestJSON 无效、消息为空、参数错误或超出上下文窗口
401missing_key · invalid_key · key_revoked缺少密钥、密钥错误或已被新密钥替换
402no_credit余额不足——充值后立即恢复
403content_blocked涉及未成年人的性内容——拒绝且不计费
404not_found未知接口
413request_too_large请求体超过 8 MB
429rate_limited · concurrency超过每分钟 300 次或 8 个并发——稍后重试
503upstream_busy模型繁忙——几秒后重试

问答

无审查模型与 GPT 或 Claude 相同吗?

不。uncensored 模型是一个开放权重模型,运行在自有 GPU 服务器上,针对合法成人用途进行了调整,可无内容拒绝地回答。它不是 GPT、Claude、Gemini、Grok 或其他厂商的模型。

如果我的预付额度用完了怎么办?

如果预付额度用完,后续请求将返回 402 错误。你可以通过加密货币(USDT 或 USDC)充值,最低 10 美元。试用额度 7 天后过期,但预付额度永不过期。

我可以用此 API 生成图片或视频吗?

不。此 API 是文本聊天补全接口。不支持图片、音频或视频生成。它专为文本输入和输出设计,例如 OCR 文本后处理、摘要或提取。

只差一张表单,即可获得密钥

创建账户,复制密钥,更改基础 URL。这就是全部设置。

获取 API 密钥