快速入门:将无审查 LLM 集成到你的 OCR 应用中
将我们的无审查 LLM 集成到 OCR 管道中,从文档中提取、清理和摘要原始文本,且内容过滤器不会干扰你的数据。本指南涵盖连接、认证和使用 OpenAI 兼容 API 进行流式响应的必要步骤。
前提条件:API 密钥和基础 URL
在发起任何请求之前,你需要 API 密钥和正确的基础 URL。只需邮箱和密码即可在获取 API 密钥页面注册。注册后立即显示密钥,试用无需信用卡。
此 API 的基础 URL 为https://api.llmocrapi.com/v1。该接口兼容标准 OpenAI SDK。你必须将客户端配置为使用此基础 URL,并在Authorization标头中包含 API 密钥。所有请求使用的模型标识符为uncensored,它在自有 GPU 服务器上运行,专为处理原始文本提取而设计,不会拒绝合法的成人或争议性内容。
基本文本提取请求
首先发送一个简单的聊天补全请求以测试连接。此接口接受文本输入并返回提取或清理后的文本。使用POST /v1/chat/completions接口和uncensored模型。确保请求正文包含消息内容和模型 ID。
此基本请求验证 API 密钥是否有效,以及无审查模型是否按预期响应。这是构建 OCR 后处理管道的第一步。
curl https://api.llmocrapi.com/v1/chat/completions \
-H "Authorization: Bearer $API_KEY" \
-H "Content-Type: application/json" \
-d '{
"model": "uncensored",
"messages": [{"role": "user", "content": "Write a blunt product review of a cheap VPN."}]
}'如果收到包含choices且带有文本的响应,则集成成功。如果收到 401 错误,请检查 API 密钥。如果收到 402 错误,可能需要添加预付额度。
Python SDK 集成
对于 Python 开发者,推荐使用官方 OpenAI SDK。安装openai包并将基础 URL 配置指向我们的 API。这允许你使用熟悉的方法如chat.completions.create()。
将base_url参数设置为https://api.llmocrapi.com/v1并传入 API 密钥。这确保所有请求正确路由到我们的无审查模型。然后你可以将 OCR 提取的文本作为用户消息发送,并定义系统提示词以指导模型如何清理或摘要数据。
from openai import OpenAI
client = OpenAI(base_url="https://api.llmocrapi.com/v1", api_key="YOUR_KEY")
resp = client.chat.completions.create(
model="uncensored",
messages=[{"role": "user", "content": "Summarise this thread without softening it."}],
)
print(resp.choices[0].message.content)此方法非常适合不需要流式处理的文档批处理。它为将 LLM 集成到现有 Python OCR 脚本提供了一种直接方式。
Node SDK 集成
Node.js 开发者也可以使用 OpenAI SDK 与 API 交互。为 Node 安装openai包,并像 Python 设置一样配置基础 URL。这允许你利用相同的chat.completions接口,使用熟悉的 JavaScript 语法。
使用 API 密钥和基础 URLhttps://api.llmocrapi.com/v1配置客户端。这确保与你现有的 Node.js 应用兼容。然后你可以发送请求,从 OCR 管道中提取或摘要文本。
import OpenAI from "openai";
const client = new OpenAI({ baseURL: "https://api.llmocrapi.com/v1", apiKey: process.env.API_KEY });
const resp = await client.chat.completions.create({
model: "uncensored",
messages: [{ role: "user", content: "Draft a villain monologue for my game." }],
});
console.log(resp.choices[0].message.content);此方法适合 Node 环境中的服务器端处理,允许你在不离开 Node 生态系统的情况下高效处理 OCR 输出。
大文档的流式响应
处理大文档时,流式响应可以通过分块生成文本来改善用户体验。在请求中使用stream: true参数启用服务器发送事件 (SSE)。这允许你实时处理文本,适用于长 OCR 输出或向用户显示进度。
流式处理有助于管理内存使用,因为不需要在处理前将整个响应保留在内存中。这对于包含大量文本的文档特别有用,否则可能导致延迟问题。
stream = client.chat.completions.create(
model="uncensored",
messages=[{"role": "user", "content": "Tell the story in second person."}],
stream=True,
)
for chunk in stream:
if chunk.choices and chunk.choices[0].delta.content:
print(chunk.choices[0].delta.content, end="", flush=True)确保客户端正确处理 SSE 事件以解析增量文本块。此方法非常适合需要在 OCR 后处理阶段获得实时反馈的应用。
速率限制、错误和上下文窗口
注意 API 限制以避免服务中断。每个 API 密钥每分钟限制 300 次请求。每个请求正文不得超过 8 MB。如果超出速率限制,将收到 429 错误。确保应用实现指数退避以优雅处理这些错误。
上下文窗口为 100,000 token,提示词和补全合计。如果 OCR 输出超过此限制,可能需要拆分文档或截断较早部分。常见错误包括:401 表示密钥无效,402 表示额度不足,429 表示速率限制。监控使用情况并根据需要添加预付额度以保持服务不间断。
技术规格
所有限制、功能与价格一览。
| 项目 | 说明 |
|---|---|
| 接口格式 | 兼容 OpenAI:任何 OpenAI SDK 或客户端只需更换 base URL 和密钥 |
| Base URL | https://api.llmocrapi.com/v1 |
| 认证 | Authorization: Bearer YOUR_KEY |
| 模型 ID | uncensored |
| 接口 | POST /v1/chat/completions · GET /v1/models |
| 最大输出 | 不单独限制输出;提示+回复共 64,000 个 token 窗口内,max_tokens 可选 |
| 函数调用 | 支持 tools、tool_choice;回复包含 tool_calls(流式同样支持),结果以 role: tool 消息返回 |
| 采样参数 | temperature、top_p、stop、seed、presence_penalty、frequency_penalty |
| JSON 模式 | response_format: {"type": "json_object"} |
| 流式输出 | 支持 SSE,最后一块包含 token 用量 |
| 上下文窗口 | 64,000 tokens(输入与输出合计) |
| 请求大小 | 每次请求不超过 8 MB |
| 响应头 | X-Request-Id、X-Balance-USD、X-RateLimit-Limit-Requests、X-RateLimit-Limit-Concurrency |
| 速率限制 | 每个密钥每分钟 300 次请求 |
| 并发 | 每个密钥同时最多 8 个请求 |
| 充值 | USDT(TRC20)或 USDC(Base),$10–$500 任意整数金额 |
| 免费试用 | $0.50,有效期 7 天,无需银行卡 · 试用密钥:2 个并发请求,每分钟 60 次;首次充值后恢复完整限额(8 和 300) |
| 额度有效期 | 付费额度永不过期,无订阅 |
| 价格 | 输入 $0.25 / 百万 tokens · 输出 $1.00 / 百万 tokens |
| 计费 | 预付额度,按实际 token 用量扣费;错误和拒绝不收费 |
| 赠送额度 | 满 $50 送 5%,满 $100 送 10% |
| 密钥 | 每个账户一个有效密钥;生成新密钥后旧密钥失效 |
| 登录 | Google 或邮箱 + 密码 |
| 内容政策 | 允许成人内容;涉及未成年人的性内容一律拒绝 |
错误代码
错误以 JSON 返回,type 字段固定;失败或被拒绝的请求不计费。
| 状态码 | 类型 | 含义 |
|---|---|---|
400 | bad_request | JSON 无效、消息为空、参数错误或超出上下文窗口 |
401 | missing_key · invalid_key · key_revoked | 缺少密钥、密钥错误或已被新密钥替换 |
402 | no_credit | 余额不足——充值后立即恢复 |
403 | content_blocked | 涉及未成年人的性内容——拒绝且不计费 |
404 | not_found | 未知接口 |
413 | request_too_large | 请求体超过 8 MB |
429 | rate_limited · concurrency | 超过每分钟 300 次或 8 个并发——稍后重试 |
503 | upstream_busy | 模型繁忙——几秒后重试 |
问答
无审查模型与 GPT 或 Claude 相同吗?
不。uncensored 模型是一个开放权重模型,运行在自有 GPU 服务器上,针对合法成人用途进行了调整,可无内容拒绝地回答。它不是 GPT、Claude、Gemini、Grok 或其他厂商的模型。
如果我的预付额度用完了怎么办?
如果预付额度用完,后续请求将返回 402 错误。你可以通过加密货币(USDT 或 USDC)充值,最低 10 美元。试用额度 7 天后过期,但预付额度永不过期。
我可以用此 API 生成图片或视频吗?
不。此 API 是文本聊天补全接口。不支持图片、音频或视频生成。它专为文本输入和输出设计,例如 OCR 文本后处理、摘要或提取。
只差一张表单,即可获得密钥
创建账户,复制密钥,更改基础 URL。这就是全部设置。