VI ▾

LLM không kiểm duyệt cho xử lý hậu kỳ OCRhttps://api.llmocrapi.com/v1

llmocrapi.comTài liệu

Hướng dẫn nhanh: Tích hợp LLM không kiểm duyệt vào ứng dụng OCR của bạn

Tích hợp LLM không kiểm duyệt của chúng tôi vào quy trình OCR của bạn để trích xuất, làm sạch và tóm tắt văn bản thô từ tài liệu mà không có bộ lọc nội dung làm ảnh hưởng đến dữ liệu của bạn. Hướng dẫn này bao gồm các bước thiết yếu để kết nối, xác thực và truyền phát phản hồi bằng API tương thích OpenAI.

Yêu cầu tiên quyết: Khóa API và URL cơ sở

Trước khi thực hiện bất kỳ yêu cầu nào, bạn cần một khóa API và URL cơ sở chính xác. Đăng ký trên trang Lấy khóa API chỉ bằng email và mật khẩu. Khóa của bạn được hiển thị ngay sau khi đăng ký và không cần thẻ tín dụng cho bản dùng thử.

URL gốc cho API này là https://api.llmocrapi.com/v1. Endpoint này tương thích với các SDK OpenAI tiêu chuẩn. Bạn cần cấu hình client của mình để sử dụng URL gốc này và bao gồm khóa API của bạn trong tiêu đề Authorization. Định danh mô hình bạn sẽ sử dụng cho tất cả các yêu cầu là uncensored, chạy trên các máy chủ GPU của chính chúng tôi và được thiết kế để xử lý trích xuất văn bản thô mà không từ chối nội dung người lớn hợp pháp hoặc gây tranh cãi.

Yêu cầu trích xuất văn bản cơ bản

Bắt đầu bằng cách gửi một yêu cầu hoàn thành trò chuyện đơn giản để kiểm tra kết nối. Endpoint này chấp nhận đầu vào văn bản và trả về văn bản đã trích xuất hoặc làm sạch. Sử dụng endpoint POST /v1/chat/completions với mô hình uncensored. Đảm bảo thân yêu cầu của bạn bao gồm nội dung tin nhắn và định danh mô hình.

Yêu cầu cơ bản này xác minh rằng khóa API của bạn hoạt động và mô hình không kiểm duyệt phản hồi như mong đợi. Đây là bước đầu tiên trong việc xây dựng quy trình xử lý hậu kỳ OCR của bạn.

curl https://api.llmocrapi.com/v1/chat/completions \
  -H "Authorization: Bearer $API_KEY" \
  -H "Content-Type: application/json" \
  -d '{
    "model": "uncensored",
    "messages": [{"role": "user", "content": "Write a blunt product review of a cheap VPN."}]
  }'

Nếu bạn nhận được phản hồi với choices chứa văn bản, việc tích hợp của bạn đã thành công. Nếu bạn nhận được lỗi 401, hãy kiểm tra khóa API của bạn. Nếu bạn nhận được lỗi 402, bạn có thể cần thêm tín dụng trả trước.

Tích hợp SDK Python

Đối với nhà phát triển Python, việc sử dụng SDK OpenAI chính thức là phương pháp được khuyến nghị. Cài đặt gói openai và cấu hình URL cơ sở trỏ đến API của chúng tôi. Điều này cho phép bạn sử dụng các phương thức quen thuộc như chat.completions.create().

Đặt tham số base_url thành https://api.llmocrapi.com/v1 và truyền khóa API của bạn. Điều này đảm bảo rằng tất cả các yêu cầu được định tuyến chính xác đến mô hình không kiểm duyệt của chúng tôi. Sau đó, bạn có thể gửi văn bản trích xuất OCR của bạn làm tin nhắn người dùng và xác định prompt hệ thống để hướng dẫn mô hình cách làm sạch hoặc tóm tắt dữ liệu.

from openai import OpenAI

client = OpenAI(base_url="https://api.llmocrapi.com/v1", api_key="YOUR_KEY")

resp = client.chat.completions.create(
    model="uncensored",
    messages=[{"role": "user", "content": "Summarise this thread without softening it."}],
)
print(resp.choices[0].message.content)

Phương pháp này lý tưởng cho việc xử lý hàng loạt tài liệu khi không cần truyền phát. Nó cung cấp cách đơn giản để tích hợp LLM vào các tập lệnh OCR Python hiện có của bạn.

Tích hợp SDK Node.js

Nhà phát triển Node.js cũng có thể sử dụng SDK OpenAI để tương tác với API. Cài đặt gói openai cho Node và cấu hình URL cơ sở tương tự như thiết lập Python. Điều này cho phép bạn tận dụng cùng endpoint chat.completions với cú pháp JavaScript quen thuộc.

Cấu hình client với khóa API của bạn và URL gốc https://api.llmocrapi.com/v1. Điều này đảm bảo tương thích với các ứng dụng Node.js hiện có của bạn. Sau đó, bạn có thể gửi các yêu cầu để trích xuất hoặc tóm tắt văn bản từ quy trình OCR của bạn.

import OpenAI from "openai";

const client = new OpenAI({ baseURL: "https://api.llmocrapi.com/v1", apiKey: process.env.API_KEY });

const resp = await client.chat.completions.create({
  model: "uncensored",
  messages: [{ role: "user", content: "Draft a villain monologue for my game." }],
});
console.log(resp.choices[0].message.content);

Phương pháp này phù hợp cho xử lý phía máy chủ trong môi trường Node, cho phép bạn xử lý đầu ra OCR một cách hiệu quả mà không rời khỏi hệ sinh thái Node của bạn.

Truyền phát phản hồi cho tài liệu lớn

Khi xử lý tài liệu lớn, truyền phát phản hồi có thể cải thiện trải nghiệm người dùng bằng cách cung cấp văn bản theo từng phần khi nó được tạo. Sử dụng tham số stream: true trong yêu cầu của bạn để kích hoạt Sự kiện được gửi qua máy chủ (SSE). Điều này cho phép bạn xử lý văn bản theo thời gian thực, hữu ích cho đầu ra OCR dài hoặc khi hiển thị tiến trình cho người dùng.

Truyền phát giúp quản lý việc sử dụng bộ nhớ bằng cách không yêu cầu toàn bộ phản hồi phải được giữ trong bộ nhớ trước khi xử lý. Nó đặc biệt hữu ích cho các tài liệu có lượng văn bản đáng kể có thể gây ra vấn đề độ trễ nếu không.

stream = client.chat.completions.create(
    model="uncensored",
    messages=[{"role": "user", "content": "Tell the story in second person."}],
    stream=True,
)
for chunk in stream:
    if chunk.choices and chunk.choices[0].delta.content:
        print(chunk.choices[0].delta.content, end="", flush=True)

Đảm bảo máy khách của bạn xử lý các sự kiện SSE đúng cách để phân tích các đoạn văn bản tăng dần. Phương pháp này lý tưởng cho các ứng dụng yêu cầu phản hồi thời gian thực trong giai đoạn xử lý hậu kỳ OCR.

Giới hạn tốc độ, Lỗi và Cửa sổ ngữ cảnh

Hãy lưu ý các giới hạn của API để tránh gián đoạn dịch vụ. Bạn được giới hạn ở 300 yêu cầu mỗi phút cho mỗi khóa API. Thân yêu cầu của mỗi yêu cầu không được vượt quá 8 MB. Nếu bạn vượt quá giới hạn tốc độ, bạn sẽ nhận được lỗi 429. Hãy đảm bảo ứng dụng của bạn triển khai cơ chế backoff theo cấp số nhân để xử lý các lỗi này một cách mượt mà.

Cửa sổ ngữ cảnh là 100.000 token cho cả prompt và kết quả kết hợp. Nếu kết quả OCR của bạn vượt quá giới hạn này, bạn có thể cần chia tài liệu hoặc cắt ngắn các phần trước đó. Các lỗi phổ biến bao gồm 401 cho khóa không hợp lệ, 402 cho tín dụng không đủ và 429 cho giới hạn tốc độ. Hãy theo dõi mức sử dụng của bạn và thêm tín dụng trả trước khi cần thiết để duy trì dịch vụ không gián đoạn.

Thông số kỹ thuật

Toàn bộ giới hạn và tính năng thực tế của API ở một nơi — hãy kiểm tra trước khi nạp tiền.

MụcGiá trị
Định dạngtương thích OpenAI: mọi SDK OpenAI đều chạy được, chỉ cần đổi base URL và khóa
Base URLhttps://api.llmocrapi.com/v1
Xác thựcAuthorization: Bearer YOUR_KEY
ID mô hìnhuncensored
EndpointPOST /v1/chat/completions · GET /v1/models
Đầu ra tối đatối đa phần còn lại của cửa sổ 64.000 token; max_tokens tùy chọn (không giới hạn riêng)
Gọi hàmcó — tools, tool_choice; phản hồi có tool_calls, kể cả khi streaming; kết quả gửi lại bằng role: tool
Tham sốtemperature, top_p, stop, seed, presence_penalty, frequency_penalty
Chế độ JSONresponse_format: {"type": "json_object"}
Streamingcó — server-sent events; phần cuối chứa lượng token đã dùng
Cửa sổ ngữ cảnh64.000 token (đầu vào + đầu ra)
Kích thước yêu cầutối đa 8 MB
Header phản hồiX-Request-Id, X-Balance-USD, X-RateLimit-Limit-Requests, X-RateLimit-Limit-Concurrency
Giới hạn tốc độ300 yêu cầu mỗi phút cho mỗi khóa
Yêu cầu đồng thờitối đa 8 cùng lúc cho mỗi khóa
Nạp tiềnUSDT (TRC20) hoặc USDC (Base), số tiền nguyên bất kỳ từ $10 đến $500
Dùng thử miễn phí$0,50 trong 7 ngày, không cần thẻ · Khóa dùng thử: 2 yêu cầu song song, 60 yêu cầu/phút; hạn mức đầy đủ (8 và 300) sau lần nạp đầu
Thời hạntín dụng đã trả không hết hạn, không đăng ký định kỳ
Giá$0,25 cho 1 triệu token đầu vào · $1,00 cho 1 triệu token đầu ra
Tính phítín dụng trả trước theo mức dùng thực tế; lỗi và từ chối miễn phí
Thưởng+5% từ $50, +10% từ $100
Khóamỗi tài khoản một khóa đang hoạt động; khóa mới thay thế khóa cũ
Đăng nhậpGoogle hoặc email và mật khẩu
Nội dungcho phép nội dung người lớn; từ chối nội dung tình dục liên quan đến trẻ vị thành niên

Mã lỗi

Lỗi trả về dạng JSON với type cố định; yêu cầu lỗi hoặc bị từ chối không bị tính phí.

MãLoạiÝ nghĩa
400bad_requestJSON sai, tin nhắn trống, tham số sai hoặc vượt cửa sổ ngữ cảnh
401missing_key · invalid_key · key_revokedthiếu khóa, sai khóa hoặc khóa đã bị thay
402no_credithết tín dụng — nạp tiền là dùng tiếp ngay
403content_blockednội dung tình dục liên quan trẻ vị thành niên — từ chối, không tính phí
404not_foundendpoint không tồn tại
413request_too_largenội dung lớn hơn 8 MB
429rate_limited · concurrencyvượt 300/phút hoặc 8 đồng thời — chờ rồi thử lại
503upstream_busymô hình đang bận — thử lại sau vài giây

Hỏi đáp

Mô hình không kiểm duyệt có giống GPT hay Claude không?

Không. Mô hình <code>uncensored</code> là mô hình trọng số mở chạy trên máy chủ GPU của chúng tôi, được tinh chỉnh để trả lời mà không từ chối nội dung cho mục đích người trưởng thành hợp pháp. Đây không phải là mô hình của GPT, Claude, Gemini, Grok hay nhà cung cấp nào khác.

Điều gì xảy ra nếu tín dụng trả trước của tôi hết?

Nếu tín dụng trả trước của bạn hết, bạn sẽ nhận được lỗi 402 trên các yêu cầu tiếp theo. Bạn có thể nạp thêm tín dụng qua tiền điện tử (USDT hoặc USDC) bắt đầu từ $10. Tín dụng dùng thử của bạn hết hạn sau 7 ngày, nhưng tín dụng trả trước không bao giờ hết hạn.

Tôi có thể sử dụng API này để tạo hình ảnh hoặc video không?

Không. API này là API chat-completions văn bản. Nó không hỗ trợ tạo hình ảnh, âm thanh hoặc video. Nó được thiết kế cho đầu vào và đầu ra văn bản, chẳng hạn như xử lý hậu kỳ văn bản OCR, tóm tắt hoặc trích xuất.

Khóa của bạn chỉ cách một biểu mẫu

Tạo tài khoản, sao chép khóa, thay đổi URL cơ sở. Đó là toàn bộ thiết lập.

Lấy khóa API