llmocrapi.comเอกสารประกอบ
เริ่มต้นใช้งาน รวมโมเดล LLM แบบไม่เซ็นเซอร์เข้ากับแอป OCR ของคุณ
บูรณาการ LLM แบบไม่เซ็นเซอร์ของเราลงในสายการผลิต OCR ของคุณเพื่อแยก ทำความสะอาด และสรุปข้อความดิบจากเอกสารโดยไม่มีการเซ็นเซอร์เนื้อหาที่รบกวนข้อมูลของคุณ คู่มือนี้ครอบคลุมขั้นตอนสำคัญในการเชื่อมต่อ การตรวจสอบสิทธิ์ และการสตรีมมิงการตอบกลับโดยใช้ API ที่เข้ากันได้กับ OpenAI
ข้อกำหนดเบื้องต้น: คีย์ API และ URL พื้นฐาน
ก่อนส่งคำขอ คุณต้องมีคีย์ API และ URL ฐานที่ถูกต้อง สมัครสมาชิกที่หน้า รับคีย์ API โดยใช้เพียงอีเมลและรหัสผ่าน คีย์ของคุณจะแสดงทันทีหลังสมัคร และไม่ต้องใช้บัตรเครดิตสำหรับการทดลองใช้
URL ฐานสำหรับ API นี้คือ https://api.llmocrapi.com/v1 เอนด์พอยต์นี้เข้ากันได้กับ SDK มาตรฐานของ OpenAI คุณต้องกำหนดค่าไคลเอนต์ของคุณเพื่อใช้ URL ฐานนี้และรวมคีย์ API ของคุณในส่วนหัว Authorization รหัสโมเดลที่คุณจะใช้สำหรับคำขอทั้งหมดคือ uncensored ซึ่งรันบนเซิร์ฟเวอร์ GPU ของเราเองและออกแบบมาเพื่อจัดการการแยกข้อความดิบโดยไม่ปฏิเสธเนื้อหาผู้ใหญ่ที่ถูกต้องตามกฎหมายหรือเนื้อหาที่ถกเถียงได้
คำขอแยกข้อความพื้นฐาน
เริ่มต้นด้วยการส่งคำขอ chat completion ง่ายๆ เพื่อทดสอบการเชื่อมต่อ เอนด์พอยต์นี้รับอินพุตข้อความและส่งกลับข้อความที่แยกหรือทำความสะอาดแล้ว ใช้เอนด์พอยต์ POST /v1/chat/completions พร้อมโมเดล uncensored ตรวจสอบให้แน่ใจว่าบอดี้คำขอของคุณรวมถึงเนื้อหาข้อความและรหัสโมเดล
คำขอพื้นฐานนี้ตรวจสอบว่าคีย์ API ของคุณใช้งานได้และโมเดลไม่เซ็นเซอร์ตอบสนองตามที่คาดหวัง นี่คือขั้นตอนแรกในการสร้างสายการผลิตประมวลผลหลัง OCR ของคุณ
curl https://api.llmocrapi.com/v1/chat/completions \
-H "Authorization: Bearer $API_KEY" \
-H "Content-Type: application/json" \
-d '{
"model": "uncensored",
"messages": [{"role": "user", "content": "Write a blunt product review of a cheap VPN."}]
}'หากคุณได้รับคำตอบที่มี choices ที่มีข้อความ การบูรณาการของคุณสำเร็จ หากได้รับข้อผิดพลาด 401 ให้ตรวจสอบคีย์ API ของคุณ หากได้รับข้อผิดพลาด 402 คุณอาจต้องเพิ่มเครดิตแบบเติมเงินล่วงหน้า
การบูรณาการ SDK Python
สำหรับนักพัฒนา Python การใช้ SDK OpenAI ทางการเป็นวิธีที่แนะนำ ติดตั้งแพ็คเกจ openai และกำหนดค่า URL พื้นฐานให้ชี้ไปที่ API ของเรา สิ่งนี้ช่วยให้คุณใช้วิธีการที่คุ้นเคยเช่น chat.completions.create()
ตั้งค่าพารามิเตอร์ base_url เป็น https://api.llmocrapi.com/v1 และส่งคีย์ API ของคุณ สิ่งนี้ทำให้แน่ใจว่าคำขอทั้งหมดจะถูกจัดเส้นทางไปยังโมเดลแบบไม่เซ็นเซอร์ของเราอย่างถูกต้อง จากนั้นคุณสามารถส่งข้อความที่แยกจาก OCR ของคุณเป็นข้อความผู้ใช้และกำหนดพรอมต์ระบบเพื่อสั่งให้โมเดลทำความสะอาดหรือสรุปข้อมูล
from openai import OpenAI
client = OpenAI(base_url="https://api.llmocrapi.com/v1", api_key="YOUR_KEY")
resp = client.chat.completions.create(
model="uncensored",
messages=[{"role": "user", "content": "Summarise this thread without softening it."}],
)
print(resp.choices[0].message.content)วิธีนี้เหมาะสำหรับการประมวลผลเอกสารแบบแบทช์เมื่อไม่จำเป็นต้องสตรีม เป็นวิธีที่ตรงไปตรงมาในการรวมโมเดล LLM เข้ากับสคริปต์ OCR Python ที่มีอยู่ของคุณ
การบูรณาการ SDK Node
นักพัฒนา Node.js ยังสามารถใช้ SDK OpenAI เพื่อโต้ตอบกับ API ได้ ติดตั้งแพ็คเกจ openai สำหรับ Node และกำหนดค่า URL พื้นฐานคล้ายกับการตั้งค่า Python สิ่งนี้ช่วยให้คุณใช้ประโยชน์จากเอนด์พอยต์ chat.completions เดียวกันด้วยไวยากรณ์ JavaScript ที่คุ้นเคย
กำหนดค่าไคลเอนต์ด้วยคีย์ API และ URL ฐาน https://api.llmocrapi.com/v1 สิ่งนี้ทำให้เข้ากันได้กับแอปพลิเคชัน Node.js ที่มีอยู่ของคุณ จากนั้นคุณสามารถส่งคำขอเพื่อแยกหรือสรุปข้อความจากสายการผลิต OCR ของคุณ
import OpenAI from "openai";
const client = new OpenAI({ baseURL: "https://api.llmocrapi.com/v1", apiKey: process.env.API_KEY });
const resp = await client.chat.completions.create({
model: "uncensored",
messages: [{ role: "user", content: "Draft a villain monologue for my game." }],
});
console.log(resp.choices[0].message.content);วิธีนี้เหมาะสำหรับการประมวลผลฝั่งเซิร์ฟเวอร์ในสภาพแวดล้อม Node ช่วยให้คุณสามารถจัดการผลลัพธ์ OCR ได้อย่างมีประสิทธิภาพโดยไม่ออกจากระบบนิเวศ Node ของคุณ
การตอบกลับแบบสตรีมมิงสำหรับเอกสารขนาดใหญ่
เมื่อประมวลผลเอกสารขนาดใหญ่ การตอบสนองแบบสตรีมสามารถปรับปรุงประสบการณ์ผู้ใช้โดยการส่งข้อความเป็นชิ้นส่วนเมื่อสร้างเสร็จ ใช้พารามิเตอร์ stream: true ในคำขอของคุณเพื่อเปิดใช้งาน Server-Sent Events (SSE) สิ่งนี้ช่วยให้คุณประมวลผลข้อความแบบเรียลไทม์ ซึ่งจะมีประโยชน์สำหรับผลลัพธ์ OCR ยาวหรือเมื่อแสดงความคืบหน้าให้ผู้ใช้
สตรีมมิงช่วยจัดการการใช้งานหน่วยความจำโดยไม่ต้องเก็บการตอบกลับทั้งหมดไว้ในหน่วยความจำก่อนประมวลผล มีประโยชน์เป็นพิเศษสำหรับเอกสารที่มีข้อความสำคัญที่อาจทำให้เกิดปัญหาความล่าช้า
stream = client.chat.completions.create(
model="uncensored",
messages=[{"role": "user", "content": "Tell the story in second person."}],
stream=True,
)
for chunk in stream:
if chunk.choices and chunk.choices[0].delta.content:
print(chunk.choices[0].delta.content, end="", flush=True)ตรวจสอบให้แน่ใจว่าไคลเอนต์ของคุณจัดการเหตุการณ์ SSE ได้ถูกต้องเพื่อแยกชิ้นส่วนข้อความแบบเพิ่มทีละส่วน วิธีนี้เหมาะสำหรับแอปพลิเคชันที่ต้องการการตอบกลับแบบเรียลไทม์ในช่วงขั้นตอนการประมวลผลหลัง OCR
ขีดจำกัดอัตรา ข้อผิดพลาด และหน้าต่างบริบท
โปรดทราบถึงขีดจำกัดอัตราของ API เพื่อหลีกเลี่ยงการหยุดชะงักของบริการ คุณมีจำกัดที่ 300 คำขอต่อนาทีต่อคีย์ API บอดี้คำขอแต่ละคำขอต้องไม่เกิน 8 MB หากคุณเกินขีดจำกัดอัตรา คุณจะได้รับข้อผิดพลาด 429 ตรวจสอบให้แน่ใจว่าแอปพลิเคชันของคุณมีการดื้อแพ่งแบบทวีคูณเพื่อจัดการข้อผิดพลาดเหล่านี้อย่างราบรื่น
หน้าต่างบริบทคือ 100,000 โทเคนสำหรับทั้งพรอมต์และการตอบกลับรวมกัน หากผลลัพธ์ OCR ของคุณเกินขีดจำกัดนี้ คุณอาจต้องแบ่งเอกสารหรือตัดส่วนก่อนหน้าออก ข้อผิดพลาดทั่วไปรวมถึง 401 สำหรับคีย์ที่ไม่ถูกต้อง 402 สำหรับเครดิตไม่เพียงพอ และ 429 สำหรับขีดจำกัดอัตรา ตรวจสอบการใช้งานของคุณและเติมเงินเครดิตแบบเติมเงินล่วงหน้าเมื่อจำเป็นเพื่อรักษาบริการอย่างต่อเนื่อง
ข้อมูลจำเพาะทางเทคนิค
ขีดจำกัดและความสามารถจริงทั้งหมดของ API ในที่เดียว ตรวจสอบก่อนเติมเงิน
| รายการ | ค่า |
|---|---|
| รูปแบบ API | รองรับ OpenAI: ใช้ OpenAI SDK ใดก็ได้ แค่เปลี่ยน base URL และคีย์ |
| Base URL | https://api.llmocrapi.com/v1 |
| การยืนยันตัวตน | Authorization: Bearer YOUR_KEY |
| ID โมเดล | uncensored |
| เอนด์พอยต์ | POST /v1/chat/completions · GET /v1/models |
| เอาต์พุตสูงสุด | ได้ถึงส่วนที่เหลือของหน้าต่าง 64,000 โทเคน; max_tokens ไม่บังคับ (ไม่มีเพดานแยก) |
| การเรียกใช้ฟังก์ชัน | รองรับ — tools, tool_choice คำตอบมี tool_calls รวมถึงตอนสตรีม ส่งผลลัพธ์กลับด้วย role: tool |
| พารามิเตอร์ | temperature, top_p, stop, seed, presence_penalty, frequency_penalty |
| โหมด JSON | response_format: {"type": "json_object"} |
| สตรีมมิง | รองรับ — server-sent events ชิ้นสุดท้ายมีจำนวนโทเคนที่ใช้ |
| หน้าต่างบริบท | 64,000 โทเคน (อินพุตรวมเอาต์พุต) |
| ขนาดคำขอ | ไม่เกิน 8 MB |
| เฮดเดอร์ของคำตอบ | X-Request-Id, X-Balance-USD, X-RateLimit-Limit-Requests, X-RateLimit-Limit-Concurrency |
| ขีดจำกัดอัตรา | 300 คำขอต่อนาทีต่อคีย์ |
| คำขอพร้อมกัน | สูงสุด 8 คำขอพร้อมกันต่อคีย์ |
| เติมเงิน | USDT (TRC20) หรือ USDC (Base) จำนวนเต็มใดก็ได้ตั้งแต่ $10 ถึง $500 |
| เครดิตทดลองใช้ฟรี | $0.50 ใช้ได้ 7 วัน ไม่ต้องใช้บัตร · คีย์ทดลอง: 2 คำขอพร้อมกัน, 60 ครั้งต่อนาที; ขีดจำกัดเต็ม (8 และ 300) หลังเติมเงินครั้งแรก |
| อายุเครดิต | เครดิตที่ซื้อไม่มีวันหมดอายุ ไม่มีการสมัครรายเดือน |
| ราคา | $0.25 ต่อ 1 ล้านโทเคนอินพุต · $1.00 ต่อ 1 ล้านโทเคนเอาต์พุต |
| การคิดเงิน | เครดิตแบบเติมเงินล่วงหน้าตามการใช้งานจริง ข้อผิดพลาดและการปฏิเสธไม่คิดเงิน |
| โบนัส | +5% เมื่อเติมตั้งแต่ $50, +10% ตั้งแต่ $100 |
| คีย์ | หนึ่งบัญชีมีคีย์ที่ใช้งานได้หนึ่งคีย์ คีย์ใหม่จะแทนคีย์เดิม |
| เข้าสู่ระบบ | Google หรืออีเมลและรหัสผ่าน |
| เนื้อหา | อนุญาตเนื้อหาสำหรับผู้ใหญ่ ปฏิเสธเนื้อหาทางเพศที่เกี่ยวข้องกับผู้เยาว์ |
รหัสข้อผิดพลาด
ข้อผิดพลาดส่งกลับเป็น JSON พร้อม type ที่คงที่ คำขอที่ล้มเหลวหรือถูกปฏิเสธไม่คิดเงิน
| รหัส | ประเภท | ความหมาย |
|---|---|---|
400 | bad_request | JSON ไม่ถูกต้อง ข้อความว่าง พารามิเตอร์ผิด หรือเกินหน้าต่างบริบท |
401 | missing_key · invalid_key · key_revoked | ไม่มีคีย์ คีย์ผิด หรือคีย์ถูกแทนที่แล้ว |
402 | no_credit | เครดิตหมด เติมเงินแล้วใช้งานต่อได้ทันที |
403 | content_blocked | เนื้อหาทางเพศเกี่ยวกับผู้เยาว์ ถูกปฏิเสธ ไม่คิดเงิน |
404 | not_found | ไม่รู้จักเอนด์พอยต์ |
413 | request_too_large | ขนาดเกิน 8 MB |
429 | rate_limited · concurrency | เกิน 300/นาที หรือ 8 พร้อมกัน รอแล้วลองใหม่ |
503 | upstream_busy | โมเดลไม่ว่าง ลองใหม่ในไม่กี่วินาที |
ถาม-ตอบ
โมเดลแบบไม่เซ็นเซอร์เหมือนกันกับ GPT หรือ Claude หรือไม่?
ไม่ โมเดล <code>uncensored</code> เป็นโมเดลแบบเปิดน้ำหนักที่รันบนเซิร์ฟเวอร์ GPU ของเราเอง ปรับแต่งให้ตอบโดยไม่ปฏิเสธเนื้อหาสำหรับการใช้งานผู้ใหญ่ที่ถูกต้องตามกฎหมาย ไม่ใช่ GPT, Claude, Gemini, Grok หรือโมเดลของผู้ขายรายอื่น
เกิดอะไรขึ้นหากเครดิตแบบเติมเงินล่วงหน้าของฉันหมด?
หากเครดิตแบบเติมเงินล่วงหน้าของคุณหมด คุณจะรับข้อผิดพลาด 402 ในคำขอถัดไป คุณสามารถเพิ่มเครดิตผ่านคริปโต (USDT หรือ USDC) เริ่มต้นที่ $10 เครดิตทดลองใช้ของคุณหมดอายุหลังจาก 7 วัน แต่เครดิตแบบเติมเงินล่วงหน้าไม่หมดอายุ
ฉันสามารถใช้ API นี้สำหรับการสร้างภาพหรือวิดีโอได้หรือไม่
ไม่ API นี้เป็น API ข้อความแชทคอมพลีชัน ไม่รองรับการสร้างภาพ เสียง หรือวิดีโอ ออกแบบมาสำหรับข้อมูลเข้าและออก เช่น การประมวลผลหลัง OCR การสรุปความ หรือการแยกข้อความ
คีย์ของคุณอยู่ห่างแค่แบบฟอร์มเดียว
สร้างบัญชี คัดลอกคีย์ เปลี่ยน URL พื้นฐาน นั่นคือการตั้งค่าทั้งหมด