llmocrapi.comDocs
Snelstart: Integreer ongecensureerde LLM in je OCR-app
Integreer onze ongecensureerde LLM in je OCR-pijplijn om ruwe tekst uit documenten te extraheren, opschonen en samenvatten zonder dat contentfilters je data beïnvloeden. Deze gids behandelt de essentiële stappen om te verbinden, te authenticeren en responsen te streamen via de OpenAI-compatible API.
Vereisten: API-sleutel en basis-URL
Voordat je verzoeken doet, heb je een API-sleutel en de juiste base URL nodig. Meld je aan op de API-sleutel ophalen-pagina met alleen een e-mailadres en wachtwoord. Je sleutel wordt direct na het aanmaken getoond en er is geen creditcard nodig voor de trial.
De base URL voor deze API is https://api.llmocrapi.com/v1. Dit endpoint is compatibel met standaard OpenAI SDK's. Je moet je client configureren om deze base URL te gebruiken en je API-sleutel op te nemen in de Authorization-header. De model-ID die je voor alle verzoeken gebruikt, is uncensored, die draait op onze eigen GPU-servers en is ontworpen om ruwe tekstextractie te verwerken zonder inhoud te weigeren die wettelijk volwassen of controversieel is.
Eenvoudige tekstextractieverzoek
Begin met het versturen van een eenvoudig chat completion-verzoek om de verbinding te testen. Dit endpoint accepteert tekstinput en retourneert geëxtraheerde of opgeschoonde tekst. Gebruik het POST /v1/chat/completions-endpoint met het uncensored-model. Zorg dat de request body de berichtinhoud en de model-ID bevat.
Dit basisverzoek verifieert dat je API-sleutel werkt en dat het ongecensureerde model reageert zoals verwacht. Het is de eerste stap in het bouwen van je OCR-nabewerkingspijplijn.
curl https://api.llmocrapi.com/v1/chat/completions \
-H "Authorization: Bearer $API_KEY" \
-H "Content-Type: application/json" \
-d '{
"model": "uncensored",
"messages": [{"role": "user", "content": "Write a blunt product review of a cheap VPN."}]
}'Als je een respons ontvangt met choices met tekst, is je integratie succesvol. Als je een 401-fout krijgt, controleer dan je API-sleutel. Als je een 402-fout krijgt, moet je mogelijk prepaid tegoed toevoegen.
Python SDK-integratie
Voor Python-ontwikkelaars is het gebruik van de officiële OpenAI SDK de aanbevolen aanpak. Installeer het openai pakket en configureer de basis-URL zodat deze naar onze API verwijst. Hierdoor kun je bekende methoden gebruiken zoals chat.completions.create().
Stel de base_url parameter in op https://api.llmocrapi.com/v1 en geef je API-sleutel door. Dit zorgt ervoor dat alle verzoeken correct worden doorgestuurd naar ons ongecensureerde model. Je kunt vervolgens je OCR-geëxtraheerde tekst sturen als de user message en een system prompt definiëren om het model instructies te geven over hoe de data opgeschoond of samengevat moet worden.
from openai import OpenAI
client = OpenAI(base_url="https://api.llmocrapi.com/v1", api_key="YOUR_KEY")
resp = client.chat.completions.create(
model="uncensored",
messages=[{"role": "user", "content": "Summarise this thread without softening it."}],
)
print(resp.choices[0].message.content)Deze methode is ideaal voor batchverwerking van documenten waar streaming niet vereist is. Het biedt een eenvoudige manier om de LLM te integreren in je bestaande Python OCR-scripts.
Node SDK-integratie
Node.js-ontwikkelaars kunnen ook de OpenAI SDK gebruiken om met de API te communiceren. Installeer het openai pakket voor Node en configureer de basis-URL vergelijkbaar met de Python-setup. Hierdoor kun je dezelfde chat.completions endpoint gebruiken met bekende JavaScript-syntaxis.
Configureer de client met je API-sleutel en de basis-URL https://api.llmocrapi.com/v1. Dit zorgt voor compatibiliteit met je bestaande Node.js-applicaties. Je kunt vervolgens verzoeken sturen om tekst te extraheren of samenvatten uit je OCR-pijplijn.
import OpenAI from "openai";
const client = new OpenAI({ baseURL: "https://api.llmocrapi.com/v1", apiKey: process.env.API_KEY });
const resp = await client.chat.completions.create({
model: "uncensored",
messages: [{ role: "user", content: "Draft a villain monologue for my game." }],
});
console.log(resp.choices[0].message.content);Deze aanpak is geschikt voor server-side verwerking in Node-omgevingen, waardoor je OCR-uitvoer efficiënt kunt verwerken zonder je Node-ecosysteem te verlaten.
Streamresponsen voor grote documenten
Bij het verwerken van grote documenten kan streaming van responsen de gebruikerservaring verbeteren door tekst in chunks te leveren terwijl deze wordt gegenereerd. Gebruik de stream: true parameter in je verzoek om Server-Sent Events (SSE) in te schakelen. Hierdoor kun je tekst in real-time verwerken, wat nuttig is voor lange OCR-uitvoer of wanneer je voortgang aan gebruikers wilt tonen.
Streaming helpt bij het beheer van geheugengebruik door niet te vereisen dat de volledige respons in het geheugen wordt gehouden voordat deze wordt verwerkt. Het is bijzonder nuttig voor documenten met aanzienlijke tekst die anders vertragingen kunnen veroorzaken.
stream = client.chat.completions.create(
model="uncensored",
messages=[{"role": "user", "content": "Tell the story in second person."}],
stream=True,
)
for chunk in stream:
if chunk.choices and chunk.choices[0].delta.content:
print(chunk.choices[0].delta.content, end="", flush=True)Zorg ervoor dat je client SSE-events correct verwerkt om de incrementele tekstchunks te parseren. Deze methode is ideaal voor applicaties die real-time feedback vereisen tijdens de OCR-nabewerkingsfase.
Rate limits, fouten en contextvensters
Houd rekening met de API-limieten om serviceonderbrekingen te voorkomen. Je bent beperkt tot 300 verzoeken per minuut per API-sleutel. Elke request body mag niet groter zijn dan 8 MB. Als je de rate limit overschrijdt, ontvang je een 429-fout. Zorg dat je applicatie exponentiële backoff implementeert om deze fouten soepel af te handelen.
Het contextvenster is 100.000 tokens voor zowel prompt als completion samen. Als je OCR-uitvoer deze limiet overschrijdt, moet je mogelijk het document splitsen of eerdere delen inkorten. Veelvoorkomende fouten zijn 401 voor ongeldige sleutels, 402 voor onvoldoende tegoed en 429 voor rate limits. Houd je gebruik bij en voeg prepaid tegoed toe naar behoefte om ononderbroken service te garanderen.
Technische specificaties
Alle echte limieten en functies van de API op één plek — controleer ze voordat je opwaardeert.
| Onderdeel | Waarde |
|---|---|
| API-formaat | OpenAI-compatibel: elke OpenAI-SDK werkt — vervang alleen base URL en sleutel |
| Base URL | https://api.llmocrapi.com/v1 |
| Authenticatie | Authorization: Bearer YOUR_KEY |
| Model-ID | uncensored |
| Endpoints | POST /v1/chat/completions · GET /v1/models |
| Max. uitvoer | tot de rest van het venster van 64.000 tokens; max_tokens optioneel (geen aparte limiet) |
| Function calling | ja — tools, tool_choice; antwoorden bevatten tool_calls, ook bij streaming; resultaten als role: tool |
| Parameters | temperature, top_p, stop, seed, presence_penalty, frequency_penalty |
| JSON-modus | response_format: {"type": "json_object"} |
| Streaming | ja — server-sent events; het laatste deel bevat het tokenverbruik |
| Contextvenster | 64.000 tokens (invoer + uitvoer) |
| Verzoekgrootte | tot 8 MB |
| Responsheaders | X-Request-Id, X-Balance-USD, X-RateLimit-Limit-Requests, X-RateLimit-Limit-Concurrency |
| Rate limit | 300 verzoeken per minuut per sleutel |
| Gelijktijdige verzoeken | tot 8 tegelijk per sleutel |
| Opwaarderen | USDT (TRC20) of USDC (Base), elk heel bedrag van $10 tot $500 |
| Gratis proeftegoed | $0,50 voor 7 dagen, zonder kaart · Proefsleutel: 2 parallelle verzoeken, 60 per minuut; volledige limieten (8 en 300) na eerste opwaardering |
| Geldigheid | betaald tegoed verloopt niet, geen abonnement |
| Prijs | $0,25 per 1 mln invoertokens · $1,00 per 1 mln uitvoertokens |
| Afrekening | prepaid tegoed op basis van echt verbruik; fouten en weigeringen zijn gratis |
| Bonus | +5% vanaf $50, +10% vanaf $100 |
| Sleutels | één actieve sleutel per account; een nieuwe vervangt de oude |
| Inloggen | Google of e-mail en wachtwoord |
| Inhoud | inhoud voor volwassenen toegestaan; seksuele inhoud met minderjarigen wordt geweigerd |
Foutcodes
Fouten komen als JSON met een vaste type; mislukte of geweigerde verzoeken kosten niets.
| Code | Type | Betekenis |
|---|---|---|
400 | bad_request | ongeldige JSON, lege berichten, verkeerde parameter of context te lang |
401 | missing_key · invalid_key · key_revoked | sleutel ontbreekt, is onjuist of is vervangen |
402 | no_credit | geen tegoed — waardeer op en ga direct verder |
403 | content_blocked | seksuele inhoud met minderjarigen — geweigerd, niet gerekend |
404 | not_found | onbekend endpoint |
413 | request_too_large | body groter dan 8 MB |
429 | rate_limited · concurrency | meer dan 300/min of 8 tegelijk — wacht en probeer opnieuw |
503 | upstream_busy | model bezet — probeer het over enkele seconden opnieuw |
Vragen en antwoorden
Is het ongecensureerde model hetzelfde als GPT of Claude?
Nee. Het <code>uncensored</code> model is een open-weight model dat op onze eigen GPU-servers draait, afgestemd op antwoorden zonder inhoudsrefusies voor wettelijk volwassen gebruik. Het is geen GPT, Claude, Gemini, Grok of een model van een andere leverancier.
Wat gebeurt er als mijn prepaid tegoed op raakt?
Als je prepaid tegoed op raakt, ontvang je een 402-fout op volgende verzoeken. Je kunt meer tegoed toevoegen via crypto (USDT of USDC) vanaf $10. Je proeftegoed vervalt na 7 dagen, maar prepaid tegoed vervalt nooit.
Kan ik deze API gebruiken voor afbeeldings- of video-generatie?
Nee. Deze API is een text chat-completions API. Het ondersteunt geen afbeeldings-, audio- of video-generatie. Het is ontworpen voor tekstinput en -output, zoals het nabewerken van OCR-tekst, samenvatting of extractie.
Je sleutel is nog maar één formulier verwijderd
Maak een account aan, kopieer de sleutel, wijzig de basis-URL. Dat is de hele setup.