NL ▾

Ongecensureerde LLM voor OCR-nabewerkinghttps://api.llmocrapi.com/v1

llmocrapi.comDocs

Snelstart: Integreer ongecensureerde LLM in je OCR-app

Integreer onze ongecensureerde LLM in je OCR-pijplijn om ruwe tekst uit documenten te extraheren, opschonen en samenvatten zonder dat contentfilters je data beïnvloeden. Deze gids behandelt de essentiële stappen om te verbinden, te authenticeren en responsen te streamen via de OpenAI-compatible API.

Vereisten: API-sleutel en basis-URL

Voordat je verzoeken doet, heb je een API-sleutel en de juiste base URL nodig. Meld je aan op de API-sleutel ophalen-pagina met alleen een e-mailadres en wachtwoord. Je sleutel wordt direct na het aanmaken getoond en er is geen creditcard nodig voor de trial.

De base URL voor deze API is https://api.llmocrapi.com/v1. Dit endpoint is compatibel met standaard OpenAI SDK's. Je moet je client configureren om deze base URL te gebruiken en je API-sleutel op te nemen in de Authorization-header. De model-ID die je voor alle verzoeken gebruikt, is uncensored, die draait op onze eigen GPU-servers en is ontworpen om ruwe tekstextractie te verwerken zonder inhoud te weigeren die wettelijk volwassen of controversieel is.

Eenvoudige tekstextractieverzoek

Begin met het versturen van een eenvoudig chat completion-verzoek om de verbinding te testen. Dit endpoint accepteert tekstinput en retourneert geëxtraheerde of opgeschoonde tekst. Gebruik het POST /v1/chat/completions-endpoint met het uncensored-model. Zorg dat de request body de berichtinhoud en de model-ID bevat.

Dit basisverzoek verifieert dat je API-sleutel werkt en dat het ongecensureerde model reageert zoals verwacht. Het is de eerste stap in het bouwen van je OCR-nabewerkingspijplijn.

curl https://api.llmocrapi.com/v1/chat/completions \
  -H "Authorization: Bearer $API_KEY" \
  -H "Content-Type: application/json" \
  -d '{
    "model": "uncensored",
    "messages": [{"role": "user", "content": "Write a blunt product review of a cheap VPN."}]
  }'

Als je een respons ontvangt met choices met tekst, is je integratie succesvol. Als je een 401-fout krijgt, controleer dan je API-sleutel. Als je een 402-fout krijgt, moet je mogelijk prepaid tegoed toevoegen.

Python SDK-integratie

Voor Python-ontwikkelaars is het gebruik van de officiële OpenAI SDK de aanbevolen aanpak. Installeer het openai pakket en configureer de basis-URL zodat deze naar onze API verwijst. Hierdoor kun je bekende methoden gebruiken zoals chat.completions.create().

Stel de base_url parameter in op https://api.llmocrapi.com/v1 en geef je API-sleutel door. Dit zorgt ervoor dat alle verzoeken correct worden doorgestuurd naar ons ongecensureerde model. Je kunt vervolgens je OCR-geëxtraheerde tekst sturen als de user message en een system prompt definiëren om het model instructies te geven over hoe de data opgeschoond of samengevat moet worden.

from openai import OpenAI

client = OpenAI(base_url="https://api.llmocrapi.com/v1", api_key="YOUR_KEY")

resp = client.chat.completions.create(
    model="uncensored",
    messages=[{"role": "user", "content": "Summarise this thread without softening it."}],
)
print(resp.choices[0].message.content)

Deze methode is ideaal voor batchverwerking van documenten waar streaming niet vereist is. Het biedt een eenvoudige manier om de LLM te integreren in je bestaande Python OCR-scripts.

Node SDK-integratie

Node.js-ontwikkelaars kunnen ook de OpenAI SDK gebruiken om met de API te communiceren. Installeer het openai pakket voor Node en configureer de basis-URL vergelijkbaar met de Python-setup. Hierdoor kun je dezelfde chat.completions endpoint gebruiken met bekende JavaScript-syntaxis.

Configureer de client met je API-sleutel en de basis-URL https://api.llmocrapi.com/v1. Dit zorgt voor compatibiliteit met je bestaande Node.js-applicaties. Je kunt vervolgens verzoeken sturen om tekst te extraheren of samenvatten uit je OCR-pijplijn.

import OpenAI from "openai";

const client = new OpenAI({ baseURL: "https://api.llmocrapi.com/v1", apiKey: process.env.API_KEY });

const resp = await client.chat.completions.create({
  model: "uncensored",
  messages: [{ role: "user", content: "Draft a villain monologue for my game." }],
});
console.log(resp.choices[0].message.content);

Deze aanpak is geschikt voor server-side verwerking in Node-omgevingen, waardoor je OCR-uitvoer efficiënt kunt verwerken zonder je Node-ecosysteem te verlaten.

Streamresponsen voor grote documenten

Bij het verwerken van grote documenten kan streaming van responsen de gebruikerservaring verbeteren door tekst in chunks te leveren terwijl deze wordt gegenereerd. Gebruik de stream: true parameter in je verzoek om Server-Sent Events (SSE) in te schakelen. Hierdoor kun je tekst in real-time verwerken, wat nuttig is voor lange OCR-uitvoer of wanneer je voortgang aan gebruikers wilt tonen.

Streaming helpt bij het beheer van geheugengebruik door niet te vereisen dat de volledige respons in het geheugen wordt gehouden voordat deze wordt verwerkt. Het is bijzonder nuttig voor documenten met aanzienlijke tekst die anders vertragingen kunnen veroorzaken.

stream = client.chat.completions.create(
    model="uncensored",
    messages=[{"role": "user", "content": "Tell the story in second person."}],
    stream=True,
)
for chunk in stream:
    if chunk.choices and chunk.choices[0].delta.content:
        print(chunk.choices[0].delta.content, end="", flush=True)

Zorg ervoor dat je client SSE-events correct verwerkt om de incrementele tekstchunks te parseren. Deze methode is ideaal voor applicaties die real-time feedback vereisen tijdens de OCR-nabewerkingsfase.

Rate limits, fouten en contextvensters

Houd rekening met de API-limieten om serviceonderbrekingen te voorkomen. Je bent beperkt tot 300 verzoeken per minuut per API-sleutel. Elke request body mag niet groter zijn dan 8 MB. Als je de rate limit overschrijdt, ontvang je een 429-fout. Zorg dat je applicatie exponentiële backoff implementeert om deze fouten soepel af te handelen.

Het contextvenster is 100.000 tokens voor zowel prompt als completion samen. Als je OCR-uitvoer deze limiet overschrijdt, moet je mogelijk het document splitsen of eerdere delen inkorten. Veelvoorkomende fouten zijn 401 voor ongeldige sleutels, 402 voor onvoldoende tegoed en 429 voor rate limits. Houd je gebruik bij en voeg prepaid tegoed toe naar behoefte om ononderbroken service te garanderen.

Technische specificaties

Alle echte limieten en functies van de API op één plek — controleer ze voordat je opwaardeert.

OnderdeelWaarde
API-formaatOpenAI-compatibel: elke OpenAI-SDK werkt — vervang alleen base URL en sleutel
Base URLhttps://api.llmocrapi.com/v1
AuthenticatieAuthorization: Bearer YOUR_KEY
Model-IDuncensored
EndpointsPOST /v1/chat/completions · GET /v1/models
Max. uitvoertot de rest van het venster van 64.000 tokens; max_tokens optioneel (geen aparte limiet)
Function callingja — tools, tool_choice; antwoorden bevatten tool_calls, ook bij streaming; resultaten als role: tool
Parameterstemperature, top_p, stop, seed, presence_penalty, frequency_penalty
JSON-modusresponse_format: {"type": "json_object"}
Streamingja — server-sent events; het laatste deel bevat het tokenverbruik
Contextvenster64.000 tokens (invoer + uitvoer)
Verzoekgroottetot 8 MB
ResponsheadersX-Request-Id, X-Balance-USD, X-RateLimit-Limit-Requests, X-RateLimit-Limit-Concurrency
Rate limit300 verzoeken per minuut per sleutel
Gelijktijdige verzoekentot 8 tegelijk per sleutel
OpwaarderenUSDT (TRC20) of USDC (Base), elk heel bedrag van $10 tot $500
Gratis proeftegoed$0,50 voor 7 dagen, zonder kaart · Proefsleutel: 2 parallelle verzoeken, 60 per minuut; volledige limieten (8 en 300) na eerste opwaardering
Geldigheidbetaald tegoed verloopt niet, geen abonnement
Prijs$0,25 per 1 mln invoertokens · $1,00 per 1 mln uitvoertokens
Afrekeningprepaid tegoed op basis van echt verbruik; fouten en weigeringen zijn gratis
Bonus+5% vanaf $50, +10% vanaf $100
Sleutelséén actieve sleutel per account; een nieuwe vervangt de oude
InloggenGoogle of e-mail en wachtwoord
Inhoudinhoud voor volwassenen toegestaan; seksuele inhoud met minderjarigen wordt geweigerd

Foutcodes

Fouten komen als JSON met een vaste type; mislukte of geweigerde verzoeken kosten niets.

CodeTypeBetekenis
400bad_requestongeldige JSON, lege berichten, verkeerde parameter of context te lang
401missing_key · invalid_key · key_revokedsleutel ontbreekt, is onjuist of is vervangen
402no_creditgeen tegoed — waardeer op en ga direct verder
403content_blockedseksuele inhoud met minderjarigen — geweigerd, niet gerekend
404not_foundonbekend endpoint
413request_too_largebody groter dan 8 MB
429rate_limited · concurrencymeer dan 300/min of 8 tegelijk — wacht en probeer opnieuw
503upstream_busymodel bezet — probeer het over enkele seconden opnieuw

Vragen en antwoorden

Is het ongecensureerde model hetzelfde als GPT of Claude?

Nee. Het <code>uncensored</code> model is een open-weight model dat op onze eigen GPU-servers draait, afgestemd op antwoorden zonder inhoudsrefusies voor wettelijk volwassen gebruik. Het is geen GPT, Claude, Gemini, Grok of een model van een andere leverancier.

Wat gebeurt er als mijn prepaid tegoed op raakt?

Als je prepaid tegoed op raakt, ontvang je een 402-fout op volgende verzoeken. Je kunt meer tegoed toevoegen via crypto (USDT of USDC) vanaf $10. Je proeftegoed vervalt na 7 dagen, maar prepaid tegoed vervalt nooit.

Kan ik deze API gebruiken voor afbeeldings- of video-generatie?

Nee. Deze API is een text chat-completions API. Het ondersteunt geen afbeeldings-, audio- of video-generatie. Het is ontworpen voor tekstinput en -output, zoals het nabewerken van OCR-tekst, samenvatting of extractie.

Je sleutel is nog maar één formulier verwijderd

Maak een account aan, kopieer de sleutel, wijzig de basis-URL. Dat is de hele setup.

API-sleutel aanvragen