Web Search API Snelle start: integreer in minuten
Integreer onze ongecensureerde LLM in je webzoekpipeline met deze OpenAI-compatibele snelle start. Verwerk, extrahereer en vat ruwe zoekresultaten samen zonder weigering door inhoudsfilters met standaard SDK's.
https://api.llmwebsearchapi.com/v1uncensoredAuthenticatie & Base URL
Om de API te gebruiken, heb je een API-sleutel nodig. Meld je aan op de API-sleutel ophalen-pagina met alleen een e-mailadres en wachtwoord. Je sleutel verschijnt direct. Er is geen creditcard nodig voor het proeftegoed. Gebruik de basis-URL https://api.llmwebsearchapi.com/v1 met elke OpenAI-compatibele client. De model-ID is uncensored. Dit model is een open-weight model en is afgestemd op het beantwoorden van vragen zonder weigeringen voor wettelijk volwassen, fictief of controversieel onderwerp. Het is geen GPT, Claude of een model van een andere leverancier.
Basis chat-completieverzoek
Stuur een standaard chat-completieverzoek om tekst uit zoekresultaten te extraheren. De API accepteert messages en retourneert een completion. Gebruik het model uncensored om te garanderen dat er geen inhoudsfilters je data blokkeren. De request body ondersteunt maximaal 8 MB. Hieronder staat een cURL-voorbeeld voor een basis extraheringstask.
curl https://api.llmwebsearchapi.com/v1/chat/completions \
-H "Authorization: Bearer $API_KEY" \
-H "Content-Type: application/json" \
-d '{
"model": "uncensored",
"messages": [{"role": "user", "content": "Write a blunt product review of a cheap VPN."}]
}'De respons bevat de gegenereerde tekst, die je vervolgens kunt doorgeven aan het geheugen of de samenvattingslaag van je agent.
SDK-voorbeelden voor Python en JavaScript
Gebruik de officiële OpenAI SDK's voor Python en Node.js. Stel de base_url in op onze endpoint en lever je API-sleutel. De Python SDK verwerkt streaming en JSON-parsering automatisch. De Node SDK werkt op vergelijkbare wijze. Hieronder staat een Python-voorbeeld dat laat zien hoe je de client initialiseert en een verzoek verstuurt.
from openai import OpenAI
client = OpenAI(base_url="https://api.llmwebsearchapi.com/v1", api_key="YOUR_KEY")
resp = client.chat.completions.create(
model="uncensored",
messages=[{"role": "user", "content": "Summarise this thread without softening it."}],
)
print(resp.choices[0].message.content)Voor JavaScript is de setup vrijwel identiek. Stel de omgevingsvariabele in of geef de sleutel direct door. De model-ID blijft uncensored.
import OpenAI from "openai";
const client = new OpenAI({ baseURL: "https://api.llmwebsearchapi.com/v1", apiKey: process.env.API_KEY });
const resp = await client.chat.completions.create({
model: "uncensored",
messages: [{ role: "user", content: "Draft a villain monologue for my game." }],
});
console.log(resp.choices[0].message.content);
Streaming-responses voor realtime verwerking
Schakel streaming in door stream: true in je verzoek in te stellen. De API retourneert Server-Sent Events (SSE)-tokens. Dit is handig voor realtime verwerking van lange zoekresultaten. Je kunt tokens weergeven zodra ze binnenkomen of ze verzamelen voor later gebruik. Het streaming-responsformaat komt overeen met de OpenAI-standaard. Hieronder staat een streaming-voorbeeld met cURL.
stream = client.chat.completions.create(
model="uncensored",
messages=[{"role": "user", "content": "Tell the story in second person."}],
stream=True,
)
for chunk in stream:
if chunk.choices and chunk.choices[0].delta.content:
print(chunk.choices[0].delta.content, end="", flush=True)Parse het data veld in elk SSE-bericht om de gedeeltelijke tekst te krijgen.
Tool calling voor structureren van zoekresultaten
Gebruik function calling om de geëxtraheerde data te structureren. Definieer een schema voor je gewenste uitvoer, zoals een lijst met URL's of een samenvattingsobject. De API retourneert gestructureerde JSON die overeenkomt met je schema. Dit is ideaal om het geheugen van een AI-agent te vullen met schone, getypte data. Definieer de tool in de parameter tools en geef de functienaam op. Het model reageert met een function call object. Je kunt de functie vervolgens uitvoeren of het resultaat direct opslaan.
Contextvensters afhandelen bij lange zoekopdrachten
Het contextvenster is 100.000 tokens voor prompt plus uitvoer. Als je zoekresultaten dit overschrijden, moet je ze afkappen of samenvatten voordat je ze verstuurt. De API behandelt lange contexten niet automatisch. Stuur alleen de relevante tekst om binnen de limieten te blijven. Als je de limiet overschrijdt, ontvang je een foutmelding. Houd je token-gebruik in de gaten om onverwachte kosten te voorkomen. De prijs is $0,25 per 1M input tokens en $1,00 per 1M output tokens.
Rate limits en foutcodes
De rate limit is 300 verzoeken per minuut per sleutel. De limiet voor de request body is 8 MB. Als je een ongeldige sleutel verstuurt, krijg je een 401-fout. Als je geen tegoed hebt, krijg je een 402-fout. Als je de rate limit overschrijdt, krijg je een 429-fout. Regenereer je sleutel op elk moment om de oude te intrekken. Elk account heeft één sleutel. Het proeftegoed vervalt na 7 dagen. Opwaarderen begint vanaf $10 met opties voor bonus tegoed.
Technische specificaties
Alle echte limieten en functies van de API op één plek — controleer ze voordat je opwaardeert.
| Onderdeel | Waarde |
|---|---|
| API-formaat | OpenAI-compatibel: elke OpenAI-SDK werkt — vervang alleen base URL en sleutel |
| Model-ID | uncensored |
| Base URL | https://api.llmwebsearchapi.com/v1 |
| Authenticatie | Authorization: Bearer YOUR_KEY |
| Endpoints | POST /v1/chat/completions · GET /v1/models |
| Streaming | ja — server-sent events; het laatste deel bevat het tokenverbruik |
| Max. uitvoer | tot de rest van het venster van 100.000 tokens; max_tokens optioneel (geen aparte limiet) |
| Parameters | temperature, top_p, stop, seed, presence_penalty, frequency_penalty |
| JSON-modus | response_format: {"type": "json_object"} |
| Contextvenster | 100.000 tokens (invoer + uitvoer) |
| Function calling | ja — tools, tool_choice; antwoorden bevatten tool_calls, ook bij streaming; resultaten als role: tool |
| Responsheaders | X-Request-Id, X-Balance-USD, X-RateLimit-Limit-Requests, X-RateLimit-Limit-Concurrency |
| Gelijktijdige verzoeken | tot 8 tegelijk per sleutel |
| Verzoekgrootte | tot 8 MB |
| Rate limit | 300 verzoeken per minuut per sleutel |
| Gratis proeftegoed | $0,50 voor 7 dagen, zonder kaart · Proefsleutel: 2 parallelle verzoeken, 60 per minuut; volledige limieten (8 en 300) na eerste opwaardering |
| Opwaarderen | USDT (TRC20) of USDC (Base), elk heel bedrag van $10 tot $500 |
| Afrekening | prepaid tegoed op basis van echt verbruik; fouten en weigeringen zijn gratis |
| Prijs | $0,25 per 1 mln invoertokens · $1,00 per 1 mln uitvoertokens |
| Geldigheid | betaald tegoed verloopt niet, geen abonnement |
| Bonus | +5% vanaf $50, +10% vanaf $100 |
| Inhoud | inhoud voor volwassenen toegestaan; seksuele inhoud met minderjarigen wordt geweigerd |
| Sleutels | één actieve sleutel per account; een nieuwe vervangt de oude |
| Inloggen | Google of e-mail en wachtwoord |
Foutcodes
Fouten komen als JSON met een vaste type; mislukte of geweigerde verzoeken kosten niets.
| Code | Type | Betekenis |
|---|---|---|
400 | bad_request | ongeldige JSON, lege berichten, verkeerde parameter of context te lang |
401 | missing_key · invalid_key · key_revoked | sleutel ontbreekt, is onjuist of is vervangen |
402 | no_credit | geen tegoed — waardeer op en ga direct verder |
403 | content_blocked | seksuele inhoud met minderjarigen — geweigerd, niet gerekend |
404 | not_found | onbekend endpoint |
413 | request_too_large | body groter dan 8 MB |
429 | rate_limited · concurrency | meer dan 300/min of 8 tegelijk — wacht en probeer opnieuw |
503 | upstream_busy | model bezet — probeer het over enkele seconden opnieuw |
Vragen en antwoorden
Is het model getraind op mijn data?
Nee, prompts worden niet gebruikt voor training. Je data blijft privé en wordt alleen verwerkt om de respons te genereren. Je kunt je API-sleutel op elk moment regenereren via de aanmeldpagina.
Wat gebeurt er als ik het contextvenster overschrijd?
De API retourneert een fout als het totale aantal tokens 100.000 overschrijdt. Je moet je input vooraf inkorten voordat je hem verstuurt. De limiet omvat zowel de prompt als de completion.
Kan ik dit gebruiken voor volwassen inhoud?
Ja, het model is ongecensureerd en weigert wettelijke onderwerpen voor volwassenen niet. De enige harde limiet is seksuele inhoud met minderjarigen, die altijd wordt geblokkeerd. Er gelden geen andere inhoudsfilters.
Je sleutel is nog maar één formulier verwijderd
Maak een account aan, kopieer de sleutel, wijzig de base URL. Dat is de hele setup.