NL ▾
llmwebsearchapi.com
llmwebsearchapi.com›Docs
API-sleutel aanvragen

Web Search API Snelle start: integreer in minuten

Integreer onze ongecensureerde LLM in je webzoekpipeline met deze OpenAI-compatibele snelle start. Verwerk, extrahereer en vat ruwe zoekresultaten samen zonder weigering door inhoudsfilters met standaard SDK's.

Base URLhttps://api.llmwebsearchapi.com/v1
Modeluncensored

Authenticatie & Base URL

Om de API te gebruiken, heb je een API-sleutel nodig. Meld je aan op de API-sleutel ophalen-pagina met alleen een e-mailadres en wachtwoord. Je sleutel verschijnt direct. Er is geen creditcard nodig voor het proeftegoed. Gebruik de basis-URL https://api.llmwebsearchapi.com/v1 met elke OpenAI-compatibele client. De model-ID is uncensored. Dit model is een open-weight model en is afgestemd op het beantwoorden van vragen zonder weigeringen voor wettelijk volwassen, fictief of controversieel onderwerp. Het is geen GPT, Claude of een model van een andere leverancier.

Basis chat-completieverzoek

Stuur een standaard chat-completieverzoek om tekst uit zoekresultaten te extraheren. De API accepteert messages en retourneert een completion. Gebruik het model uncensored om te garanderen dat er geen inhoudsfilters je data blokkeren. De request body ondersteunt maximaal 8 MB. Hieronder staat een cURL-voorbeeld voor een basis extraheringstask.

curl https://api.llmwebsearchapi.com/v1/chat/completions \
  -H "Authorization: Bearer $API_KEY" \
  -H "Content-Type: application/json" \
  -d '{
    "model": "uncensored",
    "messages": [{"role": "user", "content": "Write a blunt product review of a cheap VPN."}]
  }'

De respons bevat de gegenereerde tekst, die je vervolgens kunt doorgeven aan het geheugen of de samenvattingslaag van je agent.

SDK-voorbeelden voor Python en JavaScript

Gebruik de officiële OpenAI SDK's voor Python en Node.js. Stel de base_url in op onze endpoint en lever je API-sleutel. De Python SDK verwerkt streaming en JSON-parsering automatisch. De Node SDK werkt op vergelijkbare wijze. Hieronder staat een Python-voorbeeld dat laat zien hoe je de client initialiseert en een verzoek verstuurt.

from openai import OpenAI

client = OpenAI(base_url="https://api.llmwebsearchapi.com/v1", api_key="YOUR_KEY")

resp = client.chat.completions.create(
    model="uncensored",
    messages=[{"role": "user", "content": "Summarise this thread without softening it."}],
)
print(resp.choices[0].message.content)

Voor JavaScript is de setup vrijwel identiek. Stel de omgevingsvariabele in of geef de sleutel direct door. De model-ID blijft uncensored.

import OpenAI from "openai";

const client = new OpenAI({ baseURL: "https://api.llmwebsearchapi.com/v1", apiKey: process.env.API_KEY });

const resp = await client.chat.completions.create({
  model: "uncensored",
  messages: [{ role: "user", content: "Draft a villain monologue for my game." }],
});
console.log(resp.choices[0].message.content);

Streaming-responses voor realtime verwerking

Schakel streaming in door stream: true in je verzoek in te stellen. De API retourneert Server-Sent Events (SSE)-tokens. Dit is handig voor realtime verwerking van lange zoekresultaten. Je kunt tokens weergeven zodra ze binnenkomen of ze verzamelen voor later gebruik. Het streaming-responsformaat komt overeen met de OpenAI-standaard. Hieronder staat een streaming-voorbeeld met cURL.

stream = client.chat.completions.create(
    model="uncensored",
    messages=[{"role": "user", "content": "Tell the story in second person."}],
    stream=True,
)
for chunk in stream:
    if chunk.choices and chunk.choices[0].delta.content:
        print(chunk.choices[0].delta.content, end="", flush=True)

Parse het data veld in elk SSE-bericht om de gedeeltelijke tekst te krijgen.

Tool calling voor structureren van zoekresultaten

Gebruik function calling om de geëxtraheerde data te structureren. Definieer een schema voor je gewenste uitvoer, zoals een lijst met URL's of een samenvattingsobject. De API retourneert gestructureerde JSON die overeenkomt met je schema. Dit is ideaal om het geheugen van een AI-agent te vullen met schone, getypte data. Definieer de tool in de parameter tools en geef de functienaam op. Het model reageert met een function call object. Je kunt de functie vervolgens uitvoeren of het resultaat direct opslaan.

Contextvensters afhandelen bij lange zoekopdrachten

Het contextvenster is 100.000 tokens voor prompt plus uitvoer. Als je zoekresultaten dit overschrijden, moet je ze afkappen of samenvatten voordat je ze verstuurt. De API behandelt lange contexten niet automatisch. Stuur alleen de relevante tekst om binnen de limieten te blijven. Als je de limiet overschrijdt, ontvang je een foutmelding. Houd je token-gebruik in de gaten om onverwachte kosten te voorkomen. De prijs is $0,25 per 1M input tokens en $1,00 per 1M output tokens.

Rate limits en foutcodes

De rate limit is 300 verzoeken per minuut per sleutel. De limiet voor de request body is 8 MB. Als je een ongeldige sleutel verstuurt, krijg je een 401-fout. Als je geen tegoed hebt, krijg je een 402-fout. Als je de rate limit overschrijdt, krijg je een 429-fout. Regenereer je sleutel op elk moment om de oude te intrekken. Elk account heeft één sleutel. Het proeftegoed vervalt na 7 dagen. Opwaarderen begint vanaf $10 met opties voor bonus tegoed.

Technische specificaties

Alle echte limieten en functies van de API op één plek — controleer ze voordat je opwaardeert.

OnderdeelWaarde
API-formaatOpenAI-compatibel: elke OpenAI-SDK werkt — vervang alleen base URL en sleutel
Model-IDuncensored
Base URLhttps://api.llmwebsearchapi.com/v1
AuthenticatieAuthorization: Bearer YOUR_KEY
EndpointsPOST /v1/chat/completions · GET /v1/models
Streamingja — server-sent events; het laatste deel bevat het tokenverbruik
Max. uitvoertot de rest van het venster van 100.000 tokens; max_tokens optioneel (geen aparte limiet)
Parameterstemperature, top_p, stop, seed, presence_penalty, frequency_penalty
JSON-modusresponse_format: {"type": "json_object"}
Contextvenster100.000 tokens (invoer + uitvoer)
Function callingja — tools, tool_choice; antwoorden bevatten tool_calls, ook bij streaming; resultaten als role: tool
ResponsheadersX-Request-Id, X-Balance-USD, X-RateLimit-Limit-Requests, X-RateLimit-Limit-Concurrency
Gelijktijdige verzoekentot 8 tegelijk per sleutel
Verzoekgroottetot 8 MB
Rate limit300 verzoeken per minuut per sleutel
Gratis proeftegoed$0,50 voor 7 dagen, zonder kaart · Proefsleutel: 2 parallelle verzoeken, 60 per minuut; volledige limieten (8 en 300) na eerste opwaardering
OpwaarderenUSDT (TRC20) of USDC (Base), elk heel bedrag van $10 tot $500
Afrekeningprepaid tegoed op basis van echt verbruik; fouten en weigeringen zijn gratis
Prijs$0,25 per 1 mln invoertokens · $1,00 per 1 mln uitvoertokens
Geldigheidbetaald tegoed verloopt niet, geen abonnement
Bonus+5% vanaf $50, +10% vanaf $100
Inhoudinhoud voor volwassenen toegestaan; seksuele inhoud met minderjarigen wordt geweigerd
Sleutelséén actieve sleutel per account; een nieuwe vervangt de oude
InloggenGoogle of e-mail en wachtwoord

Foutcodes

Fouten komen als JSON met een vaste type; mislukte of geweigerde verzoeken kosten niets.

CodeTypeBetekenis
400bad_requestongeldige JSON, lege berichten, verkeerde parameter of context te lang
401missing_key · invalid_key · key_revokedsleutel ontbreekt, is onjuist of is vervangen
402no_creditgeen tegoed — waardeer op en ga direct verder
403content_blockedseksuele inhoud met minderjarigen — geweigerd, niet gerekend
404not_foundonbekend endpoint
413request_too_largebody groter dan 8 MB
429rate_limited · concurrencymeer dan 300/min of 8 tegelijk — wacht en probeer opnieuw
503upstream_busymodel bezet — probeer het over enkele seconden opnieuw

Vragen en antwoorden

Is het model getraind op mijn data?

Nee, prompts worden niet gebruikt voor training. Je data blijft privé en wordt alleen verwerkt om de respons te genereren. Je kunt je API-sleutel op elk moment regenereren via de aanmeldpagina.

Wat gebeurt er als ik het contextvenster overschrijd?

De API retourneert een fout als het totale aantal tokens 100.000 overschrijdt. Je moet je input vooraf inkorten voordat je hem verstuurt. De limiet omvat zowel de prompt als de completion.

Kan ik dit gebruiken voor volwassen inhoud?

Ja, het model is ongecensureerd en weigert wettelijke onderwerpen voor volwassenen niet. De enige harde limiet is seksuele inhoud met minderjarigen, die altijd wordt geblokkeerd. Er gelden geen andere inhoudsfilters.

Je sleutel is nog maar één formulier verwijderd

Maak een account aan, kopieer de sleutel, wijzig de base URL. Dat is de hele setup.