IT ▾
llmwebsearchapi.com
llmwebsearchapi.com›Documentazione
Ottieni la chiave API

Guida rapida Web Search API: Integra in pochi minuti

Integra il nostro LLM senza censura nella tua pipeline di ricerca web con questa guida rapida compatibile con OpenAI. Elaborazione, estrazione e riassunto dei risultati di ricerca grezzi senza rifiuti per filtri sui contenuti utilizzando SDK standard.

URL di basehttps://api.llmwebsearchapi.com/v1
Modellouncensored

Autenticazione e URL di base

Per utilizzare l'API è necessaria una chiave API. Registrati alla pagina Ottieni chiave API con solo email e password. La tua chiave appare immediatamente. Non è necessaria la carta di credito per il credito di prova. Utilizza l'URL di base https://api.llmwebsearchapi.com/v1 con qualsiasi client compatibile con OpenAI. L'ID del modello è uncensored. Questo modello a pesi aperti è ottimizzato per rispondere senza rifiuti per argomenti legali per adulti, fiction o controversi. Non è GPT, Claude o un modello di un altro fornitore.

Richiesta di completamento chat di base

Invia una richiesta standard di completamento chat per estrarre testo dai risultati di ricerca. L'API accetta messages e restituisce un completamento. Utilizza il modello uncensored per assicurarti che nessun filtro sui contenuti blocchi i tuoi dati. Il corpo della richiesta supporta fino a 8 MB. Di seguito è riportato un esempio cURL per un'attività di estrazione di base.

curl https://api.llmwebsearchapi.com/v1/chat/completions \
  -H "Authorization: Bearer $API_KEY" \
  -H "Content-Type: application/json" \
  -d '{
    "model": "uncensored",
    "messages": [{"role": "user", "content": "Write a blunt product review of a cheap VPN."}]
  }'

La risposta include il testo generato, che puoi poi passare alla memoria o allo strato di riassunto del tuo agente.

Esempi SDK per Python e JavaScript

Utilizza gli SDK ufficiali OpenAI per Python e Node.js. Imposta base_url sul nostro endpoint e fornisci la tua chiave API. L'SDK Python gestisce automaticamente lo streaming e l'analisi JSON. L'SDK Node funziona in modo simile. Di seguito è riportato un esempio Python che mostra come inizializzare il client e inviare una richiesta.

from openai import OpenAI

client = OpenAI(base_url="https://api.llmwebsearchapi.com/v1", api_key="YOUR_KEY")

resp = client.chat.completions.create(
    model="uncensored",
    messages=[{"role": "user", "content": "Summarise this thread without softening it."}],
)
print(resp.choices[0].message.content)

Per JavaScript, la configurazione è quasi identica. Imposta la variabile d'ambiente o passa la chiave direttamente. L'ID del modello rimane uncensored.

import OpenAI from "openai";

const client = new OpenAI({ baseURL: "https://api.llmwebsearchapi.com/v1", apiKey: process.env.API_KEY });

const resp = await client.chat.completions.create({
  model: "uncensored",
  messages: [{ role: "user", content: "Draft a villain monologue for my game." }],
});
console.log(resp.choices[0].message.content);

Risposte in streaming per l'elaborazione in tempo reale

Abilita lo streaming impostando stream: true nella tua richiesta. L'API restituisce token Server-Sent Events (SSE). Questo è utile per l'elaborazione in tempo reale di lunghi risultati di ricerca. Puoi visualizzare i token man mano che arrivano o accumularli per un uso successivo. Il formato della risposta in streaming corrisponde allo standard OpenAI. Di seguito è riportato un esempio di streaming utilizzando cURL.

stream = client.chat.completions.create(
    model="uncensored",
    messages=[{"role": "user", "content": "Tell the story in second person."}],
    stream=True,
)
for chunk in stream:
    if chunk.choices and chunk.choices[0].delta.content:
        print(chunk.choices[0].delta.content, end="", flush=True)

Analizza il campo data in ogni messaggio SSE per ottenere il testo parziale.

Chiamata di funzioni per la strutturazione dei risultati di ricerca

Utilizza la chiamata di funzioni per strutturare i dati estratti. Definisci uno schema per il tuo output desiderato, come un elenco di URL o un oggetto di riassunto. L'API restituisce un JSON strutturato che corrisponde al tuo schema. Questo è ideale per popolare la memoria dell'agente AI con dati puliti e tipizzati. Definisci lo strumento nel parametro tools e specifica il nome della funzione. Il modello risponderà con un oggetto di chiamata di funzione. Puoi quindi eseguire la funzione o memorizzare direttamente il risultato.

Gestione delle finestre di contesto per ricerche lunghe

La finestra di contesto è di 100.000 token per prompt più completamento. Se i tuoi risultati di ricerca superano questo limite, devi troncarli o riassumerli prima di inviarli. L'API non gestisce automaticamente contesti lunghi. Invia solo il testo rilevante per rimanere entro i limiti. Se superi il limite, riceverai un errore. Monitora l'utilizzo dei token per evitare costi imprevisti. Il prezzo è $0,25 per 1M di token in input e $1,00 per 1M di token in output.

Limiti di velocità e codici di errore

Il limite di velocità è di 300 richieste al minuto per chiave. Il limite del corpo della richiesta è di 8 MB. Se invii una chiave non valida, ottieni un errore 401. Se non hai credito, ottieni un errore 402. Se superi il limite di velocità, ottieni un errore 429. Rigenera la tua chiave in qualsiasi momento per revocare quella vecchia. Ogni account ha una sola chiave. Il credito di prova scade dopo 7 giorni. La ricarica parte da $10 con opzioni di credito bonus.

Specifiche tecniche

Tutti i limiti e le funzioni reali dell'API in un unico posto: controllali prima di ricaricare.

VoceValore
Formatocompatibile OpenAI: qualsiasi SDK OpenAI funziona cambiando base URL e chiave
ID modellouncensored
Base URLhttps://api.llmwebsearchapi.com/v1
AutenticazioneAuthorization: Bearer YOUR_KEY
EndpointPOST /v1/chat/completions · GET /v1/models
Streamingsì — server-sent events; l'ultimo blocco riporta l'uso dei token
Output massimofino al resto della finestra di 100.000 token; max_tokens opzionale (nessun limite separato)
Parametritemperature, top_p, stop, seed, presence_penalty, frequency_penalty
Modalità JSONresponse_format: {"type": "json_object"}
Finestra di contesto100.000 token (input + output)
Function callingsì — tools, tool_choice; risposte con tool_calls anche in streaming; risultati come role: tool
HeaderX-Request-Id, X-Balance-USD, X-RateLimit-Limit-Requests, X-RateLimit-Limit-Concurrency
Concorrenza8 richieste contemporanee per chiave
Dimensionefino a 8 MB per richiesta
Limite di frequenza300 richieste al minuto per chiave
Prova gratuita$0,50 per 7 giorni, senza carta · Chiave di prova: 2 richieste parallele, 60 al minuto; limiti completi (8 e 300) dopo la prima ricarica
RicaricaUSDT (TRC20) o USDC (Base), qualsiasi importo intero da $10 a $500
Fatturazionecredito prepagato in base all'uso reale; errori e rifiuti gratuiti
Prezzo$0,25 per 1M token in input · $1,00 per 1M in output
Scadenzail credito pagato non scade, nessun abbonamento
Bonus+5% da $50, +10% da $100
Contenuticontenuti per adulti consentiti; rifiutati i contenuti sessuali con minori
Chiaviuna chiave attiva per account; una nuova sostituisce la precedente
AccessoGoogle oppure e-mail e password

Codici di errore

Gli errori arrivano in JSON con un type fisso; le richieste fallite o rifiutate non si pagano.

CodiceTipoSignificato
400bad_requestJSON non valido, messaggi vuoti, parametro errato o contesto troppo lungo
401missing_key · invalid_key · key_revokedchiave mancante, errata o sostituita
402no_creditcredito esaurito — ricarica e riparti subito
403content_blockedcontenuti sessuali con minori — rifiutato, non addebitato
404not_foundendpoint sconosciuto
413request_too_largecorpo oltre 8 MB
429rate_limited · concurrencyoltre 300/min o 8 in parallelo — attendi e riprova
503upstream_busymodello occupato — riprova tra pochi secondi

Domande e risposte

Il modello è addestrato sui miei dati?

No, i prompt non vengono utilizzati per l'addestramento. I tuoi dati rimangono privati e vengono elaborati solo per generare la risposta. Puoi rigenerare la tua chiave API in qualsiasi momento dalla pagina di registrazione.

Cosa succede se supero la finestra di contesto?

L'API restituirà un errore se i token totali superano 100.000. Devi troncare l'input prima di inviarlo. Il limite include sia il prompt che il completamento.

Posso usarlo per contenuti per adulti?

Sì, il modello è senza censura e non rifiuta argomenti legali per adulti. L'unico limite rigido è il contenuto sessuale che coinvolge minori, che viene sempre bloccato. Non si applicano altri filtri sui contenuti.

La tua chiave è a un modulo di distanza

Crea un account, copia la chiave, modifica l'URL di base. È tutta qui la configurazione.