Guide de démarrage rapide de l'API Web Search : Intégration en quelques minutes
Intégrez notre LLM sans censure dans votre pipeline de recherche web avec ce guide rapide compatible OpenAI. Traitez, extrayez et résumez les résultats de recherche bruts sans refus de filtre de contenu à l'aide de SDK standards.
https://api.llmwebsearchapi.com/v1uncensoredAuthentification et URL de base
Pour utiliser l'API, vous avez besoin d'une clé API. Inscrivez-vous sur la page Obtenir la clé API avec simplement un e-mail et un mot de passe. Votre clé apparaît immédiatement. Aucune carte bancaire n'est requise pour le crédit d'essai. Utilisez l'URL de base https://api.llmwebsearchapi.com/v1 avec n'importe quel client compatible OpenAI. L'ID du modèle est uncensored. Ce modèle à poids ouverts est ajusté pour répondre sans refus pour les sujets légaux pour adultes, fictifs ou controversés. Il ne s'agit pas de GPT, Claude ou d'un autre modèle d'un autre fournisseur.
Requête de complétion de chat basique
Envoyez une requête de complétion de chat standard pour extraire du texte des résultats de recherche. L'API accepte messages et renvoie une complétion. Utilisez le modèle uncensored pour vous assurer qu'aucun filtre de contenu ne bloque vos données. Le corps de la requête prend en charge jusqu'à 8 Mo. Voici un exemple cURL pour une tâche d'extraction basique.
curl https://api.llmwebsearchapi.com/v1/chat/completions \
-H "Authorization: Bearer $API_KEY" \
-H "Content-Type: application/json" \
-d '{
"model": "uncensored",
"messages": [{"role": "user", "content": "Write a blunt product review of a cheap VPN."}]
}'La réponse inclut le texte généré, que vous pouvez ensuite transmettre à la mémoire ou à la couche de résumé de votre agent.
Exemples de SDK pour Python et JavaScript
Utilisez les SDK officiels OpenAI pour Python et Node.js. Définissez le base_url sur notre endpoint et fournissez votre clé API. Le SDK Python gère automatiquement le streaming et l'analyse JSON. Le SDK Node fonctionne de manière similaire. Voici un exemple Python montrant comment initialiser le client et envoyer une requête.
from openai import OpenAI
client = OpenAI(base_url="https://api.llmwebsearchapi.com/v1", api_key="YOUR_KEY")
resp = client.chat.completions.create(
model="uncensored",
messages=[{"role": "user", "content": "Summarise this thread without softening it."}],
)
print(resp.choices[0].message.content)Pour JavaScript, la configuration est presque identique. Définissez la variable d'environnement ou passez la clé directement. L'ID du modèle reste uncensored.
import OpenAI from "openai";
const client = new OpenAI({ baseURL: "https://api.llmwebsearchapi.com/v1", apiKey: process.env.API_KEY });
const resp = await client.chat.completions.create({
model: "uncensored",
messages: [{ role: "user", content: "Draft a villain monologue for my game." }],
});
console.log(resp.choices[0].message.content);
Réponses en streaming pour le traitement en temps réel
Activez le streaming en définissant stream: true dans votre requête. L'API renvoie des tokens d'événements envoyés par le serveur (SSE). Cela est utile pour le traitement en temps réel des longs résultats de recherche. Vous pouvez afficher les tokens à mesure qu'ils arrivent ou les accumuler pour une utilisation ultérieure. Le format de réponse en streaming correspond à la norme OpenAI. Voici un exemple de streaming utilisant cURL.
stream = client.chat.completions.create(
model="uncensored",
messages=[{"role": "user", "content": "Tell the story in second person."}],
stream=True,
)
for chunk in stream:
if chunk.choices and chunk.choices[0].delta.content:
print(chunk.choices[0].delta.content, end="", flush=True)Analysez le champ data dans chaque message SSE pour obtenir le texte partiel.
Appel de fonctions pour la structuration des résultats de recherche
Utilisez l'appel de fonctions pour structurer les données extraites. Définissez un schéma pour votre sortie souhaitée, comme une liste d'URLs ou un objet de résumé. L'API renvoie un JSON structuré qui correspond à votre schéma. C'est idéal pour alimenter la mémoire d'un agent IA avec des données propres et typées. Définissez l'outil dans le paramètre tools et spécifiez le nom de la fonction. Le modèle répondra avec un objet d'appel de fonction. Vous pouvez ensuite exécuter la fonction ou stocker le résultat directement.
Gestion des fenêtres de contexte pour les longues recherches
La fenêtre de contexte est de 100 000 tokens pour le prompt plus la complétion. Si vos résultats de recherche dépassent cette limite, vous devez les tronquer ou les résumer avant l'envoi. L'API ne gère pas automatiquement les longs contextes. Envoyez uniquement le texte pertinent pour rester dans les limites. Si vous dépassez la limite, vous recevrez une erreur. Surveillez votre utilisation de tokens pour éviter des coûts inattendus. Le prix est de 0,25 $ par 1M de tokens d'entrée et de 1,00 $ par 1M de tokens de sortie.
Limites de débit et codes d'erreur
La limite de débit est de 300 requêtes par minute par clé. La limite du corps de la requête est de 8 Mo. Si vous envoyez une clé invalide, vous obtenez une erreur 401. Si vous n'avez pas de crédit, vous obtenez une erreur 402. Si vous dépassez la limite de débit, vous obtenez une erreur 429. Régénérez votre clé à tout moment pour révoquer l'ancienne. Chaque compte possède une seule clé. Le crédit d'essai expire après 7 jours. Le rechargement commence à 10 $ avec des options de crédit bonus.
Caractéristiques techniques
Toutes les limites et fonctions réelles de l'API au même endroit — vérifiez-les avant de recharger.
| Élément | Valeur |
|---|---|
| Format | compatible OpenAI : tout SDK OpenAI fonctionne en changeant la base URL et la clé |
| ID du modèle | uncensored |
| Base URL | https://api.llmwebsearchapi.com/v1 |
| Authentification | Authorization: Bearer YOUR_KEY |
| Endpoints | POST /v1/chat/completions · GET /v1/models |
| Streaming | oui — server-sent events ; le dernier bloc contient l'usage des tokens |
| Sortie max. | jusqu'au reste de la fenêtre de 100 000 tokens ; max_tokens optionnel (pas de plafond distinct) |
| Paramètres | temperature, top_p, stop, seed, presence_penalty, frequency_penalty |
| Mode JSON | response_format: {"type": "json_object"} |
| Fenêtre de contexte | 100 000 tokens (entrée + sortie) |
| Appel de fonctions | oui — tools, tool_choice ; réponse avec tool_calls, aussi en streaming ; résultats en role: tool |
| En-têtes | X-Request-Id, X-Balance-USD, X-RateLimit-Limit-Requests, X-RateLimit-Limit-Concurrency |
| Concurrence | 8 requêtes simultanées par clé |
| Taille | jusqu'à 8 Mo par requête |
| Limite de débit | 300 requêtes par minute et par clé |
| Essai gratuit | 0,50 $ pendant 7 jours, sans carte · Clé d'essai : 2 requêtes parallèles, 60 par minute ; limites complètes (8 et 300) après la 1re recharge |
| Recharge | USDT (TRC20) ou USDC (Base), tout montant entier de 10 $ à 500 $ |
| Facturation | crédit prépayé selon l'usage réel ; erreurs et refus gratuits |
| Prix | 0,25 $ par million de tokens en entrée · 1,00 $ par million en sortie |
| Validité | le crédit payé n'expire jamais, sans abonnement |
| Bonus | +5 % dès 50 $, +10 % dès 100 $ |
| Contenu | contenu adulte autorisé ; tout contenu sexuel impliquant des mineurs est refusé |
| Clés | une clé active par compte ; une nouvelle remplace l'ancienne |
| Connexion | Google ou e-mail et mot de passe |
Codes d'erreur
Les erreurs arrivent en JSON avec un type stable ; les requêtes échouées ou refusées ne sont pas facturées.
| Code | Type | Signification |
|---|---|---|
400 | bad_request | JSON invalide, messages vides, mauvais paramètre ou contexte trop long |
401 | missing_key · invalid_key · key_revoked | clé absente, erronée ou remplacée |
402 | no_credit | plus de crédit — rechargez, la reprise est immédiate |
403 | content_blocked | contenu sexuel impliquant des mineurs — refusé, non facturé |
404 | not_found | endpoint inconnu |
413 | request_too_large | corps supérieur à 8 Mo |
429 | rate_limited · concurrency | au-delà de 300/min ou 8 en parallèle — patientez |
503 | upstream_busy | modèle occupé — réessayez dans quelques secondes |
Questions et réponses
Le modèle est-il entraîné sur mes données ?
Non, les prompts ne sont pas utilisés pour l'entraînement. Vos données restent privées et sont uniquement traitées pour générer la réponse. Vous pouvez régénérer votre clé API à tout moment depuis la page d'inscription.
Que se passe-t-il si je dépasse la fenêtre de contexte ?
L'API renverra une erreur si le nombre total de tokens dépasse 100 000. Vous devez tronquer votre entrée avant l'envoi. La limite inclut à la fois le prompt et la complétion.
Puis-je l'utiliser pour du contenu pour adultes ?
Oui, le modèle est sans censure et ne refuse pas les sujets adultes légaux. La seule limite stricte concerne le contenu sexuel impliquant des mineurs, qui est toujours bloqué. Aucun autre filtre de contenu ne s'applique.
Votre clé est à un formulaire de vous
Créez un compte, copiez la clé, modifiez l'URL de base. C'est toute la configuration.