Guía rápida de la API de búsqueda web: integración en minutos
Integra nuestro LLM sin censura en tu pipeline de búsqueda web con esta guía rápida compatible con OpenAI. Procesa, extrae y resume resultados de búsqueda sin rechazos por filtros de contenido usando SDK estándar.
https://api.llmwebsearchapi.com/v1uncensoredAutenticación y URL base
Necesitas una clave de API. Regístrate en la página Get API key con solo email y contraseña. Tu clave aparece al instante. No se requiere tarjeta para el crédito de prueba. Usa la base URL https://api.llmwebsearchapi.com/v1 con cualquier cliente compatible con OpenAI. El ID del modelo es uncensored. Es un modelo de pesos abiertos, ajustado para responder sin rechazos sobre temas adultos, ficticios o controversos. No es GPT, Claude ni de otro proveedor.
Solicitud básica de completado de chat
Envía una petición estándar de chat completion para extraer texto de resultados de búsqueda. La API acepta messages y devuelve una completación. Usa el modelo uncensored para evitar filtros de contenido. El cuerpo de la petición soporta hasta 8 MB. A continuación, un ejemplo en cURL para extracción básica.
curl https://api.llmwebsearchapi.com/v1/chat/completions \
-H "Authorization: Bearer $API_KEY" \
-H "Content-Type: application/json" \
-d '{
"model": "uncensored",
"messages": [{"role": "user", "content": "Write a blunt product review of a cheap VPN."}]
}'La respuesta incluye el texto generado, que luego puedes pasar a la memoria o capa de resumen de tu agente.
Ejemplos de SDK para Python y JavaScript
Usa los SDK oficiales de OpenAI para Python y Node.js. Establece base_url a nuestro endpoint y proporciona tu clave de API. El SDK de Python maneja streaming y parseo JSON automáticamente. El SDK de Node funciona de manera similar. A continuación se muestra un ejemplo en Python que muestra cómo inicializar el cliente y enviar una petición.
from openai import OpenAI
client = OpenAI(base_url="https://api.llmwebsearchapi.com/v1", api_key="YOUR_KEY")
resp = client.chat.completions.create(
model="uncensored",
messages=[{"role": "user", "content": "Summarise this thread without softening it."}],
)
print(resp.choices[0].message.content)Para JavaScript, la configuración es casi idéntica. Configura la variable de entorno o pasa la clave directamente. El ID del modelo sigue siendo uncensored.
import OpenAI from "openai";
const client = new OpenAI({ baseURL: "https://api.llmwebsearchapi.com/v1", apiKey: process.env.API_KEY });
const resp = await client.chat.completions.create({
model: "uncensored",
messages: [{ role: "user", content: "Draft a villain monologue for my game." }],
});
console.log(resp.choices[0].message.content);
Respuestas en streaming para procesamiento en tiempo real
Habilita el streaming estableciendo stream: true en tu petición. La API devuelve tokens de Server-Sent Events (SSE). Esto es útil para el procesamiento en tiempo real de resultados de búsqueda largos. Puedes mostrar los tokens a medida que llegan o acumularlos para su uso posterior. El formato de respuesta de streaming coincide con el estándar de OpenAI. A continuación se muestra un ejemplo de streaming usando cURL.
stream = client.chat.completions.create(
model="uncensored",
messages=[{"role": "user", "content": "Tell the story in second person."}],
stream=True,
)
for chunk in stream:
if chunk.choices and chunk.choices[0].delta.content:
print(chunk.choices[0].delta.content, end="", flush=True)Analiza el campo data en cada mensaje SSE para obtener el texto parcial.
Llamadas a herramientas para estructurar resultados de búsqueda
Usa llamadas a funciones para estructurar los datos extraídos. Define un esquema para el resultado deseado, como una lista de URLs o un objeto de resumen. La API devuelve un JSON estructurado que coincide con tu esquema. Esto es ideal para poblar la memoria del agente de IA con datos limpios y tipados. Define la herramienta en el parámetro tools y especifica el nombre de la función. El modelo responderá con un objeto de llamada a función. Luego puedes ejecutar la función o almacenar el resultado directamente.
Gestión de ventanas de contexto para búsquedas largas
La ventana de contexto es de 100.000 tokens para prompt más completación. Si tus resultados de búsqueda superan esto, debes truncarlos o resumirlos antes de enviarlos. La API no maneja automáticamente contextos largos. Envía solo el texto relevante para mantenerse dentro de los límites. Si excedes el límite, recibirás un error. Monitorea el uso de tokens para evitar costos inesperados. El precio es $0,25 por 1M de tokens de entrada y $1,00 por 1M de tokens de salida.
Límites de velocidad y códigos de error
El límite de velocidad es de 300 peticiones por minuto por clave. El límite del cuerpo de la solicitud es de 8 MB. Si envías una clave inválida, obtienes un error 401. Si no tienes crédito, obtienes un error 402. Si excedes el límite de velocidad, obtienes un error 429. Regenera tu clave en cualquier momento para revocar la antigua. Cada cuenta tiene una clave. El crédito de prueba caduca después de 7 días. La recarga comienza en $10 con opciones de crédito bonus.
Especificaciones técnicas
Todos los límites y funciones reales de la API en un solo lugar: revísalos antes de recargar.
| Elemento | Valor |
|---|---|
| Formato | compatible con OpenAI: cualquier SDK de OpenAI funciona cambiando la base URL y la clave |
| ID del modelo | uncensored |
| Base URL | https://api.llmwebsearchapi.com/v1 |
| Autenticación | Authorization: Bearer YOUR_KEY |
| Endpoints | POST /v1/chat/completions · GET /v1/models |
| Streaming | sí: server-sent events; el último fragmento incluye el uso de tokens |
| Salida máxima | hasta el resto de la ventana de 100.000 tokens; max_tokens opcional (sin límite aparte) |
| Parámetros | temperature, top_p, stop, seed, presence_penalty, frequency_penalty |
| Modo JSON | response_format: {"type": "json_object"} |
| Ventana de contexto | 100.000 tokens (entrada + salida) |
| Llamadas a funciones | sí: tools, tool_choice; la respuesta trae tool_calls, también en streaming; resultados como role: tool |
| Cabeceras | X-Request-Id, X-Balance-USD, X-RateLimit-Limit-Requests, X-RateLimit-Limit-Concurrency |
| Concurrencia | 8 peticiones a la vez por clave |
| Tamaño de petición | hasta 8 MB |
| Límite de peticiones | 300 por minuto por clave |
| Prueba gratis | $0,50 durante 7 días, sin tarjeta · Clave de prueba: 2 solicitudes paralelas, 60 por minuto; límites completos (8 y 300) tras la primera recarga |
| Recarga | USDT (TRC20) o USDC (Base), cualquier importe entero de $10 a $500 |
| Facturación | crédito prepago por uso real; errores y rechazos no se cobran |
| Precio | $0,25 por 1M tokens de entrada · $1,00 por 1M de salida |
| Caducidad | el crédito pagado no caduca, sin suscripción |
| Bono | +5 % desde $50, +10 % desde $100 |
| Contenido | contenido adulto permitido; se rechaza el contenido sexual con menores |
| Claves | una clave activa por cuenta; una nueva reemplaza a la anterior |
| Acceso | Google o correo y contraseña |
Códigos de error
Los errores llegan como JSON con un type fijo; las peticiones fallidas o rechazadas no se cobran.
| Código | Tipo | Significado |
|---|---|---|
400 | bad_request | JSON inválido, mensajes vacíos, parámetro incorrecto o contexto demasiado largo |
401 | missing_key · invalid_key · key_revoked | falta la clave, es incorrecta o fue reemplazada |
402 | no_credit | sin crédito: recarga y sigue al instante |
403 | content_blocked | contenido sexual con menores: rechazado, no se cobra |
404 | not_found | endpoint desconocido |
413 | request_too_large | cuerpo mayor de 8 MB |
429 | rate_limited · concurrency | más de 300/min o 8 en paralelo: espera y reintenta |
503 | upstream_busy | modelo ocupado: reintenta en unos segundos |
Preguntas y respuestas
¿El modelo se entrena con mis datos?
No, los prompts no se usan para el entrenamiento. Tus datos permanecen privados y solo se procesan para generar la respuesta. Puedes regenerar tu clave de API en cualquier momento desde la página de registro.
¿Qué sucede si excedo la ventana de contexto?
La API devolverá un error si los tokens totales superan los 100.000. Debes truncar tu entrada antes de enviarla. El límite incluye tanto el prompt como la completación.
¿Puedo usar esto para contenido para adultos?
Sí, el modelo es sin censura y no rechaza temas adultos legales. El único límite estricto es el contenido sexual que involucre a menores, que siempre se bloquea. No se aplican otros filtros de contenido.
Tu clave está a un formulario de distancia
Crea una cuenta, copia la clave, cambia la URL base. Esa es toda la configuración.