RU ▾
llmwebsearchapi.com
llmwebsearchapi.com›Документация
Получить API-ключ

Быстрый старт Web Search API: интеграция за минуты

Интегрируйте нашу LLM без цензуры в конвейер веб-поиска с помощью этого быстрого руководства, совместимого с OpenAI. Обрабатывайте, извлекайте и создавайте сводки сырых результатов поиска без отказов из-за фильтров контента с помощью стандартных SDK.

Базовый URLhttps://api.llmwebsearchapi.com/v1
Модельuncensored

Аутентификация и базовый URL

Для использования API вам нужен API-ключ. Зарегистрируйтесь на странице Получить API-ключ, указав только email и пароль. Ключ появляется сразу. Для получения пробного баланса не нужна кредитная карта. Используйте базовый URL https://api.llmwebsearchapi.com/v1 с любым клиентом, совместимым с OpenAI. Идентификатор модели — uncensored. Это модель с открытыми весами, настроенная на ответы без отказов по законным взрослым, художественным или спорным темам. Это не GPT, Claude или модель другого поставщика.

Базовый запрос завершения чата

Отправьте стандартный запрос chat completion для извлечения текста из результатов поиска. API принимает messages и возвращает завершение. Используйте модель uncensored, чтобы фильтры контента не блокировали ваши данные. Тело запроса поддерживает до 8 МБ. Ниже приведен пример cURL для базовой задачи извлечения.

curl https://api.llmwebsearchapi.com/v1/chat/completions \
  -H "Authorization: Bearer $API_KEY" \
  -H "Content-Type: application/json" \
  -d '{
    "model": "uncensored",
    "messages": [{"role": "user", "content": "Write a blunt product review of a cheap VPN."}]
  }'

Ответ включает сгенерированный текст, который вы затем можете передать в память или слой сводок вашего агента.

Примеры SDK для Python и JavaScript

Используйте официальные SDK OpenAI для Python и Node.js. Установите base_url на наш эндпоинт и укажите API-ключ. Python SDK автоматически обрабатывает потоковую передачу и парсинг JSON. Node SDK работает аналогично. Ниже приведен пример на Python, показывающий, как инициализировать клиент и отправить запрос.

from openai import OpenAI

client = OpenAI(base_url="https://api.llmwebsearchapi.com/v1", api_key="YOUR_KEY")

resp = client.chat.completions.create(
    model="uncensored",
    messages=[{"role": "user", "content": "Summarise this thread without softening it."}],
)
print(resp.choices[0].message.content)

Для JavaScript настройка почти идентична. Установите переменную окружения или передайте ключ напрямую. Идентификатор модели остается uncensored.

import OpenAI from "openai";

const client = new OpenAI({ baseURL: "https://api.llmwebsearchapi.com/v1", apiKey: process.env.API_KEY });

const resp = await client.chat.completions.create({
  model: "uncensored",
  messages: [{ role: "user", content: "Draft a villain monologue for my game." }],
});
console.log(resp.choices[0].message.content);

Потоковые ответы для обработки в реальном времени

Включите потоковую передачу, установив stream: true в запросе. API возвращает токены Server-Sent Events (SSE). Это полезно для обработки длинных результатов поиска в реальном времени. Вы можете отображать токены по мере их поступления или накапливать их для последующего использования. Формат потокового ответа соответствует стандарту OpenAI. Ниже приведен пример потоковой передачи с помощью cURL.

stream = client.chat.completions.create(
    model="uncensored",
    messages=[{"role": "user", "content": "Tell the story in second person."}],
    stream=True,
)
for chunk in stream:
    if chunk.choices and chunk.choices[0].delta.content:
        print(chunk.choices[0].delta.content, end="", flush=True)

Разбирайте поле data в каждом сообщении SSE, чтобы получить частичный текст.

Вызов функций для структурирования результатов поиска

Используйте вызов инструментов для структурирования извлеченных данных. Определите схему для желаемого вывода, например, список URL или объект сводки. API возвращает структурированный JSON, соответствующий вашей схеме. Это идеально подходит для заполнения памяти AI-агента чистыми типизированными данными. Определите инструмент в параметре tools и укажите имя функции. Модель ответит объектом вызова функции. Затем вы можете выполнить функцию или сохранить результат напрямую.

Обработка контекстных окон для длинных поисков

Контекстное окно составляет 100 000 токенов для промпта и ответа. Если результаты поиска превышают этот лимит, необходимо обрезать или сжать их перед отправкой. API не обрабатывает длинные контексты автоматически. Отправляйте только релевантный текст, чтобы оставаться в пределах лимитов. При превышении лимита вы получите ошибку. Следите за использованием токенов, чтобы избежать неожиданных расходов. Цена: $0,25 за 1M входных токенов и $1,00 за 1M выходных токенов.

Лимиты запросов и коды ошибок

Лимит запросов — 300 запросов в минуту на ключ. Лимит тела запроса — 8 МБ. Если вы отправите недействительный ключ, получите ошибку 401. Если у вас нет кредита, получите ошибку 402. При превышении лимита запросов получите ошибку 429. Вы можете перегенерировать ключ в любое время, чтобы отозвать старый. У каждого аккаунта один ключ. Пробный баланс истекает через 7 дней. Пополнение начинается от $10 с опциями бонусного кредита.

Технические характеристики

Все реальные лимиты и возможности API в одном месте — сверьте их до пополнения.

ПараметрЗначение
Формат APIсовместим с OpenAI: любой OpenAI SDK работает — замените base URL и ключ
ID моделиuncensored
Base URLhttps://api.llmwebsearchapi.com/v1
АвторизацияAuthorization: Bearer YOUR_KEY
ЭндпоинтыPOST /v1/chat/completions · GET /v1/models
Потоковая передачада — server-sent events, последний фрагмент содержит расход токенов
Максимум ответадо остатка окна в 100 000 токенов; max_tokens необязателен (отдельного лимита нет)
Параметрыtemperature, top_p, stop, seed, presence_penalty, frequency_penalty
JSON-режимresponse_format: {"type": "json_object"}
Контекстное окно100 000 токенов (вход и ответ вместе)
Вызов функцийда — tools, tool_choice; ответ содержит tool_calls, в том числе в потоке; результат — сообщением role: tool
Заголовки ответаX-Request-Id, X-Balance-USD, X-RateLimit-Limit-Requests, X-RateLimit-Limit-Concurrency
Параллельные запросыдо 8 одновременно на ключ
Размер запросадо 8 МБ
Лимит запросов300 запросов в минуту на ключ
Пробный баланс$0,50 на 7 дней, без карты · Пробный ключ: 2 параллельных запроса, 60 в минуту; полные лимиты (8 и 300) после первого пополнения
ПополнениеUSDT (TRC20) или USDC (Base), любая целая сумма от $10 до $500
Оплатапредоплаченный баланс по фактическому расходу; ошибки и отказы бесплатны
Цена$0,25 за 1 млн входных токенов · $1,00 за 1 млн выходных
Срок действияоплаченный баланс не сгорает, без подписки
Бонус+5% от $50, +10% от $100
Контентконтент для взрослых разрешён; сексуальный контент с несовершеннолетними запрещён
Ключиодин активный ключ на аккаунт; новый заменяет старый
ВходGoogle или e-mail и пароль

Коды ошибок

Ошибки приходят в JSON с постоянным type; неудачные и отклонённые запросы не оплачиваются.

КодТипЧто значит
400bad_requestневерный JSON, пустые сообщения, неверный параметр или превышено окно контекста
401missing_key · invalid_key · key_revokedнет ключа, ключ неверный или заменён новым
402no_creditбаланс пуст — пополните, работа продолжится сразу
403content_blockedсексуальный контент с несовершеннолетними — отказ, без оплаты
404not_foundнеизвестный эндпоинт
413request_too_largeтело запроса больше 8 МБ
429rate_limited · concurrencyбольше 300/мин или 8 параллельно — подождите и повторите
503upstream_busyмодель занята — повторите через несколько секунд

Вопросы и ответы

Обучается ли модель на моих данных?

Нет, промпты не используются для обучения. Ваши данные остаются конфиденциальными и обрабатываются только для генерации ответа. Вы можете перегенерировать свой API-ключ в любое время на странице регистрации.

Что произойдет, если я превышу контекстное окно?

API вернет ошибку, если общее количество токенов превысит 100 000. Вы должны обрезать входные данные перед отправкой. Лимит включает как промпт, так и завершение.

Могу ли я использовать это для контента для взрослых?

Да, модель без цензуры и не отказывается от законных тем для взрослых. Единственное жесткое ограничение — сексуальный контент с участием несовершеннолетних, который всегда блокируется. Другие фильтры контента не применяются.

Ваш ключ — в одной форме от вас

Создайте аккаунт, скопируйте ключ, измените базовый URL. Вот и вся настройка.