VI ▾
llmwebsearchapi.com
llmwebsearchapi.com›Tài liệu
Lấy khóa API

Bắt đầu nhanh API Web Search: Tích hợp trong vài phút

Tích hợp LLM không kiểm duyệt của chúng tôi vào quy trình tìm kiếm web của bạn với hướng dẫn nhanh tương thích OpenAI này. Xử lý, trích xuất và tóm tắt kết quả tìm kiếm thô mà không bị từ chối do bộ lọc nội dung bằng các SDK tiêu chuẩn.

URL cơ sởhttps://api.llmwebsearchapi.com/v1
Mô hìnhuncensored

Xác thực & URL cơ sở

Để sử dụng API, bạn cần một khóa API. Đăng ký trên trang Lấy khóa API chỉ bằng email và mật khẩu. Khóa của bạn xuất hiện ngay lập tức. Không cần thẻ tín dụng cho tín dụng dùng thử. Sử dụng URL cơ sở https://api.llmwebsearchapi.com/v1 với bất kỳ máy khách tương thích OpenAI nào. ID mô hình là uncensored. Mô hình này có trọng số mở và được tinh chỉnh để trả lời mà không từ chối các chủ đề người trưởng thành hợp pháp, hư cấu hoặc gây tranh cãi. Đây không phải là GPT, Claude hay mô hình của nhà cung cấp khác.

Yêu cầu hoàn thành trò chuyện cơ bản

Gửi yêu cầu hoàn thành trò chuyện tiêu chuẩn để trích xuất văn bản từ kết quả tìm kiếm. API chấp nhận messages và trả về phần hoàn thành. Sử dụng mô hình uncensored để đảm bảo không có bộ lọc nội dung nào chặn dữ liệu của bạn. Thân yêu cầu hỗ trợ tối đa 8 MB. Dưới đây là ví dụ cURL cho một nhiệm vụ trích xuất cơ bản.

curl https://api.llmwebsearchapi.com/v1/chat/completions \
  -H "Authorization: Bearer $API_KEY" \
  -H "Content-Type: application/json" \
  -d '{
    "model": "uncensored",
    "messages": [{"role": "user", "content": "Write a blunt product review of a cheap VPN."}]
  }'

Phản hồi bao gồm văn bản được tạo, sau đó bạn có thể chuyển nó vào bộ nhớ hoặc lớp tóm tắt của agent của bạn.

Ví dụ SDK cho Python và JavaScript

Sử dụng các SDK chính thức của OpenAI cho Python và Node.js. Đặt base_url thành endpoint của chúng tôi và cung cấp khóa API của bạn. SDK Python xử lý truyền phát và phân tích JSON tự động. SDK Node hoạt động tương tự. Dưới đây là ví dụ Python về cách khởi tạo máy khách và gửi yêu cầu.

from openai import OpenAI

client = OpenAI(base_url="https://api.llmwebsearchapi.com/v1", api_key="YOUR_KEY")

resp = client.chat.completions.create(
    model="uncensored",
    messages=[{"role": "user", "content": "Summarise this thread without softening it."}],
)
print(resp.choices[0].message.content)

Đối với JavaScript, thiết lập gần như giống hệt nhau. Đặt biến môi trường hoặc truyền khóa trực tiếp. ID mô hình vẫn là uncensored.

import OpenAI from "openai";

const client = new OpenAI({ baseURL: "https://api.llmwebsearchapi.com/v1", apiKey: process.env.API_KEY });

const resp = await client.chat.completions.create({
  model: "uncensored",
  messages: [{ role: "user", content: "Draft a villain monologue for my game." }],
});
console.log(resp.choices[0].message.content);

Phản hồi truyền phát để xử lý thời gian thực

Bật truyền phát bằng cách đặt stream: true trong yêu cầu của bạn. API trả về các token Sự kiện do máy chủ gửi (SSE). Điều này hữu ích cho việc xử lý thời gian thực các kết quả tìm kiếm dài. Bạn có thể hiển thị token khi chúng đến hoặc tích lũy chúng để sử dụng sau. Định dạng phản hồi truyền phát khớp với tiêu chuẩn OpenAI. Dưới đây là ví dụ truyền phát bằng cURL.

stream = client.chat.completions.create(
    model="uncensored",
    messages=[{"role": "user", "content": "Tell the story in second person."}],
    stream=True,
)
for chunk in stream:
    if chunk.choices and chunk.choices[0].delta.content:
        print(chunk.choices[0].delta.content, end="", flush=True)

Phân tích trường data trong mỗi thông báo SSE để lấy văn bản một phần.

Gọi hàm để cấu trúc kết quả tìm kiếm

Sử dụng gọi công cụ để cấu trúc dữ liệu đã trích xuất. Xác định lược đồ cho kết quả mong muốn của bạn, chẳng hạn như danh sách URL hoặc đối tượng tóm tắt. API trả về JSON có cấu trúc khớp với lược đồ của bạn. Điều này rất lý tưởng để điền bộ nhớ tác nhân AI bằng dữ liệu sạch, có kiểu. Xác định công cụ trong tham số tools và chỉ định tên hàm. Mô hình sẽ phản hồi bằng một đối tượng gọi hàm. Sau đó, bạn có thể thực thi hàm hoặc lưu kết quả trực tiếp.

Xử lý cửa sổ ngữ cảnh cho các tìm kiếm dài

Cửa sổ ngữ cảnh là 100.000 token cho prompt cộng với phần hoàn thành. Nếu kết quả tìm kiếm của bạn vượt quá giới hạn này, bạn phải cắt ngắn hoặc tóm tắt chúng trước khi gửi. API không tự động xử lý các ngữ cảnh dài. Chỉ gửi văn bản liên quan để nằm trong giới hạn. Nếu bạn vượt quá giới hạn, bạn sẽ nhận được lỗi. Theo dõi việc sử dụng token của bạn để tránh chi phí không mong muốn. Giá là $0,25 cho mỗi 1M token đầu vào và $1,00 cho mỗi 1M token đầu ra.

Giới hạn tốc độ và mã lỗi

Giới hạn tốc độ là 300 yêu cầu mỗi phút trên mỗi khóa. Giới hạn thân yêu cầu là 8 MB. Nếu bạn gửi khóa không hợp lệ, bạn sẽ nhận được lỗi 401. Nếu bạn không có tín dụng, bạn sẽ nhận được lỗi 402. Nếu bạn vượt quá giới hạn tốc độ, bạn sẽ nhận được lỗi 429. Tạo lại khóa của bạn bất cứ lúc nào để thu hồi khóa cũ. Mỗi tài khoản có một khóa. Tín dụng dùng thử hết hạn sau 7 ngày. Nạp tiền bắt đầu từ 10 USD với các tùy chọn tín dụng tặng thêm.

Thông số kỹ thuật

Toàn bộ giới hạn và tính năng thực tế của API ở một nơi — hãy kiểm tra trước khi nạp tiền.

MụcGiá trị
Định dạngtương thích OpenAI: mọi SDK OpenAI đều chạy được, chỉ cần đổi base URL và khóa
ID mô hìnhuncensored
Base URLhttps://api.llmwebsearchapi.com/v1
Xác thựcAuthorization: Bearer YOUR_KEY
EndpointPOST /v1/chat/completions · GET /v1/models
Streamingcó — server-sent events; phần cuối chứa lượng token đã dùng
Đầu ra tối đatối đa phần còn lại của cửa sổ 100.000 token; max_tokens tùy chọn (không giới hạn riêng)
Tham sốtemperature, top_p, stop, seed, presence_penalty, frequency_penalty
Chế độ JSONresponse_format: {"type": "json_object"}
Cửa sổ ngữ cảnh100.000 token (đầu vào + đầu ra)
Gọi hàmcó — tools, tool_choice; phản hồi có tool_calls, kể cả khi streaming; kết quả gửi lại bằng role: tool
Header phản hồiX-Request-Id, X-Balance-USD, X-RateLimit-Limit-Requests, X-RateLimit-Limit-Concurrency
Yêu cầu đồng thờitối đa 8 cùng lúc cho mỗi khóa
Kích thước yêu cầutối đa 8 MB
Giới hạn tốc độ300 yêu cầu mỗi phút cho mỗi khóa
Dùng thử miễn phí$0,50 trong 7 ngày, không cần thẻ · Khóa dùng thử: 2 yêu cầu song song, 60 yêu cầu/phút; hạn mức đầy đủ (8 và 300) sau lần nạp đầu
Nạp tiềnUSDT (TRC20) hoặc USDC (Base), số tiền nguyên bất kỳ từ $10 đến $500
Tính phítín dụng trả trước theo mức dùng thực tế; lỗi và từ chối miễn phí
Giá$0,25 cho 1 triệu token đầu vào · $1,00 cho 1 triệu token đầu ra
Thời hạntín dụng đã trả không hết hạn, không đăng ký định kỳ
Thưởng+5% từ $50, +10% từ $100
Nội dungcho phép nội dung người lớn; từ chối nội dung tình dục liên quan đến trẻ vị thành niên
Khóamỗi tài khoản một khóa đang hoạt động; khóa mới thay thế khóa cũ
Đăng nhậpGoogle hoặc email và mật khẩu

Mã lỗi

Lỗi trả về dạng JSON với type cố định; yêu cầu lỗi hoặc bị từ chối không bị tính phí.

MãLoạiÝ nghĩa
400bad_requestJSON sai, tin nhắn trống, tham số sai hoặc vượt cửa sổ ngữ cảnh
401missing_key · invalid_key · key_revokedthiếu khóa, sai khóa hoặc khóa đã bị thay
402no_credithết tín dụng — nạp tiền là dùng tiếp ngay
403content_blockednội dung tình dục liên quan trẻ vị thành niên — từ chối, không tính phí
404not_foundendpoint không tồn tại
413request_too_largenội dung lớn hơn 8 MB
429rate_limited · concurrencyvượt 300/phút hoặc 8 đồng thời — chờ rồi thử lại
503upstream_busymô hình đang bận — thử lại sau vài giây

Hỏi đáp

Mô hình có được huấn luyện trên dữ liệu của tôi không?

Không, prompt không được dùng để huấn luyện. Dữ liệu của bạn vẫn được giữ bí mật và chỉ được xử lý để tạo phản hồi. Bạn có thể tạo lại khóa API bất kỳ lúc nào từ trang đăng ký.

Điều gì xảy ra nếu tôi vượt quá cửa sổ ngữ cảnh?

API sẽ trả về lỗi nếu tổng số token vượt quá 100.000. Bạn phải cắt ngắn dữ liệu đầu vào trước khi gửi. Giới hạn này bao gồm cả prompt và phần hoàn thành.

Tôi có thể dùng cái này cho nội dung người lớn không?

Có, mô hình không kiểm duyệt và không từ chối các chủ đề người lớn hợp pháp. Giới hạn cứng duy nhất là nội dung tình dục liên quan đến trẻ vị thành niên, luôn bị chặn. Không có bộ lọc nội dung nào khác áp dụng.

Khóa của bạn chỉ cách một biểu mẫu

Tạo tài khoản, sao chép khóa, thay đổi URL cơ sở. Đó là toàn bộ thiết lập.