VI ▾

API tương thích OpenAI không bộ lọc cho người dùng trưởng thành

https://api.llmsemcensura.com/v1uncensored

Tích hợp nhanh với API của chúng tôi

Tích hợp API tương thích OpenAI của chúng tôi trong vài phút để tạo văn bản không từ chối nội dung người lớn. Sử dụng endpoint chat-completions với mô hình 'uncensored' và kiểm soát hoàn toàn ngữ cảnh 100.000 token.

https://api.llmsemcensura.com/v1uncensored

Xác thực và Base URL

Để bắt đầu, hãy truy cập nền tảng của chúng tôi và tạo tài khoản chỉ với email và mật khẩu. Sau khi xác nhận, khóa API của bạn sẽ được hiển thị ngay lập tức. Không cần thẻ tín dụng để dùng thử. Sử dụng base URL https://api.llmsemcensura.com/v1 trong các ứng dụng khách của bạn và đặt khóa trong tiêu đề Authorization: Bearer SUA_CHAVE. Mô hình cần gọi được xác định bằng uncensored.

Endpoint Chat Completions

Endpoint POST /v1/chat/completions là tuyến duy nhất cần thiết cho việc sử dụng văn bản. Gửi tin nhắn theo cấu trúc messages và nhận phản hồi trực tiếp. Chúng tôi không cung cấp embedding hay tạo ảnh. Mô hình mở và chạy trên máy chủ GPU của chúng tôi, không sử dụng dữ liệu để huấn luyện các mô hình khác. Đặt model thành uncensored trong các yêu cầu.

Ví dụ yêu cầu cơ bản:

curl https://api.llmsemcensura.com/v1/chat/completions \
  -H "Authorization: Bearer $API_KEY" \
  -H "Content-Type: application/json" \
  -d '{
    "model": "uncensored",
    "messages": [{"role": "user", "content": "Write a blunt product review of a cheap VPN."}]
  }'

Hỗ trợ Streaming (SSE)

Đối với các ứng dụng yêu cầu độ trễ thấp, hãy kích hoạt streaming bằng cách đặt stream: true. API sẽ trả về luồng sự kiện Server-Sent Events (SSE), cho phép hiển thị văn bản token theo token. Điều này rất lý tưởng cho các giao diện chat phản hồi nhanh. Ứng dụng khách phải xử lý luồng cho đến khi nhận được sự kiện done.

Ví dụ sử dụng với streaming:

stream = client.chat.completions.create(
    model="uncensored",
    messages=[{"role": "user", "content": "Tell the story in second person."}],
    stream=True,
)
for chunk in stream:
    if chunk.choices and chunk.choices[0].delta.content:
        print(chunk.choices[0].delta.content, end="", flush=True)

Gọi hàm và Công cụ

Mô hình hỗ trợ gọi hàm gốc. Bạn có thể định nghĩa tools trong thân yêu cầu để AI trả về các đối số có cấu trúc thay vì văn bản tự do. Điều này giúp tích hợp với các hệ thống bên ngoài dễ dàng hơn. Định dạng phản hồi tuân theo tiêu chuẩn OpenAI, trả về tool_calls khi thích hợp.

Quản lý Token và Giới hạn

Ngữ cảnh tổng thể (prompt + completion) được giới hạn ở 100.000 token. Giá là $0,25 cho 1 triệu token đầu vào và $1,00 cho 1 triệu token đầu ra. Tín dụng trả trước không bao giờ hết hạn. Bạn có thể nạp tiền từ $10, với bonus +5% trên $50 và +10% trên $100. Dùng thử ban đầu cung cấp $0,50 có hiệu lực trong 7 ngày.

Ví dụ mã Python

Thư viện chính thức openai hoạt động gốc. Chỉ cần thay đổi base_url và cung cấp khóa của bạn. Mã dưới đây minh họa một tương tác đơn giản. Hãy đảm bảo cài đặt gói qua pip trước khi chạy.

from openai import OpenAI

client = OpenAI(base_url="https://api.llmsemcensura.com/v1", api_key="YOUR_KEY")

resp = client.chat.completions.create(
    model="uncensored",
    messages=[{"role": "user", "content": "Summarise this thread without softening it."}],
)
print(resp.choices[0].message.content)

Node.js

import OpenAI from "openai";

const client = new OpenAI({ baseURL: "https://api.llmsemcensura.com/v1", apiKey: process.env.API_KEY });

const resp = await client.chat.completions.create({
  model: "uncensored",
  messages: [{ role: "user", content: "Draft a villain monologue for my game." }],
});
console.log(resp.choices[0].message.content);

Thông số kỹ thuật

Toàn bộ giới hạn và tính năng thực tế của API ở một nơi — hãy kiểm tra trước khi nạp tiền.

MụcGiá trị
Định dạngtương thích OpenAI: mọi SDK OpenAI đều chạy được, chỉ cần đổi base URL và khóa
Xác thựcAuthorization: Bearer YOUR_KEY
EndpointPOST /v1/chat/completions · GET /v1/models
Base URLhttps://api.llmsemcensura.com/v1
ID mô hìnhuncensored
Tham sốtemperature, top_p, stop, seed, presence_penalty, frequency_penalty
Đầu ra tối đatối đa phần còn lại của cửa sổ 64.000 token; max_tokens tùy chọn (không giới hạn riêng)
Chế độ JSONresponse_format: {"type": "json_object"}
Streamingcó — server-sent events; phần cuối chứa lượng token đã dùng
Gọi hàmcó — tools, tool_choice; phản hồi có tool_calls, kể cả khi streaming; kết quả gửi lại bằng role: tool
Cửa sổ ngữ cảnh64.000 token (đầu vào + đầu ra)
Giới hạn tốc độ300 yêu cầu mỗi phút cho mỗi khóa
Kích thước yêu cầutối đa 8 MB
Header phản hồiX-Request-Id, X-Balance-USD, X-RateLimit-Limit-Requests, X-RateLimit-Limit-Concurrency
Yêu cầu đồng thờitối đa 8 cùng lúc cho mỗi khóa
Thời hạntín dụng đã trả không hết hạn, không đăng ký định kỳ
Thưởng+5% từ $50, +10% từ $100
Tính phítín dụng trả trước theo mức dùng thực tế; lỗi và từ chối miễn phí
Dùng thử miễn phí$0,50 trong 7 ngày, không cần thẻ · Khóa dùng thử: 2 yêu cầu song song, 60 yêu cầu/phút; hạn mức đầy đủ (8 và 300) sau lần nạp đầu
Giá$0,25 cho 1 triệu token đầu vào · $1,00 cho 1 triệu token đầu ra
Nạp tiềnUSDT (TRC20) hoặc USDC (Base), số tiền nguyên bất kỳ từ $10 đến $500
Khóamỗi tài khoản một khóa đang hoạt động; khóa mới thay thế khóa cũ
Nội dungcho phép nội dung người lớn; từ chối nội dung tình dục liên quan đến trẻ vị thành niên
Đăng nhậpGoogle hoặc email và mật khẩu

Mã lỗi

Lỗi trả về dạng JSON với type cố định; yêu cầu lỗi hoặc bị từ chối không bị tính phí.

MãLoạiÝ nghĩa
400bad_requestJSON sai, tin nhắn trống, tham số sai hoặc vượt cửa sổ ngữ cảnh
401missing_key · invalid_key · key_revokedthiếu khóa, sai khóa hoặc khóa đã bị thay
402no_credithết tín dụng — nạp tiền là dùng tiếp ngay
403content_blockednội dung tình dục liên quan trẻ vị thành niên — từ chối, không tính phí
404not_foundendpoint không tồn tại
413request_too_largenội dung lớn hơn 8 MB
429rate_limited · concurrencyvượt 300/phút hoặc 8 đồng thời — chờ rồi thử lại
503upstream_busymô hình đang bận — thử lại sau vài giây

Câu hỏi thường gặp

Sự khác biệt giữa mô hình này và GPT hay Claude là gì?

Mô hình của chúng tôi là mã nguồn mở, chạy trên phần cứng riêng và không sử dụng prompt của bạn để huấn luyện các mô hình khác. Nó được cấu hình cụ thể để không từ chối nội dung người dùng trưởng thành hợp pháp, khác với các mô hình tiêu chuẩn của OpenAI hoặc Anthropic. Đây không phải là phiên bản của GPT hay Claude.

Điều gì xảy ra nếu tôi vượt quá giới hạn tốc độ?

Nếu bạn vượt quá 300 yêu cầu mỗi phút, bạn sẽ nhận được lỗi HTTP 429 (Quá nhiều yêu cầu). Thân phản hồi sẽ cho biết giới hạn đã vượt quá. Hãy giảm tần suất gọi hoặc đợi cửa sổ 60 giây được đặt lại.

Cơ chế chặn nội dung hoạt động như thế nào?

Mô hình là 'không kiểm duyệt' đối với nội dung người dùng trưởng thành, chính trị và gây tranh cãi, nhưng duy trì một giới hạn nghiêm ngặt: nội dung tình dục liên quan đến trẻ vị thành niên luôn bị chặn. Chúng tôi không khuyến khích sử dụng bất hợp pháp, nhưng không áp dụng các bộ lọc đạo đức tiêu chuẩn cho người dùng trưởng thành.

Khóa của bạn chỉ cách một bước đăng ký

Tạo tài khoản, sao chép khóa và thay đổi URL base. Đó là toàn bộ cấu hình.

Lấy khóa APIhttps://api.llmsemcensura.com/v1