Cách chọn API LLM riêng cho dự án AI không giới hạn
API LLM riêng cung cấp một endpoint văn bản không kiểm duyệt chuyên dụng, loại bỏ bộ lọc nội dung của bên thứ ba và khóa đăng ký, giúp nhà phát triển kiểm soát hoàn toàn hành vi của mô hình và quyền riêng tư dữ liệu. Hướng dẫn này giải thích cách đánh giá các API LLM không kiểm duyệt cho các dự án NSFW và AI không giới hạn, tập trung vào chính sách quyền riêng tư, khả năng tương thích với OpenAI và giá cả minh bạch theo mức sử dụng.
Cập nhật
Điểm chính
- API LLM riêng đảm bảo prompt của bạn không được sử dụng để huấn luyện các mô hình khác, bảo toàn tính bảo mật dữ liệu cho các ứng dụng NSFW hoặc thương mại nhạy cảm.
- Các mô hình không kiểm duyệt loại bỏ việc từ chối tùy tiện đối với nội dung người lớn hợp pháp, các chủ đề gây tranh cãi và văn học sáng tạo mà không cần các giải pháp thay thế phức tạp.
- Giá theo mức sử dụng với tín dụng trả trước loại bỏ phí đăng ký hàng tháng và chi phí dung lượng không sử dụng, mang lại chi phí dự đoán được cho mức sử dụng biến động.
- Các endpoint tương thích với OpenAI cho phép bạn chuyển từ nhà cung cấp thương mại sang các mô hình không kiểm duyệt với ít thay đổi mã nhất, hỗ trợ truyền phát và gọi hàm.
API LLM riêng là gì?
Một API LLM riêng là dịch vụ được lưu trữ, cung cấp mô hình ngôn ngữ lớn thông qua giao diện tiêu chuẩn, thường tương thích với cấu trúc của OpenAI. Khác với các phiên bản công cộng chia sẻ hoặc trình chạy cục bộ, API riêng cung cấp tài nguyên tính toán dành riêng cho các yêu cầu của bạn. Sự cô lập này đảm bảo hiệu suất và độ trễ ổn định, điều rất quan trọng đối với các ứng dụng cần thời gian phản hồi đáng tin cậy.
Thuật ngữ 'riêng' trong ngữ cảnh này chủ yếu đề cập đến việc xử lý dữ liệu và kiểm soát truy cập. Khi bạn sử dụng API LLM riêng, khóa API của bạn xác thực các yêu cầu và nhà cung cấp dịch vụ cam kết không sử dụng dữ liệu đầu vào của bạn để huấn luyện các mô hình chung của họ. Điều này khác với các gói miễn phí hoặc chia sẻ nơi prompt của bạn có thể đóng góp vào trọng số của mô hình cơ sở.
Đối với các nhà phát triển xây dựng các ứng dụng AI NSFW hoặc không giới hạn, API riêng loại bỏ sự phức tạp khi phải đối phó với bộ lọc nội dung. Thay vì nhận phản hồi '403 Forbidden' cho nội dung người lớn hợp pháp, bạn nhận được đầu ra văn bản ổn định. API đóng vai trò là một kênh dẫn thuần túy: văn bản vào, văn bản ra. Sự đơn giản này giảm độ phức tạp khi gỡ lỗi vì bạn không cần quản lý trình điều khiển GPU cục bộ hay phiên bản mô hình. Bạn chỉ cần trỏ máy khách của mình đến URL API và gửi các yêu cầu.
Tại sao 'Không kiểm duyệt' quan trọng đối với dự án NSFW
Hầu hết các LLM thương mại được tinh chỉnh bằng Học tăng cường từ phản hồi của con người (RLHF) để trở nên 'hữu ích, vô hại và trung thực'. Điều này thường dẫn đến các bộ lọc nội dung nhạy cảm quá mức, từ chối tạo tiểu thuyết khiêu dâm, thảo luận về các tranh cãi chính trị hoặc phân tích các lỗ hổng bảo mật. API LLM không kiểm duyệt loại bỏ các ràng buộc nhân tạo này. Mô hình được tinh chỉnh để trả lời mà không từ chối nội dung cho mục đích người lớn hợp pháp, cho phép bạn xây dựng các ứng dụng có thể xử lý mọi chủ đề mà không có các chặn không mong đợi.
Điều quan trọng cần lưu ý là 'không kiểm duyệt' không có nghĩa là 'không giới hạn'. Hầu hết các nhà cung cấp, bao gồm dịch vụ này, duy trì một giới hạn nội dung cứng: nội dung tình dục liên quan đến trẻ em bị chặn. Đây là một biện pháp bảo vệ pháp lý tiêu chuẩn. Ngoài ra, mô hình sẽ tạo ra nội dung có thể bị các bộ phân loại tiêu chuẩn đánh dấu, bao gồm các mô tả rõ ràng, ý kiến gây tranh cãi hoặc các câu chuyện NSFW sáng tạo.
Đối với người sáng tạo, điều này có nghĩa là bạn có thể xây dựng một bot trò chuyện hoặc trình tạo câu chuyện thực sự hoạt động như người dùng mong đợi, mà không cần mô hình đột nhiên quyết định rằng nó là 'không phù hợp' để mô tả một cảnh lãng mạn. Mô hình không kiểm duyệt hỗ trợ một phạm vi rộng hơn các trường hợp sử dụng sáng tạo và dành cho người lớn, khiến nó lý tưởng cho các API bot trò chuyện NSFW, NPC trò chơi người lớn và các công cụ tạo nội dung không giới hạn.
Quyền riêng tư: Chính sách sử dụng dữ liệu và huấn luyện
Khi bạn gửi dữ liệu đến LLM, hai điều xảy ra: mô hình tạo ra phản hồi và dữ liệu được lưu trữ hoặc sử dụng. Trong một API công cộng, prompt của bạn có thể được lưu trữ trong một thời gian ngắn để gỡ lỗi hoặc được sử dụng để huấn luyện các phiên bản mô hình trong tương lai. Trong API LLM riêng, chính sách quyền riêng tư thường rõ ràng hơn. Dịch vụ của chúng tôi đảm bảo rằng các prompt không được sử dụng để huấn luyện. Dữ liệu của bạn vẫn thuộc về bạn.
Tạo tài khoản chỉ yêu cầu email và mật khẩu. Không cần số điện thoại hoặc thẻ tín dụng cho gói dùng thử. Điều này làm giảm lượng thông tin nhận dạng cá nhân (PII) mà bạn chia sẻ với nhà cung cấp. Khóa API là định danh duy nhất cho việc sử dụng của bạn. Bạn có thể tạo lại nó bất cứ lúc nào, điều này sẽ thu hồi ngay lập tức khóa cũ, cung cấp một mô hình bảo mật đơn giản mà không cần các phạm vi quyền phức tạp.
Đối với các dự án NSFW, quyền riêng tư thường là mối quan tâm chính. Người dùng có thể chia sẻ những câu chuyện cá nhân hoặc sở thích nhạy cảm. Việc biết rằng nhà cung cấp API của bạn không huấn luyện trên dữ liệu của bạn có nghĩa là các tương tác của người dùng vẫn được bảo mật. Đây là một điểm khác biệt chính so với các công ty công nghệ lớn sử dụng dữ liệu người dùng để cải thiện các mô hình cốt lõi của họ. Với API riêng, bạn giữ toàn quyền kiểm soát dòng dữ liệu của mình.
Khả năng tương thích với OpenAI so với SDK độc quyền
Khả năng tương thích với OpenAI có nghĩa là API tuân theo lược đồ JSON tiêu chuẩn được sử dụng bởi endpoint Chat Completions của OpenAI. Điều này cho phép bạn sử dụng các SDK chính thức của OpenAI hoặc bất kỳ máy khách nào hỗ trợ định dạng OpenAI. Bạn chỉ cần thay đổi URL cơ sở và khóa API trong cấu hình của mình. Điều này làm giảm đáng kể nỗ lực tích hợp. Nếu bạn có mã hiện có được xây dựng cho GPT-4, bạn có thể chuyển sang mô hình không kiểm duyệt với những thay đổi tối thiểu.
Các SDK độc quyền, như của Anthropic hoặc Google, thường yêu cầu các thư viện cụ thể và xử lý truyền phát hoặc gọi hàm theo những cách độc đáo. Với API tương thích với OpenAI, bạn sử dụng một cơ sở mã duy nhất cho nhiều mô hình. Điều này rất quan trọng đối với các nhà phát triển muốn hoán đổi mô hình dựa trên chi phí hoặc hiệu suất mà không cần viết lại toàn bộ lớp ứng dụng của họ.
API của chúng tôi hỗ trợ truyền phát qua Sự kiện gửi qua máy chủ (SSE) và gọi hàm/chức năng. Đây là các tính năng tiêu chuẩn trong lược đồ OpenAI. Truyền phát cho phép bạn gửi token cho người dùng khi chúng được tạo, cải thiện độ trễ cảm nhận. Gọi hàm cho phép mô hình thực hiện các chức năng, điều rất cần thiết để xây dựng các đại lý AI. Cả hai tính năng đều hoạt động trong lớp tương thích tiêu chuẩn, đảm bảo bạn không mất chức năng khi chuyển sang nhà cung cấp không kiểm duyệt.
Hiểu về cửa sổ ngữ cảnh và chi phí token
Cửa sổ ngữ cảnh xác định lượng văn bản mà mô hình có thể ghi nhớ trong một cuộc hội thoại duy nhất. Cửa sổ ngữ cảnh 100.000 token cho phép lưu trữ lịch sử đáng kể, hỗ trợ các cuộc hội thoại đa lượt phức tạp hoặc xử lý tài liệu lớn. Điều này lớn hơn đáng kể so với giới hạn 8.000 token của các mô hình cũ, cho phép các tương tác dài hạn mạch lạc hơn.
Chi phí token được tính trên mỗi triệu token. Token đầu vào là văn bản bạn gửi (prompt), và token đầu ra là văn bản mô hình tạo ra (completion). Trong mô hình giá của chúng tôi, token đầu vào có giá $0.25 trên 1 triệu token, và token đầu ra có giá $1.00 trên 1 triệu token. Điều này có nghĩa là tạo văn bản đắt hơn bốn lần so với việc đọc nó, điều này là điển hình đối với các mô hình dựa trên bộ chuyển đổi.
Khi ước tính chi phí, hãy xem xét rằng một cuộc trò chuyện dài với cửa sổ ngữ cảnh lớn sẽ tiêu thụ token đầu vào nhanh chóng. Nếu bạn đang xây dựng một bot trò chuyện giữ toàn bộ lịch sử, chi phí đầu vào của bạn sẽ tăng lên. Tuy nhiên, giá theo mức sử dụng có nghĩa là bạn chỉ trả tiền cho những gì bạn sử dụng. Không có phí hàng tháng để đặt trước dung lượng. Bạn có thể ngừng sử dụng API bất cứ lúc nào và không nợ gì.
Thanh toán theo mức sử dụng so với mô hình đăng ký
Các mô hình đăng ký tính phí cố định hàng tháng cho một số lượng yêu cầu hoặc token nhất định. Nếu bạn không sử dụng khoản phân bổ của mình, bạn sẽ mất giá trị. Nếu bạn vượt quá nó, bạn sẽ trả phí quá hạn. Thanh toán theo mức sử dụng (PAYG) chỉ tính phí cho việc sử dụng thực tế. API của chúng tôi sử dụng hệ thống tín dụng trả trước. Bạn thêm tiền và số dư của bạn giảm khi bạn thực hiện yêu cầu. Tín dụng trả trước không bao giờ hết hạn.
Đối với các mẫu sử dụng biến động, PAYG hiệu quả hơn. Nếu dự án của bạn có các đỉnh lưu lượng truy cập, bạn không cần phải nâng cấp lên gói cao hơn ngay lập tức. Bạn chỉ cần đảm bảo số dư tín dụng trả trước của bạn là đủ. Nếu việc sử dụng giảm, bạn không phải trả tiền cho dung lượng nhàn rỗi. Điều này rất lý tưởng cho các nhà phát triển độc lập, công ty khởi nghiệp hoặc người sáng tạo đang kiểm tra các mô hình của họ trước khi cam kết với cơ sở hạ tầng lớn hơn.
Chúng tôi cũng cung cấp tín dụng bổ sung cho các khoản nạp tiền lớn. Thêm $50 cho bạn bonus +5%, và thêm $100 cho bạn bonus +10%. Điều này giảm chi phí hiệu dụng trên mỗi token. Không có phí ẩn hoặc chính sách quá hạn. Các yêu cầu của bạn sẽ được xử lý miễn là số dư tín dụng của bạn đủ để chi trả chi phí token. Sự minh bạch này giúp việc lập ngân sách trở nên đơn giản.
Yêu cầu kỹ thuật: Truyền phát và gọi hàm
Truyền phát rất quan trọng đối với trải nghiệm người dùng tốt. Thay vì chờ đợi toàn bộ phản hồi được tạo, API gửi các đoạn văn bản khi chúng được tạo. Điều này làm giảm độ trễ cảm nhận và cho phép người dùng bắt đầu đọc ngay lập tức. API của chúng tôi hỗ trợ truyền phát qua Sự kiện gửi qua máy chủ (SSE), đây là tiêu chuẩn cho các máy khách tương thích với OpenAI.
Gọi hàm (hoặc gọi chức năng) cho phép mô hình xuất dữ liệu có cấu trúc mà ứng dụng của bạn có thể thực thi. Ví dụ, mô hình có thể quyết định gọi hàm 'get_weather'. API trả về một đối tượng JSON với tên hàm và các đối số. Mã của bạn thực thi hàm và gửi kết quả trở lại mô hình để có câu trả lời cuối cùng. Điều này rất quan trọng để xây dựng các đại lý AI có thể tương tác với các hệ thống bên ngoài.
Cả hai tính năng đều có sẵn thông qua endpoint tiêu chuẩn POST /v1/chat/completions. Bạn không cần các tiêu đề hoặc tham số đặc biệt nào ngoài lược đồ OpenAI tiêu chuẩn. Điều này đảm bảo rằng việc tích hợp của bạn vẫn di động được. Nếu bạn cần chuyển nhà cung cấp trong tương lai, cấu trúc mã vẫn giống nhau.
Cách tích hợp API vào hệ thống của bạn
Việc tích hợp rất đơn giản nếu ứng dụng của bạn sử dụng máy khách tương thích với OpenAI. Bạn cần hai thông tin: URL cơ sở và khóa API của bạn. URL cơ sở cho API của chúng tôi là https://api.anonymousllmapi.com/v1. ID mô hình là uncensored.
Đối với người dùng Python, bạn có thể cài đặt thư viện openai và định cấu hình máy khách. Mẫu mã bên dưới cho thấy cách đặt URL cơ sở và thực hiện yêu cầu.
from openai import OpenAI
client = OpenAI(base_url="https://api.anonymousllmapi.com/v1", api_key="YOUR_KEY")
resp = client.chat.completions.create(
model="uncensored",
messages=[{"role": "user", "content": "Summarise this thread without softening it."}],
)
print(resp.choices[0].message.content)Đối với người dùng Node.js, quy trình tương tự. Bạn đặt baseURL trong cấu hình. Mẫu mã bên dưới minh họa điều này.
import OpenAI from "openai";
const client = new OpenAI({ baseURL: "https://api.anonymousllmapi.com/v1", apiKey: process.env.API_KEY });
const resp = await client.chat.completions.create({
model: "uncensored",
messages: [{ role: "user", content: "Draft a villain monologue for my game." }],
});
console.log(resp.choices[0].message.content);Để kiểm tra nhanh, bạn có thể sử dụng curl để gửi yêu cầu trực tiếp đến endpoint. Điều này hữu ích cho việc gỡ lỗi hoặc xác minh kết nối.
curl https://api.anonymousllmapi.com/v1/chat/completions \
-H "Authorization: Bearer $API_KEY" \
-H "Content-Type: application/json" \
-d '{
"model": "uncensored",
"messages": [{"role": "user", "content": "Write a blunt product review of a cheap VPN."}]
}'Các ví dụ này giả định bạn đang sử dụng các thư viện chính thức. Nếu bạn sử dụng máy khách khác, hãy đảm bảo nó hỗ trợ URL cơ sở tùy chỉnh. Khóa API được cung cấp ngay sau khi đăng ký. Không cần thẻ cho gói dùng thử, bao gồm $0.50 tín dụng có hiệu lực trong 7 ngày.
Danh sách kiểm tra cuối cùng để chọn API không kiểm duyệt
Trước khi cam kết sử dụng một API, hãy xác minh các tiêu chí sau để đảm bảo nó đáp ứng nhu cầu của dự án của bạn:
- Chính sách quyền riêng tư: Xác nhận rằng các prompt không được sử dụng để huấn luyện. Dịch vụ của chúng tôi không sử dụng dữ liệu của bạn để huấn luyện.
- Bộ lọc nội dung: Đảm bảo mô hình cho phép nội dung người lớn hợp pháp. Mô hình của chúng tôi được tinh chỉnh để đưa ra phản hồi không kiểm duyệt.
- Mô hình giá: Ưu tiên trả theo nhu cầu thay vì đăng ký để phù hợp với nhu cầu sử dụng biến đổi. Tín dụng trả trước của bạn không bao giờ hết hạn.
- Tương thích: Xác minh tính tương thích với OpenAI để tích hợp dễ dàng. API của chúng tôi hỗ trợ các endpoint tiêu chuẩn.
- Giới hạn tốc độ: Kiểm tra giới hạn số lượng yêu cầu mỗi phút. Giới hạn của chúng tôi là 300 yêu cầu mỗi phút trên mỗi khóa.
- Cửa sổ ngữ cảnh: Đảm bảo cửa sổ ngữ cảnh đủ lớn cho trường hợp sử dụng của bạn. Mô hình của chúng tôi hỗ trợ 100.000 token.
Bằng cách làm theo danh sách kiểm tra này, bạn có thể tránh những sai lầm phổ biến và chọn một API vừa mạnh mẽ về mặt kỹ thuật vừa phù hợp với yêu cầu về quyền riêng tư và nội dung của bạn.
Hỏi đáp
Mô hình không kiểm duyệt có giống với GPT-4 hay Claude không?
Không. Mô hình là một mô hình trọng số mở được lưu trữ trên các máy chủ GPU của riêng chúng tôi. Nó không phải là GPT, Claude, Gemini, Grok hay bất kỳ mô hình của nhà cung cấp nào khác. Nó được tinh chỉnh để trả lời mà không từ chối nội dung cho mục đích người dùng hợp pháp.
Làm thế nào để bắt đầu sử dụng API?
Đăng ký trên trang 'Lấy khóa API' bằng email và mật khẩu. Bạn sẽ nhận được khóa API ngay lập tức. Bạn có thể bắt đầu với $0.50 tín dụng dùng thử miễn phí có hiệu lực trong 7 ngày, không cần thẻ. Để sử dụng liên tục, hãy nạp tiền bằng tiền điện tử (USDT hoặc USDC).
Giới hạn tốc độ là gì?
Giới hạn là 300 yêu cầu mỗi phút trên mỗi khóa. Kích thước thân yêu cầu được giới hạn ở 8 MB. Bạn có thể tạo lại khóa của mình bất cứ lúc nào, điều này sẽ thu hồi khóa cũ.
API có hỗ trợ truyền phát và gọi hàm không?
Có. API hỗ trợ truyền phát qua Server-Sent Events (SSE) và gọi công cụ/hàm thông qua endpoint tiêu chuẩn <code>POST /v1/chat/completions</code>. Điều này tương thích với các SDK chính thức của OpenAI.
Khóa của bạn chỉ cách một biểu mẫu
Tạo tài khoản, sao chép khóa, thay đổi URL cơ sở. Đó là toàn bộ quá trình thiết lập.