Hoe kies je een private LLM API voor onbeperkte AI-projecten
Een private LLM API biedt een dedicated, ongecensureerd tekstendpoint dat derde partij inhoudsfilters en abonnementsvergrendelingen elimineert, waardoor ontwikkelaars volledige controle krijgen over modelgedrag en gegevensprivacy. Deze gids legt uit hoe je ongecensureerde LLM API's kunt evalueren voor NSFW- en onbeperkte AI-projecten, met focus op privacybeleid, OpenAI-compatibiliteit en transparante pay-as-you-go prijzen.
Bijgewerkt
Belangrijkste punten
- Een private LLM API zorgt ervoor dat je prompts niet worden gebruikt voor het trainen van andere modellen, waardoor de gegevensgeheimhouding voor gevoelige NSFW- of commerciële toepassingen behouden blijft.
- Ongecensureerde modellen verwijderen willekeurige weigeringen voor wettelijke volwassen inhoud, controversiële onderwerpen en creatief schrijven zonder dat complexe omwegen nodig zijn.
- Pay-as-you-go prijzen met prepaid tegoed elimineren maandelijkse abonnementskosten en kosten voor ongebruikte capaciteit, wat voorspelbare kosten biedt voor variabele gebruikspatronen.
- OpenAI-compatibele endpoints stellen je in staat om van commerciële aanbieders over te schakelen op ongecensureerde modellen met minimale codeaanpassingen, met ondersteuning voor streaming en tool calling.
Wat is een private LLM API?
Een private LLM API is een gehoste service die een large language model blootlegt via een standaardinterface, meestal compatibel met de structuur van OpenAI. In tegenstelling tot gedeelde publieke instanties of lokale runners, biedt een private API dedicated compute resources voor je verzoeken. Deze isolatie zorgt voor consistente prestaties en latentie, wat cruciaal is voor toepassingen die betrouwbare reactietijden nodig hebben.
De term 'private' verwijst in deze context primair naar gegevensverwerking en toegangscontrole. Wanneer je een private LLM API gebruikt, verifieert je API-sleutel je verzoeken, en de serviceprovider verbindt zich ertoe je invoergegevens niet te gebruiken voor het trainen van hun algemene modellen. Dit verschilt van gratis of gedeelde tiers waar je prompts mogelijk bijdragen aan de weights van het basismodel.
Voor ontwikkelaars die NSFW- of onbeperkte AI-toepassingen bouwen, elimineert een private API de wrijving van het vechten tegen inhoudsfilters. In plaats van '403 Forbidden' reacties te ontvangen voor wettelijke volwassen inhoud, krijg je consistente tekstuitvoer. De API fungeert als een pure geleider: tekst in, tekst uit. Deze eenvoud vermindert de complexiteit van debugging omdat je geen lokale GPU-drivers of modelversies hoeft te beheren. Je wijst je client gewoon naar de API URL en stuurt verzoeken.
Waarom 'ongecensureerd' belangrijk is voor NSFW-projecten
De meeste commerciële LLM's zijn afgestemd met Reinforcement Learning from Human Feedback (RLHF) om 'behulpzaam, onschuldig en eerlijk' te zijn. Dit resulteert vaak in overgevoelige inhoudsfilters die weigeren erotische fictie te genereren, politieke controverses te bespreken of beveiligingskwetsbaarheden te analyseren. Een ongecensureerde LLM API verwijdert deze kunstmatige beperkingen. Het model is afgestemd om zonder inhoudsweigeringen te antwoorden voor wettelijk volwassen gebruik, waardoor je toepassingen kunt bouwen die elk onderwerp kunnen afhandelen zonder onverwachte blokkades.
Het is belangrijk op te merken dat 'ongecensureerd' niet 'onbeperkt' betekent. De meeste providers, waaronder deze service, handhaven een harde inhoudslimiet: seksuele inhoud met minderjarigen wordt geblokkeerd. Dit is een standaard juridische waarborg. Daarbovenop zal het inhoud genereren die door standaard classifers als flagbaar wordt beschouwd, waaronder expliciete beschrijvingen, controversiële meningen of creatieve NSFW-verhalen.
Voor makers betekent dit dat je een chatbot of story generator kunt bouwen die zich echt gedraagt zoals de gebruiker verwacht, zonder dat het model plotseling besluit dat het 'ongepast' is om een romantische scène te beschrijven. Het ongecensureerde model ondersteunt een breder scala aan creatieve en volwassen gerichte use cases, waardoor het ideaal is voor NSFW chatbot API's, volwassen gaming NPCs en onbeperkte content generatietools.
Privacy: Gegevensgebruik en trainingsbeleid
Wanneer je gegevens naar een LLM stuurt, gebeuren twee dingen: het model genereert een reactie en de gegevens worden opgeslagen of gebruikt. In een publieke API kunnen je prompts voor een korte periode worden opgeslagen voor debugging of worden gebruikt om toekomstige modelversies te trainen. In een private LLM API is het privacybeleid vaak explicieter. Onze service zorgt ervoor dat prompts niet worden gebruikt voor training. Je gegevens blijven van jou.
Accountaanmaak vereist alleen een e-mailadres en wachtwoord. Er is geen telefoonnummer of creditcard nodig voor de trial tier. Dit vermindert de hoeveelheid personally identifiable information (PII) die je deelt met de provider. De API-sleutel is de enige identifier voor je gebruik. Je kunt deze op elk moment regenereren, waardoor de oude sleutel direct ongeldig wordt, wat een eenvoudig beveiligingsmodel biedt zonder complexe permission scopes.
Voor NSFW-projecten is privacy vaak een primaire zorg. Gebruikers kunnen gevoelige persoonlijke verhalen of voorkeuren delen. Het weten dat je API-provider niet op je gegevens traint, betekent dat de interacties van je gebruikers vertrouwelijk blijven. Dit is een belangrijk onderscheidend vermogen ten opzichte van grote techbedrijven die gebruikersgegevens gebruiken om hun kernmodellen te verbeteren. Met een private API behoud je volledige controle over je data lineage.
OpenAI-compatibiliteit vs. propriëtaire SDKs
OpenAI-compatibiliteit betekent dat de API de standaard JSON-schema volgt dat wordt gebruikt door het Chat Completions endpoint van OpenAI. Dit stelt je in staat om de officiële OpenAI SDKs of elke client die het OpenAI-formaat ondersteunt, te gebruiken. Je hoeft alleen de base URL en de API-sleutel in je configuratie te wijzigen. Dit vermindert de integratie-inspanning aanzienlijk. Als je bestaande code hebt gebouwd voor GPT-4, kun je met minimale wijzigingen overschakelen op een ongecensureerd model.
Propriëtaire SDKs, zoals die voor Anthropic of Google, vereisen vaak specifieke bibliotheken en behandelen streaming of tool calling op unieke manieren. Met een OpenAI-compatibele API gebruik je een enkele codebase voor meerdere modellen. Dit is cruciaal voor ontwikkelaars die modellen willen wisselen op basis van kosten of prestaties zonder hun hele applicatielaag te herschrijven.
Onze API ondersteunt streaming via Server-Sent Events (SSE) en tool/function calling. Dit zijn standaardfuncties in het OpenAI-schema. Streaming stelt je in staat om tokens naar de gebruiker te sturen zodra ze worden gegenereerd, wat de waargenomen latentie verbetert. Tool calling stelt het model in staat om functies uit te voeren, wat essentieel is voor het bouwen van AI agents. Beide functies werken binnen de standaard compatibiliteitslaag, zodat je geen functionaliteit verliest door over te schakelen op een ongecensureerde provider.
Contextvensters en tokenkosten begrijpen
Het contextvenster bepaalt hoeveel tekst het model in een enkel gesprek kan onthouden. Een contextvenster van 100.000 tokens staat substantiële geschiedenis toe, waardoor complexe multi-turn dialoog of het verwerken van grote documenten mogelijk is. Dit is aanzienlijk groter dan de 8.000-token limiet van oudere modellen, waardoor meer coherente interacties op lange termijn mogelijk zijn.
Tokenkosten worden berekend per miljoen tokens. Input tokens zijn de tekst die je stuurt (prompt), en output tokens zijn de tekst die het model genereert (completion). In ons prijsmodel kosten input tokens $0,25 per 1M tokens, en output tokens kosten $1,00 per 1M tokens. Dit betekent dat het genereren van tekst vier keer zo duur is als het lezen ervan, wat gebruikelijk is voor transformer-based modellen.
Bij het schatten van kosten moet je rekening houden met het feit dat een lang gesprek met een groot contextvenster snel input tokens verbruikt. Als je een chatbot bouwt die volledige geschiedenis onthoudt, zullen je inputkosten stijgen. Pay-as-you-go prijzen betekenen echter dat je alleen betaalt voor wat je gebruikt. Er zijn geen maandelijkse kosten voor het reserveren van capaciteit. Je kunt de API op elk moment stoppen gebruiken en niets verschuldigd zijn.
Pay-As-You-Go vs. abonnementsmodellen
Abonnementsmodellen rekenen een vaste maandelijkse prijs voor een bepaald aantal verzoeken of tokens. Als je je toewijzing niet gebruikt, verlies je de waarde. Als je deze overschrijdt, betaal je overage fees. Pay-as-you-go (PAYG) rekent alleen voor daadwerkelijk gebruik. Onze API gebruikt een prepaid credit systeem. Je voegt geld toe en je saldo daalt naarmate je verzoeken doet. Prepaid tegoed verloopt nooit.
Voor variabele gebruikspatronen is PAYG efficiënter. Als je project pieken in verkeer heeft, hoef je niet direct over te schakelen naar een hoger tier. Je zorgt er gewoon voor dat je prepaid saldo voldoende is. Als het gebruik daalt, betaal je niet voor idle capaciteit. Dit is ideaal voor indie ontwikkelaars, startups of makers die hun modellen testen voordat ze zich committeren aan grotere infrastructuur.
We bieden ook bonus credits voor grotere top-ups. Het toevoegen van $50 geeft je een +5% bonus, en het toevoegen van $100 geeft je een +10% bonus. Dit vermindert de effectieve kosten per token. Er zijn geen verborgen kosten of overage policies. Je verzoeken worden verwerkt zolang je credit saldo de tokenkosten dekt. Deze transparantie maakt budgettering eenvoudig.
Technische vereisten: streaming en tool calling
Streaming is essentieel voor een goede gebruikerservaring. In plaats van te wachten tot de volledige reactie is gegenereerd, stuurt de API chunks van tekst zodra ze worden geproduceerd. Dit vermindert de waargenomen latentie en stelt gebruikers in staat direct te beginnen met lezen. Onze API ondersteunt streaming via Server-Sent Events (SSE), wat de standaard is voor OpenAI-compatibele clients.
Tool calling (of function calling) stelt het model in staat gestructureerde gegevens uit te brengen die je applicatie kan uitvoeren. Het model kan bijvoorbeeld besluiten de functie 'get_weather' aan te roepen. De API retourneert een JSON-object met de functienaam en argumenten. Je code voert de functie uit en stuurt het resultaat terug naar het model voor een definitief antwoord. Dit is essentieel voor het bouwen van AI-agents die met externe systemen kunnen communiceren.
Beide functies zijn beschikbaar via de standaard POST /v1/chat/completions endpoint. Je hebt geen speciale headers of parameters nodig naast het standaard OpenAI-schema. Dit zorgt ervoor dat je integratie draagbaar blijft. Als je in de toekomst van provider wilt wisselen, blijft de codestructuur hetzelfde.
De API in je stack integreren
Integratie is eenvoudig als je applicatie een OpenAI-compatible client gebruikt. Je hebt twee onderdelen nodig: de base URL en je API-sleutel. De base URL voor onze API is https://api.anonymousllmapi.com/v1. De model ID is uncensored.
Voor Python-gebruikers kun je de openai bibliotheek installeren en de client configureren. Het onderstaande codevoorbeeld toont hoe je de base URL instelt en een verzoek doet.
from openai import OpenAI
client = OpenAI(base_url="https://api.anonymousllmapi.com/v1", api_key="YOUR_KEY")
resp = client.chat.completions.create(
model="uncensored",
messages=[{"role": "user", "content": "Summarise this thread without softening it."}],
)
print(resp.choices[0].message.content)Voor Node.js-gebruikers is het proces vergelijkbaar. Je stelt de baseURL in de configuratie in. Het onderstaande codevoorbeeld toont dit.
import OpenAI from "openai";
const client = new OpenAI({ baseURL: "https://api.anonymousllmapi.com/v1", apiKey: process.env.API_KEY });
const resp = await client.chat.completions.create({
model: "uncensored",
messages: [{ role: "user", content: "Draft a villain monologue for my game." }],
});
console.log(resp.choices[0].message.content);Voor snelle tests kun je curl gebruiken om een verzoek rechtstreeks naar de endpoint te sturen. Dit is handig voor foutopsporing of het verifiëren van de verbinding.
curl https://api.anonymousllmapi.com/v1/chat/completions \
-H "Authorization: Bearer $API_KEY" \
-H "Content-Type: application/json" \
-d '{
"model": "uncensored",
"messages": [{"role": "user", "content": "Write a blunt product review of a cheap VPN."}]
}'Deze voorbeelden gaan ervan uit dat je de officiële bibliotheken gebruikt. Als je een andere client gebruikt, controleer dan of deze aangepaste base URLs ondersteunt. De API-sleutel wordt direct na je aanmelding verstrekt. Er is geen creditcard nodig voor de trial, die $0,50 aan tegoed omvat, geldig voor 7 dagen.
Definitieve checklist voor het selecteren van een ongecensureerde API
Voordat je een API kiest, controleer je de volgende criteria om zeker te weten dat deze voldoet aan de behoeften van je project:
- Privacybeleid: Controleer of prompts niet worden gebruikt voor training. Onze service gebruikt je gegevens niet voor training.
- Content Filters: Zorg dat het model wettelijk toegestaan volwassen inhoud toelaat. Ons model is afgestemd op ongekensureerde antwoorden.
- Prijsmodel: Geef de voorkeur aan pay-as-you-go boven abonnementen voor variabel gebruik. Ons prepaid tegoed vervalt nooit.
- Compatibiliteit: Controleer de OpenAI-compatibiliteit voor eenvoudige integratie. Onze API ondersteunt standaard endpoints.
- Rate Limits: Controleer het limiet voor verzoeken per minuut. Ons limiet is 300 verzoeken per minuut per sleutel.
- Contextvenster: Zorg ervoor dat het contextvenster voldoende is voor je use case. Ons model ondersteunt 100.000 tokens.
Door deze checklist te volgen, voorkom je veelvoorkomende valkuilen en kies je een API die technisch robuust is en aansluit bij je privacy- en inhoudsvereisten.
Vragen en antwoorden
Is het ongecensureerde model hetzelfde als GPT-4 of Claude?
Nee. Het model is een open-weight model dat op onze eigen GPU-servers draait. Het is geen GPT, Claude, Gemini, Grok of een model van een andere leverancier. Het is afgestemd op antwoorden zonder inhoudsbeperkingen voor wettelijk toegestaan volwassen gebruik.
Hoe begin ik met de API?
Meld je aan op de pagina 'API-sleutel ophalen' met een e-mailadres en wachtwoord. Je ontvangt direct een API-sleutel. Je kunt beginnen met $0,50 aan proeftegoed dat 7 dagen geldig is, geen creditcard nodig. Voor doorlopend gebruik kun je opwaarderen met crypto (USDT of USDC).
Wat zijn de rate limits?
Het limiet is 300 verzoeken per minuut per sleutel. De grootte van het request body is beperkt tot 8 MB. Je kunt je sleutel op elk moment opnieuw genereren, waardoor de oude ongeldig wordt.
Ondersteunt de API streaming en tool calling?
Ja. De API ondersteunt streaming via Server-Sent Events (SSE) en tool-/function calling via de standaard <code>POST /v1/chat/completions</code> endpoint. Dit is compatibel met officiële OpenAI SDKs.
Je sleutel is nog maar één formulier verwijderd
Maak een account aan, kopieer de sleutel, pas de base URL aan. Dat is de hele configuratie.