NSFW-Chat: Unzensierte LLM-API-Dokumentation
Integriere die unzensierte LLM-API in deine NSFW-Chat-Anwendung mit diesem Schnellstart-Guide. Sende Text an den Chat-Completions-Endpunkt und erhalte rohe, uneingeschränkte Modellantworten.
Base URL und Authentifizierung
Richte deinen OpenAI-kompatiblen Client auf die Base URL https://api.nsfwchat.top/v1 ein. Authentifiziere jede Anfrage, indem du deinen API-Schlüssel als Bearer-Token in den Authorization-Header einfügst. Du kannst diesen Schlüssel direkt nach der Anmeldung über Google oder E-Mail auf der Seite API-Schlüssel abrufen generieren. Der Schlüssel wird bei der Erstellung einmalig angezeigt, speichere ihn daher sicher. Dieser einzelne Schlüssel ist mit dem Prepaid-Guthaben und den Ratenlimits deines Kontos verknüpft.
Erste Anfrage
Sende eine Standard-Chat-Completions-Anfrage, um die Konnektivität und Antwortqualität zu testen. Verwende die Modell-ID uncensored, um auf das für erwachsene Inhalte optimierte Open-Weight-Modell zuzugreifen. Die API akzeptiert Texteingaben und gibt Text aus. Stelle sicher, dass dein Payload das messages-Array und das Feld model enthält. Dieser Basis-Aufruf überprüft, ob deine Authentifizierung und Basis-URL-Konfiguration korrekt sind, bevor du deine Anwendungslogik erstellst.
Python SDK-Integration
Verwende das offizielle OpenAI Python SDK, um mit der API zu interagieren. Setze die Umgebungsvariablen base_url und api_key oder übergebe sie direkt an den Client-Konstruktor. Rufe chat.completions.create mit dem Modell uncensored auf. Dieser Ansatz nutzt bestehenden Community-Code für NSFW-Chat-Anwendungen. Das SDK übernimmt Serialisierung und Fehleranalyse, sodass du dich auf Prompt Engineering und die Verwaltung des Nachrichtenverlaufs in deiner Python-Umgebung konzentrieren kannst.
Node SDK-Integration
Initialisiere für JavaScript- oder TypeScript-Anwendungen den OpenAI-Client mit deiner Basis-URL und deinem API-Schlüssel. Das Node-SDK ist standardmäßig asynchron und gibt Promises für alle API-Aufrufe zurück. Rufe chat.completions.create auf, um deinen Konversationsverlauf zu senden. Diese Integration ist ideal für Webserver oder Node-basierte Game-Backends, die nicht-blockierende E/A benötigen. Verarbeite das Antwortobjekt, um die Antwort des Assistenten zu extrahieren und deinen lokalen Status oder deine Datenbank zu aktualisieren.
Streaming-Antworten über SSE
Aktiviere das Streaming, indem du stream: true in deiner Anfrage setzt. Die API gibt Server-Sent Events (SSE) zurück, während das Modell Text generiert. Jeder Chunk enthält partielle Delta-Werte. Der letzte Chunk enthält die Token-Nutzungsstatistiken für die Anfrage. Diese Methode reduziert die wahrgenommene Latenz für Nutzer in NSFW-Chat-Schnittstellen, indem Text angezeigt wird, während er generiert wird. Verarbeite jedes Event in deinem Client, um die Benutzeroberfläche in Echtzeit zu aktualisieren.
Grenzen, Fehler und Kontextfenster
Das Kontextfenster unterstützt bis zu 100.000 Token für Prompt und Vervollständigung zusammen. Dein Anfragekörper darf 8 MB nicht überschreiten. Du bist auf 300 Anfragen pro Minute und 8 parallele Anfragen pro Schlüssel begrenzt. Wenn dein Prepaid-Guthaben aufgebraucht ist, lehnt die API weitere Anfragen ab. Authentifizierungsfehler geben einen 401-Fehler zurück, und Ratenlimits lösen eine 429-Antwort aus. Stelle sicher, dass deine Anwendung diese Fehler gracefully behandelt, um eine reibungslose Nutzererfahrung während hoher Traffic-Zeiten aufrechtzuerhalten.
cURL
curl https://api.nsfwchat.top/v1/chat/completions \
-H "Authorization: Bearer $API_KEY" \
-H "Content-Type: application/json" \
-d '{
"model": "uncensored",
"messages": [{"role": "user", "content": "Write a blunt product review of a cheap VPN."}]
}'Python
from openai import OpenAI
client = OpenAI(base_url="https://api.nsfwchat.top/v1", api_key="YOUR_KEY")
resp = client.chat.completions.create(
model="uncensored",
messages=[{"role": "user", "content": "Summarise this thread without softening it."}],
)
print(resp.choices[0].message.content)Node.js
import OpenAI from "openai";
const client = new OpenAI({ baseURL: "https://api.nsfwchat.top/v1", apiKey: process.env.API_KEY });
const resp = await client.chat.completions.create({
model: "uncensored",
messages: [{ role: "user", content: "Draft a villain monologue for my game." }],
});
console.log(resp.choices[0].message.content);Streaming
stream = client.chat.completions.create(
model="uncensored",
messages=[{"role": "user", "content": "Tell the story in second person."}],
stream=True,
)
for chunk in stream:
if chunk.choices and chunk.choices[0].delta.content:
print(chunk.choices[0].delta.content, end="", flush=True)Funktionen und Limits
Alle echten Grenzen und Funktionen der API auf einen Blick – prüfe sie, bevor du Guthaben kaufst.
| Merkmal | Wert |
|---|---|
| API-Format | OpenAI-kompatibel: jedes OpenAI-SDK funktioniert – nur Base-URL und Schlüssel ändern |
| Modell-ID | uncensored |
| Endpunkte | POST /v1/chat/completions · GET /v1/models |
| Authentifizierung | Authorization: Bearer YOUR_KEY |
| Base-URL | https://api.nsfwchat.top/v1 |
| Parameter | temperature, top_p, stop, seed, presence_penalty, frequency_penalty |
| Kontextfenster | 100.000 Tokens (Eingabe + Ausgabe) |
| Streaming | ja – Server-Sent Events, der letzte Chunk enthält die Token-Nutzung |
| Function Calling | ja – tools, tool_choice; Antworten mit tool_calls, auch im Stream; Ergebnisse als role: tool |
| JSON-Modus | response_format: {"type": "json_object"} |
| Max. Ausgabe | bis zum Rest des 100.000-Token-Fensters; max_tokens optional (kein separates Limit) |
| Antwort-Header | X-Request-Id, X-Balance-USD, X-RateLimit-Limit-Requests, X-RateLimit-Limit-Concurrency |
| Ratenlimit | 300 Anfragen pro Minute und Schlüssel |
| Anfragegröße | bis 8 MB |
| Parallelität | 8 gleichzeitige Anfragen pro Schlüssel |
| Aufladen | USDT (TRC20) oder USDC (Base), jeder ganze Betrag von $10 bis $500 |
| Testguthaben | $0,50 für 7 Tage, ohne Karte · Testschlüssel: 2 parallele Anfragen, 60 pro Minute; volle Limits (8 und 300) nach erster Aufladung |
| Abrechnung | Prepaid-Guthaben nach echter Nutzung; Fehler und Ablehnungen sind kostenlos |
| Bonus | +5 % ab $50, +10 % ab $100 |
| Preis | $0,25 pro 1 Mio. Eingabe-Tokens · $1,00 pro 1 Mio. Ausgabe-Tokens |
| Gültigkeit | bezahltes Guthaben verfällt nie, kein Abo |
| Schlüssel | ein aktiver Schlüssel pro Konto; ein neuer ersetzt den alten |
| Anmeldung | Google oder E-Mail und Passwort |
| Inhalte | Inhalte für Erwachsene erlaubt; sexuelle Inhalte mit Minderjährigen werden abgelehnt |
Fehlercodes
Fehler kommen als JSON mit festem type; fehlgeschlagene oder abgelehnte Anfragen kosten nichts.
| Code | Typ | Bedeutung |
|---|---|---|
400 | bad_request | ungültiges JSON, leere Nachrichten, falscher Parameter oder Kontext zu lang |
401 | missing_key · invalid_key · key_revoked | Schlüssel fehlt, ist falsch oder wurde ersetzt |
402 | no_credit | kein Guthaben – aufladen, dann geht es sofort weiter |
403 | content_blocked | sexuelle Inhalte mit Minderjährigen – abgelehnt, nicht berechnet |
404 | not_found | unbekannter Endpunkt |
413 | request_too_large | Anfrage größer als 8 MB |
429 | rate_limited · concurrency | über 300/Min. oder 8 parallel – kurz warten |
503 | upstream_busy | Modell ausgelastet – in Sekunden erneut versuchen |
Fragen und Antworten
Welche Modell-ID soll ich verwenden?
Verwende die Modell-ID <code>uncensored</code>. Dies ist ein Open-Weight-Modell, das auf unseren Servern gehostet wird und sich von GPT, Claude oder anderen Modellen der Anbieter unterscheidet.
Unterstützt die API Function Calling?
Ja, die API unterstützt Function Calling (Tools und tool_choice) sowie den JSON-Modus für strukturierte Ausgaben. Du kannst Tools in deinem Anfragekörper definieren.
Gibt es einen Inhaltsfilter für Minderjährige?
Es gilt eine harte Inhaltsgrenze: Anfragen, die sexuelle Inhalte mit Minderjährigen enthalten, werden unabhängig vom Prompt-Kontext immer abgelehnt.
Dein Schlüssel ist nur ein Formular entfernt
Erstelle ein Konto, kopiere den Schlüssel, ändere die Basis-URL. Das ist die gesamte Einrichtung.