DE ▾

NSFW-Chat: Unzensierte LLM-API-Dokumentation

Integriere die unzensierte LLM-API in deine NSFW-Chat-Anwendung mit diesem Schnellstart-Guide. Sende Text an den Chat-Completions-Endpunkt und erhalte rohe, uneingeschränkte Modellantworten.

Base URL und Authentifizierung

Richte deinen OpenAI-kompatiblen Client auf die Base URL https://api.nsfwchat.top/v1 ein. Authentifiziere jede Anfrage, indem du deinen API-Schlüssel als Bearer-Token in den Authorization-Header einfügst. Du kannst diesen Schlüssel direkt nach der Anmeldung über Google oder E-Mail auf der Seite API-Schlüssel abrufen generieren. Der Schlüssel wird bei der Erstellung einmalig angezeigt, speichere ihn daher sicher. Dieser einzelne Schlüssel ist mit dem Prepaid-Guthaben und den Ratenlimits deines Kontos verknüpft.

Erste Anfrage

Sende eine Standard-Chat-Completions-Anfrage, um die Konnektivität und Antwortqualität zu testen. Verwende die Modell-ID uncensored, um auf das für erwachsene Inhalte optimierte Open-Weight-Modell zuzugreifen. Die API akzeptiert Texteingaben und gibt Text aus. Stelle sicher, dass dein Payload das messages-Array und das Feld model enthält. Dieser Basis-Aufruf überprüft, ob deine Authentifizierung und Basis-URL-Konfiguration korrekt sind, bevor du deine Anwendungslogik erstellst.

Python SDK-Integration

Verwende das offizielle OpenAI Python SDK, um mit der API zu interagieren. Setze die Umgebungsvariablen base_url und api_key oder übergebe sie direkt an den Client-Konstruktor. Rufe chat.completions.create mit dem Modell uncensored auf. Dieser Ansatz nutzt bestehenden Community-Code für NSFW-Chat-Anwendungen. Das SDK übernimmt Serialisierung und Fehleranalyse, sodass du dich auf Prompt Engineering und die Verwaltung des Nachrichtenverlaufs in deiner Python-Umgebung konzentrieren kannst.

Node SDK-Integration

Initialisiere für JavaScript- oder TypeScript-Anwendungen den OpenAI-Client mit deiner Basis-URL und deinem API-Schlüssel. Das Node-SDK ist standardmäßig asynchron und gibt Promises für alle API-Aufrufe zurück. Rufe chat.completions.create auf, um deinen Konversationsverlauf zu senden. Diese Integration ist ideal für Webserver oder Node-basierte Game-Backends, die nicht-blockierende E/A benötigen. Verarbeite das Antwortobjekt, um die Antwort des Assistenten zu extrahieren und deinen lokalen Status oder deine Datenbank zu aktualisieren.

Streaming-Antworten über SSE

Aktiviere das Streaming, indem du stream: true in deiner Anfrage setzt. Die API gibt Server-Sent Events (SSE) zurück, während das Modell Text generiert. Jeder Chunk enthält partielle Delta-Werte. Der letzte Chunk enthält die Token-Nutzungsstatistiken für die Anfrage. Diese Methode reduziert die wahrgenommene Latenz für Nutzer in NSFW-Chat-Schnittstellen, indem Text angezeigt wird, während er generiert wird. Verarbeite jedes Event in deinem Client, um die Benutzeroberfläche in Echtzeit zu aktualisieren.

Grenzen, Fehler und Kontextfenster

Das Kontextfenster unterstützt bis zu 100.000 Token für Prompt und Vervollständigung zusammen. Dein Anfragekörper darf 8 MB nicht überschreiten. Du bist auf 300 Anfragen pro Minute und 8 parallele Anfragen pro Schlüssel begrenzt. Wenn dein Prepaid-Guthaben aufgebraucht ist, lehnt die API weitere Anfragen ab. Authentifizierungsfehler geben einen 401-Fehler zurück, und Ratenlimits lösen eine 429-Antwort aus. Stelle sicher, dass deine Anwendung diese Fehler gracefully behandelt, um eine reibungslose Nutzererfahrung während hoher Traffic-Zeiten aufrechtzuerhalten.

cURL

curl https://api.nsfwchat.top/v1/chat/completions \
  -H "Authorization: Bearer $API_KEY" \
  -H "Content-Type: application/json" \
  -d '{
    "model": "uncensored",
    "messages": [{"role": "user", "content": "Write a blunt product review of a cheap VPN."}]
  }'

Python

from openai import OpenAI

client = OpenAI(base_url="https://api.nsfwchat.top/v1", api_key="YOUR_KEY")

resp = client.chat.completions.create(
    model="uncensored",
    messages=[{"role": "user", "content": "Summarise this thread without softening it."}],
)
print(resp.choices[0].message.content)

Node.js

import OpenAI from "openai";

const client = new OpenAI({ baseURL: "https://api.nsfwchat.top/v1", apiKey: process.env.API_KEY });

const resp = await client.chat.completions.create({
  model: "uncensored",
  messages: [{ role: "user", content: "Draft a villain monologue for my game." }],
});
console.log(resp.choices[0].message.content);

Streaming

stream = client.chat.completions.create(
    model="uncensored",
    messages=[{"role": "user", "content": "Tell the story in second person."}],
    stream=True,
)
for chunk in stream:
    if chunk.choices and chunk.choices[0].delta.content:
        print(chunk.choices[0].delta.content, end="", flush=True)

Funktionen und Limits

Alle echten Grenzen und Funktionen der API auf einen Blick – prüfe sie, bevor du Guthaben kaufst.

MerkmalWert
API-FormatOpenAI-kompatibel: jedes OpenAI-SDK funktioniert – nur Base-URL und Schlüssel ändern
Modell-IDuncensored
EndpunktePOST /v1/chat/completions · GET /v1/models
AuthentifizierungAuthorization: Bearer YOUR_KEY
Base-URLhttps://api.nsfwchat.top/v1
Parametertemperature, top_p, stop, seed, presence_penalty, frequency_penalty
Kontextfenster100.000 Tokens (Eingabe + Ausgabe)
Streamingja – Server-Sent Events, der letzte Chunk enthält die Token-Nutzung
Function Callingja – tools, tool_choice; Antworten mit tool_calls, auch im Stream; Ergebnisse als role: tool
JSON-Modusresponse_format: {"type": "json_object"}
Max. Ausgabebis zum Rest des 100.000-Token-Fensters; max_tokens optional (kein separates Limit)
Antwort-HeaderX-Request-Id, X-Balance-USD, X-RateLimit-Limit-Requests, X-RateLimit-Limit-Concurrency
Ratenlimit300 Anfragen pro Minute und Schlüssel
Anfragegrößebis 8 MB
Parallelität8 gleichzeitige Anfragen pro Schlüssel
AufladenUSDT (TRC20) oder USDC (Base), jeder ganze Betrag von $10 bis $500
Testguthaben$0,50 für 7 Tage, ohne Karte · Testschlüssel: 2 parallele Anfragen, 60 pro Minute; volle Limits (8 und 300) nach erster Aufladung
AbrechnungPrepaid-Guthaben nach echter Nutzung; Fehler und Ablehnungen sind kostenlos
Bonus+5 % ab $50, +10 % ab $100
Preis$0,25 pro 1 Mio. Eingabe-Tokens · $1,00 pro 1 Mio. Ausgabe-Tokens
Gültigkeitbezahltes Guthaben verfällt nie, kein Abo
Schlüsselein aktiver Schlüssel pro Konto; ein neuer ersetzt den alten
AnmeldungGoogle oder E-Mail und Passwort
InhalteInhalte für Erwachsene erlaubt; sexuelle Inhalte mit Minderjährigen werden abgelehnt

Fehlercodes

Fehler kommen als JSON mit festem type; fehlgeschlagene oder abgelehnte Anfragen kosten nichts.

CodeTypBedeutung
400bad_requestungültiges JSON, leere Nachrichten, falscher Parameter oder Kontext zu lang
401missing_key · invalid_key · key_revokedSchlüssel fehlt, ist falsch oder wurde ersetzt
402no_creditkein Guthaben – aufladen, dann geht es sofort weiter
403content_blockedsexuelle Inhalte mit Minderjährigen – abgelehnt, nicht berechnet
404not_foundunbekannter Endpunkt
413request_too_largeAnfrage größer als 8 MB
429rate_limited · concurrencyüber 300/Min. oder 8 parallel – kurz warten
503upstream_busyModell ausgelastet – in Sekunden erneut versuchen

Fragen und Antworten

Welche Modell-ID soll ich verwenden?

Verwende die Modell-ID <code>uncensored</code>. Dies ist ein Open-Weight-Modell, das auf unseren Servern gehostet wird und sich von GPT, Claude oder anderen Modellen der Anbieter unterscheidet.

Unterstützt die API Function Calling?

Ja, die API unterstützt Function Calling (Tools und tool_choice) sowie den JSON-Modus für strukturierte Ausgaben. Du kannst Tools in deinem Anfragekörper definieren.

Gibt es einen Inhaltsfilter für Minderjährige?

Es gilt eine harte Inhaltsgrenze: Anfragen, die sexuelle Inhalte mit Minderjährigen enthalten, werden unabhängig vom Prompt-Kontext immer abgelehnt.

Dein Schlüssel ist nur ein Formular entfernt

Erstelle ein Konto, kopiere den Schlüssel, ändere die Basis-URL. Das ist die gesamte Einrichtung.

API-Schlüssel erhalten