FR ▾

Intégrez l'API NSFW Chatbot

Obtenez votre clé API LLM sans censure et commencez à générer du texte en quelques minutes avec notre endpoint compatible OpenAI. Ce guide couvre l'authentification, les requêtes de base et le streaming avec l'API NSFW Chatbot.

URL de base et authentification

L'API NSFW Chatbot utilise l'URL de base standard compatible OpenAI. Toutes les requêtes nécessitent une clé API transmise dans l'en-tête Authorization. Vous pouvez générer cette clé instantanément en vous inscrivant avec Google ou une adresse e-mail. Il n'y a pas de frais mensuels ni d'abonnements ; vous rechargez simplement avec de la cryptomonnaie et payez ce que vous utilisez.

L'URL de base est https://api.nsfwchatbot.top/v1. Pour utiliser les SDK officiels OpenAI ou tout client compatible, configurez votre client pour pointer vers cette URL et définissez la clé API. L'identifiant de modèle que vous devez envoyer est uncensored. Ce modèle à poids ouverts est ajusté pour répondre sans refus de contenu pour un usage adulte licite, ce qui le rend idéal pour les développeurs créant des applications de chatbot NSFW.

Première requête

Votre première étape consiste à envoyer une requête simple de complétion de chat. L'API accepte le format JSON standard OpenAI. Vous devez spécifier le model comme uncensored. L'endpoint est POST /v1/chat/completions. Voici un exemple cURL de base pour vous aider à démarrer.

curl https://api.nsfwchatbot.top/v1/chat/completions \
  -H "Authorization: Bearer $API_KEY" \
  -H "Content-Type: application/json" \
  -d '{
    "model": "uncensored",
    "messages": [{"role": "user", "content": "Write a blunt product review of a cheap VPN."}]
  }'

Cette requête envoie un prompt et attend une réponse textuelle. L'API traitera les tokens et retournera le texte généré. Vous pouvez ajuster des paramètres comme temperature ou top_p pour contrôler la créativité. Rappelez-vous que la fenêtre de contexte est de 100 000 tokens au total, avec une sortie maximale de 32 000 tokens par requête.

Intégration SDK Python

Pour les développeurs Python, le package officiel openai fonctionne directement avec notre API. Vous devez simplement remplacer l'URL de base. Cela vous permet d'utiliser des méthodes familières comme chat.completions.create(). Cette approche minimise les modifications de code si vous migrez depuis un autre fournisseur. Cependant, notez que nous ne proposons pas d'embeddings, d'images ni d'audio. Notre API est strictement dédiée à la génération de texte.

from openai import OpenAI

client = OpenAI(base_url="https://api.nsfwchatbot.top/v1", api_key="YOUR_KEY")

resp = client.chat.completions.create(
    model="uncensored",
    messages=[{"role": "user", "content": "Summarise this thread without softening it."}],
)
print(resp.choices[0].message.content)

Définissez la clé API dans votre environnement ou passez-la directement. Le paramètre base_url est crucial pour acheminer les requêtes vers nos serveurs. Vous pouvez également passer une api_key personnalisée si vous préférez. Cette configuration vous donne accès à l'appel de fonctions, au mode JSON et aux capacités de streaming dès le départ.

Intégration SDK Node.js

Les développeurs Node.js peuvent utiliser le package npm openai avec une configuration similaire. Définissez l'URL de base et la clé API dans l'initialisation de votre client. Cela garantit la compatibilité avec les bases de code existantes. L'identifiant de modèle reste uncensored. Vous pouvez utiliser des paramètres standard comme messages et stream.

import OpenAI from "openai";

const client = new OpenAI({ baseURL: "https://api.nsfwchatbot.top/v1", apiKey: process.env.API_KEY });

const resp = await client.chat.completions.create({
  model: "uncensored",
  messages: [{ role: "user", content: "Draft a villain monologue for my game." }],
});
console.log(resp.choices[0].message.content);

Ce SDK gère les requêtes HTTP et l'analyse des réponses pour vous. Vous pouvez l'intégrer facilement dans des routes Express ou des fonctions serverless. Comme nous utilisons un crédit prépayé, surveillez votre consommation via le tableau de bord. Les erreurs ne consomment pas de crédit, ce qui aide à garder les coûts prévisibles. L'API prend en charge jusqu'à 300 requêtes par minute par clé.

Réponses en streaming

Pour des expériences utilisateur en temps réel, activez le streaming en définissant stream: true. L'API renvoie des données sous forme d'événements envoyés par le serveur (SSE). Chaque chunk contient une réponse partielle. Le dernier chunk inclut les statistiques d'utilisation des tokens. Cela vous permet d'afficher le texte au fur et à mesure de sa génération, améliorant la latence perçue.

stream = client.chat.completions.create(
    model="uncensored",
    messages=[{"role": "user", "content": "Tell the story in second person."}],
    stream=True,
)
for chunk in stream:
    if chunk.choices and chunk.choices[0].delta.content:
        print(chunk.choices[0].delta.content, end="", flush=True)

Gérez le stream dans votre code client pour accumuler les tokens. C'est essentiel pour les interfaces de chatbot où les utilisateurs attendent une réponse instantanée. Le modèle prend en charge le streaming pour tous les types de requêtes. Vous pouvez toujours utiliser des paramètres comme les séquences stop ou max_tokens pendant le streaming. Assurez-vous simplement que votre client ferme correctement la connexion de stream après le dernier chunk.

Limites, erreurs et contexte

Comprenez les limites pour éviter les interruptions de service. Vous avez droit à 300 requêtes par minute et à 8 requêtes simultanées par clé. Le corps de la requête ne doit pas dépasser 8 Mo. Si vous envoyez une clé API invalide, vous recevrez une erreur 401. Si vous n'avez pas de crédit, vous obtenez une erreur 402. Les limites de débit déclenchent une erreur 429. Ces erreurs ne consomment pas votre crédit prépayé.

La fenêtre de contexte est de 100 000 tokens pour le prompt et la complétion combinés. La sortie maximale est de 32 000 tokens, ou 2 048 si vous ne définissez pas max_tokens. Les erreurs et les refus sont gratuits. Cette structure garantit que vous ne payez que pour les complétions réussies. Gérez vos clés avec soin, car le remplacement d'une clé invalide immédiatement l'ancienne.

Questions et réponses

Comment fonctionne la facturation ?

Vous ne payez que pour les tokens utilisés. Les tokens d'entrée coûtent 0,25 $ par million, et les tokens de sortie coûtent 1,00 $ par million. Les erreurs et les refus ne vous sont pas facturés. Le crédit est rechargé via crypto et n'expire jamais.

Quels modes de paiement crypto sont acceptés ?

Nous acceptons USDT (TRC20) et USDC (Base). Le rechargement minimum est de 10 $, le maximum est de 500 $. Vous bénéficiez d'un bonus de +5 % pour 50 $+ et de +10 % pour 100 $+. Les cartes et PayPal ne sont pas acceptés.

Le modèle est-il vraiment sans censure ?

Oui, le modèle n'accepte pas les sujets légaux pour adultes, fictifs ou controversés. Il n'est pas GPT ou Claude. La seule limite stricte est l'absence de contenu sexuel impliquant des mineurs, qui est toujours refusé.

Votre clé est à un formulaire de vous

Créez un compte, copiez la clé, modifiez l'URL de base. C'est toute la configuration.

Obtenir une clé API

Fonctions et limites

Toutes les limites et fonctions réelles de l'API au même endroit — vérifiez-les avant de recharger.

ÉlémentValeur
Formatcompatible OpenAI : tout SDK OpenAI fonctionne en changeant la base URL et la clé
EndpointsPOST /v1/chat/completions · GET /v1/models
ID du modèleuncensored
AuthentificationAuthorization: Bearer YOUR_KEY
Base URLhttps://api.nsfwchatbot.top/v1
Sortie max.jusqu'au reste de la fenêtre de 100 000 tokens ; max_tokens optionnel (pas de plafond distinct)
Streamingoui — server-sent events ; le dernier bloc contient l'usage des tokens
Appel de fonctionsoui — tools, tool_choice ; réponse avec tool_calls, aussi en streaming ; résultats en role: tool
Fenêtre de contexte100 000 tokens (entrée + sortie)
Mode JSONresponse_format: {"type": "json_object"}
Paramètrestemperature, top_p, stop, seed, presence_penalty, frequency_penalty
Taillejusqu'à 8 Mo par requête
Limite de débit300 requêtes par minute et par clé
En-têtesX-Request-Id, X-Balance-USD, X-RateLimit-Limit-Requests, X-RateLimit-Limit-Concurrency
Concurrence8 requêtes simultanées par clé
RechargeUSDT (TRC20) ou USDC (Base), tout montant entier de 10 $ à 500 $
Bonus+5 % dès 50 $, +10 % dès 100 $
Prix0,25 $ par million de tokens en entrée · 1,00 $ par million en sortie
Facturationcrédit prépayé selon l'usage réel ; erreurs et refus gratuits
Essai gratuit0,50 $ pendant 7 jours, sans carte · Clé d'essai : 2 requêtes parallèles, 60 par minute ; limites complètes (8 et 300) après la 1re recharge
Validitéle crédit payé n'expire jamais, sans abonnement
Clésune clé active par compte ; une nouvelle remplace l'ancienne
Contenucontenu adulte autorisé ; tout contenu sexuel impliquant des mineurs est refusé
ConnexionGoogle ou e-mail et mot de passe

Erreurs et solutions

Les erreurs arrivent en JSON avec un type stable ; les requêtes échouées ou refusées ne sont pas facturées.

CodeTypeSignification
400bad_requestJSON invalide, messages vides, mauvais paramètre ou contexte trop long
401missing_key · invalid_key · key_revokedclé absente, erronée ou remplacée
402no_creditplus de crédit — rechargez, la reprise est immédiate
403content_blockedcontenu sexuel impliquant des mineurs — refusé, non facturé
404not_foundendpoint inconnu
413request_too_largecorps supérieur à 8 Mo
429rate_limited · concurrencyau-delà de 300/min ou 8 en parallèle — patientez
503upstream_busymodèle occupé — réessayez dans quelques secondes