Documentation de l'API NoFilter AI | NoFilter AI (nofilterai.cc)
Intégrez notre API LLM sans censure en quelques minutes avec des clients compatibles OpenAI. Ajoutez votre clé, pointez vers notre URL de base et commencez à générer du texte immédiatement.
Authentification et configuration
Commencez par créer un compte via Continuer avec Google ou par e-mail et mot de passe. Aucun numéro de téléphone n'est requis. À l'inscription, vous recevez immédiatement une clé API. Vous obtenez également $0,50 de crédit d'essai valable 7 jours, sans carte bancaire. Votre clé API authentifie toutes les requêtes. L'URL de base pour tous les endpoints est https://api.nofilterai.cc/v1. Cette URL fonctionne avec les SDK OpenAI officiels et tout client compatible OpenAI en mettant simplement à jour la configuration base_url.
Notre service nofilter ai utilise un crédit prépayé. Si vous n'avez pas suffisamment de crédit, vous recevez une erreur 402 Paiement requis. Les erreurs et les refus sont gratuits. Le dernier chunk du streaming inclut l'utilisation totale des tokens pour la requête. Le modèle est ajusté pour respecter le format demandé.
L'endpoint Chat Completions
Le cœur de notre API est l'endpoint POST /v1/chat/completions. Il accepte une entrée textuelle et retourne une sortie textuelle. Il n'y a pas de capacités de génération d'embeddings, d'images, d'audio ou de vidéo. L'ID du modèle à envoyer est uncensored. Il s'agit d'un modèle à poids ouverts ajusté pour répondre sans refus de contenu pour une utilisation adulte licite. Ce n'est ni GPT, ni Claude, ni aucun autre modèle d'un autre fournisseur.
Configurez votre client pour utiliser notre URL de base et votre clé API. Le corps de la requête suit le format standard de complétion de chat OpenAI. Vous pouvez spécifier le modèle, les messages et divers paramètres. L'API prend en charge le streaming via SSE pour la livraison de tokens en temps réel. L'appel de fonctions et le mode JSON sont également disponibles. Utilisez la commande curl suivante pour effectuer votre première requête.
Intégration SDK Python
L'utilisation du SDK Python OpenAI officiel est le moyen le plus rapide d'intégrer. Installez la bibliothèque et définissez le base_url sur notre endpoint. Transmettez votre clé API dans le paramètre api_key. Le SDK gère automatiquement les requêtes HTTP et l'analyse des réponses. Cette approche centrée sur le code vous permet de commencer à générer du contenu immédiatement.
Le SDK prend en charge toutes les fonctionnalités de notre API, y compris le streaming et l'appel de fonctions. Vous pouvez définir des paramètres comme temperature et top_p pour contrôler la sortie. L'ID de modèle reste uncensored. Les erreurs sont levées sous forme d'exceptions standard. Les refus et les erreurs ne consomment pas de tokens de votre solde prépayé. Utilisez le SDK Python pour prototyper rapidement votre application.
Intégration SDK Node.js
Pour les développeurs JavaScript et TypeScript, le SDK Node OpenAI offre une intégration transparente. Définissez le baseURL sur https://api.nofilterai.cc/v1 et fournissez votre clé API. Le SDK gère l'authentification et le formatage des requêtes. Vous pouvez utiliser la méthode chat.completions.create pour envoyer des messages.
Le SDK Node prend en charge les réponses en streaming, vous permettant de traiter les tokens à mesure qu'ils arrivent. Cela est utile pour les applications en temps réel. Vous pouvez également utiliser le mode JSON pour obtenir une sortie structurée. L'ID du modèle est uncensored. L'API est optimisée pour une intégration directe, afin que vous puissiez vous concentrer sur la création de votre application. Utilisez le SDK Node pour intégrer notre API sans censure dans vos applications web ou côté serveur.
Réponses en streaming avec SSE
Activez le streaming en définissant stream: true dans votre requête. L'API retourne un flux Server-Sent Events (SSE). Chaque chunk contient du texte partiel. Le dernier chunk inclut l'utilisation de tokens pour la requête. Cela vous permet d'afficher la sortie en temps réel.
Le streaming est efficace pour les réponses longues. Le modèle prend en charge jusqu'à 32 000 tokens par requête. Vous pouvez analyser le flux SSE dans votre client pour mettre à jour l'interface utilisateur de manière incrémentale. C'est idéal pour les interfaces de chat et les outils de génération de code. Notre API garantit une faible latence pour la livraison des tokens. Utilisez l'endpoint de streaming pour améliorer l'expérience utilisateur de votre application.
Limites de débit et contraintes
Notre API applique des limites strictes pour garantir la stabilité. Vous avez droit à 300 requêtes par minute par clé et à 8 requêtes simultanées. La taille maximale du corps de la requête est de 8 Mo. Si vous dépassez ces limites, vous recevrez une erreur. L'API retourne une erreur 429 Trop de requêtes lorsque vous dépassez la limite de débit. La fenêtre de contexte du modèle est de 100 000 tokens, incluant à la fois le prompt et la complétion.
Si la clé est invalide ou expirée, vous recevez une erreur 401 Non autorisé. Les erreurs et les refus sont gratuits, vous n'êtes donc pas facturé pour les requêtes échouées. Le crédit prépayé n'expire jamais. Vous pouvez recharger votre crédit en utilisant des crypto. Des limites s'appliquent par clé API. Si vous avez besoin de plus de clés, vous pouvez en générer une nouvelle, ce qui remplace l'ancienne. Utilisez ces limites pour planifier l'évolutivité de votre application.
cURL
curl https://api.nofilterai.cc/v1/chat/completions \
-H "Authorization: Bearer $API_KEY" \
-H "Content-Type: application/json" \
-d '{
"model": "uncensored",
"messages": [{"role": "user", "content": "Write a blunt product review of a cheap VPN."}]
}'Python
from openai import OpenAI
client = OpenAI(base_url="https://api.nofilterai.cc/v1", api_key="YOUR_KEY")
resp = client.chat.completions.create(
model="uncensored",
messages=[{"role": "user", "content": "Summarise this thread without softening it."}],
)
print(resp.choices[0].message.content)Node.js
import OpenAI from "openai";
const client = new OpenAI({ baseURL: "https://api.nofilterai.cc/v1", apiKey: process.env.API_KEY });
const resp = await client.chat.completions.create({
model: "uncensored",
messages: [{ role: "user", content: "Draft a villain monologue for my game." }],
});
console.log(resp.choices[0].message.content);Streaming
stream = client.chat.completions.create(
model="uncensored",
messages=[{"role": "user", "content": "Tell the story in second person."}],
stream=True,
)
for chunk in stream:
if chunk.choices and chunk.choices[0].delta.content:
print(chunk.choices[0].delta.content, end="", flush=True)Fonctions et limites
Toutes les limites et fonctions réelles de l'API au même endroit — vérifiez-les avant de recharger.
| Élément | Valeur |
|---|---|
| Format | compatible OpenAI : tout SDK OpenAI fonctionne en changeant la base URL et la clé |
| Base URL | https://api.nofilterai.cc/v1 |
| Authentification | Authorization: Bearer YOUR_KEY |
| ID du modèle | uncensored |
| Endpoints | POST /v1/chat/completions · GET /v1/models |
| Paramètres | temperature, top_p, stop, seed, presence_penalty, frequency_penalty |
| Mode JSON | response_format: {"type": "json_object"} |
| Sortie max. | jusqu'au reste de la fenêtre de 64 000 tokens ; max_tokens optionnel (pas de plafond distinct) |
| Appel de fonctions | oui — tools, tool_choice ; réponse avec tool_calls, aussi en streaming ; résultats en role: tool |
| Streaming | oui — server-sent events ; le dernier bloc contient l'usage des tokens |
| Fenêtre de contexte | 64 000 tokens (entrée + sortie) |
| Concurrence | 8 requêtes simultanées par clé |
| Limite de débit | 300 requêtes par minute et par clé |
| Taille | jusqu'à 8 Mo par requête |
| En-têtes | X-Request-Id, X-Balance-USD, X-RateLimit-Limit-Requests, X-RateLimit-Limit-Concurrency |
| Validité | le crédit payé n'expire jamais, sans abonnement |
| Facturation | crédit prépayé selon l'usage réel ; erreurs et refus gratuits |
| Essai gratuit | 0,50 $ pendant 7 jours, sans carte · Clé d'essai : 2 requêtes parallèles, 60 par minute ; limites complètes (8 et 300) après la 1re recharge |
| Bonus | +5 % dès 50 $, +10 % dès 100 $ |
| Recharge | USDT (TRC20) ou USDC (Base), tout montant entier de 10 $ à 500 $ |
| Prix | 0,25 $ par million de tokens en entrée · 1,00 $ par million en sortie |
| Connexion | Google ou e-mail et mot de passe |
| Contenu | contenu adulte autorisé ; tout contenu sexuel impliquant des mineurs est refusé |
| Clés | une clé active par compte ; une nouvelle remplace l'ancienne |
Erreurs et solutions
Les erreurs arrivent en JSON avec un type stable ; les requêtes échouées ou refusées ne sont pas facturées.
| Code | Type | Signification |
|---|---|---|
400 | bad_request | JSON invalide, messages vides, mauvais paramètre ou contexte trop long |
401 | missing_key · invalid_key · key_revoked | clé absente, erronée ou remplacée |
402 | no_credit | plus de crédit — rechargez, la reprise est immédiate |
403 | content_blocked | contenu sexuel impliquant des mineurs — refusé, non facturé |
404 | not_found | endpoint inconnu |
413 | request_too_large | corps supérieur à 8 Mo |
429 | rate_limited · concurrency | au-delà de 300/min ou 8 en parallèle — patientez |
503 | upstream_busy | modèle occupé — réessayez dans quelques secondes |
Questions et réponses
Quelle est la taille de la fenêtre de contexte ?
La fenêtre de contexte est de 100 000 tokens, couvrant à la fois le prompt et la complétion. La sortie maximale par requête est de 32 000 tokens, ou 2 048 si max_tokens n'est pas défini.
Comment payer l'API ?
Nous acceptons uniquement les cryptomonnaies : USDT (TRC20) ou USDC (Base). Vous pouvez recharger avec n'importe quel montant entier de 10 $ à 500 $. Le crédit n'expire jamais, et les erreurs sont gratuites.
Le modèle est-il sans censure ?
Oui, le modèle n'accepte pas les refus pour les sujets légaux, adultes, fictifs ou controversés. Cependant, nous bloquons le contenu sexuel impliquant des mineurs. Le modèle n'est pas GPT, Claude ou tout autre modèle d'un autre fournisseur.
Votre clé est à un formulaire de vous
Créez un compte, copiez la clé, modifiez l'URL de base. C'est toute la configuration.