Modèle IA sans censure pour le codage : Documentation API
Commencez avec le modèle de codage sans censure en vous authentifiant avec votre clé API et en envoyant des requêtes à notre endpoint compatible OpenAI. Utilisez les exemples de code ci-dessous pour intégrer le LLM sans censure dans vos workflows existants immédiatement.
https://api.uncensoredcodingai.com/v1uncensored
URL de base et authentification
Notre API suit la structure des chat-completions OpenAI, vous permettant d'utiliser les SDK existants avec une configuration minimale. L'URL de base est https://api.uncensoredcodingai.com/v1. L'authentification est gérée via un token Bearer dans l'en-tête Authorization. Vous devez inclure votre clé API exactement comme lors de l'inscription ; il n'y a pas d'abonnements ni de frais mensuels, uniquement du crédit prépayé au paiement à l'usage.
Important : Bien que le modèle soit très permissif, il ne supprime pas tous les filtres. Une limite de contenu stricte s'applique toujours : les requêtes contenant du contenu sexuel impliquant des mineurs seront bloquées. Tous les autres sujets adultes, controversés ou techniques, s'ils sont licites, sont traités sans refus.
Première requête
Envoyez une requête standard de chat completion pour générer du texte. L'ID du modèle est uncensored. Il s'agit d'un LLM de codage sans censure optimisé pour la génération de code et les tâches techniques, et non un clone de GPT ou Claude. Le modèle s'exécute sur nos propres serveurs GPU et est un modèle à poids ouverts ajusté pour des réponses directes.
curl https://api.uncensoredcodingai.com/v1/chat/completions \
-H "Authorization: Bearer $API_KEY" \
-H "Content-Type: application/json" \
-d '{
"model": "uncensored",
"messages": [{"role": "user", "content": "Write a blunt product review of a cheap VPN."}]
}'Remplacez YOUR_API_KEY par votre clé réelle. La réponse contiendra le texte généré dans le champ choices[0].message.content. Assurez-vous que votre entrée tient dans la fenêtre de contexte de 100 000 tokens.
Intégration SDK Python
Utilisez le package Python officiel openai pour interagir avec l'API. Initialisez le client avec l'URL de base personnalisée et votre clé API. Cette approche vous permet de tirer parti des bases de code existantes qui prennent déjà en charge les endpoints compatibles OpenAI.
from openai import OpenAI
client = OpenAI(base_url="https://api.uncensoredcodingai.com/v1", api_key="YOUR_KEY")
resp = client.chat.completions.create(
model="uncensored",
messages=[{"role": "user", "content": "Summarise this thread without softening it."}],
)
print(resp.choices[0].message.content)Ce script envoie un prompt au modèle de codage sans censure et affiche la réponse. L'ID du modèle est défini sur uncensored. Vous pouvez ajuster les paramètres temperature et max_tokens pour contrôler la créativité et la longueur de la sortie. Rappelez-vous que le LLM sans censure n'a pas de mémoire des conversations précédentes à moins que vous ne passiez l'historique complet dans le tableau messages.
Intégration SDK Node
Pour les projets JavaScript et TypeScript, utilisez le package Node openai. Configurez le client avec les variables d'environnement ou les valeurs directes baseUrl et apiKey.
import OpenAI from "openai";
const client = new OpenAI({ baseURL: "https://api.uncensoredcodingai.com/v1", apiKey: process.env.API_KEY });
const resp = await client.chat.completions.create({
model: "uncensored",
messages: [{ role: "user", content: "Draft a villain monologue for my game." }],
});
console.log(resp.choices[0].message.content);Cet exemple crée une requête de chat completion en utilisant le modèle uncensored. L'objet de réponse contient le texte généré. Vous pouvez gérer les erreurs et les codes de statut directement dans la logique de votre application Node.js. Cette méthode est idéale pour les services backend ou les fonctions serverless qui doivent générer du code ou du texte à la demande.
Réponses en streaming
Activez le streaming en définissant stream: true dans votre requête. L'API retourne un flux Server-Sent Events (SSE), vous permettant d'afficher la sortie au fur et à mesure de sa génération. Cela est utile pour les gros blocs de code ou les explications longues.
stream = client.chat.completions.create(
model="uncensored",
messages=[{"role": "user", "content": "Tell the story in second person."}],
stream=True,
)
for chunk in stream:
if chunk.choices and chunk.choices[0].delta.content:
print(chunk.choices[0].delta.content, end="", flush=True)Traitez les chunks du stream à leur arrivée. Chaque chunk contient du texte partiel que vous pouvez ajouter à votre interface utilisateur ou journaliser. Le streaming réduit la latence perçue pour l'utilisateur, car il voit les progrès immédiatement. Le temps total de réponse dépend toujours de la vitesse d'inférence du modèle et de la longueur de la sortie.
Limites, erreurs et contexte
Votre clé API est limitée à 300 requêtes par minute. Si vous dépassez cette limite, vous recevrez une erreur 429 Trop de requêtes. La taille du corps de la requête est plafonnée à 8 Mo. Les erreurs d'authentification retournent un statut 401 si la clé est invalide. Les erreurs de facturation retournent un statut 402 si votre crédit prépayé est épuisé ; rechargez à partir de 10 $ pour rétablir le service.
Le modèle prend en charge une fenêtre de contexte de 100k (prompt + complétion). Assurez-vous que vos entrées tiennent dans cette limite. Si vous avez besoin de plus de contexte, vous devrez peut-être gérer le troncage dans la logique de votre application. Le modèle de codage sans censure est conçu pour la fiabilité, surveillez donc votre utilisation pour éviter les interruptions.
Fiche technique de l'API
Toutes les limites et fonctions réelles de l'API au même endroit — vérifiez-les avant de recharger.
| Élément | Valeur |
|---|---|
| Format | compatible OpenAI : tout SDK OpenAI fonctionne en changeant la base URL et la clé |
| Authentification | Authorization: Bearer YOUR_KEY |
| Base URL | https://api.uncensoredcodingai.com/v1 |
| Endpoints | POST /v1/chat/completions · GET /v1/models |
| ID du modèle | uncensored |
| Paramètres | temperature, top_p, stop, seed, presence_penalty, frequency_penalty |
| Streaming | oui — server-sent events ; le dernier bloc contient l'usage des tokens |
| Mode JSON | response_format: {"type": "json_object"} |
| Appel de fonctions | oui — tools, tool_choice ; réponse avec tool_calls, aussi en streaming ; résultats en role: tool |
| Fenêtre de contexte | 100 000 tokens (entrée + sortie) |
| Sortie max. | jusqu'au reste de la fenêtre de 100 000 tokens ; max_tokens optionnel (pas de plafond distinct) |
| En-têtes | X-Request-Id, X-Balance-USD, X-RateLimit-Limit-Requests, X-RateLimit-Limit-Concurrency |
| Limite de débit | 300 requêtes par minute et par clé |
| Concurrence | 8 requêtes simultanées par clé |
| Taille | jusqu'à 8 Mo par requête |
| Recharge | USDT (TRC20) ou USDC (Base), tout montant entier de 10 $ à 500 $ |
| Bonus | +5 % dès 50 $, +10 % dès 100 $ |
| Prix | 0,25 $ par million de tokens en entrée · 1,00 $ par million en sortie |
| Facturation | crédit prépayé selon l'usage réel ; erreurs et refus gratuits |
| Essai gratuit | 0,50 $ pendant 7 jours, sans carte · Clé d'essai : 2 requêtes parallèles, 60 par minute ; limites complètes (8 et 300) après la 1re recharge |
| Validité | le crédit payé n'expire jamais, sans abonnement |
| Contenu | contenu adulte autorisé ; tout contenu sexuel impliquant des mineurs est refusé |
| Connexion | Google ou e-mail et mot de passe |
| Clés | une clé active par compte ; une nouvelle remplace l'ancienne |
Codes d'erreur
Les erreurs arrivent en JSON avec un type stable ; les requêtes échouées ou refusées ne sont pas facturées.
| Code | Type | Signification |
|---|---|---|
400 | bad_request | JSON invalide, messages vides, mauvais paramètre ou contexte trop long |
401 | missing_key · invalid_key · key_revoked | clé absente, erronée ou remplacée |
402 | no_credit | plus de crédit — rechargez, la reprise est immédiate |
403 | content_blocked | contenu sexuel impliquant des mineurs — refusé, non facturé |
404 | not_found | endpoint inconnu |
413 | request_too_large | corps supérieur à 8 Mo |
429 | rate_limited · concurrency | au-delà de 300/min ou 8 en parallèle — patientez |
503 | upstream_busy | modèle occupé — réessayez dans quelques secondes |
Questions et réponses
Ce modèle est-il identique à GPT ou Claude ?
Non. Le modèle de codage sans censure est un modèle à poids ouverts exécuté sur nos propres serveurs. Il est ajusté pour des réponses directes sans les garde-fous typiques de GPT, Claude ou Gemini. Il ne s'agit pas d'une revente du modèle d'un autre fournisseur.
Que se passe-t-il si je manque de crédit ?
Les requêtes retourneront une erreur 402. Vous pouvez recharger votre compte avec du crédit à partir de 10 $ en utilisant des cryptomonnaies (USDT ou USDC). Un crédit bonus est disponible pour les recharges plus importantes, et votre crédit n'expire jamais.
Le modèle filtre-t-il tout le contenu ?
Non, il est sans censure pour les sujets adultes légaux, controversés et techniques. Cependant, une limite stricte de contenu s'applique toujours : le contenu sexuel impliquant des mineurs est bloqué. Tous les autres sujets sont traités sans refus.
Votre clé est à un formulaire de vous
Créez un compte, copiez la clé, modifiez l'URL de base. C'est toute la configuration.