Unzensiertes KI-Modell für Coding: API-Dokumentation
Starte mit dem unzensierten KI-Modell für Coding, indem du dich mit deinem API-Schlüssel authentifizierst und Anfragen an unseren OpenAI-kompatiblen Endpunkt sendest. Nutze die Codebeispiele unten, um das unzensierte LLM sofort in deine bestehenden Workflows zu integrieren.
https://api.uncensoredcodingai.com/v1uncensored
Base URL & Authentifizierung
Unsere API folgt der OpenAI-Struktur für Chat-Kompletierungen, sodass du bestehende SDKs mit minimaler Konfiguration nutzen kannst. Die Basis-URL ist https://api.uncensoredcodingai.com/v1. Die Authentifizierung erfolgt über ein Bearer-Token im Authorization-Header. Du musst deinen API-Schlüssel genau so eingeben, wie er bei der Anmeldung angegeben wurde; es gibt keine Abonnements oder monatlichen Gebühren, nur Prepaid-Guthaben im Pay-as-you-go-Modus.
Wichtig: Obwohl das Modell sehr tolerant ist, werden nicht alle Filter entfernt. Es gilt immer eine harte Inhaltsgrenze: Anfragen mit sexuellen Inhalten mit Minderjährigen werden blockiert. Alle anderen legalen erwachsenen, kontroversen oder technischen Themen werden ohne Verweigerung verarbeitet.
Erste Anfrage
Sende eine Standard-Chat-Completion-Anfrage, um Text zu generieren. Die Modell-ID ist uncensored. Dies ist ein unzensiertes Coding-LLM, das für Codegenerierung und technische Aufgaben optimiert ist, kein Klon von GPT oder Claude. Das Modell läuft auf unseren eigenen GPU-Servern und ist ein Open-Weight-Modell, das auf direkte Antworten abgestimmt ist.
curl https://api.uncensoredcodingai.com/v1/chat/completions \
-H "Authorization: Bearer $API_KEY" \
-H "Content-Type: application/json" \
-d '{
"model": "uncensored",
"messages": [{"role": "user", "content": "Write a blunt product review of a cheap VPN."}]
}'Ersetze YOUR_API_KEY durch deinen tatsächlichen Schlüssel. Die Antwort enthält den generierten Text im Feld choices[0].message.content. Stelle sicher, dass deine Eingabe in das 100.000-Token-Kontextfenster passt.
Python SDK-Integration
Nutze das offizielle openai Python-Paket, um mit der API zu interagieren. Initialisiere den Client mit der benutzerdefinierten Base URL und deinem API-Schlüssel. Dieser Ansatz ermöglicht es dir, bestehende Codebasen zu nutzen, die bereits OpenAI-kompatible Endpunkte unterstützen.
from openai import OpenAI
client = OpenAI(base_url="https://api.uncensoredcodingai.com/v1", api_key="YOUR_KEY")
resp = client.chat.completions.create(
model="uncensored",
messages=[{"role": "user", "content": "Summarise this thread without softening it."}],
)
print(resp.choices[0].message.content)Dieses Skript sendet einen Prompt an das unzensierte KI-Modell und gibt die Antwort aus. Die Modell-ID ist auf uncensored eingestellt. Du kannst die Parameter temperature und max_tokens anpassen, um Kreativität und Ausgabelänge zu steuern. Denke daran, dass das unzensierte LLM keinen Speicher für vorherige Unterhaltungen hat, es sei denn, du übergibst den vollständigen Verlauf im messages-Array.
Node SDK-Integration
Für JavaScript- und TypeScript-Projekte nutze das openai Node-Paket. Konfiguriere den Client mit den Umgebungsvariablen oder direkten Werten für baseUrl und apiKey.
import OpenAI from "openai";
const client = new OpenAI({ baseURL: "https://api.uncensoredcodingai.com/v1", apiKey: process.env.API_KEY });
const resp = await client.chat.completions.create({
model: "uncensored",
messages: [{ role: "user", content: "Draft a villain monologue for my game." }],
});
console.log(resp.choices[0].message.content);Dieses Beispiel erstellt eine Chat-Completion-Anfrage mit dem uncensored-Modell. Das Antwortobjekt enthält den generierten Text. Du kannst Fehler und Statuscodes direkt in deiner Node.js-Anwendungslogik behandeln. Diese Methode ist ideal für Backend-Services oder Serverless-Funktionen, die Code oder Text bei Bedarf generieren müssen.
Streaming-Antworten
Aktiviere Streaming, indem du stream: true in deiner Anfrage festlegst. Die API gibt einen Server-Sent Events (SSE)-Stream zurück, sodass du die Ausgabe anzeigen kannst, während sie generiert wird. Dies ist nützlich für große Codeblöcke oder ausführliche Erklärungen.
stream = client.chat.completions.create(
model="uncensored",
messages=[{"role": "user", "content": "Tell the story in second person."}],
stream=True,
)
for chunk in stream:
if chunk.choices and chunk.choices[0].delta.content:
print(chunk.choices[0].delta.content, end="", flush=True)Verarbeite die Stream-Chunks, sobald sie eintreffen. Jeder Chunk enthält partiellen Text, den du an deine UI anhängen oder protokollieren kannst. Streaming reduziert die wahrgenommene Latenz für den Benutzer, da Fortschritt sofort sichtbar wird. Die Gesamtantwortzeit hängt jedoch weiterhin von der Inferenzgeschwindigkeit des Modells und der Länge der Ausgabe ab.
Grenzen, Fehler & Kontext
Dein API-Schlüssel ist auf 300 Anfragen pro Minute begrenzt. Wenn du dies überschreitest, erhältst du einen 429 Too Many Requests-Fehler. Die Größe des Anfragekörpers ist auf 8 MB begrenzt. Authentifizierungsfehler geben einen 401-Status zurück, wenn der Schlüssel ungültig ist. Zahlungsfehler geben einen 402-Status zurück, wenn dein Prepaid-Guthaben aufgebraucht ist; lade ab 10 $ auf, um den Dienst wiederherzustellen.
Das Modell unterstützt ein 100k-Kontextfenster (Prompt + Completion). Stelle sicher, dass deine Eingaben in dieses Limit passen. Wenn du mehr Kontext benötigst, musst du möglicherweise das Abschneiden in deiner Anwendungslogik verwalten. Das unzensierte KI-Modell für Coding ist auf Zuverlässigkeit ausgelegt, also überwache deine Nutzung, um Unterbrechungen zu vermeiden.
API-Spezifikation
Eine Tabelle mit jedem Limit, jeder Funktion und jedem Preis.
| Merkmal | Wert |
|---|---|
| API-Format | OpenAI-kompatibel: jedes OpenAI-SDK funktioniert – nur Base-URL und Schlüssel ändern |
| Authentifizierung | Authorization: Bearer YOUR_KEY |
| Base-URL | https://api.uncensoredcodingai.com/v1 |
| Endpunkte | POST /v1/chat/completions · GET /v1/models |
| Modell-ID | uncensored |
| Parameter | temperature, top_p, stop, seed, presence_penalty, frequency_penalty |
| Streaming | ja – Server-Sent Events, der letzte Chunk enthält die Token-Nutzung |
| JSON-Modus | response_format: {"type": "json_object"} |
| Function Calling | ja – tools, tool_choice; Antworten mit tool_calls, auch im Stream; Ergebnisse als role: tool |
| Kontextfenster | 100.000 Tokens (Eingabe + Ausgabe) |
| Max. Ausgabe | bis zum Rest des 100.000-Token-Fensters; max_tokens optional (kein separates Limit) |
| Antwort-Header | X-Request-Id, X-Balance-USD, X-RateLimit-Limit-Requests, X-RateLimit-Limit-Concurrency |
| Ratenlimit | 300 Anfragen pro Minute und Schlüssel |
| Parallelität | 8 gleichzeitige Anfragen pro Schlüssel |
| Anfragegröße | bis 8 MB |
| Aufladen | USDT (TRC20) oder USDC (Base), jeder ganze Betrag von $10 bis $500 |
| Bonus | +5 % ab $50, +10 % ab $100 |
| Preis | $0,25 pro 1 Mio. Eingabe-Tokens · $1,00 pro 1 Mio. Ausgabe-Tokens |
| Abrechnung | Prepaid-Guthaben nach echter Nutzung; Fehler und Ablehnungen sind kostenlos |
| Testguthaben | $0,50 für 7 Tage, ohne Karte · Testschlüssel: 2 parallele Anfragen, 60 pro Minute; volle Limits (8 und 300) nach erster Aufladung |
| Gültigkeit | bezahltes Guthaben verfällt nie, kein Abo |
| Inhalte | Inhalte für Erwachsene erlaubt; sexuelle Inhalte mit Minderjährigen werden abgelehnt |
| Anmeldung | Google oder E-Mail und Passwort |
| Schlüssel | ein aktiver Schlüssel pro Konto; ein neuer ersetzt den alten |
Fehlercodes
Fehler kommen als JSON mit festem type; fehlgeschlagene oder abgelehnte Anfragen kosten nichts.
| Code | Typ | Bedeutung |
|---|---|---|
400 | bad_request | ungültiges JSON, leere Nachrichten, falscher Parameter oder Kontext zu lang |
401 | missing_key · invalid_key · key_revoked | Schlüssel fehlt, ist falsch oder wurde ersetzt |
402 | no_credit | kein Guthaben – aufladen, dann geht es sofort weiter |
403 | content_blocked | sexuelle Inhalte mit Minderjährigen – abgelehnt, nicht berechnet |
404 | not_found | unbekannter Endpunkt |
413 | request_too_large | Anfrage größer als 8 MB |
429 | rate_limited · concurrency | über 300/Min. oder 8 parallel – kurz warten |
503 | upstream_busy | Modell ausgelastet – in Sekunden erneut versuchen |
Fragen und Antworten
Ist dieses Modell dasselbe wie GPT oder Claude?
Nein. Das unzensierte KI-Modell für Coding ist ein Open-Weight-Modell, das auf unseren eigenen Servern läuft. Es ist auf direkte Antworten ohne die typischen Guardrails von GPT, Claude oder Gemini abgestimmt. Es ist kein Weiterverkauf des Modells eines anderen Anbieters.
Was passiert, wenn mein Guthaben aufgebraucht ist?
Die Anfragen geben einen 402-Fehler zurück. Du kannst dein Konto mit Guthaben ab 10 $ aufladen, Krypto (USDT oder USDC) akzeptiert. Bonusguthaben gibt es für größere Aufladungen, und dein Guthaben verfällt nie.
Filtert das Modell alle Inhalte?
Nein, es ist unzensiert für legale erwachsene, kontroverse und technische Themen. Es gilt jedoch immer eine harte Inhaltsgrenze: Sexuelle Inhalte mit Minderjährigen werden blockiert. Alle anderen Themen werden ohne Verweigerung verarbeitet.
Dein Schlüssel ist nur ein Formular entfernt
Erstelle ein Konto, kopiere den Schlüssel, ändere die Base URL. Das ist die gesamte Einrichtung.