무검열 AI 코딩 모델: API 문서
API 키로 인증하고 OpenAI 호환 엔드포인트로 요청을 보내 코딩용 무검열 AI 모델 사용을 시작하세요. 아래 코드 샘플을 사용하여 기존 워크플로우에 무검열 LLM을 즉시 통합하세요.
https://api.uncensoredcodingai.com/v1uncensored
Base URL 및 인증
당사의 API는 OpenAI chat-completions 구조를 따르므로 최소한의 구성으로 기존 SDK를 사용할 수 있습니다. Base URL은 https://api.uncensoredcodingai.com/v1입니다. 인증은 Authorization 헤더의 Bearer 토큰으로 처리됩니다. 가입 시 제공된 대로 API 키를 정확히 포함해야 합니다. 구독이나 월 요금이 없으며 선불 크레딧 선불 결제만 있습니다.
중요: 모델은 매우 관대하지만 모든 필터를 제거하지는 않습니다. 하드 콘텐츠 제한이 항상 적용됩니다: 미성년자가 포함된 성 콘텐츠가 포함된 요청은 차단됩니다. 기타 모든 합법적인 성인, 논쟁적 또는 기술적 주제는 거부 없이 처리됩니다.
첫 번째 요청
텍스트 생성을 위해 표준 채팅 완료 요청을 보내세요. 모델 ID는 uncensored입니다. 이는 GPT나 Claude의 복제본이 아닌 코드 생성 및 기술 작업에 최적화된 무검열 코딩 LLM입니다. 이 모델은 자체 GPU 서버에서 실행되며 직접적인 응답을 위해 조정된 오픈 웨이트 모델입니다.
curl https://api.uncensoredcodingai.com/v1/chat/completions \
-H "Authorization: Bearer $API_KEY" \
-H "Content-Type: application/json" \
-d '{
"model": "uncensored",
"messages": [{"role": "user", "content": "Write a blunt product review of a cheap VPN."}]
}'YOUR_API_KEY를 실제 키로 바꾸세요. 응답에는 choices[0].message.content 필드에 생성된 텍스트가 포함됩니다. 입력이 100,000 토큰 컨텍스트 창 내에 들어맞는지 확인하세요.
Python SDK 통합
공식 openai Python 패키지를 사용하여 API와 상호작용합니다. 커스텀 Base URL과 API 키를 사용하여 클라이언트를 초기화합니다. 이 방식은 이미 OpenAI 호환 엔드포인트를 지원하는 기존 코드베이스를 활용할 수 있게 해줍니다.
from openai import OpenAI
client = OpenAI(base_url="https://api.uncensoredcodingai.com/v1", api_key="YOUR_KEY")
resp = client.chat.completions.create(
model="uncensored",
messages=[{"role": "user", "content": "Summarise this thread without softening it."}],
)
print(resp.choices[0].message.content)이 스크립트는 프롬프트를 무검열 AI 모델에 전송하고 응답을 출력합니다. 모델 ID는 uncensored로 설정됩니다. 창의성과 출력 길이를 제어하기 위해 temperature 및 max_tokens 매개변수를 조정할 수 있습니다. 이전 대화의 전체 이력을 messages 배열에 전달하지 않는 한, 무검열 LLM은 이전 대화의 기억이 없음을 기억하세요.
Node SDK 통합
JavaScript 및 TypeScript 프로젝트의 경우 openai Node 패키지를 사용하세요. baseUrl 및 apiKey 환경 변수 또는 직접 값을 사용하여 클라이언트를 구성합니다.
import OpenAI from "openai";
const client = new OpenAI({ baseURL: "https://api.uncensoredcodingai.com/v1", apiKey: process.env.API_KEY });
const resp = await client.chat.completions.create({
model: "uncensored",
messages: [{ role: "user", content: "Draft a villain monologue for my game." }],
});
console.log(resp.choices[0].message.content);이 예시는 uncensored 모델을 사용하여 채팅 완료 요청을 생성합니다. 응답 객체에는 생성된 텍스트가 포함됩니다. Node.js 애플리케이션 로직 내에서 오류 및 상태 코드를 직접 처리할 수 있습니다. 이 방법은 필요에 따라 코드나 텍스트를 생성해야 하는 백엔드 서비스 또는 서버리스 함수에 이상적입니다.
스트리밍 응답
요청에 stream: true를 설정하여 스트리밍을 활성화하세요. API는 생성되는 대로 출력을 표시할 수 있는 SSE 스트림을 반환합니다. 이는 큰 코드 블록이나 긴 설명에 유용합니다.
stream = client.chat.completions.create(
model="uncensored",
messages=[{"role": "user", "content": "Tell the story in second person."}],
stream=True,
)
for chunk in stream:
if chunk.choices and chunk.choices[0].delta.content:
print(chunk.choices[0].delta.content, end="", flush=True)스트림 청크가 도착할 때 처리하세요. 각 청크에는 UI에 추가하거나 로깅할 수 있는 부분 텍스트가 포함됩니다. 스트리밍은 사용자가 즉시 진행 상황을 보게 되어 사용자의 지각된 지연 시간을 줄입니다. 총 응답 시간은 여전히 모델의 추론 속도와 출력 길이에 따라 달라집니다.
제한, 오류 및 컨텍스트
API 키는 분당 300개의 요청으로 제한됩니다. 이를 초과하면 429 Too Many Requests 오류가 발생합니다. 요청 본문 크기는 8 MB로 제한됩니다. 키가 유효하지 않으면 인증 오류로 401 상태가 반환됩니다. 선불 크레딧이 고갈되면 청구 오류로 402 상태가 반환되며, 서비스를 복구하려면 $10 이상 충전하세요.
모델은 100k 컨텍스트 창(프롬프트 + 완성)을 지원합니다. 입력이 이 제한 내에 들어오는지 확인하세요. 더 많은 컨텍스트가 필요한 경우 애플리케이션 로직에서 잘림을 관리해야 할 수 있습니다. 코딩용 무검열 AI 모델은 신뢰성을 위해 설계되었으므로 중단 방지를 위해 사용량을 모니터링하세요.
API 사양
크레딧을 구매하기 전에 확인할 수 있도록 API의 실제 한도와 기능을 한곳에 정리했습니다.
| 항목 | 내용 |
|---|---|
| 형식 | OpenAI 호환: 어떤 OpenAI SDK든 base URL과 키만 바꾸면 동작 |
| 인증 | Authorization: Bearer YOUR_KEY |
| Base URL | https://api.uncensoredcodingai.com/v1 |
| 엔드포인트 | POST /v1/chat/completions · GET /v1/models |
| 모델 ID | uncensored |
| 파라미터 | temperature, top_p, stop, seed, presence_penalty, frequency_penalty |
| 스트리밍 | 지원 — SSE, 마지막 청크에 토큰 사용량 포함 |
| JSON 모드 | response_format: {"type": "json_object"} |
| 함수 호출 | 지원 — tools, tool_choice; 응답에 tool_calls (스트리밍 포함), 결과는 role: tool로 전송 |
| 컨텍스트 창 | 100,000 토큰 (입력 + 출력) |
| 최대 출력 | 100,000 토큰 윈도우의 남은 만큼; max_tokens는 선택 사항(별도 상한 없음) |
| 응답 헤더 | X-Request-Id, X-Balance-USD, X-RateLimit-Limit-Requests, X-RateLimit-Limit-Concurrency |
| 속도 제한 | 키당 분당 300회 |
| 동시 요청 | 키당 동시 8개 |
| 요청 크기 | 최대 8 MB |
| 충전 | USDT (TRC20) 또는 USDC (Base), $10~$500 사이 원하는 정수 금액 |
| 보너스 | $50 이상 +5%, $100 이상 +10% |
| 가격 | 입력 100만 토큰당 $0.25 · 출력 100만 토큰당 $1.00 |
| 과금 | 선불 크레딧에서 실제 사용량만큼 차감, 오류·거부는 무료 |
| 무료 체험 | $0.50, 7일, 카드 불필요 · 체험 키: 동시 요청 2건, 분당 60건. 첫 충전 후 전체 한도(8건, 300건) 적용 |
| 유효기간 | 유료 크레딧은 만료되지 않으며 구독 없음 |
| 콘텐츠 | 성인 콘텐츠 허용, 미성년자가 관련된 성적 콘텐츠는 거부 |
| 로그인 | Google 또는 이메일과 비밀번호 |
| 키 | 계정당 활성 키 1개, 새 키를 만들면 이전 키는 무효 |
오류 코드
오류는 고정된 type을 가진 JSON으로 반환되며, 실패하거나 거부된 요청은 과금되지 않습니다.
| 코드 | 유형 | 의미 |
|---|---|---|
400 | bad_request | 잘못된 JSON, 빈 메시지, 잘못된 파라미터 또는 컨텍스트 초과 |
401 | missing_key · invalid_key · key_revoked | 키 없음·잘못됨·새 키로 교체됨 |
402 | no_credit | 잔액 없음 — 충전하면 즉시 재개 |
403 | content_blocked | 미성년자 관련 성적 콘텐츠 — 거부, 과금 없음 |
404 | not_found | 알 수 없는 엔드포인트 |
413 | request_too_large | 본문 8 MB 초과 |
429 | rate_limited · concurrency | 분당 300회 또는 동시 8개 초과 — 잠시 후 재시도 |
503 | upstream_busy | 모델 혼잡 — 몇 초 후 재시도 |
질문과 답변
이 모델은 GPT나 Claude와 동일한가요?
아니요. 코딩용 무검열 AI 모델은 자체 서버에서 실행되는 오픈 웨이트 모델입니다. GPT, Claude 또는 Gemini의 전형적인 가드레일 없이 직접적인 응답을 위해 조정되었습니다. 다른 벤더의 모델을 재판매한 것이 아닙니다.
크레딧이 부족하면 어떻게 되나요?
요청 시 402 오류가 반환됩니다. 암호화폐(USDT 또는 USDC)를 사용하여 계정 크레딧을 $10 이상 충전할 수 있습니다. 더 큰 금액의 충전 시 보너스 크레딧을 제공하며, 크레딧은 만료되지 않습니다.
모델이 모든 콘텐츠를 필터링하나요?
아니요, 합법적인 성인, 논쟁적 및 기술적 주제에 대해 무검열입니다. 그러나 하드 콘텐츠 제한이 항상 적용됩니다: 미성년자가 포함된 성 콘텐츠는 차단됩니다. 다른 모든 주제는 거부 없이 처리됩니다.
키는 양식 하나만 작성하면 받을 수 있습니다
계정을 생성하고 키를 복사한 후 Base URL을 변경하세요. 설정은 이것뿐입니다.