시작하기: 클라이언트 연결
기존 OpenAI 호환 클라이언트를 업데이트된 base URL과 API 키로 우리의 무검열 Chinese LLM API에 연결하세요. 이 빠른 시작 가이드에는 인증, 채팅 완성, 스트리밍, 함수 호출에 대한 구체적인 예제가 포함되어 있습니다.
- 기본 URL
- https://api.chinesellmapi.com/v1
- 모델
- 무검열
Base URL 및 인증
우리의 API는 표준 OpenAI 형식을 따르므로 base URL과 API 키 두 가지 변수만 변경하면 공급자를 전환할 수 있습니다. 이메일과 비밀번호만으로 API 키 받기 페이지에서 가입하여 키를 얻을 수 있습니다. 체험용에는 신용카드가 필요 없으며, 키는 즉시 재생성할 수 있습니다.
클라이언트 구성에 base URL https://api.chinesellmapi.com/v1을 사용하세요. 전송해야 하는 모델 ID는 uncensored입니다. 이는 전용 인프라에서 실행되는 오픈 웨이트 모델로, GPT, Claude 또는 기타 벤더 모델과 구별됩니다. 합법적인 성인 용도에 대해 콘텐츠 거부 없이 답변하도록 조정되었습니다.
채팅 완성 엔드포인트 (POST /v1/chat/completions)
표준 채팅 완성 엔드포인트를 사용하여 텍스트를 입력하고 텍스트를 받습니다. 이 엔드포인트는 비스트리밍 및 스트리밍 응답과 도구/함수 호출을 모두 지원합니다. 요청 본문에 model 필드를 uncensored로 설정해야 합니다.
요청 본문 크기는 8 MB로 제한됩니다. 100,000 토큰 컨텍스트 창(프롬프트 + 완성)을 초과하면 API가 요청을 거부합니다. 클라이언트가 표준 HTTP 응답을 올바르게 처리하는지 확인하세요.
- 입력:
messages배열이 있는 JSON 본문. - 출력:
choices에message.content을 포함하는 JSON입니다.
이 예제를 사용하여 첫 번째 요청을 수행하세요:
curl https://api.chinesellmapi.com/v1/chat/completions \
-H "Authorization: Bearer $API_KEY" \
-H "Content-Type: application/json" \
-d '{
"model": "uncensored",
"messages": [{"role": "user", "content": "Write a blunt product review of a cheap VPN."}]
}'
Python SDK 통합
공식 OpenAI Python SDK를 사용하는 것이 통합을 위한 가장 간단한 방법입니다. pip를 통해 패키지를 설치하고 클라이언트를 Base URL로 설정하세요. 이 방식은 OpenAI Python 클라이언트를 기반으로 하는 모든 라이브러리와 원활하게 작동합니다.
우리의 모델이 GPT-4나 다른 벤더 모델이 아님을 기억하세요. 이 모델은 무검열 모델입니다. 다른 모델과 다른 스타일적 경향을 가질 수 있으므로 프롬프트 엔지니어링을 그에 맞게 조정하세요.
클라이언트 초기화 및 요청 보내기 방법:
from openai import OpenAI
client = OpenAI(base_url="https://api.chinesellmapi.com/v1", api_key="YOUR_KEY")
resp = client.chat.completions.create(
model="uncensored",
messages=[{"role": "user", "content": "Summarise this thread without softening it."}],
)
print(resp.choices[0].message.content)
Node.js SDK 통합
JavaScript 또는 TypeScript 프로젝트의 경우 openai npm 패키지는 약간의 구성 변경으로 작동합니다. baseURL을 API 엔드포인트로 설정하고 API 키를 제공하세요. 이는 OpenAI 표준 응답을 기대하는 기존 코드베이스와의 호환성을 보장합니다.
응답 구조는 id, object, created, choices 필드를 포함하여 OpenAI 형식과 동일하게 유지됩니다. 이를 통해 데이터 파싱 로직을 수정하지 않고도 테스트 또는 프로덕션 환경에서 무검열 모델로 쉽게 전환할 수 있습니다.
API 구성 및 호출:
import OpenAI from "openai";
const client = new OpenAI({ baseURL: "https://api.chinesellmapi.com/v1", apiKey: process.env.API_KEY });
const resp = await client.chat.completions.create({
model: "uncensored",
messages: [{ role: "user", content: "Draft a villain monologue for my game." }],
});
console.log(resp.choices[0].message.content);
스트리밍 응답 (SSE)
요청에 stream: true을 설정하여 스트리밍을 활성화하세요. API는 응답의 증분 청크를 포함하는 서버 전송 이벤트(SSE)를 반환합니다. 이는 생성되는 대로 텍스트를 실시간으로 표시해야 하는 사용자 인터페이스에 이상적입니다.
각 청크에는 delta.content에 부분 콘텐츠가 포함되어 있습니다. 클라이언트에서 이러한 청크를 증분적으로 처리하여 UI를 업데이트하세요. 스트림은 finish_reason이 stop 또는 tool_calls로 설정된 최종 청크가 수신되면 종료됩니다.
스트리밍 구현 예제:
stream = client.chat.completions.create(
model="uncensored",
messages=[{"role": "user", "content": "Tell the story in second person."}],
stream=True,
)
for chunk in stream:
if chunk.choices and chunk.choices[0].delta.content:
print(chunk.choices[0].delta.content, end="", flush=True)
속도 제한, 오류 및 제약 사항
중단을 피하려면 사용량을 모니터링하세요. 각 API 키는 분당 300개 요청으로 제한됩니다. 이를 초과하면 429 Too Many Requests 오류를 받습니다. 요청 본문은 8 MB를 초과할 수 없습니다. 컨텍스트 창은 프롬프트와 완성을 합쳐서 엄격히 100,000 토큰입니다.
일반적인 오류는 다음과 같습니다:
- 401 Unauthorized: 유효하지 않거나 누락된 API 키.
- 402 Payment Required: 선불 크레딧 부족.
- 429 Rate Limit: 분당 300개 요청 초과.
가격은 투명합니다: 입력 토큰 1M당 $0.25, 출력 토큰 1M당 $1.00. 크레딧은 만료되지 않습니다. 사용 가능한 모델을 확인하려면 GET /v1/models 엔드포인트를 사용하세요. 채팅 완성에는 오직 uncensored만 제공됩니다.
API 사양
크레딧을 구매하기 전에 확인할 수 있도록 API의 실제 한도와 기능을 한곳에 정리했습니다.
| 항목 | 내용 |
|---|---|
| 형식 | OpenAI 호환: 어떤 OpenAI SDK든 base URL과 키만 바꾸면 동작 |
| 모델 ID | uncensored |
| 인증 | Authorization: Bearer YOUR_KEY |
| 엔드포인트 | POST /v1/chat/completions · GET /v1/models |
| Base URL | https://api.chinesellmapi.com/v1 |
| 컨텍스트 창 | 100,000 토큰 (입력 + 출력) |
| 함수 호출 | 지원 — tools, tool_choice; 응답에 tool_calls (스트리밍 포함), 결과는 role: tool로 전송 |
| 파라미터 | temperature, top_p, stop, seed, presence_penalty, frequency_penalty |
| 최대 출력 | 100,000 토큰 윈도우의 남은 만큼; max_tokens는 선택 사항(별도 상한 없음) |
| 스트리밍 | 지원 — SSE, 마지막 청크에 토큰 사용량 포함 |
| JSON 모드 | response_format: {"type": "json_object"} |
| 응답 헤더 | X-Request-Id, X-Balance-USD, X-RateLimit-Limit-Requests, X-RateLimit-Limit-Concurrency |
| 속도 제한 | 키당 분당 300회 |
| 동시 요청 | 키당 동시 8개 |
| 요청 크기 | 최대 8 MB |
| 유효기간 | 유료 크레딧은 만료되지 않으며 구독 없음 |
| 가격 | 입력 100만 토큰당 $0.25 · 출력 100만 토큰당 $1.00 |
| 충전 | USDT (TRC20) 또는 USDC (Base), $10~$500 사이 원하는 정수 금액 |
| 무료 체험 | $0.50, 7일, 카드 불필요 · 체험 키: 동시 요청 2건, 분당 60건. 첫 충전 후 전체 한도(8건, 300건) 적용 |
| 과금 | 선불 크레딧에서 실제 사용량만큼 차감, 오류·거부는 무료 |
| 보너스 | $50 이상 +5%, $100 이상 +10% |
| 로그인 | Google 또는 이메일과 비밀번호 |
| 콘텐츠 | 성인 콘텐츠 허용, 미성년자가 관련된 성적 콘텐츠는 거부 |
| 키 | 계정당 활성 키 1개, 새 키를 만들면 이전 키는 무효 |
오류 코드
오류는 고정된 type을 가진 JSON으로 반환되며, 실패하거나 거부된 요청은 과금되지 않습니다.
| 코드 | 유형 | 의미 |
|---|---|---|
400 | bad_request | 잘못된 JSON, 빈 메시지, 잘못된 파라미터 또는 컨텍스트 초과 |
401 | missing_key · invalid_key · key_revoked | 키 없음·잘못됨·새 키로 교체됨 |
402 | no_credit | 잔액 없음 — 충전하면 즉시 재개 |
403 | content_blocked | 미성년자 관련 성적 콘텐츠 — 거부, 과금 없음 |
404 | not_found | 알 수 없는 엔드포인트 |
413 | request_too_large | 본문 8 MB 초과 |
429 | rate_limited · concurrency | 분당 300회 또는 동시 8개 초과 — 잠시 후 재시도 |
503 | upstream_busy | 모델 혼잡 — 몇 초 후 재시도 |
질문과 답변
이 모델이 GPT-4나 다른 OpenAI 모델인가요?
아니요. 모델 ID는 <code>uncensored</code>이며, 단일 무검열 모델입니다. 벤더 간 라우팅 없이 직접 제공됩니다. GPT-4, Claude 또는 기타 벤더 모델이 아닙니다. 합법적인 성인 콘텐츠에 대해 거부 없이 응답합니다.
내 데이터를 학습용으로 유지하나요?
아니요. API로 전송된 프롬프트는 모델 학습에 사용되지 않습니다. 계정 생성에는 이메일과 비밀번호만 필요하므로 데이터 수집이 최소화됩니다.
속도 제한을 초과하면 어떻게 되나요?
429 상태 코드를 받습니다. 제한은 API 키당 분당 300개 요청입니다. 키를 재생성하거나 시간 창이 초기화될 때까지 기다릴 수 있습니다. 월 구독료는 없으며, 사용한 만큼만 지불합니다.
키는 양식 하나만 작성하면 받을 수 있습니다
계정을 생성하고 키를 복사한 후 Base URL을 변경하세요. 설정은 이것뿐입니다.