Snelstart: Verbind je client
Verbind je bestaande OpenAI-compatible client met onze ongecensureerde Chinese LLM API door de basis-URL en API-sleutel aan te passen. Deze snelstart behandelt authenticatie, chat-completies, streaming en tool calling met concrete voorbeelden.
- Basis-URL
- https://api.chinesellmapi.com/v1
- Model
- ongecensureerd
Basis-URL & Authenticatie
Onze API volgt de standaard OpenAI-indeling, zodat je van provider kunt wisselen door slechts twee variabelen aan te passen: de basis-URL en de API-sleutel. Je kunt een sleutel verkrijgen door je aan te melden op de API-sleutel verkrijgen pagina met alleen een e-mailadres en wachtwoord. Er is geen creditcard nodig voor de proefversie, en sleutels kunnen direct worden geregeneerd indien ze zijn gecompromitteerd.
Gebruik de basis-URL https://api.chinesellmapi.com/v1 in je clientconfiguratie. De model-ID die je moet verzenden is uncensored. Dit is een open-weight model dat draait op onze speciale infrastructuur, verschillend van GPT, Claude of andere leveranciersmodellen. Het is afgestemd om zonder inhoudsweigeringen te antwoorden voor wettelijk volwassen gebruik.
Chat Completies Endpoint (POST /v1/chat/completions)
Verstuur tekst en ontvang tekst via het standaard chat-completies endpoint. Dit endpoint ondersteunt zowel niet-streamende als streamende reacties, evenals tool/function calling. Je moet het veld model instellen op uncensored in je request body.
Verzoeken zijn beperkt tot 8 MB aan body-grootte. Als je het contextvenster van 100.000 tokens (prompt + completion) overschrijdt, zal de API het verzoek afwijzen. Zorg ervoor dat je client standaard HTTP-reacties correct verwerkt.
- Input: JSON-body met
messagesarray. - Output: JSON met
choicesbevattendemessage.content.
Maak je eerste verzoek met dit voorbeeld:
curl https://api.chinesellmapi.com/v1/chat/completions \
-H "Authorization: Bearer $API_KEY" \
-H "Content-Type: application/json" \
-d '{
"model": "uncensored",
"messages": [{"role": "user", "content": "Write a blunt product review of a cheap VPN."}]
}'
Python SDK Integratie
Het gebruik van de officiële OpenAI Python SDK is de meest eenvoudige manier om te integreren. Installeer het pakket via pip en configureer de client om naar onze basis-URL te wijzen. Deze aanpak werkt naadloos met elke bibliotheek die is gebouwd op de OpenAI Python client.
Onthoud dat ons model geen GPT-4 of een ander leveranciersmodel is. Het is een ongecensureerd model. Pas je prompt engineering daarop aan, aangezien het model andere stijltendensen kan hebben in vergelijking met andere modellen.
Zo initialiseer je de client en verstuur je een verzoek:
from openai import OpenAI
client = OpenAI(base_url="https://api.chinesellmapi.com/v1", api_key="YOUR_KEY")
resp = client.chat.completions.create(
model="uncensored",
messages=[{"role": "user", "content": "Summarise this thread without softening it."}],
)
print(resp.choices[0].message.content)
Node.js SDK Integratie
Voor JavaScript- of TypeScript-projecten werkt het openai npm-pakket met kleine configuratiewijzigingen. Stel de baseURL in op ons API-endpoint en verstrek je API-sleutel. Dit zorgt voor compatibiliteit met bestaande codebases die OpenAI-standaardreacties verwachten.
De responsstructuur blijft identiek aan de OpenAI-indeling, inclusief id, object, created en choices velden. Dit maakt het eenvoudig om ons ongecensureerde model te gebruiken voor testen of productie zonder je dataverwerkingslogica te herschrijven.
Configureer en roep de API aan:
import OpenAI from "openai";
const client = new OpenAI({ baseURL: "https://api.chinesellmapi.com/v1", apiKey: process.env.API_KEY });
const resp = await client.chat.completions.create({
model: "uncensored",
messages: [{ role: "user", content: "Draft a villain monologue for my game." }],
});
console.log(resp.choices[0].message.content);
Streamende Reacties (SSE)
Schakel streaming in door stream: true in je request in te stellen. De API retourneert Server-Sent Events (SSE) met incrementele chunks van de respons. Dit is ideaal voor gebruikersinterfaces die tekst in real-time moeten weergeven terwijl deze wordt gegenereerd.
Elke chunk bevat gedeeltelijke inhoud in delta.content. Verwerk deze chunks incrementeel in je client om de UI bij te werken. De stream eindigt wanneer de laatste chunk wordt ontvangen met finish_reason ingesteld op stop of tool_calls.
Voorbeeld streaming-implementatie:
stream = client.chat.completions.create(
model="uncensored",
messages=[{"role": "user", "content": "Tell the story in second person."}],
stream=True,
)
for chunk in stream:
if chunk.choices and chunk.choices[0].delta.content:
print(chunk.choices[0].delta.content, end="", flush=True)
Rate Limits, Fouten & Beperkingen
Houd je gebruik in de gaten om onderbrekingen te voorkomen. Elke API-sleutel is beperkt tot 300 verzoeken per minuut. Als je dit overschrijdt, ontvang je een 429 Too Many Requests fout. Request bodies mogen niet groter zijn dan 8 MB. Het contextvenster is strikt 100.000 tokens voor prompt plus completion samen.
Veelvoorkomende fouten zijn:
- 401 Unauthorized: Ongeldige of ontbrekende API-sleutel.
- 402 Payment Required: Onvoldoende prepaid tegoed.
- 429 Rate Limit: Meer dan 300 verzoeken per minuut overschreden.
Prijzen zijn transparant: $0,25 per 1M input tokens en $1,00 per 1M output tokens. Credits vervallen niet. Gebruik het GET /v1/models endpoint om beschikbare modellen te verifiëren, hoewel alleen uncensored wordt aangeboden voor chat-completies.
API-specificaties
Alle echte limieten en functies van de API op één plek — controleer ze voordat je opwaardeert.
| Onderdeel | Waarde |
|---|---|
| API-formaat | OpenAI-compatibel: elke OpenAI-SDK werkt — vervang alleen base URL en sleutel |
| Model-ID | uncensored |
| Authenticatie | Authorization: Bearer YOUR_KEY |
| Endpoints | POST /v1/chat/completions · GET /v1/models |
| Base URL | https://api.chinesellmapi.com/v1 |
| Contextvenster | 100.000 tokens (invoer + uitvoer) |
| Function calling | ja — tools, tool_choice; antwoorden bevatten tool_calls, ook bij streaming; resultaten als role: tool |
| Parameters | temperature, top_p, stop, seed, presence_penalty, frequency_penalty |
| Max. uitvoer | tot de rest van het venster van 100.000 tokens; max_tokens optioneel (geen aparte limiet) |
| Streaming | ja — server-sent events; het laatste deel bevat het tokenverbruik |
| JSON-modus | response_format: {"type": "json_object"} |
| Responsheaders | X-Request-Id, X-Balance-USD, X-RateLimit-Limit-Requests, X-RateLimit-Limit-Concurrency |
| Rate limit | 300 verzoeken per minuut per sleutel |
| Gelijktijdige verzoeken | tot 8 tegelijk per sleutel |
| Verzoekgrootte | tot 8 MB |
| Geldigheid | betaald tegoed verloopt niet, geen abonnement |
| Prijs | $0,25 per 1 mln invoertokens · $1,00 per 1 mln uitvoertokens |
| Opwaarderen | USDT (TRC20) of USDC (Base), elk heel bedrag van $10 tot $500 |
| Gratis proeftegoed | $0,50 voor 7 dagen, zonder kaart · Proefsleutel: 2 parallelle verzoeken, 60 per minuut; volledige limieten (8 en 300) na eerste opwaardering |
| Afrekening | prepaid tegoed op basis van echt verbruik; fouten en weigeringen zijn gratis |
| Bonus | +5% vanaf $50, +10% vanaf $100 |
| Inloggen | Google of e-mail en wachtwoord |
| Inhoud | inhoud voor volwassenen toegestaan; seksuele inhoud met minderjarigen wordt geweigerd |
| Sleutels | één actieve sleutel per account; een nieuwe vervangt de oude |
Foutcodes
Fouten komen als JSON met een vaste type; mislukte of geweigerde verzoeken kosten niets.
| Code | Type | Betekenis |
|---|---|---|
400 | bad_request | ongeldige JSON, lege berichten, verkeerde parameter of context te lang |
401 | missing_key · invalid_key · key_revoked | sleutel ontbreekt, is onjuist of is vervangen |
402 | no_credit | geen tegoed — waardeer op en ga direct verder |
403 | content_blocked | seksuele inhoud met minderjarigen — geweigerd, niet gerekend |
404 | not_found | onbekend endpoint |
413 | request_too_large | body groter dan 8 MB |
429 | rate_limited · concurrency | meer dan 300/min of 8 tegelijk — wacht en probeer opnieuw |
503 | upstream_busy | model bezet — probeer het over enkele seconden opnieuw |
Vragen en antwoorden
Is dit model GPT-4 of een ander OpenAI-model?
Nee. De model-ID is <code>uncensored</code>, een enkel ongecensureerd model, direct geleverd zonder routing tussen leveranciers. Het is geen GPT-4, Claude of een ander model van een andere leverancier. Het reageert zonder weigering op wettelijke volwassen inhoud.
Bewaren jullie mijn gegevens voor training?
Nee. Prompts die naar de API worden gestuurd, worden niet gebruikt voor het trainen van je model. Je account vereist alleen een e-mailadres en wachtwoord, wat minimale gegevensverzameling garandeert.
Wat gebeurt er als ik de rate limit overschrijd?
Je ontvangt een 429-statuscode. De limiet is 300 verzoeken per minuut per API-sleutel. Je kunt je sleutel regenereren of wachten tot het venster reset. Er zijn geen maandelijkse kosten; je betaalt alleen voor wat je gebruikt.
Je sleutel is nog maar één formulier verwijderd
Maak een account aan, kopieer de sleutel, pas de basis-URL aan. Dat is de hele setup.