NL ▾

Chinese LLM APIDocs

API-sleutel aanvragen

Snelstart: Verbind je client

Verbind je bestaande OpenAI-compatible client met onze ongecensureerde Chinese LLM API door de basis-URL en API-sleutel aan te passen. Deze snelstart behandelt authenticatie, chat-completies, streaming en tool calling met concrete voorbeelden.

Basis-URL
https://api.chinesellmapi.com/v1
Model
ongecensureerd

Basis-URL & Authenticatie

Onze API volgt de standaard OpenAI-indeling, zodat je van provider kunt wisselen door slechts twee variabelen aan te passen: de basis-URL en de API-sleutel. Je kunt een sleutel verkrijgen door je aan te melden op de API-sleutel verkrijgen pagina met alleen een e-mailadres en wachtwoord. Er is geen creditcard nodig voor de proefversie, en sleutels kunnen direct worden geregeneerd indien ze zijn gecompromitteerd.

Gebruik de basis-URL https://api.chinesellmapi.com/v1 in je clientconfiguratie. De model-ID die je moet verzenden is uncensored. Dit is een open-weight model dat draait op onze speciale infrastructuur, verschillend van GPT, Claude of andere leveranciersmodellen. Het is afgestemd om zonder inhoudsweigeringen te antwoorden voor wettelijk volwassen gebruik.

Chat Completies Endpoint (POST /v1/chat/completions)

Verstuur tekst en ontvang tekst via het standaard chat-completies endpoint. Dit endpoint ondersteunt zowel niet-streamende als streamende reacties, evenals tool/function calling. Je moet het veld model instellen op uncensored in je request body.

Verzoeken zijn beperkt tot 8 MB aan body-grootte. Als je het contextvenster van 100.000 tokens (prompt + completion) overschrijdt, zal de API het verzoek afwijzen. Zorg ervoor dat je client standaard HTTP-reacties correct verwerkt.

  • Input: JSON-body met messages array.
  • Output: JSON met choices bevattende message.content.

Maak je eerste verzoek met dit voorbeeld:

curl https://api.chinesellmapi.com/v1/chat/completions \
  -H "Authorization: Bearer $API_KEY" \
  -H "Content-Type: application/json" \
  -d '{
    "model": "uncensored",
    "messages": [{"role": "user", "content": "Write a blunt product review of a cheap VPN."}]
  }'

Python SDK Integratie

Het gebruik van de officiële OpenAI Python SDK is de meest eenvoudige manier om te integreren. Installeer het pakket via pip en configureer de client om naar onze basis-URL te wijzen. Deze aanpak werkt naadloos met elke bibliotheek die is gebouwd op de OpenAI Python client.

Onthoud dat ons model geen GPT-4 of een ander leveranciersmodel is. Het is een ongecensureerd model. Pas je prompt engineering daarop aan, aangezien het model andere stijltendensen kan hebben in vergelijking met andere modellen.

Zo initialiseer je de client en verstuur je een verzoek:

from openai import OpenAI

client = OpenAI(base_url="https://api.chinesellmapi.com/v1", api_key="YOUR_KEY")

resp = client.chat.completions.create(
    model="uncensored",
    messages=[{"role": "user", "content": "Summarise this thread without softening it."}],
)
print(resp.choices[0].message.content)

Node.js SDK Integratie

Voor JavaScript- of TypeScript-projecten werkt het openai npm-pakket met kleine configuratiewijzigingen. Stel de baseURL in op ons API-endpoint en verstrek je API-sleutel. Dit zorgt voor compatibiliteit met bestaande codebases die OpenAI-standaardreacties verwachten.

De responsstructuur blijft identiek aan de OpenAI-indeling, inclusief id, object, created en choices velden. Dit maakt het eenvoudig om ons ongecensureerde model te gebruiken voor testen of productie zonder je dataverwerkingslogica te herschrijven.

Configureer en roep de API aan:

import OpenAI from "openai";

const client = new OpenAI({ baseURL: "https://api.chinesellmapi.com/v1", apiKey: process.env.API_KEY });

const resp = await client.chat.completions.create({
  model: "uncensored",
  messages: [{ role: "user", content: "Draft a villain monologue for my game." }],
});
console.log(resp.choices[0].message.content);

Streamende Reacties (SSE)

Schakel streaming in door stream: true in je request in te stellen. De API retourneert Server-Sent Events (SSE) met incrementele chunks van de respons. Dit is ideaal voor gebruikersinterfaces die tekst in real-time moeten weergeven terwijl deze wordt gegenereerd.

Elke chunk bevat gedeeltelijke inhoud in delta.content. Verwerk deze chunks incrementeel in je client om de UI bij te werken. De stream eindigt wanneer de laatste chunk wordt ontvangen met finish_reason ingesteld op stop of tool_calls.

Voorbeeld streaming-implementatie:

stream = client.chat.completions.create(
    model="uncensored",
    messages=[{"role": "user", "content": "Tell the story in second person."}],
    stream=True,
)
for chunk in stream:
    if chunk.choices and chunk.choices[0].delta.content:
        print(chunk.choices[0].delta.content, end="", flush=True)

Rate Limits, Fouten & Beperkingen

Houd je gebruik in de gaten om onderbrekingen te voorkomen. Elke API-sleutel is beperkt tot 300 verzoeken per minuut. Als je dit overschrijdt, ontvang je een 429 Too Many Requests fout. Request bodies mogen niet groter zijn dan 8 MB. Het contextvenster is strikt 100.000 tokens voor prompt plus completion samen.

Veelvoorkomende fouten zijn:

  • 401 Unauthorized: Ongeldige of ontbrekende API-sleutel.
  • 402 Payment Required: Onvoldoende prepaid tegoed.
  • 429 Rate Limit: Meer dan 300 verzoeken per minuut overschreden.

Prijzen zijn transparant: $0,25 per 1M input tokens en $1,00 per 1M output tokens. Credits vervallen niet. Gebruik het GET /v1/models endpoint om beschikbare modellen te verifiëren, hoewel alleen uncensored wordt aangeboden voor chat-completies.

API-specificaties

Alle echte limieten en functies van de API op één plek — controleer ze voordat je opwaardeert.

OnderdeelWaarde
API-formaatOpenAI-compatibel: elke OpenAI-SDK werkt — vervang alleen base URL en sleutel
Model-IDuncensored
AuthenticatieAuthorization: Bearer YOUR_KEY
EndpointsPOST /v1/chat/completions · GET /v1/models
Base URLhttps://api.chinesellmapi.com/v1
Contextvenster100.000 tokens (invoer + uitvoer)
Function callingja — tools, tool_choice; antwoorden bevatten tool_calls, ook bij streaming; resultaten als role: tool
Parameterstemperature, top_p, stop, seed, presence_penalty, frequency_penalty
Max. uitvoertot de rest van het venster van 100.000 tokens; max_tokens optioneel (geen aparte limiet)
Streamingja — server-sent events; het laatste deel bevat het tokenverbruik
JSON-modusresponse_format: {"type": "json_object"}
ResponsheadersX-Request-Id, X-Balance-USD, X-RateLimit-Limit-Requests, X-RateLimit-Limit-Concurrency
Rate limit300 verzoeken per minuut per sleutel
Gelijktijdige verzoekentot 8 tegelijk per sleutel
Verzoekgroottetot 8 MB
Geldigheidbetaald tegoed verloopt niet, geen abonnement
Prijs$0,25 per 1 mln invoertokens · $1,00 per 1 mln uitvoertokens
OpwaarderenUSDT (TRC20) of USDC (Base), elk heel bedrag van $10 tot $500
Gratis proeftegoed$0,50 voor 7 dagen, zonder kaart · Proefsleutel: 2 parallelle verzoeken, 60 per minuut; volledige limieten (8 en 300) na eerste opwaardering
Afrekeningprepaid tegoed op basis van echt verbruik; fouten en weigeringen zijn gratis
Bonus+5% vanaf $50, +10% vanaf $100
InloggenGoogle of e-mail en wachtwoord
Inhoudinhoud voor volwassenen toegestaan; seksuele inhoud met minderjarigen wordt geweigerd
Sleutelséén actieve sleutel per account; een nieuwe vervangt de oude

Foutcodes

Fouten komen als JSON met een vaste type; mislukte of geweigerde verzoeken kosten niets.

CodeTypeBetekenis
400bad_requestongeldige JSON, lege berichten, verkeerde parameter of context te lang
401missing_key · invalid_key · key_revokedsleutel ontbreekt, is onjuist of is vervangen
402no_creditgeen tegoed — waardeer op en ga direct verder
403content_blockedseksuele inhoud met minderjarigen — geweigerd, niet gerekend
404not_foundonbekend endpoint
413request_too_largebody groter dan 8 MB
429rate_limited · concurrencymeer dan 300/min of 8 tegelijk — wacht en probeer opnieuw
503upstream_busymodel bezet — probeer het over enkele seconden opnieuw

Vragen en antwoorden

Is dit model GPT-4 of een ander OpenAI-model?

Nee. De model-ID is <code>uncensored</code>, een enkel ongecensureerd model, direct geleverd zonder routing tussen leveranciers. Het is geen GPT-4, Claude of een ander model van een andere leverancier. Het reageert zonder weigering op wettelijke volwassen inhoud.

Bewaren jullie mijn gegevens voor training?

Nee. Prompts die naar de API worden gestuurd, worden niet gebruikt voor het trainen van je model. Je account vereist alleen een e-mailadres en wachtwoord, wat minimale gegevensverzameling garandeert.

Wat gebeurt er als ik de rate limit overschrijd?

Je ontvangt een 429-statuscode. De limiet is 300 verzoeken per minuut per API-sleutel. Je kunt je sleutel regenereren of wachten tot het venster reset. Er zijn geen maandelijkse kosten; je betaalt alleen voor wat je gebruikt.

Je sleutel is nog maar één formulier verwijderd

Maak een account aan, kopieer de sleutel, pas de basis-URL aan. Dat is de hele setup.

API-sleutel aanvragen