Bijgewerkt
Chinese LLM API gratis proefversie: hoe het werkt en veelgestelde vragen
Nieuwe accounts kunnen de API uitproberen voordat ze iets opwaarderen. Deze pagina beantwoordt de vragen die het meest naar voren komen: wat de proefperiode omvat, hoe ver $0,50 reikt, hoe sleutels werken, welke limieten en fouten je kunt verwachten en welke inhoud is toegestaan. Antwoorden zijn gegroepeerd per onderwerp, zodat je direct naar het relevante onderdeel kunt springen.
Over de proefversie
Wat krijg ik gratis?
Elk nieuw account ontvangt $0,50 aan tegoed. Dit tegoed is zeven dagen geldig vanaf de registratie en je hoeft geen betaalgegevens in te voeren om het te claimen. Het tegoed geldt voor dezelfde endpoint en hetzelfde model dat betaalde accounts gebruiken, dus wat je test, is wat je in productie zou draaien.
Hoe ver reikt $0,50?
Dit hangt af van je prompts, dus hier is een illustratie met uitgewerkte aannames. Stel dat elk verzoek 1.000 input tokens stuurt en 500 output tokens ontvangt. Bij $0,25 per miljoen input tokens en $1,00 per miljoen output tokens kost één verzoek $0,00025 plus $0,0005, wat neerkomt op $0,00075. Dan dekt $0,50 ongeveer 660 dergelijke verzoeken. Kortere uitwisselingen rekken dit verder uit, en calls met lange context verbruiken het tegoed sneller.
Wat gebeurt er als de proefperiode eindigt?
Als de zeven dagen voorbij zijn of het tegoed is opgebruikt, retourneren verzoeken HTTP 402 met de code no_credit. Er wordt niets verwijderd. Laad je prepaid saldo op en dezelfde sleutel werkt weer. Er is geen abonnement en opgeladen saldo verloopt nooit.
Moet ik betaalgegevens toevoegen om te starten?
Nee. Registratie vereist alleen een e-mailadres en een wachtwoord. De sleutel wordt direct na het registreren weergegeven op de pagina voor het ophalen van je sleutel.
Een praktisch plan voor de zeven dagen
Zeven dagen is meer dan genoeg als je van tevoren beslist wat je wilt leren. Behandel de proefperiode als een klein evaluatieproject in plaats van een omgeving om maar wat rond te neuzen. Hier is een volgorde die goed werkt voor de meeste teams:
- Dag 1, smoke test. Bevestig de sleutel, de modellenlijst en één korte voltooiing. De onderstaande commando's voeren alle drie de acties uit.
- Dagen 2 tot en met 3, je eigen prompts. Voer twintig tot vijftig representatieve inputs van je eigen product via de API. Sla de uitvoeren op naast de inputs, zodat een collega ze kan beoordelen zonder dat er opnieuw iets hoeft te worden uitgevoerd.
- Dag 4, failure paths. Trigger bewust een 400 met een te groot verzoek, een 401 met een verkeerde sleutel, en test je 429- en 503-handling met een kleine burst. Het is beter om dit nu te zien dan in productie.
- Dagen 5 tot en met 6, kostenmodel. Vermenigvuldig je genoteerde tokenaantallen met de gepubliceerde tarieven en projecteer een maandbedrag op basis van je eigen verkeersaannames.
- Dag 7, beslissing. Vergelijk kwaliteit, kosten en limieten met je vereisten en beslis vervolgens of je wilt opwaarderen.
export API_KEY="paste-your-key-here"
# 1) confirm the key works and see the model id
curl -s https://api.chinesellmapi.com/v1/models \
-H "Authorization: Bearer $API_KEY"
# 2) one short completion; read the usage block in the reply
curl -s https://api.chinesellmapi.com/v1/chat/completions \
-H "Authorization: Bearer $API_KEY" \
-H "Content-Type: application/json" \
-d '{"model":"uncensored","messages":[{"role":"user","content":"用一句话介绍杭州的春天。"}],"max_tokens":120}'
De tweede aanroep retourneert een gebruik-object met prompt- en voltooiingstokenaantallen. Log deze vanaf de eerste dag; dit is de grondstof voor elke kostenraming die je later zult maken.
Sleutels en aan de slag
Hoeveel sleutels kan ik hebben?
Eén per account. Als je er een nieuwe nodig hebt, regenereer deze dan via je account. De oude sleutel wordt direct ongeldig, dus update je deployments direct, anders zie je 401-fouten bij alles wat nog de vorige waarde gebruikt.
Waar moet ik de sleutel plaatsen?
In een omgevingsvariabele op je server, bijvoorbeeld genaamd API_KEY, en nooit in browsercode of een openbare repository. Verzoeken dragen deze als Authorization: Bearer <key>.
Wat is het kleinste verzoek dat bewijst dat het werkt?
Lijst de modellen op met GET /v1/models, stuur vervolgens een korte chatvoltooiing naar /v1/chat/completions met model uncensored en een lage max_tokens. Het gebruiksveld in de respons toont precies wat de aanroep kostte in tokens.
Kan ik de OpenAI SDK gebruiken?
Ja. De API is compatibel met OpenAI chatvoltooiingen. Wijs de basis-URL naar https://api.chinesellmapi.com/v1, lever je sleutel in en stel het model in op uncensored. Een volledige handleiding, inclusief prompts en scriptbesturing, vind je in de quickstart.
Limieten en mogelijkheden
Hoe lang kan een prompt en antwoord zijn?
Het contextvenster is 100.000 tokens, tellend prompt en voltooiing samen. De instelling max_tokens staat standaard op 2.048 en kan per verzoek worden verhoogd naar 32.000. Een requestbody kan maximaal 8 MB zijn. Als prompt plus max_tokens het venster overschrijdt, retourneert de API 400.
Hoeveel verzoeken kan ik sturen?
Elke sleutel is beperkt tot 300 verzoeken per minuut. Daarboven ontvang je 429. Verspreid batchtaken gelijkmatig en voeg een backoff toe; de batchhandleiding bevat een batchscript met timing.
Ondersteunt het streaming en function calling?
Ja op beide. Stel stream: true in voor server-sent events, met een laatste chunk die gebruikgegevens bevat. Tools worden geaccepteerd in OpenAI-formaat, en steekproefvelden zoals temperature, top_p en stop worden doorgegeven.
Wat is er niet beschikbaar?
Alleen tekst wordt aangeboden: geen embeddings, afbeeldingen, audio, video of fine-tuning. Er is één model. Als je project een van de ontbrekende functies nodig heeft, plan dan om deze API te combineren met een ander hulpmiddel voor dat onderdeel.
Fouten die je kunt tegenkomen
Welke statuscodes kan ik verwachten?
Fouten retourneren JSON in de vorm van {"error":{"code":...,"message":...}}. Een 400 betekent een foutief verzoek, 401 een ongeldige of ontbrekende sleutel, 402 no_credit, 403 content_blocked, 404 een onbekend endpoint, 429 de rate limit en 503 upstream_busy.
Welke fouten zijn het waard om opnieuw te proberen?
Alleen 429 en 503. Wacht, voeg willekeurige jitter toe en probeer het een beperkt aantal keren opnieuw; een paar seconden is genoeg voor 503. 400, 401, 402 of 403 opnieuw proberen verandert de uitkomst niet.
Ik heb opgewaardeerd maar zie nog steeds 402, wat nu?
Controleer of je de huidige sleutel gebruikt, omdat het opnieuw genereren van een sleutel de oude vervangt. Bevestig vervolgens of het verzoek naar de juiste basis-URL gaat. Als alles overeenkomt, stuur dan een minimaal verzoek en lees de foutmelding in de response body.
De proefkrediet zo lang mogelijk laten duren
Het tegoed is bewust klein, dus een paar gewoontes rekken het uit. Houd max_tokens laag terwijl je test, omdat uitvoertokens vier keer zo duur zijn als inputtokens: $1,00 per miljoen versus $0,25 per miljoen. Test eerst met korte, representatieve prompts en ga pas naar je langste inputs als de korte goed werken. Vermijd lussen die de API aanroepen zonder stopvoorwaarde, en beperk het aantal herhalingen in je eigen code.
Uitgewerkt voorbeeld met gestelde aannames: een evaluatieset van 50 prompts, elk ongeveer 600 input-tokens, met antwoorden beperkt tot 300 output-tokens. Eén run kost 30.000 input-tokens plus 15.000 output-tokens, wat $0,0075 plus $0,015 is, oftewel $0,0225. Je kunt die hele set ongeveer 22 keer draaien voordat het tegoed op is, wat genoeg is om verschillende promptvarianten goed te vergelijken.
Als je een zeer lange prompt doorgeeft, onthoud dan dat de hele prompt bij elke aanroep wordt gefactureerd. Een document van 40.000 tokens dat twintig keer wordt verzonden, kost evenveel als twintig aparte grote verzoeken, dus cache of vat gedeelde context samen waar je kunt. Huidige tarieven staan op de prijzenpagina en parameterdetails vind je in de documentatie.
Inhoudsregels en privacy
Welke inhoud is toegestaan?
Wettelijke volwassen inhoud, fictie en controversiële onderwerpen worden niet standaard geweigerd. De dienst is bedoeld voor volwassenen van 18 jaar of ouder. Voor langere fictie en personagegesprekken behandelt de fictiehandleiding promptstructuur en kosten.
Wat wordt altijd geblokkeerd?
Seksuele inhoud met minderjarigen wordt in alle gevallen geblokkeerd en retourneert een 403, inclusief fictie en roleplay. De blokkade kan niet worden gewijzigd door formulering van de prompt, dus probeer het niet opnieuw.
Worden mijn prompts gebruikt voor training?
Nee, prompts worden niet gebruikt voor training.
Vragen en antwoorden
Hoeveel gratis krediet krijgen nieuwe accounts?
Nieuwe accounts krijgen $0,50 aan proefkrediet, geldig voor 7 dagen, zonder dat betaalgegevens nodig zijn om je aan te melden.
Heb ik een kaart nodig om de proefversie te starten?
Geen betaalgegevens zijn nodig. Je registreert je met een e-mailadres en wachtwoord en je sleutel verschijnt direct.
Wat als het proefkrediet op raakt?
Verzoeken retourneren een 402 no_credit fout. Laad je prepaid saldo op en dezelfde sleutel blijft werken; er is geen abonnement.
Kan ik meerdere sleutels hebben?
Elk account heeft één sleutel. Je kunt deze regenereren, maar de vorige sleutel stopt direct met werken.
Welke limieten gelden tijdens de proefversie?
Hetzelfde als betaald gebruik: contextvenster van 100.000 tokens, max_tokens tot 32.000, verzoeklichamen van 8 MB en 300 verzoeken per minuut per sleutel.
Je sleutel is nog maar één formulier verwijderd
Maak een account aan, kopieer de sleutel, pas de basis-URL aan. Dat is de hele setup.