FR ▾

Chinese LLM APIFAQ de l'essai gratuit

Obtenir une clé API

Mis à jour le

Essai gratuit Chinese LLM API : fonctionnement et questions fréquentes

Les nouveaux comptes peuvent tester l'API sans recharger de crédit. Cette page répond aux questions les plus fréquentes : ce que comprend l'essai, ce que permettent les 0,50 $, le comportement des clés, les limites et erreurs à anticiper, et le contenu autorisé. Les réponses sont classées par thème pour que vous accédiez directement à celle qui vous intéresse.

À propos de l'essai

Que recevez-vous gratuitement ?

Chaque nouveau compte reçoit 0,50 $ de crédit. Il est valable sept jours à compter de l'inscription, et vous n'avez pas besoin de saisir de détails de paiement pour le réclamer. Le crédit s'applique au même endpoint et au même modèle que ceux utilisés par les comptes payants, ainsi ce que vous testez est ce que vous exécuteriez en production.

Ce que permettent les 0,50 $ ?

Cela dépend de vos prompts, voici donc une illustration avec des hypothèses précisées. Supposons que chaque requête envoie 1 000 tokens d'entrée et reçoive 500 tokens de sortie. À 0,25 $ par million de tokens d'entrée et 1,00 $ par million de tokens de sortie, une requête coûte 0,00025 $ plus 0,0005 $, soit 0,00075 $. Les 0,50 $ couvrent alors environ 660 requêtes de ce type. Les échanges plus courts étirent davantage le crédit, et les appels à fenêtre longue l'épuisent plus vite.

Que se passe-t-il à la fin de l'essai ?

Si les sept jours sont écoulés ou si le crédit est dépensé en premier, les requêtes retournent HTTP 402 avec le code no_credit. Rien n'est supprimé. Rechargez votre solde prépayé et la même clé fonctionne à nouveau. Il n'y a pas d'abonnement, et le solde rechargé n'expire jamais.

Dois-je ajouter des détails de paiement pour commencer ?

Non. L'inscription ne nécessite qu'une adresse e-mail et un mot de passe. La clé s'affiche immédiatement après votre inscription sur la page get-your-key.

Un plan pratique pour les sept jours

Sept jours suffisent amplement si vous décidez à l'avance ce que vous souhaitez apprendre. Traitez l'essai comme un petit projet d'évaluation plutôt que comme un espace pour tâtonner. Voici une séquence qui fonctionne bien pour la plupart des équipes :

  1. Jour 1, test de fumée. Confirmez la clé, la liste des modèles et une courte complétion. Les commandes ci-dessous réalisent ces trois actions.
  2. Jours 2 à 3, vos vrais prompts. Exécutez vingt à cinquante entrées représentatives issues de votre propre produit via l'API. Enregistrez les sorties à côté des entrées afin qu'un collègue puisse les examiner sans rien relancer.
  3. Jour 4, chemins d'échec. Déclenchez délibérément une erreur 400 avec une requête trop volumineuse, une 401 avec une clé incorrecte, et testez la gestion des 429 et 503 avec une petite rafale. Il vaut mieux les voir maintenant qu'en production.
  4. Jours 5 à 6, modèle de coût. Multipliez vos comptes de tokens enregistrés par les tarifs publiés et projetez un montant mensuel selon vos propres hypothites de trafic.
  5. Jour 7, décision. Comparez la qualité, le coût et les limites par rapport à vos exigences, puis décidez si vous souhaitez recharger.
export API_KEY="paste-your-key-here"

# 1) confirm the key works and see the model id
curl -s https://api.chinesellmapi.com/v1/models \
  -H "Authorization: Bearer $API_KEY"

# 2) one short completion; read the usage block in the reply
curl -s https://api.chinesellmapi.com/v1/chat/completions \
  -H "Authorization: Bearer $API_KEY" \
  -H "Content-Type: application/json" \
  -d '{"model":"uncensored","messages":[{"role":"user","content":"用一句话介绍杭州的春天。"}],"max_tokens":120}'

Le deuxième appel retourne un objet d'utilisation avec les comptes de tokens prompt et completion. Enregistrez-les dès le premier jour ; ils constituent la matière brute pour toute estimation de coût future.

Clés et démarrage

Combien de clés puis-je avoir ?

Une par compte. Si vous en avez besoin d'une nouvelle, régénérez-la depuis votre compte. L'ancienne clé cesse immédiatement de fonctionner, mettez donc vos déploiements à jour tout de suite, sinon vous verrez des erreurs 401 sur tout ce qui utilise encore l'ancienne valeur.

Où placer la clé ?

Dans une variable d'environnement sur votre serveur, nommée par exemple API_KEY, et jamais dans du code navigateur ou un dépôt public. Les requêtes la transmettent via Authorization: Bearer <key>.

Quelle est la plus petite requête qui prouve que cela fonctionne ?

Listez les modèles avec GET /v1/models, puis envoyez une courte complétion de chat à /v1/chat/completions avec le modèle uncensored et un max_tokens faible. Le champ usage dans la réponse indique exactement ce que l'appel a coûté en tokens.

Puis-je utiliser le SDK OpenAI ?

Oui. L'API est compatible avec les chat completions d'OpenAI. Pointez l'URL de base vers https://api.chinesellmapi.com/v1, fournissez votre clé et définissez le modèle sur uncensored. Un guide complet, incluant les prompts et le contrôle du script, se trouve dans le quickstart.

Limites et capacités

Quelle peut être la longueur d'un prompt et d'une réponse ?

La fenêtre de contexte est de 100 000 tokens, comptant le prompt et la complétion ensemble. Le paramètre max_tokens vaut par défaut 2 048 et peut être porté à 32 000 par requête. Un corps de requête peut faire jusqu'à 8 Mo. Si prompt plus max_tokens dépasse la fenêtre, l'API retourne 400.

Combien de requêtes puis-je envoyer ?

Chaque clé est limitée à 300 requêtes par minute. Au-delà, vous recevez un 429. Répartissez les tâches par lots uniformément et ajoutez un backoff ; le guide de traduction inclut un script de lot rythmé.

Prend-il en charge le streaming et l'appel de fonctions ?

Oui aux deux. Définissez stream: true pour les événements envoyés par le serveur, avec un dernier chunk contenant l'utilisation. Les outils sont acceptés au format OpenAI, et les champs d'échantillonnage tels que temperature, top_p et stop sont transmis tels quels.

Qu'est-ce qui n'est pas disponible ?

Seul le texte est proposé : pas d'embeddings, images, audio, vidéo ou fine-tuning. Il n'y a qu'un seul modèle. Si votre projet a besoin d'une des fonctionnalités manquantes, prévoyez d'associer cette API à un autre outil pour cette partie.

Erreurs que vous pouvez rencontrer

Quels codes de statut dois-je attendre ?

Les erreurs retournent un JSON de la forme {"error":{"code":...,"message":...}}. Un 400 signifie une requête malformée, un 401 une clé invalide ou manquante, un 402 no_credit, un 403 content_blocked, un 404 un endpoint inconnu, un 429 la limite de débit et un 503 upstream_busy.

Quelles erreurs valent la peine d'être réessayées ?

Seulement les 429 et 503. Attendez, ajoutez un jitter aléatoire, et réessayez un nombre limité de fois ; quelques secondes suffisent pour un 503. Réessayer les 400, 401, 402 ou 403 ne changera pas le résultat.

J'ai rechargé mais je vois toujours 402, que faire ?

Vérifiez que vous utilisez la clé actuelle, car régénérer une clé remplace l'ancienne. Confirmez ensuite que la requête est envoyée à la bonne URL de base. Si tout correspond, envoyez une requête minimale et lisez le message d'erreur dans le corps de la réponse.

Prolonger la durée du crédit d'essai

Le crédit est volontairement limité, donc quelques habitudes permettent de l'étirer. Gardez max_tokens bas pendant vos tests, car les tokens de sortie coûtent quatre fois plus cher que les tokens d'entrée : 1,00 $ par million contre 0,25 $ par million. Testez d'abord avec des prompts courts et représentatifs, puis passez à vos entrées les plus longues uniquement une fois que les courts fonctionnent correctement. Évitez les boucles qui appellent l'API sans condition d'arrêt, et limitez le nombre de tentatives dans votre propre code.

Exemple concret avec les hypothèses indiquées : un jeu d'évaluation de 50 prompts, chacun contenant environ 600 tokens d'entrée, avec des réponses limitées à 300 tokens de sortie. Un seul passage coûte 30 000 tokens d'entrée plus 15 000 tokens de sortie, soit 0,0075 $ plus 0,015 $, ou 0,0225 $. Vous pourriez exécuter cet ensemble complet environ 22 fois avant épuisement du crédit, ce qui suffit pour comparer correctement plusieurs variantes de prompts.

Si vous transmettez un prompt très long, rappelez-vous que l'intégralité du prompt est facturée à chaque appel. Un document de 40 000 tokens envoyé vingt fois coûte autant que vingt grandes requêtes distinctes, donc mettez en cache ou résumez le contexte partagé autant que possible. Les tarifs actuels sont listés sur la page de tarification, et les détails des paramètres se trouvent dans les docs.

Règles de contenu et confidentialité

Quel contenu est autorisé ?

Le contenu adulte légal, la fiction et les sujets controversés ne sont pas refusés en tant que tels. Le service est destiné aux adultes âgés de 18 ans ou plus. Pour la fiction longue et les chats de personnages, le guide fiction couvre la structure des prompts et les coûts.

Que bloque-t-on toujours ?

Le contenu sexuel impliquant des mineurs est bloqué dans tous les cas et renvoie une erreur 403, y compris pour la fiction et le jeu de rôle. Le blocage ne peut pas être modifié par la formulation du prompt, donc ne réessayez pas.

Mes prompts sont-ils utilisés pour l'entraînement ?

Non, les prompts ne sont pas utilisés pour l'entraînement.

Questions et réponses

Combien de crédit gratuit les nouveaux comptes reçoivent-ils ?

Les nouveaux comptes reçoivent 0,50 $ de crédit d'essai, valable 7 jours, sans besoin de fournir de détails de paiement pour s'inscrire.

Ai-je besoin d'une carte pour commencer l'essai ?

Aucun détail de paiement n'est nécessaire. Vous vous inscrivez avec une adresse e-mail et un mot de passe, et votre clé apparaît immédiatement.

Que se passe-t-il si le crédit d'essai est épuisé ?

Les requêtes renvoient une erreur 402 no_credit. Rechargez le solde prépayé et la même clé continue de fonctionner ; il n'y a pas d'abonnement.

Puis-je avoir plusieurs clés ?

Chaque compte possède une clé. Vous pouvez la régénérer, mais l'ancienne clé cesse immédiatement de fonctionner.

Quelles limites s'appliquent pendant l'essai ?

Les mêmes que pour l'utilisation payante : fenêtre de contexte de 100 000 tokens, max_tokens jusqu'à 32 000, corps de requête de 8 Mo et 300 requêtes par minute par clé.

Votre clé est à un formulaire de vous

Créez un compte, copiez la clé, modifiez l'URL de base. C'est toute la configuration nécessaire.

Obtenir une clé API