Aggiornato il
Prova gratuita di Chinese LLM API: come funziona e le domande più frequenti
I nuovi account possono provare l'API prima di ricaricare. Questa pagina risponde alle domande più frequenti: cosa include la prova, quanto vale $0,50, come si comportano le chiavi, quali limiti e errori aspettarsi e quali contenuti sono consentiti. Le risposte sono raggruppate per argomento così che tu possa saltare direttamente a quella che ti serve.
Informazioni sulla prova
Cosa ottengo gratuitamente?
Ogni nuovo account riceve $0,50 di credito. È valido per sette giorni dalla registrazione e non devi inserire i dati di pagamento per ottenerlo. Il credito si applica allo stesso endpoint e allo stesso modello usati dagli account a pagamento, quindi ciò che testi è ciò che useresti in produzione.
Quanto lontano arriva $0,50?
Dipende dai tuoi prompt, quindi ecco un'illustrazione con le ipotesi esplicitate. Supponiamo che ogni richiesta invii 1.000 token di input e riceva 500 token di output. A $0,25 per milione di token di input e $1,00 per milione di token di output, una richiesta costa $0,00025 più $0,0005, per un totale di $0,00075. Quindi $0,50 coprono circa 660 richieste di questo tipo. Scambi più brevi durano di più, mentre le chiamate con contesto lungo consumano il credito più velocemente.
Cosa succede quando finisce la prova?
Se scadono i sette giorni o il credito si esaurisce prima, le richieste restituiscono HTTP 402 con il codice no_credit. Non viene cancellato nulla. Ricarica il saldo prepagato e la stessa chiave funzionerà di nuovo. Non c'è abbonamento e il saldo ricaricato non scade mai.
Devo aggiungere i dati di pagamento per iniziare?
No. La registrazione richiede solo un'email e una password. La chiave viene visualizzata subito dopo la registrazione alla pagina get-your-key.
Un piano pratico per i sette giorni
Sette giorni sono sufficienti se decidi in anticipo cosa vuoi imparare. Tratta la prova come un piccolo progetto di valutazione piuttosto che come un luogo dove fare esperimenti casuali. Ecco una sequenza che funziona bene per la maggior parte dei team:
- Giorno 1, test di fumo. Conferma la chiave, l'elenco dei modelli e una breve completazione. I comandi seguenti eseguono tutte e tre le operazioni.
- Giorni 2-3, i tuoi prompt reali. Esegui venti o cinquanta input rappresentativi dal tuo prodotto reale tramite l'API. Salva gli output accanto agli input così che un collega possa revisionarli senza dover eseguire nuovamente nulla.
- Giorno 4, percorsi di errore. Attiva deliberatamente un errore 400 con una richiesta troppo grande, un 401 con una chiave errata e testa la gestione di 429 e 503 con un piccolo burst. È meglio vedere questi errori ora che in produzione.
- Giorni 5-6, modello di costo. Moltiplica i conteggi dei token registrati dai tassi pubblicati e proietta una cifra mensile sotto le tue ipotesi di traffico.
- Giorno 7, decisione. Confronta qualità, costo e limiti rispetto ai tuoi requisiti, quindi decidi se ricaricare.
export API_KEY="paste-your-key-here"
# 1) confirm the key works and see the model id
curl -s https://api.chinesellmapi.com/v1/models \
-H "Authorization: Bearer $API_KEY"
# 2) one short completion; read the usage block in the reply
curl -s https://api.chinesellmapi.com/v1/chat/completions \
-H "Authorization: Bearer $API_KEY" \
-H "Content-Type: application/json" \
-d '{"model":"uncensored","messages":[{"role":"user","content":"用一句话介绍杭州的春天。"}],"max_tokens":120}'
La seconda chiamata restituisce un oggetto di utilizzo con i conteggi dei token di prompt e completamento. Registra questi dati fin dal primo giorno; sono la materia prima per ogni stima dei costi che farai in seguito.
Chiavi e primi passi
Quante chiavi posso avere?
Una per account. Se ne hai bisogno di una nuova, rigenerala dal tuo account. La chiave precedente smette di funzionare immediatamente, quindi aggiorna i tuoi deploy subito, altrimenti vedrai errori 401 da tutto ciò che sta ancora usando il valore precedente.
Dove devo inserire la chiave?
In una variabile d'ambiente sul tuo server, ad esempio denominata API_KEY, e mai nel codice del browser o in un repository pubblico. Le richieste la trasmettono come Authorization: Bearer <key>.
Qual è la richiesta più piccola che dimostra che funziona?
Elenca i modelli con GET /v1/models, quindi invia una breve chat completion a /v1/chat/completions con il modello uncensored e un max_tokens basso. Il campo usage nella risposta mostra esattamente quanto è costata la chiamata in token.
Posso usare l'SDK OpenAI?
Sì. L'API è compatibile con le chat completions di OpenAI. Imposta l'URL di base su https://api.chinesellmapi.com/v1, fornisci la tua chiave e imposta il modello su uncensored. Una guida completa, inclusi prompt e controllo degli script, è disponibile nella quickstart.
Limiti e funzionalità
Quanto possono essere lunghi un prompt e una risposta?
La finestra di contesto è di 100.000 token, contando prompt e completazione insieme. L'impostazione max_tokens ha un valore predefinito di 2.048 e può essere aumentata fino a 32.000 per richiesta. Un corpo della richiesta può essere fino a 8 MB. Se prompt più max_tokens superano la finestra, l'API restituisce 400.
Quante richieste posso inviare?
Ogni chiave è limitata a 300 richieste al minuto. Oltre questo limite ricevi un 429. Distribuisci uniformemente i job batch e aggiungi un backoff; la guida alla traduzione include uno script batch a ritmo.
Supporta lo streaming e la chiamata di funzioni?
Sì a entrambi. Imposta stream: true per gli eventi inviati dal server, con un ultimo chunk che trasporta l'utilizzo. Gli strumenti sono accettati nel formato OpenAI e i campi di campionamento come temperature, top_p e stop vengono passati invariati.
Cosa non è disponibile?
Viene offerto solo testo: nessun embedding, immagini, audio, video o fine-tuning. C'è un unico modello. Se il tuo progetto ha bisogno di una delle funzionalità mancanti, pianifica di associare questa API a un altro strumento per quella parte.
Errori che potresti incontrare
Quali codici di stato devo aspettarmi?
Gli errori restituiscono un JSON strutturato come {"error":{"code":...,"message":...}}. Un 400 indica una richiesta malformata, un 401 una chiave non valida o mancante, un 402 no_credit, un 403 content_blocked, un 404 un endpoint sconosciuto, un 429 il limite di richieste e un 503 upstream_busy.
Quali errori vale la pena ritentare?
Solo 429 e 503. Attendi, aggiungi un jitter casuale e ritenta per un numero limitato di volte; pochi secondi sono sufficienti per un 503. Ritentare 400, 401, 402 o 403 non cambierà il risultato.
Ho ricaricato ma vedo ancora 402, cosa faccio?
Verifica di usare la chiave corrente, poiché la rigenerazione di una chiave sostituisce quella vecchia. Poi conferma che la richiesta vada all'URL di base corretto. Se tutto corrisponde, invia una richiesta minima e leggi il messaggio di errore nel corpo della risposta.
Far durare il credito di prova
Il credito è piccolo per progettazione, quindi alcune abitudini lo fanno durare di più. Tieni max_tokens basso mentre testi, poiché i token di output costano quattro volte tanto rispetto ai token di input: $1,00 per milione contro $0,25 per milione. Testa prima con prompt brevi e rappresentativi e passa ai tuoi input più lunghi solo quando quelli brevi funzionano. Evita loop che chiamano l'API senza una condizione di stop e limita il numero di tentativi nel tuo codice.
Esempio di calcolo con le assunzioni dichiarate: un set di valutazione di 50 prompt, ciascuno di circa 600 token di input, con risposte limitate a 300 token di output. Un passaggio costa 30.000 token di input più 15.000 token di output, che è $0,0075 più $0,015, ovvero $0,0225. Potresti eseguire l'intero set circa 22 volte prima che il credito si esaurisca, il che è sufficiente per confrontare correttamente diverse varianti di prompt.
Se passi un prompt molto lungo, ricorda che l'intero prompt viene fatturato su ogni chiamata. Un documento da 40.000 token inviato venti volte costa quanto venti grandi richieste separate, quindi metti in cache o riassumi il contesto condiviso dove puoi. I tariffari attuali sono elencati nella pagina dei prezzi e i dettagli sui parametri sono nella documentazione.
Regole sui contenuti e privacy
Quali contenuti sono consentiti?
I contenuti adulti leciti, la narrativa e gli argomenti controversi non vengono rifiutati in quanto tali. Il servizio è per adulti di età pari o superiore a 18 anni. Per narrativa estesa e chat con personaggi, la guida alla narrativa copre la struttura del prompt e i costi.
Cosa viene sempre bloccato?
I contenuti sessuali che coinvolgono minori sono bloccati in ogni caso e restituiscono un 403, inclusa la narrativa e il roleplay. Il blocco non può essere modificato con la formulazione del prompt, quindi non riprovare.
I miei prompt vengono usati per l'addestramento?
No, i prompt non vengono usati per l'addestramento.
Domande e risposte
Quanto credito gratuito ricevono i nuovi account?
I nuovi account ricevono $0,50 di credito di prova, valido per 7 giorni, senza bisogno di inserire i dettagli di pagamento per registrarsi.
Ho bisogno di una carta per iniziare la prova?
Non sono necessari i dettagli di pagamento. Ti registri con email e password e la tua chiave appare subito.
Cosa succede se il credito di prova si esaurisce?
Le richieste restituiscono un errore 402 no_credit. Ricarica il saldo prepagato e la stessa chiave continua a funzionare; non c'è abbonamento.
Posso avere più chiavi?
Ogni account ha una chiave. Puoi rigenerarla, ma la chiave precedente smette di funzionare immediatamente.
Quali limiti si applicano durante la prova?
Gli stessi dell'uso a pagamento: contesto di 100.000 token, max_tokens fino a 32.000, corpi delle richieste fino a 8 MB e 300 richieste al minuto per chiave.
La tua chiave è a un modulo di distanza
Crea un account, copia la chiave, cambia l'URL di base. È tutta la configurazione.