IT ▾

Chinese LLM APIDocumentazione

Ottieni la chiave API

Avvio rapido: connetti il tuo client

Collega il tuo client compatibile con OpenAI al nostro Chinese LLM API senza censura aggiornando l'URL di base e la chiave API. Questa guida rapida copre autenticazione, chat completions, streaming e chiamata di funzioni con esempi concreti.

URL di base
https://api.chinesellmapi.com/v1
Modello
senza censura

URL di base e autenticazione

La nostra API segue il formato standard OpenAI, consentendoti di cambiare provider modificando solo due variabili: l'URL di base e la chiave API. Puoi ottenere una chiave iscrivendoti alla pagina Ottieni chiave API con solo email e password. Non è richiesta la carta di credito per la prova e le chiavi possono essere rigenerate istantaneamente se compromesse.

Utilizza l'URL di base https://api.chinesellmapi.com/v1 nella configurazione del tuo client. L'ID del modello che devi inviare è uncensored. Si tratta di un modello a pesi aperti in esecuzione sulla nostra infrastruttura dedicata, distinto da GPT, Claude o altri modelli di vendor. È ottimizzato per rispondere senza rifiuti sui contenuti per uso adulto lecito.

Endpoint Chat Completions (POST /v1/chat/completions)

Invia testo e ricevi testo in risposta utilizzando l'endpoint standard per le chat completions. Questo endpoint supporta sia risposte non in streaming che in streaming, nonché la chiamata di funzioni/strumenti. Devi includere il campo model impostato su uncensored nel corpo della richiesta.

Le richieste sono limitate a 8 MB di dimensione del corpo. Se superi la finestra di contesto da 100.000 token (prompt + completamento), l'API rifiuterà la richiesta. Assicurati che il tuo client gestisca correttamente le risposte HTTP standard.

  • Input: corpo JSON con matrice messages.
  • Output: JSON con choices contenente message.content.

Esegui la tua prima richiesta con questo esempio:

curl https://api.chinesellmapi.com/v1/chat/completions \
  -H "Authorization: Bearer $API_KEY" \
  -H "Content-Type: application/json" \
  -d '{
    "model": "uncensored",
    "messages": [{"role": "user", "content": "Write a blunt product review of a cheap VPN."}]
  }'

Integrazione SDK Python

L'utilizzo dell'SDK Python ufficiale di OpenAI è il modo più semplice per integrare. Installa il pacchetto tramite pip e configura il client per puntare al nostro URL di base. Questo approccio funziona perfettamente con qualsiasi libreria basata sul client Python di OpenAI.

Ricorda che il nostro modello non è GPT-4 o un altro modello di vendor. È un modello senza censura. Regola di conseguenza la tua ingegneria dei prompt, poiché il modello potrebbe avere tendenze stilistiche diverse rispetto ad altri modelli.

Ecco come inizializzare il client e inviare una richiesta:

from openai import OpenAI

client = OpenAI(base_url="https://api.chinesellmapi.com/v1", api_key="YOUR_KEY")

resp = client.chat.completions.create(
    model="uncensored",
    messages=[{"role": "user", "content": "Summarise this thread without softening it."}],
)
print(resp.choices[0].message.content)

Integrazione SDK Node.js

Per progetti JavaScript o TypeScript, il pacchetto npm openai funziona con lievi modifiche alla configurazione. Imposta baseURL sul nostro endpoint API e fornisci la tua chiave API. Questo garantisce la compatibilità con codebase esistenti che si aspettano risposte standard OpenAI.

La struttura della risposta rimane identica al formato OpenAI, inclusi i campi id, object, created e choices. Ciò rende facile sostituire il nostro modello senza censura per test o produzione senza riscrivere la logica di parsing dei dati.

Configura e chiama l'API:

import OpenAI from "openai";

const client = new OpenAI({ baseURL: "https://api.chinesellmapi.com/v1", apiKey: process.env.API_KEY });

const resp = await client.chat.completions.create({
  model: "uncensored",
  messages: [{ role: "user", content: "Draft a villain monologue for my game." }],
});
console.log(resp.choices[0].message.content);

Risposte in streaming (SSE)

Abilita lo streaming impostando stream: true nella tua richiesta. L'API restituisce Server-Sent Events (SSE) contenenti chunk incrementali della risposta. Questo è ideale per le interfacce utente che devono visualizzare il testo in tempo reale mentre viene generato.

Ogni chunk contiene contenuto parziale in delta.content. Gestisci questi chunk in modo incrementale nel tuo client per aggiornare l'interfaccia utente. Lo stream termina quando viene ricevuto l'ultimo chunk con finish_reason impostato su stop o tool_calls.

Esempio di implementazione dello streaming:

stream = client.chat.completions.create(
    model="uncensored",
    messages=[{"role": "user", "content": "Tell the story in second person."}],
    stream=True,
)
for chunk in stream:
    if chunk.choices and chunk.choices[0].delta.content:
        print(chunk.choices[0].delta.content, end="", flush=True)

Limiti di velocità, errori e vincoli

Monitora il tuo utilizzo per evitare interruzioni. Ogni chiave API è limitata a 300 richieste al minuto. Se superi questo limite, riceverai un errore 429 Too Many Requests. I corpi delle richieste non devono superare 8 MB. La finestra di contesto è rigorosamente di 100.000 token per prompt e completamento combinati.

Gli errori comuni includono:

  • 401 Non autorizzato: chiave API non valida o mancante.
  • 402 Pagamento richiesto: credito prepagato insufficiente.
  • 429 Limite di velocità: superate 300 richieste al minuto.

I prezzi sono trasparenti: $0,25 per 1M token di input e $1,00 per 1M token di output. I crediti non scadono. Usa l'endpoint GET /v1/models per verificare i modelli disponibili, anche se solo uncensored è offerto per le chat completions.

Scheda tecnica dell'API

Tutti i limiti e le funzioni reali dell'API in un unico posto: controllali prima di ricaricare.

VoceValore
Formatocompatibile OpenAI: qualsiasi SDK OpenAI funziona cambiando base URL e chiave
ID modellouncensored
AutenticazioneAuthorization: Bearer YOUR_KEY
EndpointPOST /v1/chat/completions · GET /v1/models
Base URLhttps://api.chinesellmapi.com/v1
Finestra di contesto100.000 token (input + output)
Function callingsì — tools, tool_choice; risposte con tool_calls anche in streaming; risultati come role: tool
Parametritemperature, top_p, stop, seed, presence_penalty, frequency_penalty
Output massimofino al resto della finestra di 100.000 token; max_tokens opzionale (nessun limite separato)
Streamingsì — server-sent events; l'ultimo blocco riporta l'uso dei token
Modalità JSONresponse_format: {"type": "json_object"}
HeaderX-Request-Id, X-Balance-USD, X-RateLimit-Limit-Requests, X-RateLimit-Limit-Concurrency
Limite di frequenza300 richieste al minuto per chiave
Concorrenza8 richieste contemporanee per chiave
Dimensionefino a 8 MB per richiesta
Scadenzail credito pagato non scade, nessun abbonamento
Prezzo$0,25 per 1M token in input · $1,00 per 1M in output
RicaricaUSDT (TRC20) o USDC (Base), qualsiasi importo intero da $10 a $500
Prova gratuita$0,50 per 7 giorni, senza carta · Chiave di prova: 2 richieste parallele, 60 al minuto; limiti completi (8 e 300) dopo la prima ricarica
Fatturazionecredito prepagato in base all'uso reale; errori e rifiuti gratuiti
Bonus+5% da $50, +10% da $100
AccessoGoogle oppure e-mail e password
Contenuticontenuti per adulti consentiti; rifiutati i contenuti sessuali con minori
Chiaviuna chiave attiva per account; una nuova sostituisce la precedente

Codici di errore

Gli errori arrivano in JSON con un type fisso; le richieste fallite o rifiutate non si pagano.

CodiceTipoSignificato
400bad_requestJSON non valido, messaggi vuoti, parametro errato o contesto troppo lungo
401missing_key · invalid_key · key_revokedchiave mancante, errata o sostituita
402no_creditcredito esaurito — ricarica e riparti subito
403content_blockedcontenuti sessuali con minori — rifiutato, non addebitato
404not_foundendpoint sconosciuto
413request_too_largecorpo oltre 8 MB
429rate_limited · concurrencyoltre 300/min o 8 in parallelo — attendi e riprova
503upstream_busymodello occupato — riprova tra pochi secondi

Domande e risposte

Questo modello è GPT-4 o un altro modello OpenAI?

No. L'ID del modello è <code>uncensored</code>, un singolo modello senza censura, servito direttamente senza instradamento tra fornitori. Non è GPT-4, Claude o qualsiasi altro modello di fornitore. Risponde senza rifiuti a contenuti adulti leciti.

Conservate i miei dati per l'addestramento?

No. I prompt inviati all'API non vengono utilizzati per addestrare il tuo modello. Il tuo account richiede solo email e password, garantendo una raccolta dati minima.

Cosa succede se supero il limite di richieste?

Riceverai un codice di stato 429. Il limite è di 300 richieste al minuto per chiave API. Puoi rigenerare la chiave o attendere il reset della finestra. Non ci sono canoni mensili; paghi solo ciò che usi.

La tua chiave è a un modulo di distanza

Crea un account, copia la chiave, cambia l'URL di base. È tutta qui la configurazione.

Ottieni la chiave API