Avvio rapido: connetti il tuo client
Collega il tuo client compatibile con OpenAI al nostro Chinese LLM API senza censura aggiornando l'URL di base e la chiave API. Questa guida rapida copre autenticazione, chat completions, streaming e chiamata di funzioni con esempi concreti.
- URL di base
- https://api.chinesellmapi.com/v1
- Modello
- senza censura
URL di base e autenticazione
La nostra API segue il formato standard OpenAI, consentendoti di cambiare provider modificando solo due variabili: l'URL di base e la chiave API. Puoi ottenere una chiave iscrivendoti alla pagina Ottieni chiave API con solo email e password. Non è richiesta la carta di credito per la prova e le chiavi possono essere rigenerate istantaneamente se compromesse.
Utilizza l'URL di base https://api.chinesellmapi.com/v1 nella configurazione del tuo client. L'ID del modello che devi inviare è uncensored. Si tratta di un modello a pesi aperti in esecuzione sulla nostra infrastruttura dedicata, distinto da GPT, Claude o altri modelli di vendor. È ottimizzato per rispondere senza rifiuti sui contenuti per uso adulto lecito.
Endpoint Chat Completions (POST /v1/chat/completions)
Invia testo e ricevi testo in risposta utilizzando l'endpoint standard per le chat completions. Questo endpoint supporta sia risposte non in streaming che in streaming, nonché la chiamata di funzioni/strumenti. Devi includere il campo model impostato su uncensored nel corpo della richiesta.
Le richieste sono limitate a 8 MB di dimensione del corpo. Se superi la finestra di contesto da 100.000 token (prompt + completamento), l'API rifiuterà la richiesta. Assicurati che il tuo client gestisca correttamente le risposte HTTP standard.
- Input: corpo JSON con matrice
messages. - Output: JSON con
choicescontenentemessage.content.
Esegui la tua prima richiesta con questo esempio:
curl https://api.chinesellmapi.com/v1/chat/completions \
-H "Authorization: Bearer $API_KEY" \
-H "Content-Type: application/json" \
-d '{
"model": "uncensored",
"messages": [{"role": "user", "content": "Write a blunt product review of a cheap VPN."}]
}'
Integrazione SDK Python
L'utilizzo dell'SDK Python ufficiale di OpenAI è il modo più semplice per integrare. Installa il pacchetto tramite pip e configura il client per puntare al nostro URL di base. Questo approccio funziona perfettamente con qualsiasi libreria basata sul client Python di OpenAI.
Ricorda che il nostro modello non è GPT-4 o un altro modello di vendor. È un modello senza censura. Regola di conseguenza la tua ingegneria dei prompt, poiché il modello potrebbe avere tendenze stilistiche diverse rispetto ad altri modelli.
Ecco come inizializzare il client e inviare una richiesta:
from openai import OpenAI
client = OpenAI(base_url="https://api.chinesellmapi.com/v1", api_key="YOUR_KEY")
resp = client.chat.completions.create(
model="uncensored",
messages=[{"role": "user", "content": "Summarise this thread without softening it."}],
)
print(resp.choices[0].message.content)
Integrazione SDK Node.js
Per progetti JavaScript o TypeScript, il pacchetto npm openai funziona con lievi modifiche alla configurazione. Imposta baseURL sul nostro endpoint API e fornisci la tua chiave API. Questo garantisce la compatibilità con codebase esistenti che si aspettano risposte standard OpenAI.
La struttura della risposta rimane identica al formato OpenAI, inclusi i campi id, object, created e choices. Ciò rende facile sostituire il nostro modello senza censura per test o produzione senza riscrivere la logica di parsing dei dati.
Configura e chiama l'API:
import OpenAI from "openai";
const client = new OpenAI({ baseURL: "https://api.chinesellmapi.com/v1", apiKey: process.env.API_KEY });
const resp = await client.chat.completions.create({
model: "uncensored",
messages: [{ role: "user", content: "Draft a villain monologue for my game." }],
});
console.log(resp.choices[0].message.content);
Risposte in streaming (SSE)
Abilita lo streaming impostando stream: true nella tua richiesta. L'API restituisce Server-Sent Events (SSE) contenenti chunk incrementali della risposta. Questo è ideale per le interfacce utente che devono visualizzare il testo in tempo reale mentre viene generato.
Ogni chunk contiene contenuto parziale in delta.content. Gestisci questi chunk in modo incrementale nel tuo client per aggiornare l'interfaccia utente. Lo stream termina quando viene ricevuto l'ultimo chunk con finish_reason impostato su stop o tool_calls.
Esempio di implementazione dello streaming:
stream = client.chat.completions.create(
model="uncensored",
messages=[{"role": "user", "content": "Tell the story in second person."}],
stream=True,
)
for chunk in stream:
if chunk.choices and chunk.choices[0].delta.content:
print(chunk.choices[0].delta.content, end="", flush=True)
Limiti di velocità, errori e vincoli
Monitora il tuo utilizzo per evitare interruzioni. Ogni chiave API è limitata a 300 richieste al minuto. Se superi questo limite, riceverai un errore 429 Too Many Requests. I corpi delle richieste non devono superare 8 MB. La finestra di contesto è rigorosamente di 100.000 token per prompt e completamento combinati.
Gli errori comuni includono:
- 401 Non autorizzato: chiave API non valida o mancante.
- 402 Pagamento richiesto: credito prepagato insufficiente.
- 429 Limite di velocità: superate 300 richieste al minuto.
I prezzi sono trasparenti: $0,25 per 1M token di input e $1,00 per 1M token di output. I crediti non scadono. Usa l'endpoint GET /v1/models per verificare i modelli disponibili, anche se solo uncensored è offerto per le chat completions.
Scheda tecnica dell'API
Tutti i limiti e le funzioni reali dell'API in un unico posto: controllali prima di ricaricare.
| Voce | Valore |
|---|---|
| Formato | compatibile OpenAI: qualsiasi SDK OpenAI funziona cambiando base URL e chiave |
| ID modello | uncensored |
| Autenticazione | Authorization: Bearer YOUR_KEY |
| Endpoint | POST /v1/chat/completions · GET /v1/models |
| Base URL | https://api.chinesellmapi.com/v1 |
| Finestra di contesto | 100.000 token (input + output) |
| Function calling | sì — tools, tool_choice; risposte con tool_calls anche in streaming; risultati come role: tool |
| Parametri | temperature, top_p, stop, seed, presence_penalty, frequency_penalty |
| Output massimo | fino al resto della finestra di 100.000 token; max_tokens opzionale (nessun limite separato) |
| Streaming | sì — server-sent events; l'ultimo blocco riporta l'uso dei token |
| Modalità JSON | response_format: {"type": "json_object"} |
| Header | X-Request-Id, X-Balance-USD, X-RateLimit-Limit-Requests, X-RateLimit-Limit-Concurrency |
| Limite di frequenza | 300 richieste al minuto per chiave |
| Concorrenza | 8 richieste contemporanee per chiave |
| Dimensione | fino a 8 MB per richiesta |
| Scadenza | il credito pagato non scade, nessun abbonamento |
| Prezzo | $0,25 per 1M token in input · $1,00 per 1M in output |
| Ricarica | USDT (TRC20) o USDC (Base), qualsiasi importo intero da $10 a $500 |
| Prova gratuita | $0,50 per 7 giorni, senza carta · Chiave di prova: 2 richieste parallele, 60 al minuto; limiti completi (8 e 300) dopo la prima ricarica |
| Fatturazione | credito prepagato in base all'uso reale; errori e rifiuti gratuiti |
| Bonus | +5% da $50, +10% da $100 |
| Accesso | Google oppure e-mail e password |
| Contenuti | contenuti per adulti consentiti; rifiutati i contenuti sessuali con minori |
| Chiavi | una chiave attiva per account; una nuova sostituisce la precedente |
Codici di errore
Gli errori arrivano in JSON con un type fisso; le richieste fallite o rifiutate non si pagano.
| Codice | Tipo | Significato |
|---|---|---|
400 | bad_request | JSON non valido, messaggi vuoti, parametro errato o contesto troppo lungo |
401 | missing_key · invalid_key · key_revoked | chiave mancante, errata o sostituita |
402 | no_credit | credito esaurito — ricarica e riparti subito |
403 | content_blocked | contenuti sessuali con minori — rifiutato, non addebitato |
404 | not_found | endpoint sconosciuto |
413 | request_too_large | corpo oltre 8 MB |
429 | rate_limited · concurrency | oltre 300/min o 8 in parallelo — attendi e riprova |
503 | upstream_busy | modello occupato — riprova tra pochi secondi |
Domande e risposte
Questo modello è GPT-4 o un altro modello OpenAI?
No. L'ID del modello è <code>uncensored</code>, un singolo modello senza censura, servito direttamente senza instradamento tra fornitori. Non è GPT-4, Claude o qualsiasi altro modello di fornitore. Risponde senza rifiuti a contenuti adulti leciti.
Conservate i miei dati per l'addestramento?
No. I prompt inviati all'API non vengono utilizzati per addestrare il tuo modello. Il tuo account richiede solo email e password, garantendo una raccolta dati minima.
Cosa succede se supero il limite di richieste?
Riceverai un codice di stato 429. Il limite è di 300 richieste al minuto per chiave API. Puoi rigenerare la chiave o attendere il reset della finestra. Non ci sono canoni mensili; paghi solo ciò che usi.
La tua chiave è a un modulo di distanza
Crea un account, copia la chiave, cambia l'URL di base. È tutta qui la configurazione.