Início rápido: Conecte seu cliente
Conecte seu cliente compatível com OpenAI ao nosso Chinese LLM API sem censura atualizando a URL base e a chave de API. Este início rápido cobre autenticação, conclusões de chat, streaming e chamada de funções com exemplos concretos.
- URL base
- https://api.chinesellmapi.com/v1
- Modelo
- sem censura
URL base e autenticação
Nossa API segue o formato padrão da OpenAI, permitindo que você altere o provedor modificando apenas duas variáveis: a URL base e a chave de API. Você pode obter uma chave fazendo login na página Obter chave de API com apenas um e-mail e senha. Não é necessário cartão de crédito para o teste, e as chaves podem ser regeneradas instantaneamente se comprometidas.
Use a URL base https://api.chinesellmapi.com/v1 na configuração do seu cliente. O ID do modelo que você deve enviar é uncensored. Este é um modelo de pesos abertos executado em nossa infraestrutura dedicada, distinto de GPT, Claude ou outros modelos de fornecedores. Ele é ajustado para responder sem recusas de conteúdo para uso adulto lícito.
Endpoint de Conclusões de Chat (POST /v1/chat/completions)
Envie texto e receba texto de volta usando o endpoint padrão de conclusões de chat. Este endpoint suporta respostas não streaming e streaming, bem como chamada de ferramentas/funções. Você deve incluir o campo model definido como uncensored no corpo da sua requisição.
As requisições são limitadas a 8 MB de tamanho de corpo. Se você exceder a janela de contexto de 100.000 tokens (prompt + conclusão), a API rejeitará a requisição. Certifique-se de que seu cliente lide corretamente com as respostas HTTP padrão.
- Entrada: corpo JSON com matriz
messages. - Saída: JSON com
choicescontendomessage.content.
Faça sua primeira requisição com este exemplo:
curl https://api.chinesellmapi.com/v1/chat/completions \
-H "Authorization: Bearer $API_KEY" \
-H "Content-Type: application/json" \
-d '{
"model": "uncensored",
"messages": [{"role": "user", "content": "Write a blunt product review of a cheap VPN."}]
}'
Integração com SDK Python
Usar o SDK Python oficial da OpenAI é a maneira mais direta de integrar. Instale o pacote via pip e configure o cliente para apontar para nossa URL base. Esta abordagem funciona perfeitamente com qualquer biblioteca construída sobre o cliente Python da OpenAI.
Lembre-se de que nosso modelo não é GPT-4 ou qualquer outro modelo de fornecedor. É um modelo sem censura. Ajuste sua engenharia de prompts de acordo, pois o modelo pode ter tendências estilísticas diferentes em comparação com outros modelos.
Veja como inicializar o cliente e enviar uma requisição:
from openai import OpenAI
client = OpenAI(base_url="https://api.chinesellmapi.com/v1", api_key="YOUR_KEY")
resp = client.chat.completions.create(
model="uncensored",
messages=[{"role": "user", "content": "Summarise this thread without softening it."}],
)
print(resp.choices[0].message.content)
Integração com SDK Node.js
Para projetos JavaScript ou TypeScript, o pacote npm openai funciona com pequenas alterações de configuração. Defina o baseURL para o endpoint da nossa API e forneça sua chave de API. Isso garante compatibilidade com bases de código existentes que esperam respostas padrão da OpenAI.
A estrutura da resposta permanece idêntica ao formato da OpenAI, incluindo os campos id, object, created e choices. Isso facilita a substituição pelo nosso modelo sem censura para testes ou produção sem reescrever a lógica de análise de dados.
Configure e chame a API:
import OpenAI from "openai";
const client = new OpenAI({ baseURL: "https://api.chinesellmapi.com/v1", apiKey: process.env.API_KEY });
const resp = await client.chat.completions.create({
model: "uncensored",
messages: [{ role: "user", content: "Draft a villain monologue for my game." }],
});
console.log(resp.choices[0].message.content);
Respostas em Streaming (SSE)
Ative o streaming definindo stream: true na sua requisição. A API retorna Eventos Enviados pelo Servidor (SSE) contendo pedaços incrementais da resposta. Isso é ideal para interfaces do usuário que precisam exibir texto em tempo real conforme é gerado.
Cada pedaço contém conteúdo parcial em delta.content. Processe esses pedaços incrementalmente no seu cliente para atualizar a interface do usuário. O stream termina quando o último pedaço é recebido com finish_reason definido como stop ou tool_calls.
Exemplo de implementação de streaming:
stream = client.chat.completions.create(
model="uncensored",
messages=[{"role": "user", "content": "Tell the story in second person."}],
stream=True,
)
for chunk in stream:
if chunk.choices and chunk.choices[0].delta.content:
print(chunk.choices[0].delta.content, end="", flush=True)
Limites de taxa, erros e restrições
Monitore seu uso para evitar interrupções. Cada chave de API é limitada a 300 requisições por minuto. Se você exceder isso, receberá um erro 429 Too Many Requests. Os corpos das requisições não devem exceder 8 MB. A janela de contexto é estritamente de 100.000 tokens para prompt mais conclusão combinados.
Erros comuns incluem:
- 401 Não autorizado: Chave de API inválida ou ausente.
- 402 Pagamento necessário: Crédito pré-pago insuficiente.
- 429 Limite de taxa: Excedeu 300 requisições por minuto.
A precificação é transparente: $0,25 por 1M de tokens de entrada e $1,00 por 1M de tokens de saída. Os créditos não expiram. Use o endpoint GET /v1/models para verificar os modelos disponíveis, embora apenas o uncensored seja oferecido para conclusões de chat.
Recursos e limites
Uma tabela com cada limite, recurso e preço.
| Item | Valor |
|---|---|
| Formato | compatível com OpenAI: qualquer SDK da OpenAI funciona trocando a base URL e a chave |
| ID do modelo | uncensored |
| Autenticação | Authorization: Bearer YOUR_KEY |
| Endpoints | POST /v1/chat/completions · GET /v1/models |
| Base URL | https://api.chinesellmapi.com/v1 |
| Janela de contexto | 100.000 tokens (entrada + saída) |
| Chamada de funções | sim — tools, tool_choice; resposta com tool_calls, inclusive em streaming; resultados como role: tool |
| Parâmetros | temperature, top_p, stop, seed, presence_penalty, frequency_penalty |
| Saída máxima | até o restante da janela de 100.000 tokens; max_tokens opcional (sem limite separado) |
| Streaming | sim — server-sent events; o último bloco traz o uso de tokens |
| Modo JSON | response_format: {"type": "json_object"} |
| Cabeçalhos | X-Request-Id, X-Balance-USD, X-RateLimit-Limit-Requests, X-RateLimit-Limit-Concurrency |
| Limite de taxa | 300 requisições por minuto por chave |
| Concorrência | 8 requisições ao mesmo tempo por chave |
| Tamanho | até 8 MB por requisição |
| Validade | crédito pago não expira, sem assinatura |
| Preço | $0,25 por 1M tokens de entrada · $1,00 por 1M de saída |
| Recarga | USDT (TRC20) ou USDC (Base), qualquer valor inteiro de $10 a $500 |
| Teste grátis | $0,50 por 7 dias, sem cartão · Chave de teste: 2 requisições paralelas, 60 por minuto; limites totais (8 e 300) após a primeira recarga |
| Cobrança | crédito pré-pago pelo uso real; erros e recusas são grátis |
| Bônus | +5% a partir de $50, +10% a partir de $100 |
| Login | Google ou e-mail e senha |
| Conteúdo | conteúdo adulto permitido; conteúdo sexual com menores é recusado |
| Chaves | uma chave ativa por conta; uma nova substitui a anterior |
Erros e o que fazer
Erros chegam em JSON com um type fixo; requisições com falha ou recusadas não são cobradas.
| Código | Tipo | Significado |
|---|---|---|
400 | bad_request | JSON inválido, mensagens vazias, parâmetro errado ou contexto longo demais |
401 | missing_key · invalid_key · key_revoked | chave ausente, errada ou substituída |
402 | no_credit | sem crédito — recarregue e continue na hora |
403 | content_blocked | conteúdo sexual com menores — recusado, sem cobrança |
404 | not_found | endpoint desconhecido |
413 | request_too_large | corpo acima de 8 MB |
429 | rate_limited · concurrency | acima de 300/min ou 8 em paralelo — aguarde e tente de novo |
503 | upstream_busy | modelo ocupado — tente em alguns segundos |
Perguntas e respostas
Este modelo é GPT-4 ou outro modelo da OpenAI?
Não. O ID do modelo é <code>uncensored</code>, um único modelo sem censura, servido diretamente sem roteamento entre fornecedores. Não é GPT-4, Claude ou qualquer outro modelo de fornecedor. Ele responde sem recusas a conteúdo adulto lícito.
Vocês retêm meus dados para treinamento?
Não. Os prompts enviados à API não são usados para treinar seu modelo. Sua conta requer apenas um e-mail e senha, garantindo coleta mínima de dados.
O que acontece se eu exceder o limite de requisições?
Você receberá um código de status 429. O limite é de 300 requisições por minuto por chave de API. Você pode regenerar sua chave ou aguardar a reinicialização da janela. Não há mensalidades; você paga apenas pelo que usa.
Sua chave está a um formulário de distância
Crie uma conta, copie a chave, altere a URL base. Essa é toda a configuração.