PT ▾

Chinese LLM APIFAQ do teste

Obter chave de API

Atualizado

Teste grátis Chinese LLM API: como funciona e perguntas frequentes

Novas contas podem experimentar a API antes de recarregar qualquer valor. Esta página responde às perguntas mais comuns: o que o teste inclui, até onde o crédito de $0,50 chega, como as chaves se comportam, quais limites e erros esperar e qual conteúdo é permitido. As respostas estão agrupadas por tópico para que você possa ir direto ao que precisa.

Sobre o teste

O que recebo de graça?

Cada nova conta recebe $0,50 de crédito. Ele é válido por sete dias a partir do cadastro, e você não precisa inserir dados de pagamento para obtê-lo. O crédito se aplica ao mesmo endpoint e ao mesmo modelo usados pelas contas pagas, então o que você testa é o que usará em produção.

Até onde chega o crédito de $0,50?

Depende dos seus prompts, então aqui está uma ilustração com as suposições explicitadas. Suponha que cada requisição envie 1.000 tokens de entrada e receba 500 tokens de saída. A $0,25 por milhão de tokens de entrada e $1,00 por milhão de tokens de saída, uma requisição custa $0,00025 mais $0,0005, totalizando $0,00075. Assim, $0,50 cobre aproximadamente 660 requisições assim. Interações mais curtas rendem mais, e chamadas com contexto longo consomem o crédito mais rápido.

O que acontece quando o teste acaba?

Se os sete dias passarem ou o crédito for gasto primeiro, as requisições retornam HTTP 402 com o código no_credit. Nada é excluído. Recarregue o saldo pré-pago e a mesma chave volta a funcionar. Não há assinatura, e o saldo recarregado nunca expira.

Preciso adicionar dados de pagamento para começar?

Não. O registro exige apenas um e-mail e uma senha. A chave é exibida logo após o cadastro na página get-your-key.

Um plano prático para os sete dias

Sete dias são suficientes se você decidir antecipadamente o que quer aprender. Trate o teste como um pequeno projeto de avaliação, não apenas como um lugar para explorar. Aqui está uma sequência que funciona bem para a maioria das equipes:

  1. Dia 1, teste de fumaça. Confirme a chave, a lista de modelos e uma conclusão curta. Os comandos abaixo realizam as três etapas.
  2. Dias 2 a 3, seus prompts reais. Execute vinte a cinquenta entradas representativas do seu próprio produto através da API. Salve as saídas ao lado das entradas para que um colega possa revisá-las sem precisar executar novamente nada.
  3. Dia 4, caminhos de falha. Dispare deliberadamente um 400 com uma requisição muito grande, um 401 com uma chave errada e teste o tratamento de 429 e 503 com um pequeno pico de requisições. É melhor ver isso agora do que em produção.
  4. Dias 5 a 6, modelo de custos. Multiplique suas contagens de tokens registradas pelas tarifas publicadas e projete um valor mensal sob suas próprias suposições de tráfego.
  5. Dia 7, decisão. Compare qualidade, custo e limites contra seus requisitos, então decida se deve recarregar.
export API_KEY="paste-your-key-here"

# 1) confirm the key works and see the model id
curl -s https://api.chinesellmapi.com/v1/models \
  -H "Authorization: Bearer $API_KEY"

# 2) one short completion; read the usage block in the reply
curl -s https://api.chinesellmapi.com/v1/chat/completions \
  -H "Authorization: Bearer $API_KEY" \
  -H "Content-Type: application/json" \
  -d '{"model":"uncensored","messages":[{"role":"user","content":"用一句话介绍杭州的春天。"}],"max_tokens":120}'

A segunda chamada retorna um objeto de uso com contagens de tokens de prompt e conclusão. Registre isso desde o primeiro dia; eles são a matéria-prima para todas as estimativas de custo que você fará depois.

Chaves e primeiros passos

Quantas chaves posso ter?

Uma por conta. Se precisar de uma nova, gere-a novamente na sua conta. A chave antiga deixa de funcionar imediatamente, então atualize suas implantações imediatamente, ou você verá erros 401 em tudo que ainda usar o valor anterior.

Onde coloco a chave?

Em uma variável de ambiente no seu servidor, nomeada por exemplo API_KEY, e nunca em código do navegador ou repositório público. As requisições a enviam como Authorization: Bearer <key>.

Qual é a menor requisição que prova que funciona?

Liste os modelos com GET /v1/models, então envie uma conclusão de chat curta para /v1/chat/completions com o modelo uncensored e um max_tokens baixo. O campo de uso na resposta mostra exatamente quanto a chamada custou em tokens.

Posso usar o SDK da OpenAI?

Sim. A API é compatível com as conclusões de chat da OpenAI. Aponte a URL base para https://api.chinesellmapi.com/v1, forneça sua chave e defina o modelo como uncensored. Um guia completo, incluindo prompts e controle de script, está no quickstart.

Limites e capacidades

Qual o tamanho máximo de um prompt e resposta?

A janela de contexto é de 100.000 tokens, contando prompt e conclusão juntos. A configuração max_tokens vem como padrão 2.048 e pode ser aumentada para 32.000 por requisição. Um corpo de requisição pode ter até 8 MB. Se prompt mais max_tokens exceder a janela, a API retorna 400.

Quantas requisições posso enviar?

Cada chave tem limite de 300 requisições por minuto. Além disso, você recebe 429. Distribua trabalhos em lote uniformemente e adicione um backoff; o guia de tradução inclui um script de lote com ritmo.

Suporta streaming e chamada de funções?

Sim para ambos. Defina stream: true para eventos enviados pelo servidor, com um último chunk carregando o uso. Ferramentas são aceitas no formato OpenAI, e campos de amostragem como temperature, top_p e stop são passados diretamente.

O que não está disponível?

Apenas texto é oferecido: sem embeddings, imagens, áudio, vídeo ou ajuste fino. Há um único modelo. Se seu projeto precisa de uma das funcionalidades ausentes, planeje associar esta API a outra ferramenta para essa parte.

Erros que você pode encontrar

Quais códigos de status devo esperar?

Erros retornam JSON no formato {"error":{"code":...,"message":...}}. 400 significa uma requisição malformada, 401 uma chave inválida ou ausente, 402 no_credit, 403 content_blocked, 404 um endpoint desconhecido, 429 o limite de requisições e 503 upstream_busy.

Quais erros valem a pena tentar novamente?

Apenas 429 e 503. Aguarde, adicione um jitter aleatório e tente novamente por um número limitado de vezes; alguns segundos são suficientes para 503. Tentar novamente 400, 401, 402 ou 403 não mudará o resultado.

Recarreguei o saldo, mas ainda vejo 402, o que faço agora?

Verifique se está usando a chave atual, já que regenerar uma chave substitui a antiga. Depois confirme se a requisição está indo para a URL base correta. Se tudo estiver correto, envie uma requisição mínima e leia a mensagem de erro no corpo da resposta.

Prolongando o crédito de teste

O crédito é pequeno por design, então alguns hábitos o estendem. Mantenha o max_tokens baixo enquanto testa, já que tokens de saída custam quatro vezes mais que tokens de entrada: $1,00 por milhão contra $0,25 por milhão. Teste com prompts curtos e representativos primeiro e passe para suas entradas mais longas apenas quando as curtas se comportarem bem. Evite loops que chamam a API sem uma condição de parada e limite o número de tentativas no seu próprio código.

Exemplo prático com suposições declaradas: um conjunto de avaliação de 50 prompts, cada um com cerca de 600 tokens de entrada, com respostas limitadas a 300 tokens de saída. Uma passagem custa 30.000 tokens de entrada mais 15.000 tokens de saída, que é $0,0075 mais $0,015, ou $0,0225. Você poderia executar esse conjunto inteiro cerca de 22 vezes antes que o crédito acabe, o que é suficiente para comparar várias variantes de prompt adequadamente.

Se você passar um prompt muito longo, lembre-se de que todo o prompt é cobrado em cada chamada. Um documento de 40.000 tokens enviado vinte vezes custa o mesmo que vinte requisições grandes separadas, então faça cache ou resuma o contexto compartilhado onde puder. As tarifas atuais estão listadas na página de preços, e os detalhes dos parâmetros estão na documentação.

Regras de conteúdo e privacidade

Que conteúdo é permitido?

Conteúdo adulto lícito, ficção e tópicos controversos não são recusados como tal. O serviço é para adultos com 18 anos ou mais. Para ficção longa e bate-papo com personagens, o guia de ficção cobre estrutura de prompt e custo.

O que é sempre bloqueado?

Conteúdo sexual envolvendo menores é bloqueado em todos os casos e retorna 403, incluindo ficção e interpretação de papéis. O bloqueio não pode ser alterado pelo wording do prompt, portanto não tente novamente.

Meus prompts são usados para treinamento?

Não, os prompts não são usados para treinamento.

Perguntas e respostas

Quanto de crédito grátis novas contas recebem?

Novas contas recebem $0,50 de crédito de teste, válido por 7 dias, sem necessidade de informar dados de pagamento para se cadastrar.

Preciso de um cartão para iniciar o teste?

Não são necessários detalhes de pagamento. Você se registra com um e-mail e senha e sua chave aparece imediatamente.

E se o crédito do teste acabar?

As requisições retornam um erro 402 no_credit. Recarregue o saldo pré-pago e a mesma chave continua funcionando; não há assinatura.

Posso ter várias chaves?

Cada conta tem uma chave. Você pode regenerá-la, mas a chave anterior para de funcionar imediatamente.

Quais limites se aplicam durante o teste?

Os mesmos do uso pago: janela de contexto de 100.000 tokens, max_tokens até 32.000, corpos de requisição de 8 MB e 300 requisições por minuto por chave.

Sua chave está a um formulário de distância

Crie uma conta, copie a chave, altere a URL base. Essa é toda a configuração.

Obter chave de API