Actualizado
Prueba gratuita de Chinese LLM API: cómo funciona y preguntas frecuentes
Las cuentas nuevas pueden probar la API antes de recargar cualquier saldo. Esta página responde a las preguntas más frecuentes: qué incluye la prueba, hasta dónde llega el crédito de $0.50, cómo se comportan las claves, qué límites y errores esperar y qué contenido está permitido. Las respuestas están agrupadas por tema para que puedas ir directamente al que necesitas.
Sobre la prueba
¿Qué obtengo gratis?
Cada cuenta nueva recibe $0,50 de crédito. Es válido durante siete días desde el registro y no necesitas ingresar los datos de pago para reclamarlo. El crédito se aplica al mismo endpoint y al mismo modelo que usan las cuentas de pago, así que lo que pruebas es lo que ejecutarías en producción.
¿Hasta dónde llega el crédito de $0.50?
Depende de tus prompts, así que aquí tienes una ilustración con suposiciones explicadas. Supongamos que cada petición envía 1.000 tokens de entrada y recibe 500 tokens de salida. A $0.25 por millón de tokens de entrada y $1.00 por millón de tokens de salida, una petición cuesta $0.00025 más $0.0005, lo que suma $0.00075. Entonces, $0.50 cubre aproximadamente 660 de estas peticiones. Los intercambios más cortos rinden más, y las llamadas de contexto largo consumen el crédito más rápido.
¿Qué sucede cuando termina la prueba?
Si pasan los siete días o se gasta el crédito primero, las peticiones devuelven HTTP 402 con el código no_credit. No se elimina nada. Recarga el saldo prepago y la misma clave vuelve a funcionar. No hay suscripción y el saldo recargado no caduca.
¿Necesito agregar datos de pago para empezar?
No. El registro solo requiere un correo electrónico y una contraseña. La clave se muestra justo después de que te registras en la página get-your-key.
Un plan práctico para los siete días
Siete días es suficiente si decides con antelación qué quieres aprender. Trata la prueba como un pequeño proyecto de evaluación en lugar de un lugar para explorar. Esta secuencia funciona bien para la mayoría de los equipos:
- Día 1, prueba de humo. Confirma la clave, la lista de modelos y una finalización corta. Los comandos a continuación hacen las tres cosas.
- Días 2 a 3, tus prompts reales. Ejecuta veinte a cincuenta entradas representativas de tu propio producto a través de la API. Guarda las salidas junto con las entradas para que un colega pueda revisarlas sin volver a ejecutar nada.
- Día 4, rutas de error. Activa deliberadamente un 400 con una petición demasiado grande, un 401 con una clave incorrecta y prueba tu manejo de 429 y 503 con una ráfaga pequeña. Es mejor ver estos errores ahora que en producción.
- Días 5 a 6, modelo de costes. Multiplica tus conteos de tokens registrados por las tarifas publicadas y proyecta una cifra mensual bajo tus propias suposiciones de tráfico.
- Día 7, decisión. Compara la calidad, el coste y los límites con tus requisitos y decide si recargar.
export API_KEY="paste-your-key-here"
# 1) confirm the key works and see the model id
curl -s https://api.chinesellmapi.com/v1/models \
-H "Authorization: Bearer $API_KEY"
# 2) one short completion; read the usage block in the reply
curl -s https://api.chinesellmapi.com/v1/chat/completions \
-H "Authorization: Bearer $API_KEY" \
-H "Content-Type: application/json" \
-d '{"model":"uncensored","messages":[{"role":"user","content":"用一句话介绍杭州的春天。"}],"max_tokens":120}'
La segunda llamada devuelve un objeto de uso con los conteos de tokens de prompt y de finalización. Registra esos datos desde el primer día; son la materia prima para cada estimación de costo que harás más adelante.
Claves y primeros pasos
¿Cuántas claves puedo tener?
Una por cuenta. Si necesitas una nueva, regénerala desde tu cuenta. La clave antigua deja de funcionar inmediatamente, así que actualiza tus despliegues de inmediato, o verás errores 401 en cualquier cosa que aún use el valor anterior.
¿Dónde pongo la clave?
En una variable de entorno en tu servidor, por ejemplo API_KEY, y nunca en el código del navegador ni en un repositorio público. Las peticiones la envían como Authorization: Bearer <key>.
¿Cuál es la petición más pequeña que demuestra que funciona?
Lista los modelos con GET /v1/models, luego envía una finalización de chat corta a /v1/chat/completions con el modelo uncensored y un max_tokens bajo. El campo de uso en la respuesta muestra exactamente cuánto costó la llamada en tokens.
¿Puedo usar el SDK de OpenAI?
Sí. La API es compatible con las finalizaciones de chat de OpenAI. Apunta la URL base a https://api.chinesellmapi.com/v1, proporciona tu clave y establece el modelo en uncensored. Un recorrido completo, incluidos prompts y control de scripts, está en la guía de inicio rápido.
Límites y capacidades
¿Qué tan largo puede ser un prompt y una respuesta?
La ventana de contexto es de 100.000 tokens, contando prompt y finalización juntos. La configuración max_tokens tiene un valor predeterminado de 2.048 y se puede aumentar hasta 32.000 por petición. El cuerpo de una petición puede tener hasta 8 MB. Si prompt más max_tokens excede la ventana, la API devuelve 400.
¿Cuántas peticiones puedo enviar?
Cada clave está limitada a 300 peticiones por minuto. Más allá de eso, recibes 429. Distribuye los trabajos por lotes de manera uniforme y añade un backoff; la guía de traducción incluye un script de lotes con ritmo.
¿Soporta streaming y llamadas a funciones?
Sí a ambas. Establece stream: true para eventos enviados por el servidor, con un último fragmento que lleva el uso. Las herramientas se aceptan en formato OpenAI, y los campos de muestreo como temperature, top_p y stop se pasan a través.
¿Qué no está disponible?
Solo se ofrece texto: no hay incrustaciones, imágenes, audio, video ni ajuste fino. Hay un único modelo. Si tu proyecto necesita una de las funciones faltantes, planea asociar esta API con otra herramienta para esa parte.
Errores que puedes encontrar
¿Qué códigos de estado debo esperar?
Los errores devuelven JSON con la forma {"error":{"code":...,"message":...}}. Un 400 significa una petición mal formada, 401 una clave inválida o faltante, 402 no_credit, 403 content_blocked, 404 un endpoint desconocido, 429 el límite de peticiones y 503 upstream_busy.
¿Qué errores vale la pena reintentar?
Solo 429 y 503. Espera, añade jitter aleatorio y reintenta un número limitado de veces; unos segundos son suficientes para 503. Reintentar 400, 401, 402 o 403 no cambiará el resultado.
Recargué pero aún veo 402, ¿qué hago?
Verifica que estás usando la clave actual, ya que regenerar una clave reemplaza a la antigua. Luego confirma que la petición se dirige a la URL base correcta. Si todo coincide, envía una petición mínima y lee el mensaje de error en el cuerpo de la respuesta.
Hacer que el crédito de prueba dure más
El crédito es pequeño por diseño, así que algunos hábitos lo estiran. Mantén max_tokens bajo mientras pruebas, ya que los tokens de salida cuestan cuatro veces más que los de entrada: $1,00 por millón frente a $0,25 por millón. Prueba primero con prompts cortos y representativos y pasa a tus entradas más largas solo cuando las cortas se comporten correctamente. Evita bucles que llamen a la API sin una condición de parada y limita el número de reintentos en tu propio código.
Ejemplo de trabajo con supuestos declarados: un conjunto de evaluación de 50 prompts, cada uno de aproximadamente 600 tokens de entrada, con respuestas limitadas a 300 tokens de salida. Una iteración cuesta 30.000 tokens de entrada más 15.000 tokens de salida, lo que es $0,0075 más $0,015, o $0,0225. Podrías ejecutar todo ese conjunto unas 22 veces antes de que se agote el crédito, lo cual es suficiente para comparar varias variantes de prompts adecuadamente.
Si pasas un prompt muy largo, recuerda que todo el prompt se factura en cada llamada. Un documento de 40.000 tokens enviado veinte veces cuesta lo mismo que veinte solicitudes de gran tamaño separadas, así que almacena en caché o resume el contexto compartido donde puedas. Las tarifas actuales se enumeran en la página de precios, y los detalles de los parámetros están en la documentación.
Reglas de contenido y privacidad
¿Qué contenido está permitido?
El contenido adulto lícito, la ficción y los temas controvertidos no se rechazan como tales. El servicio es para adultos mayores de 18 años. Para ficción de formato largo y chat de personajes, la guía de ficción cubre la estructura del prompt y el costo.
¿Qué se bloquea siempre?
El contenido sexual que involucra a menores está bloqueado en todos los casos y devuelve un 403, incluyendo ficción y juego de roles. El bloqueo no se puede cambiar con la redacción del prompt, así que no reintentes.
¿Se usan mis prompts para el entrenamiento?
No, los prompts no se usan para el entrenamiento.
Preguntas y respuestas
¿Cuánto crédito gratis reciben las cuentas nuevas?
Las cuentas nuevas reciben $0,50 en crédito de prueba, válido durante 7 días, sin necesidad de datos de pago para registrarse.
¿Necesito una tarjeta para iniciar la prueba?
No se necesitan datos de pago. Te registras con un correo electrónico y una contraseña y tu clave aparece de inmediato.
¿Qué pasa si se agota el crédito de prueba?
Las solicitudes devuelven un error 402 no_credit. Recarga el saldo prepago y la misma clave seguirá funcionando; no hay suscripción.
¿Puedo tener varias claves?
Cada cuenta tiene una clave. Puedes regenerarla, pero la clave anterior deja de funcionar inmediatamente.
¿Qué límites se aplican durante la prueba?
Los mismos que el uso pagado: ventana de contexto de 100.000 tokens, max_tokens hasta 32.000, cuerpos de solicitud de 8 MB y 300 solicitudes por minuto por clave.
Tu clave está a un formulario de distancia
Crea una cuenta, copia la clave, cambia la URL base. Esa es toda la configuración.