中文 ▾

Chinese LLM API试用常见问题

获取 API 密钥

更新于

Chinese LLM API 免费试用:工作原理与常见问题

新账户可在充值前试用 API。本页面解答最高频的问题:试用额度包含什么、$0.50 能产生多少结果、密钥的行为方式、预期遇到的速率限制和错误,以及允许的内容类型。答案按主题分组,方便你直接跳转到所需部分。

关于试用

我能免费获得什么?

每个新账户都会获得 $0.50 的额度。该额度自注册之日起七天内有效,领取时无需输入支付详情。该额度适用于付费账户所使用的同一接口和同一模型,因此你测试的内容就是你在生产环境中会运行的内容。

$0.50 能做什么?

这取决于你的提示词,因此这里有一个说明假设的示例。假设每个请求发送 1,000 个输入 token 并接收 500 个输出 token。每百万输入 token $0.25,每百万输出 token $1.00,一个请求成本为 $0.00025 加 $0.0005,即 $0.00075。那么 $0.50 可覆盖约 660 次此类请求。较短的交互消耗更慢,长上下文调用会更快消耗额度。

试用结束时会发生什么?

如果七天过去或额度先耗尽,请求返回 HTTP 402 及代码 no_credit。不会删除任何内容。充值预付余额后,同一密钥再次有效。没有订阅,充值余额永不过期。

开始需要添加支付信息吗?

不需要。注册仅需邮箱和密码。密钥会在你注册后于 获取密钥页面 直接显示。

七天的实用计划

如果你提前决定要学习什么,七天绰绰有余。将试用视为小型评估项目,而不是随意探索。以下序列对大多数团队有效:

  1. 第 1 天,冒烟测试。 确认密钥、模型列表和一次简短补全。以下命令可完成这三项。
  2. 第 2 至 3 天,你的实际提示词。 将二十到五十个来自你自身产品的代表性输入通过 API 运行。将输出结果与输入保存在一起,以便同事无需重新运行即可审查。
  3. 第 4 天,失败路径。 故意触发 400(请求过大)、401(密钥错误),并通过小批量测试 429 和 503 处理。现在看到这些比在生产环境中看到更好。
  4. 第 5 至 6 天,成本模型。 将记录的 token 计数乘以公布费率,并根据你的流量假设预测月度费用。
  5. 第 7 天,决策。 将质量、成本和限制与你的需求进行比较,然后决定是否充值。
export API_KEY="paste-your-key-here"

# 1) confirm the key works and see the model id
curl -s https://api.chinesellmapi.com/v1/models \
  -H "Authorization: Bearer $API_KEY"

# 2) one short completion; read the usage block in the reply
curl -s https://api.chinesellmapi.com/v1/chat/completions \
  -H "Authorization: Bearer $API_KEY" \
  -H "Content-Type: application/json" \
  -d '{"model":"uncensored","messages":[{"role":"user","content":"用一句话介绍杭州的春天。"}],"max_tokens":120}'

第二次调用返回一个包含提示词和输出 token 计数的 usage 对象。从第一天开始记录这些数据;它们是你稍后制作所有成本估算的原始材料。

密钥与入门

我可以拥有多少个密钥?

每个账户一个。如果需要新密钥,请从账户重新生成。旧密钥会立即失效,因此立即更新你的部署,否则你仍在使用旧值时会看到 401 错误。

我应该把密钥放在哪里?

放在服务器的环境变量中,例如命名为 API_KEY,不要放在浏览器代码或公共仓库中。请求通过 Authorization: Bearer <key> 携带密钥。

证明其工作的最小请求是什么?

通过 GET /v1/models 列出模型,然后向 /v1/chat/completions 发送简短的聊天补全请求,模型设为 uncensored,并设置较低的 max_tokens。响应中的 usage 字段会精确显示该次调用消耗的 token 数量。

我可以使用 OpenAI SDK 吗?

是的。该 API 兼容 OpenAI 聊天补全。将 base URL 指向 https://api.chinesellmapi.com/v1,提供你的密钥,并将模型设置为 uncensored。完整指南(包括提示词和脚本控制)位于 快速入门。

限制与功能

提示词和回复可以有多长?

上下文窗口为 100,000 个 token,包含提示词和输出 token 的总和。max_tokens 设置默认为 2,048,每个请求可提高至 32,000。请求体最大可达 8 MB。如果提示词加上 max_tokens 超过窗口限制,API 将返回 400。

我可以发送多少请求?

每个密钥每分钟限制 300 次请求。超出后你将收到 429 错误。均匀分布批处理作业并添加退避机制;翻译指南 包含一个限速批处理脚本。

支持流式输出和函数调用吗?

两者都支持。设置 stream: true 以启用服务器发送事件,最后一个 chunk 携带 usage 信息。接受 OpenAI 格式的工具,采样字段如 temperature、top_p 和 stop 会原样传递。

什么不可用?

仅提供文本:无嵌入、图像、音频、视频或微调。只有一个模型。如果你的项目需要缺失的某项功能,请计划将该 API 与其他工具配合使用以处理该部分。

你可能遇到的错误

我应该预期哪些状态代码?

错误返回格式如 {"error":{"code":...,"message":...}} 的 JSON。400 表示请求格式错误,401 表示密钥无效或缺失,402 no_credit,403 content_blocked,404 表示未知接口,429 表示速率限制,503 upstream_busy。

哪些错误值得重试?

仅 429 和 503。等待,添加随机抖动,并重试有限次数;几秒就足以应对 503。重试 400、401、402 或 403 不会改变结果。

我充值了但仍看到 402,现在怎么办?

检查你使用的是当前密钥,因为重新生成密钥会替换旧密钥。然后确认请求正发往正确的 base URL。如果一切匹配,发送一个最小请求并读取响应体中的错误消息。

让试用额度更耐用

额度设计得较小,因此一些习惯可以延长其使用。在测试期间保持 max_tokens 较低,因为输出 token 的成本是输入 token 的四倍:每百万 token 输出为 $1.00,而输入为 $0.25。先使用简短且具有代表性的提示词进行测试,只有在简短提示词表现正常后,再使用最长输入。避免没有停止条件的循环调用 API,并在你自己的代码中限制重试次数。

带假设的示例:评估集包含 50 个提示词,每个提示词约 600 个输入 token,回复限制为 300 个输出 token。一次运行需要 30,000 个输入 token 和 15,000 个输出 token,费用为 $0.0075 加 $0.015,即 $0.0225。你可以运行该集合约 22 次,直到额度用完,这足以充分比较几种提示词变体。

如果你传递很长的提示词,请记住每次调用都会对整段提示词计费。发送 40,000 token 的文档二十次,费用等同于二十次单独的大请求,因此请尽可能缓存或总结共享上下文。当前费率列在 定价页面 上,参数详情见 文档。

内容规则与隐私

允许哪些内容?

合法的成人内容、虚构作品和争议性话题不会被拒绝。该服务面向 18 岁及以上成年人。对于长篇虚构作品和角色对话,虚构作品指南 涵盖了提示词结构和成本。

哪些内容始终被屏蔽?

涉及未成年人的色情内容在任何情况下都会被屏蔽,并返回 403 错误,包括小说和角色扮演。屏蔽无法通过提示词更改,因此不要重试。

我的提示词会用于训练吗?

不会,提示词不会用于训练。

问答

新账户能获得多少免费额度?

新账户获得 $0.50 试用额度,有效期 7 天,无需提供支付信息即可注册。

开始试用需要绑定银行卡吗?

不需要支付详情。你只需使用邮箱和密码注册,密钥就会立即显示。

如果试用额度用完了怎么办?

请求将返回 402 no_credit 错误。充值预付余额后,同一密钥将继续有效;没有订阅机制。

我可以拥有多个密钥吗?

每个账户只有一个密钥。你可以重新生成它,但旧密钥将立即失效。

试用期间适用哪些限制?

与付费使用相同:100,000 token 上下文窗口,max_tokens 最高 32,000,请求体最大 8 MB,每个密钥每分钟 300 次请求。

只差一张表单,即可获得密钥

创建账户,复制密钥,更改基础 URL。这就是全部设置。

获取 API 密钥