Diperbarui
Uji coba gratis Chinese LLM API: cara kerja dan pertanyaan umum
Akun baru dapat mencoba API sebelum mengisi saldo. Halaman ini menjawab pertanyaan yang paling sering muncul: apa saja yang termasuk dalam uji coba, seberapa jauh $0,50 dapat digunakan, bagaimana perilaku kunci, batas dan kesalahan apa yang diharapkan, serta konten apa yang diizinkan. Jawaban dikelompokkan berdasarkan topik agar Anda dapat langsung melompat ke bagian yang Anda butuhkan.
Tentang uji coba
Apa yang saya dapatkan secara gratis?
Setiap akun baru menerima kredit senilai $0,50. Kredit ini berlaku selama tujuh hari sejak pendaftaran, dan Anda tidak perlu memasukkan detail pembayaran untuk mengklaimnya. Kredit berlaku untuk endpoint yang sama dan model yang sama yang digunakan oleh akun berbayar, sehingga apa yang Anda uji adalah apa yang akan Anda jalankan di produksi.
Seberapa jauh $0,50 dapat digunakan?
Hal ini bergantung pada prompt Anda, jadi berikut adalah ilustrasi dengan asumsi yang dijelaskan. Misalkan setiap permintaan mengirimkan 1.000 token input dan menerima 500 token output. Dengan harga $0,25 per juta token input dan $1,00 per juta token output, satu permintaan berharga $0,00025 ditambah $0,0005, yang berarti $0,00075. Maka $0,50 mencakup sekitar 660 permintaan seperti itu. Pertukaran yang lebih singkat akan lebih jauh, dan panggilan konteks panjang menggunakan kredit lebih cepat.
Apa yang terjadi ketika uji coba berakhir?
Jika tujuh hari berlalu atau kredit habis terlebih dahulu, permintaan mengembalikan HTTP 402 dengan kode no_credit. Tidak ada yang dihapus. Isi ulang saldo prabayar dan kunci yang sama akan berfungsi lagi. Tidak ada langganan, dan saldo yang diisi ulang tidak pernah kedaluwarsa.
Apakah saya perlu menambahkan detail pembayaran untuk memulai?
Tidak. Pendaftaran hanya memerlukan email dan kata sandi. Kunci ditampilkan segera setelah Anda sign up di halaman get-your-key.
Rencana praktis untuk tujuh hari
Tujuh hari cukup jika Anda memutuskan sebelumnya apa yang ingin Anda pelajari. Perlakukan uji coba seperti proyek evaluasi kecil daripada tempat untuk mencoba-coba. Berikut adalah urutan yang bekerja dengan baik untuk sebagian besar tim:
- Hari 1, uji asap. Konfirmasi kunci, daftar model, dan satu penyelesaian singkat. Perintah di bawah ini melakukan ketiganya.
- Hari 2 hingga 3, prompt asli Anda. Jalankan dua puluh hingga lima puluh input perwakilan dari produk Anda sendiri melalui API. Simpan output di samping input agar rekan dapat menilainya tanpa menjalankan ulang apa pun.
- Hari 4, jalur kegagalan. Picu kesalahan 400 dengan permintaan yang terlalu besar, kesalahan 401 dengan kunci yang salah, dan uji penanganan 429 dan 503 dengan lonjakan kecil. Lebih baik melihat ini sekarang daripada di produksi.
- Hari 5 hingga 6, model biaya. Kalikan jumlah token yang Anda log dengan tarif yang diterbitkan dan proyeksikan angka bulanan berdasarkan asumsi lalu lintas Anda sendiri.
- Hari 7, keputusan. Bandingkan kualitas, biaya, dan batas dengan persyaratan Anda, lalu putuskan apakah akan mengisi saldo.
export API_KEY="paste-your-key-here"
# 1) confirm the key works and see the model id
curl -s https://api.chinesellmapi.com/v1/models \
-H "Authorization: Bearer $API_KEY"
# 2) one short completion; read the usage block in the reply
curl -s https://api.chinesellmapi.com/v1/chat/completions \
-H "Authorization: Bearer $API_KEY" \
-H "Content-Type: application/json" \
-d '{"model":"uncensored","messages":[{"role":"user","content":"用一句话介绍杭州的春天。"}],"max_tokens":120}'
Panggilan kedua mengembalikan objek penggunaan dengan jumlah token prompt dan penyelesaian. Log itu sejak hari pertama; mereka adalah bahan mentah untuk setiap estimasi biaya yang akan Anda buat nanti.
Kunci dan memulai
Berapa banyak kunci yang bisa saya miliki?
Satu per akun. Jika Anda membutuhkan yang baru, buat ulang dari akun Anda. Kunci lama berhenti berfungsi segera, jadi perbarui deployment Anda segera, atau Anda akan melihat kesalahan 401 dari apa pun yang masih menggunakan nilai sebelumnya.
Di mana saya harus menempatkan kunci?
Dalam variabel lingkungan di server Anda, dinamai misalnya API_KEY, dan jangan pernah dalam kode browser atau repositori publik. Permintaan membawanya sebagai Authorization: Bearer <key>.
Apa permintaan terkecil yang membuktikan bahwa semuanya berfungsi?
Daftar model dengan GET /v1/models, lalu kirim penyelesaian chat singkat ke /v1/chat/completions dengan model uncensored dan max_tokens rendah. Bidang penggunaan dalam respons menunjukkan tepat berapa biaya panggilan dalam token.
Bisakah saya menggunakan SDK OpenAI?
Ya. API ini kompatibel dengan penyelesaian chat OpenAI. Arahkan URL dasar ke https://api.chinesellmapi.com/v1, berikan kunci Anda, dan atur model menjadi uncensored. Panduan lengkap, termasuk prompt dan kontrol skrip, terdapat di quickstart.
Batas dan kemampuan
Seberapa panjang prompt dan balasan bisa menjadi?
Jendela konteks adalah 100.000 token, menghitung prompt dan penyelesaian bersama. Pengaturan max_tokens secara default adalah 2.048 dan dapat ditingkatkan hingga 32.000 per permintaan. Badan permintaan dapat berukuran hingga 8 MB. Jika prompt ditambah max_tokens melebihi jendela, API mengembalikan 400.
Berapa banyak permintaan yang bisa saya kirim?
Setiap kunci dibatasi hingga 300 permintaan per menit. Di luar itu Anda menerima 429. Sebarkan pekerjaan batch secara merata dan tambahkan penundaan; panduan terjemahan mencakup skrip batch yang diatur kecepatannya.
Apakah mendukung streaming dan pemanggilan fungsi?
Ya untuk keduanya. Atur stream: true untuk server-sent events, dengan chunk terakhir yang membawa penggunaan. Alat diterima dalam format OpenAI, dan bidang sampling seperti temperature, top_p dan stop diteruskan.
Apa yang tidak tersedia?
Hanya teks yang ditawarkan: tidak ada embedding, gambar, audio, video, atau penyesuaian halus. Ada satu model. Jika proyek Anda membutuhkan salah satu fitur yang hilang, rencanakan untuk menggabungkan API ini dengan alat lain untuk bagian itu.
Kesalahan yang mungkin Anda temui
Kode status mana yang harus saya harapkan?
Error mengembalikan JSON berbentuk {"error":{"code":...,"message":...}}. Kode 400 berarti permintaan tidak sesuai format, 401 kunci tidak valid atau hilang, 402 no_credit, 403 content_blocked, 404 endpoint tidak dikenal, 429 batas laju, dan 503 upstream_busy.
Kesalahan mana yang layak dicoba lagi?
Hanya 429 dan 503. Tunggu, tambahkan jitter acak, dan coba lagi sejumlah terbatas; beberapa detik sudah cukup untuk 503. Mencoba lagi 400, 401, 402, atau 403 tidak akan mengubah hasilnya.
Saya sudah mengisi saldo tetapi masih melihat 402, apa yang harus dilakukan?
Periksa apakah Anda menggunakan kunci saat ini, karena pembuatan ulang kunci menggantikan kunci lama. Kemudian konfirmasi bahwa permintaan dikirim ke URL dasar yang benar. Jika semuanya cocok, kirim permintaan minimal dan baca pesan kesalahan dalam badan respons.
Memperpanjang masa kredit uji coba
Kredit dirancang kecil, sehingga beberapa kebiasaan dapat memperpanjang penggunaannya. Pertahankan max_tokens rendah saat Anda menguji, karena token output harganya empat kali lebih mahal daripada token input: $1,00 per juta versus $0,25 per juta. Uji dengan prompt pendek yang representatif terlebih dahulu dan beralih ke input terpanjang Anda hanya setelah yang pendek berhasil. Hindari loop yang memanggil API tanpa kondisi berhenti, dan batasi jumlah percobaan ulang dalam kode Anda sendiri.
Contoh perhitungan dengan asumsi yang dinyatakan: satu set evaluasi berisi 50 prompt, masing-masing sekitar 600 token input, dengan balasan dibatasi hingga 300 token output. Satu kali proses membutuhkan 30.000 token input ditambah 15.000 token output, yang berarti $0,0075 ditambah $0,015, atau total $0,0225. Anda dapat menjalankan seluruh set tersebut sekitar 22 kali sebelum kredit habis, yang cukup untuk membandingkan beberapa variasi prompt secara memadai.
Jika Anda mengirimkan prompt yang sangat panjang, ingat bahwa seluruh prompt ditagih pada setiap panggilan. Dokumen 40.000 token yang dikirimkan dua puluh kali harganya sama dengan dua puluh permintaan besar terpisah, jadi simpan cache atau ringkas konteks yang dibagikan jika memungkinkan. Tarif saat ini tercantum di halaman pricing, dan detail parameter terdapat di docs.
Aturan konten dan privasi
Konten apa saja yang diperbolehkan?
Konten dewasa yang sah, fiksi, dan topik kontroversial tidak ditolak secara otomatis. Layanan ini ditujukan untuk orang dewasa berusia 18 tahun ke atas. Untuk fiksi panjang dan obrolan karakter, panduan fiksi mencakup struktur prompt dan biaya.
Apa saja yang selalu diblokir?
Konten seksual yang melibatkan anak di bawah umur diblokir dalam setiap kasus dan mengembalikan 403, termasuk fiksi dan roleplay. Blokir ini tidak dapat diubah dengan wording prompt, jadi jangan mencobanya lagi.
Apakah prompt saya digunakan untuk pelatihan?
Tidak, prompt tidak digunakan untuk pelatihan.
Tanya jawab
Berapa banyak kredit gratis yang diperoleh akun baru?
Akun baru mendapatkan $0,50 dalam kredit uji coba, berlaku selama 7 hari, tanpa memerlukan detail pembayaran untuk mendaftar.
Apakah saya perlu kartu untuk memulai uji coba?
Tidak diperlukan detail pembayaran. Anda mendaftar dengan email dan kata sandi, dan kunci Anda akan muncul segera.
Bagaimana jika kredit uji coba habis?
Permintaan mengembalikan error 402 no_credit. Isi saldo prabayar, dan kunci yang sama tetap berfungsi; tidak ada langganan.
Bisakah saya memiliki beberapa kunci?
Setiap akun memiliki satu kunci. Anda dapat membuat ulang kunci tersebut, tetapi kunci sebelumnya akan berhenti berfungsi segera.
Batas mana yang berlaku selama uji coba?
Sama seperti penggunaan berbayar: jendela konteks 100.000 token, max_tokens hingga 32.000, body permintaan 8 MB, dan 300 permintaan per menit per kunci.
Kunci Anda hanya selangkah lagi dari satu formulir
Buat akun, salin kunci, ubah URL dasar. Itu saja seluruh proses pengaturannya.