อัปเดต
การทดลองใช้ฟรี Chinese LLM API: วิธีการทำงานและคำถามที่พบบ่อย
บัญชีใหม่สามารถลองใช้ API ได้ก่อนเติมเงิน หน้าหน้านี้ตอบคำถามที่พบบ่อยที่สุด: การทดลองใช้ครอบคลุมอะไรบ้าง, $0.50 ใช้ได้นานแค่ไหน, คีย์ทำงานอย่างไร, ขีดจำกัดและข้อผิดพลาดที่คาดว่าจะเจอ, และเนื้อหาใดที่อนุญาต คำตอบแบ่งตามหัวข้อเพื่อให้คุณข้ามไปยังหัวข้อที่ต้องการได้ทันที
เกี่ยวกับการทดลองใช้
ฉันได้รับอะไรฟรี?
บัญชีใหม่ทุกบัญชีได้รับเครดิต $0.50 ใช้งานได้เจ็ดวันนับจากวันที่สมัคร และไม่ต้องใส่รายละเอียดการชำระเงินเพื่อรับเครดิต เครดิตนี้ใช้กับเอนด์พอยต์และโมเดลเดียวกันกับบัญชีเสียเงิน ดังนั้นสิ่งที่คุณทดสอบคือสิ่งที่คุณจะนำไปใช้ในระบบจริง
เครดิต $0.50 ใช้ได้กี่คำขอ?
ขึ้นอยู่กับพรอมต์ของคุณ นี่คือตัวอย่างโดยกำหนดสมมติฐานไว้ สมมติว่าแต่ละคำขอส่ง 1,000 โทเคนอินพุตและรับ 500 โทเคนเอาต์พุต ที่อัตรา $0.25 ต่อล้านโทเคนอินพุตและ $1.00 ต่อล้านโทเคนเอาต์พุต คำขอหนึ่งๆ มีค่าใช้จ่าย $0.00025 บวก $0.0005 ซึ่งรวมเป็น $0.00075 ดังนั้น $0.50 จะครอบคลุมคำขอขนาดนี้ประมาณ 660 คำขอ การสนทนาที่สั้นกว่าจะไปได้ไกลกว่า และการเรียกใช้บริบทยาวจะใช้เครดิตเร็วขึ้น
เกิดอะไรขึ้นเมื่อการทดลองใช้สิ้นสุด?
หากเจ็ดวันผ่านไปหรือเครดิตหมดก่อน คำขอจะส่ง HTTP 402 พร้อมรหัส no_credit ไม่มีข้อมูลถูกลบ เติมเงินเครดิตแบบเติมเงินล่วงหน้าและคีย์เดิมจะใช้งานได้ต่อ ไม่มีระบบสมาชิก และยอดเงินที่เติมแล้วจะไม่หมดอายุ
ฉันจำเป็นต้องเพิ่มรายละเอียดการชำระเงินเพื่อเริ่มต้นหรือไม่?
ไม่ต้องครับ การลงทะเบียนใช้เฉพาะอีเมลและรหัสผ่านเท่านั้น คีย์จะแสดงทันทีหลังจากคุณเข้าสู่ระบบที่หน้า get-your-key
แผนปฏิบัติสำหรับเจ็ดวัน
เจ็ดวันก็เพียงพอหากคุณตัดสินใจล่วงหน้าว่าจะเรียนรู้เรื่องอะไร ให้ treating การทดลองใช้เหมือนโครงการประเมินขนาดเล็กแทนที่จะเป็นสถานที่เพื่อ poke ไปมา นี่คือลำดับที่ทำงานได้ดีสำหรับทีมส่วนใหญ่:
- วันที่ 1, ทดสอบพื้นฐาน ยืนยันคีย์ รายการโมเดล และการสร้างข้อความสั้นๆ คำสั่งด้านล่างทำทั้งสามอย่าง
- วันที่ 2 ถึง 3, พรอมต์จริงของคุณ รันอินพุตตัวแทนยี่สิบถึงห้าสิบรายการจากผลิตภัณฑ์ของคุณผ่าน API บันทึกเอาต์พุตไว้ข้างๆ อินพุตเพื่อให้เพื่อนร่วมงานสามารถตรวจสอบได้โดยไม่ต้องรันใหม่
- วันที่ 4, เส้นทางความล้มเหลว กระตุ้นข้อผิดพลาด 400 ด้วยคำขอที่มีขนาดใหญ่เกินไป, 401 ด้วยคีย์ที่ผิด, และทดสอบการจัดการ 429 และ 503 ด้วยปริมาณเล็กน้อย เป็นการดีกว่าที่จะเห็นสิ่งเหล่านี้ตอนนี้มากกว่าในระบบจริง
- วันที่ 5 ถึง 6, โมเดลต้นทุน คูณจำนวนโทเคนที่บันทึกไว้ด้วยอัตราที่เผยแพร่และประมาณการรายเดือนภายใต้สมมติการณ์การจราจรของคุณเอง
- วันที่ 7, ตัดสินใจ เปรียบเทียบคุณภาพ ต้นทุน และขีดจำกัดกับข้อกำหนดของคุณ จากนั้นตัดสินใจว่าจะเติมเงินหรือไม่
export API_KEY="paste-your-key-here"
# 1) confirm the key works and see the model id
curl -s https://api.chinesellmapi.com/v1/models \
-H "Authorization: Bearer $API_KEY"
# 2) one short completion; read the usage block in the reply
curl -s https://api.chinesellmapi.com/v1/chat/completions \
-H "Authorization: Bearer $API_KEY" \
-H "Content-Type: application/json" \
-d '{"model":"uncensored","messages":[{"role":"user","content":"用一句话介绍杭州的春天。"}],"max_tokens":120}'
การเรียกครั้งที่สองจะคืน object usage พร้อมจำนวนโทเคน prompt และ completion บันทึกสิ่งเหล่านั้นนับจากวันแรก; นี่คือข้อมูลดิบสำหรับการประมาณค่าใช้จ่ายทุกประเภทที่คุณจะทำในภายหลัง
คีย์และการเริ่มต้นใช้งาน
ฉันมีคีย์ได้กี่คีย์?
หนึ่งคีย์ต่อบัญชี หากคุณต้องการคีย์ใหม่ ให้สร้างใหม่จากบัญชีของคุณ คีย์เก่าจะหยุดทำงานทันที ดังนั้นอัปเดตการปรับใช้ของคุณทันที มิฉะนั้นคุณจะเห็นข้อผิดพลาด 401 จากทุกสิ่งที่ยังใช้ค่าเดิม
ฉันควรใส่คีย์ไว้ที่ไหน?
ในตัวแปรสภาพแวดล้อมบนเซิร์ฟเวอร์ของคุณ ตั้งชื่อตัวอย่างเช่น API_KEY และอย่าใส่ในโค้ดเบราว์เซอร์หรือที่เก็บสาธารณะ คำขอจะส่งคีย์เป็น Authorization: Bearer <key>
คำขอที่เล็กที่สุดที่พิสูจน์ว่าใช้งานได้คืออะไร?
แสดงรายการโมเดลด้วย GET /v1/models จากนั้นส่งการเสร็จสิ้นแชทสั้นๆ ไปยัง /v1/chat/completions ด้วยโมเดล uncensored และ max_tokens ต่ำ ฟิลด์การใช้งานในคำตอบแสดงค่าใช้จ่ายที่แท้จริงของการเรียกในโทเคน
ฉันสามารถใช้ SDK ของ OpenAI ได้หรือไม่?
ใช่ API นี้เข้ากันได้กับการ chat completions ของ OpenAI ชี้ base URL ไปที่ https://api.chinesellmapi.com/v1 ใส่คีย์ของคุณ และตั้งค่าโมเดลเป็น uncensored การแนะนำแบบครบวงจร รวมถึงพรอมต์และการควบคุมสคริปต์ อยู่ใน quickstart
ขีดจำกัดและความสามารถ
พรอมต์และคำตอบมีความยาวได้แค่ไหน?
หน้าต่างบริบทมีขนาด 100,000 โทเคน โดยนับรวม prompt และ completion การตั้งค่า max_tokens มีค่าเริ่มต้นที่ 2,048 และสามารถเพิ่มได้เป็น 32,000 ต่อคำขอ body ของคำขอสามารถมีขนาดได้สูงสุด 8 MB หาก prompt รวมกับ max_tokens เกินหน้าต่าง API จะคืนค่า 400
ฉันส่งคำขอได้กี่คำขอ?
แต่ละคีย์จำกัดอยู่ที่ 300 คำขอต่อนาที เกินกว่านั้นคุณจะรับ 429 กระจายงานแบทช์อย่างสม่ำเสมอและเพิ่มการหน่วงเวลา; คู่มือการแปล มีสคริปต์แบทช์แบบกำหนดจังหวะ
รองรับสตรีมมิงและการเรียกใช้ฟังก์ชันหรือไม่?
ใช่ทั้งสองอย่าง ตั้งค่า stream: true สำหรับ server-sent events พร้อมข้อมูลการใช้งานในชิ้นสุดท้าย รองรับเครื่องมือรูปแบบ OpenAI และส่งผ่านฟิลด์ sampling เช่น temperature, top_p และ stop
อะไรที่ไม่พร้อมใช้งาน?
มีเฉพาะข้อความเท่านั้น: ไม่มี embeddings, รูปภาพ, เสียง, วิดีโอ หรือการปรับแต่งพิเศษ มีโมเดลเดียว หากโปรเจกต์ของคุณต้องการฟีเจอร์ที่ขาดหายไป ให้วางแผนที่จะจับคู่ API นี้กับเครื่องมืออื่นสำหรับส่วนนั้น
ข้อผิดพลาดที่คุณอาจพบ
ฉันควรคาดหวังรหัสสถานะใด?
ข้อผิดพลาดจะส่ง JSON รูปแบบ {"error":{"code":...,"message":...}}. 400 คือคำขอผิดรูปแบบ, 401 คือคีย์ไม่ถูกต้องหรือหายไป, 402 no_credit, 403 content_blocked, 404 คือเอนด์พอยต์ไม่รู้จัก, 429 คือขีดจำกัดอัตรา และ 503 upstream_busy
ข้อผิดพลาดใดที่ควรลองเรียกใหม่
มีเพียง 429 และ 503 เท่านั้น รอแล้วเพิ่ม random jitter แล้วลองเรียกใหม่จำนวนจำกัดครั้ง; สองสามวินาทีก็เพียงพอสำหรับ 503 การลองเรียก 400, 401, 402 หรือ 403 จะไม่เปลี่ยนผลลัพธ์
ฉันเติมเงินแล้วแต่ยังคงเห็น 402 ตอนนี้ต้องทำอย่างไร?
ตรวจสอบว่าคุณใช้คีย์ปัจจุบันอยู่ เนื่องจากการสร้างคีย์ใหม่จะแทนที่คีย์เก่า จากนั้นยืนยันว่าคำขอไปยัง base URL ที่ถูกต้อง หากทุกอย่างตรงกัน ให้ส่งคำขอขั้นต่ำและอ่านข้อความข้อผิดพลาดใน response body
ทำให้เครดิตทดลองใช้ใช้งานได้ยาวนาน
เครดิตถูกกำหนดให้มีจำนวนน้อยโดยเจตนา ดังนั้นนิสัยบางประการจึงช่วยยืดอายุการใช้งานได้ ให้ตั้งค่า max_tokens ให้ต่ำขณะทำการทดสอบ เนื่องจากโทเคนผลลัพธ์มีราคาสูงกว่าโทเคนอินพุตสี่เท่า: $1.00 ต่อหนึ่งล้านโทเคน เทียบกับ $0.25 ต่อหนึ่งล้านโทเคน ให้ทดสอบด้วยพรอมต์สั้นๆ ที่เป็นตัวแทนก่อน แล้วจึงย้ายไปใช้อินพุตที่ยาวที่สุดก็ต่อเมื่ออินพุตสั้นๆ ทำงานได้ถูกต้องแล้ว หลีกเลี่ยงลูปที่เรียก API โดยไม่มีเงื่อนไขหยุด และจำกัดจำนวนการลองใหม่ในโค้ดของคุณเอง
ตัวอย่างการคำนวณพร้อมข้อกำหนดที่ระบุ: ชุดประเมินผลที่มีพรอมต์ 50 รายการ แต่ละรายการมีอินพุตประมาณ 600 โทเคน โดยจำกัดผลลัพธ์ที่ 300 โทเคน การรันหนึ่งรอบใช้ 30,000 โทเคนอินพุตและ 15,000 โทเคนเอาท์พุต ซึ่งคิดเป็น $0.0075 บวก $0.015 หรือรวม $0.0225 คุณจะสามารถรันชุดข้อมูลทั้งหมดนี้ได้ประมาณ 22 ครั้งก่อนที่เครดิตจะหมด ซึ่งเพียงพอสำหรับการเปรียบเทียบพรอมต์หลายรูปแบบอย่างถูกต้อง
หากคุณส่งพรอมต์ที่ยาวมาก โปรดจำไว้ว่าพรอมต์ทั้งหมดจะถูกเรียกเก็บเงินในการเรียกใช้ทุกครั้ง เอกสารขนาด 40,000 โทเคนที่ส่งยี่สิบครั้งจะมีค่าใช้จ่ายเท่ากับคำขอขนาดใหญ่แยกกันยี่สิบครั้ง ดังนั้นให้ cache หรือสรุปบริบทที่แชร์ได้เมื่อทำได้ อัตราปัจจุบันแสดงอยู่ที่ pricing page และรายละเอียดพารามิเตอร์อยู่ใน docs
กฎเกี่ยวกับเนื้อหาและความเป็นส่วนตัว
อนุญาตให้ใช้เนื้อหาประเภทใดได้บ้าง?
เนื้อหาผู้ใหญ่ที่ถูกต้องตามกฎหมาย นิยาย และหัวข้อที่ถกเถียงได้ไม่ถูกปฏิเสธเป็นกรณีทั่วไป บริการนี้สำหรับผู้ใหญ่ที่มีอายุ 18 ปีขึ้นไป สำหรับนิยายแบบยาวและการสนทนาตัวละคร หน้า คู่มือนิยาย ครอบคลุมโครงสร้างพรอมต์และค่าใช้จ่าย
เนื้อหาใดที่ถูกบล็อกเสมอ?
เนื้อหาทางเพศที่เกี่ยวข้องกับเด็กจะถูกบล็อกในทุกกรณีและส่งสถานะ 403 กลับมา รวมถึงในนิยายและการสวมบทบาท การบล็อกนี้ไม่สามารถเปลี่ยนแปลงได้ด้วยการใช้คำในพรอมต์ ดังนั้นอย่าลองส่งซ้ำ
พรอมต์ของฉันถูกนำไปใช้ในการฝึกโมเดลหรือไม่?
ไม่ พรอมต์ไม่ถูกนำไปใช้ในการฝึกโมเดล
ถาม-ตอบ
บัญชีใหม่ได้รับเครดิตฟรีเท่าใด?
บัญชีใหม่ได้รับเครดิตทดลองใช้ $0.50 ใช้ได้เป็นเวลา 7 วัน โดยไม่ต้องกรอกข้อมูลการชำระเงินเพื่อสมัคร
ฉันจำเป็นต้องใช้บัตรเพื่อเริ่มทดลองใช้หรือไม่?
ไม่จำเป็นต้องใช้ข้อมูลการชำระเงิน คุณลงทะเบียนด้วยอีเมลและรหัสผ่าน แล้วคีย์ของคุณจะปรากฏทันที
เกิดอะไรขึ้นหากเครดิตทดลองใช้หมด?
คำขอจะคืน error 402 no_credit เติมเงินในยอดคงเหลือแบบเติมเงินล่วงหน้าและคีย์เดียวกันจะใช้งานได้ต่อไป; ไม่มี subscription
ฉันมีคีย์ได้หลายคีย์หรือไม่?
แต่ละบัญชีมีคีย์เพียงหนึ่งคีย์ คุณสามารถสร้างคีย์ใหม่ได้ แต่คีย์เดิมจะหยุดทำงานทันที
ขีดจำกัดใดที่ใช้ได้ในระหว่างทดลองใช้?
เหมือนกับการใช้งานแบบเสียเงิน: หน้าต่างบริบทขนาด 100,000 โทเคน, max_tokens สูงสุด 32,000, ขนาดบอดีคำขอสูงสุด 8 MB และ 300 คำขอต่อนาทีต่อคีย์
คีย์ของคุณอยู่ห่างแค่แบบฟอร์มเดียว
สร้างบัญชี คัดลอกคีย์ แล้วเปลี่ยน URL ฐาน นั่นคือการตั้งค่าทั้งหมด