Rate Limits
Rate limits คือข้อจำกัดที่ API ของเรากำหนดขึ้นเกี่ยวกับจำนวนครั้งที่ผู้ใช้หรือไคลเอนต์สามารถเข้าถึงบริการของเราได้ภายในช่วงเวลาที่กำหนด
เหตุผลของการจำกัดอัตรา
เราได้กำหนด rate limits ไว้ใน API ของเราเพื่อช่วยสร้างประสบการณ์ที่ดีที่สุดให้กับทุกคน นี่คือเหตุผลว่าทำไมมันถึงสำคัญ:
-
เพื่อให้บริการของเราปลอดภัยและมั่นคง! ลองคิดว่า rate limits เป็นเหมือนเจ้าหน้าที่รักษาความปลอดภัยที่เป็นมิตร - พวกเขาคอยดูแลไม่ให้ใครสามารถส่งคำขอมากเกินไปจนล้น API ของเราในคราวเดียว สิ่งนี้ช่วยปกป้องบริการของเราจากการใช้งานในทางที่ผิดที่อาจเกิดขึ้น และทำให้ทุกอย่างดำเนินไปอย่างราบรื่น
-
เพื่อให้แน่ใจว่าทุกคนได้รับส่วนแบ่งที่ยุติธรรม เหมือนกับการแบ่งปันของเล่นในสนามเด็กเล่น เราต้องการให้แน่ใจว่าผู้ใช้ทุกคนของเรามีสิทธิ์เข้าถึง API อย่างเท่าเทียมกัน โดยการจำกัดจำนวนคำขอที่ผู้ใช้แต่ละคนสามารถทำได้อย่างนุ่มนวล เราจึงมั่นใจได้ว่าไม่มีใครต้องรอคิวนานเกินไป
-
เพื่อรักษาประสิทธิภาพให้รวดเร็วและเชื่อถือได้ ด้วยการจัดการการไหลของคำขอโดยรวม เราสามารถรักษาเวลาตอบสนองที่รวดเร็วและบริการที่มั่นคงสำหรับผู้ใช้ที่ยอดเยี่ยมของเราทุกคน มันเหมือนกับการทำให้ทางหลวงไม่แออัดจนเกินไป - การจราจรจะไหลลื่นขึ้นเมื่อเราป้องกันความหนาแน่น!
การทำงานของการจำกัดอัตรา
Rate limits ถูกวัดด้วย 2 วิธี:
- คำขอต่อวินาที: นี่คือจำนวนคำขอเครือข่ายที่คุณสามารถทำได้ต่อวินาที
- งานในคิว: นี่คือจำนวนงานสร้างที่สามารถทำงานพร้อมกันในคิวได้ในเวลาใดเวลาหนึ่ง
งานในคิวรวมถึง endpoint ของ ข้อความเป็น 3D, รูปภาพเป็น 3D, ข้อความเป็นเท็กซ์เจอร์ และ รีเมช ส่วน endpoint อื่น ๆ เช่น Upload และ Balance ไม่ถูกนับรวมในข้อจำกัดนี้
ข้อจำกัดเหล่านี้ถูกนำไปใช้ในระดับบัญชี ซึ่งหมายความว่าข้อจำกัดจะถูกใช้ร่วมกันในทุก API key ของคุณ
นอกเหนือจาก rate limits แล้ว ลำดับความสำคัญในการประมวลผลงานก็จะส่งผลต่อความเร็วของงานของคุณด้วย
แต่ละระดับผู้ใช้จะมี rate limits และระดับลำดับความสำคัญเฉพาะที่ออกแบบมาให้เหมาะสมกับความต้องการของตน นี่คือข้อจำกัดปัจจุบันแยกตามระดับ:
| ระดับผู้ใช้ | คำขอต่อวินาที | งานในคิว | ระดับลำดับความสำคัญ |
|---|---|---|---|
| Pro | 20 | 10 | ค่าเริ่มต้น |
| Premium | 20 | 30 | สูงกว่า Pro |
| Ultra | 20 | 100 | สูงสุด |
| Studio | 20 | 20 | สูงกว่า Pro |
| Enterprise | 100 | ค่าเริ่มต้น 100 สามารถปรับแต่งได้ | สูงสุด |
หากคุณเกินข้อจำกัดเหล่านี้ คุณจะได้รับการตอบกลับ 429 Too Many Requests จาก API ของเรา มีการชนกัน 2 ประเภทที่สามารถกระตุ้นให้เกิดสิ่งนี้ขึ้น โดยแต่ละประเภทจะมีการตอบกลับที่แตกต่างกัน:
- Request Hit: สิ่งนี้เกิดขึ้นเมื่อคุณส่งคำขอมากเกินไปต่อวินาที คุณจะได้รับการตอบกลับ
429 Too Many Requestsพร้อมข้อความRateLimitExceeded - Queue Hit: สิ่งนี้เกิดขึ้นเมื่อคุณมีงานสร้างที่ทำงานพร้อมกันมากเกินไป คุณจะได้รับการตอบกลับ
429 Too Many Requestsพร้อมข้อความNoMoreConcurrentTasks