Rate Limits

Rate limits คือข้อจำกัดที่ API ของเรากำหนดขึ้นเกี่ยวกับจำนวนครั้งที่ผู้ใช้หรือไคลเอนต์สามารถเข้าถึงบริการของเราได้ภายในช่วงเวลาที่กำหนด


เหตุผลของการจำกัดอัตรา

เราได้กำหนด rate limits ไว้ใน API ของเราเพื่อช่วยสร้างประสบการณ์ที่ดีที่สุดให้กับทุกคน นี่คือเหตุผลว่าทำไมมันถึงสำคัญ:

  • เพื่อให้บริการของเราปลอดภัยและมั่นคง! ลองคิดว่า rate limits เป็นเหมือนเจ้าหน้าที่รักษาความปลอดภัยที่เป็นมิตร - พวกเขาคอยดูแลไม่ให้ใครสามารถส่งคำขอมากเกินไปจนล้น API ของเราในคราวเดียว สิ่งนี้ช่วยปกป้องบริการของเราจากการใช้งานในทางที่ผิดที่อาจเกิดขึ้น และทำให้ทุกอย่างดำเนินไปอย่างราบรื่น

  • เพื่อให้แน่ใจว่าทุกคนได้รับส่วนแบ่งที่ยุติธรรม เหมือนกับการแบ่งปันของเล่นในสนามเด็กเล่น เราต้องการให้แน่ใจว่าผู้ใช้ทุกคนของเรามีสิทธิ์เข้าถึง API อย่างเท่าเทียมกัน โดยการจำกัดจำนวนคำขอที่ผู้ใช้แต่ละคนสามารถทำได้อย่างนุ่มนวล เราจึงมั่นใจได้ว่าไม่มีใครต้องรอคิวนานเกินไป

  • เพื่อรักษาประสิทธิภาพให้รวดเร็วและเชื่อถือได้ ด้วยการจัดการการไหลของคำขอโดยรวม เราสามารถรักษาเวลาตอบสนองที่รวดเร็วและบริการที่มั่นคงสำหรับผู้ใช้ที่ยอดเยี่ยมของเราทุกคน มันเหมือนกับการทำให้ทางหลวงไม่แออัดจนเกินไป - การจราจรจะไหลลื่นขึ้นเมื่อเราป้องกันความหนาแน่น!


การทำงานของการจำกัดอัตรา

Rate limits ถูกวัดด้วย 2 วิธี:

  • คำขอต่อวินาที: นี่คือจำนวนคำขอเครือข่ายที่คุณสามารถทำได้ต่อวินาที
  • งานในคิว: นี่คือจำนวนงานสร้างที่สามารถทำงานพร้อมกันในคิวได้ในเวลาใดเวลาหนึ่ง

งานในคิวรวมถึง endpoint ของ ข้อความเป็น 3D, รูปภาพเป็น 3D, ข้อความเป็นเท็กซ์เจอร์ และ รีเมช ส่วน endpoint อื่น ๆ เช่น Upload และ Balance ไม่ถูกนับรวมในข้อจำกัดนี้

ข้อจำกัดเหล่านี้ถูกนำไปใช้ในระดับบัญชี ซึ่งหมายความว่าข้อจำกัดจะถูกใช้ร่วมกันในทุก API key ของคุณ

นอกเหนือจาก rate limits แล้ว ลำดับความสำคัญในการประมวลผลงานก็จะส่งผลต่อความเร็วของงานของคุณด้วย

แต่ละระดับผู้ใช้จะมี rate limits และระดับลำดับความสำคัญเฉพาะที่ออกแบบมาให้เหมาะสมกับความต้องการของตน นี่คือข้อจำกัดปัจจุบันแยกตามระดับ:

ระดับผู้ใช้คำขอต่อวินาทีงานในคิวระดับลำดับความสำคัญ
Pro2010ค่าเริ่มต้น
Premium2030สูงกว่า Pro
Ultra20100สูงสุด
Studio2020สูงกว่า Pro
Enterprise100ค่าเริ่มต้น 100 สามารถปรับแต่งได้สูงสุด

หากคุณเกินข้อจำกัดเหล่านี้ คุณจะได้รับการตอบกลับ 429 Too Many Requests จาก API ของเรา มีการชนกัน 2 ประเภทที่สามารถกระตุ้นให้เกิดสิ่งนี้ขึ้น โดยแต่ละประเภทจะมีการตอบกลับที่แตกต่างกัน:

  • Request Hit: สิ่งนี้เกิดขึ้นเมื่อคุณส่งคำขอมากเกินไปต่อวินาที คุณจะได้รับการตอบกลับ 429 Too Many Requests พร้อมข้อความ RateLimitExceeded
  • Queue Hit: สิ่งนี้เกิดขึ้นเมื่อคุณมีงานสร้างที่ทำงานพร้อมกันมากเกินไป คุณจะได้รับการตอบกลับ 429 Too Many Requests พร้อมข้อความ NoMoreConcurrentTasks