レート制限

レート制限とは、当社のAPIが、ユーザーやクライアントが指定された期間内に当社のサービスにアクセスできる回数に課す制限のことです。


制限を設ける理由

私たちは、すべてのユーザーにとって最良の体験を実現するため、APIにレート制限を設けています。その理由は以下の通りです。

  • サービスを安全に保つため!レート制限は、フレンドリーな門番のようなものだと考えてください。あまりに多くのリクエストが一度にAPIに押し寄せて圧倒されることがないようにしてくれます。これにより、潜在的な不正利用からサービスを守り、すべてが円滑に動作するようにしています。

  • すべてのユーザーに公平な取り分を保証するため。遊び場でおもちゃを共有するのと同じように、すべてのユーザーがAPIへの平等なアクセスを持てるようにしたいと考えています。各ユーザーが行えるリクエスト数を緩やかに制限することで、誰も自分の順番を待ちすぎることがないようにしています。

  • パフォーマンスを軽快かつ信頼性の高いものに保つため。リクエスト全体の流れを管理することで、素晴らしいすべてのユーザーに対して高速な応答時間と安定したサービスを維持できます。これは、高速道路が混雑しすぎないようにするようなものです。渋滞を防げば、交通の流れはより良くなります!


制限の仕組み

レート制限は、次の2つの方法で測定されます。

  • 秒間リクエスト数:これは、1秒間に行うことができるネットワークリクエストの数です。
  • キュータスク数:これは、任意の時点でキュー内で同時に実行できる生成タスクの数です。

キュータスク数には、テキストから3D、画像から3D、テキストからテクスチャ、およびリメッシュのendpointが含まれます。アップロードやBalanceなど、他のendpointはこの制限には含まれません。

制限はアカウント単位で適用されます。つまり、この制限はあなたのすべてのAPI keyにわたって共有されます。

レート制限に加えて、タスク処理の優先度もタスクの処理速度に影響します。

各ユーザー階層には、それぞれのニーズに合わせて設計された特定のレート制限と優先度レベルが設定されています。現在の階層別の制限は以下の通りです。

ユーザー階層秒間リクエスト数キュータスク数優先度レベル
Pro2010デフォルト
Premium2030Proより高い
Ultra20100最高
Studio2020Proより高い
Enterprise100デフォルトは100、カスタマイズ可能最高

これらの制限を超えると、当社のAPIから429 Too Many Requestsのレスポンスが返されます。これを引き起こすヒットには2種類あり、それぞれ異なるレスポンスが返されます。

  • リクエストヒット:これは、1秒あたりのリクエスト数が多すぎる場合に発生します。RateLimitExceededメッセージとともに429 Too Many Requestsのレスポンスが返されます。
  • キューヒット:これは、同時に実行中の生成タスクが多すぎる場合に発生します。NoMoreConcurrentTasksメッセージとともに429 Too Many Requestsのレスポンスが返されます。