Ratenlimits
Ratenlimits sind Beschränkungen, die unsere API hinsichtlich der Anzahl der Zugriffe eines Benutzers oder Clients auf unsere Dienste innerhalb eines bestimmten Zeitraums auferlegt.
Warum Limits
Wir haben Ratenlimits in unserer API eingeführt, um das bestmögliche Erlebnis für alle zu schaffen. Hier ist, warum sie wichtig sind:
-
Um unseren Dienst sicher und stabil zu halten! Betrachten Sie Ratenlimits als freundliche Türsteher - sie sorgen dafür, dass niemand unsere API mit zu vielen Anfragen auf einmal überlasten kann. Dies hilft, unseren Dienst vor potenziellem Missbrauch zu schützen und alles reibungslos laufen zu lassen.
-
Um sicherzustellen, dass jeder seinen fairen Anteil bekommt. Genau wie beim Teilen von Spielzeug auf einem Spielplatz möchten wir sicherstellen, dass alle unsere Nutzer gleichberechtigten Zugang zur API haben. Indem wir sanft begrenzen, wie viele Anfragen jeder Nutzer stellen kann, sorgen wir dafür, dass niemand zu lange auf seine Chance warten muss.
-
Um die Leistung schnell und zuverlässig zu halten. Durch das Management des gesamten Anfrageflusses können wir schnelle Antwortzeiten und einen stabilen Service für alle unsere wunderbaren Nutzer aufrechterhalten. Es ist wie sicherzustellen, dass eine Autobahn nicht zu überfüllt wird - der Verkehr fließt besser, wenn wir Staus verhindern!
Wie Limits funktionieren
Ratenlimits werden auf zwei Arten gemessen:
- Anfragen pro Sekunde: Dies ist die Anzahl der Netzwerk-Anfragen, die Sie pro Sekunde stellen können.
- Warteschlangen-Tasks: Dies ist die Anzahl der gleichzeitigen Generierungs-Tasks, die Sie zu einem bestimmten Zeitpunkt in der Warteschlange ausführen können.
Warteschlangen-Tasks umfassen Text zu 3D, Bild zu 3D, Text zu Textur und Neuvernetzung endpoints. Andere endpoints wie Upload und Balance sind in diesem Limit nicht enthalten.
Die Limits werden pro Konto angewendet. Das bedeutet, dass die Limits auf alle Ihre API keys verteilt sind.
Neben den Ratenlimits beeinflusst auch die Task-Verarbeitungspriorität die Geschwindigkeit Ihrer Tasks.
Jede Nutzerstufe hat spezifische Ratenlimits und Prioritätsstufen, die auf ihre Bedürfnisse abgestimmt sind. Hier sind die aktuellen Limits nach Stufe:
| Nutzerstufe | Anfragen pro Sekunde | Warteschlangen-Tasks | Prioritätsstufe |
|---|---|---|---|
| Pro | 20 | 10 | Standard |
| Premium | 20 | 30 | Höher als Pro |
| Ultra | 20 | 100 | Höchste |
| Studio | 20 | 20 | Höher als Pro |
| Enterprise | 100 | Standardmäßig 50, kann angepasst werden | Höchste |
Wenn Sie diese Limits überschreiten, erhalten Sie eine 429 Too Many Requests Antwort von unserer API. Es gibt zwei Arten von Treffern, die dies auslösen können, jeweils mit einer anderen Antwort:
- Anfrage-Treffer: Dies passiert, wenn Sie zu viele Anfragen pro Sekunde stellen. Sie erhalten eine
429 Too Many RequestsAntwort mit einerRateLimitExceededNachricht. - Warteschlangen-Treffer: Dies passiert, wenn Sie zu viele gleichzeitige Generierungs-Tasks ausführen. Sie erhalten eine
429 Too Many RequestsAntwort mit einerNoMoreConcurrentTasksNachricht.