OpenAI
Deze pagina is automatisch vertaald. Bekijk het oorspronkelijke Engelstalige artikel.

Problemen met API-volumelimieten en 429-fouten oplossen

Achterhaal de oorzaak van een API 429-fout, beperk pieken in aanvragen en kies de juiste vervolgstap voor volume-, credit- of gebruikslimieten.

Bijgewerkt: 2 days ago

Overzicht

Voor API-gebruik gelden volumelimieten. Deze limieten beperken het aantal aanvragen, tokens of ander gebruik binnen een bepaalde periode.

Een 429-respons kan wijzen op een tijdelijke volumelimiet, een opgebruikt prepaidtegoed of een bestedings- of gebruikslimiet. Controleer de foutdetails voordat je het opnieuw probeert of je factureringsinstellingen wijzigt.

Achterhaal de oorzaak

Lees de foutmelding en, indien vermeld, error.code. Bij factureringsfouten kan de bredere waarde insufficient_quota voor error.type worden gebruikt.

Fout of codeBetekenisWat je moet doen
Volumelimiet voor aanvragen of tokens bereiktDe aanvragen overschrijden een toepasselijke volumelimiet.Spreid aanvragen en volg het onderstaande advies voor nieuwe pogingen.
credit_balance_exhaustedDe organisatie heeft geen prepaid credits meer.Voeg credits toe via je instellingen voor API-facturering.
organization_usage_limit_exceededDe organisatie heeft de door OpenAI toegewezen gebruikslimiet bereikt.Vraag goedkeuring voor een hogere gebruikslimiet.
organization_spend_limit_exceededDe organisatie heeft de afgedwongen bestedingslimiet bereikt.Verhoog of verwijder de limiet, of wacht op de maandelijkse reset.
project_spend_limit_exceededHet project heeft de afgedwongen bestedingslimiet bereikt.Verhoog of verwijder de projectlimiet, of wacht op de maandelijkse reset.

Een nieuwe poging bij een facturerings-, bestedings- of quotafout herstelt de toegang niet. Los eerst het gemelde probleem met het saldo of de limiet op. Het kan enige tijd duren voordat wijzigingen in afgedwongen bestedingslimieten van kracht worden.

Voor het wijzigen van een bestedingslimiet heb je toestemming nodig om de relevante organisatie- of projectinstellingen te beheren. Als je geen toegang hebt, vraag dit dan aan degene die deze instellingen beheert.

Zie voor de aanschaf van prepaid credits: Prepaid API-facturering instellen en beheren.

Zie de handleiding voor API-bestedingslimieten voor de verschillende bestedingsregelingen.

Controleer de toepasselijke volumelimieten

Ga naar de pagina Limieten van je organisatie om het huidige gebruiksniveau en de limieten te bekijken.

Volumelimieten kunnen gelden op organisatie- en projectniveau. Het zijn geen individuele gebruiksrechten per gebruiker. Limieten verschillen ook per model en sommige modelfamilies delen een limiet.

Controleer welke limiet in de fout wordt vermeld. Aanvragen per minuut en tokens per minuut zijn bijvoorbeeld afzonderlijke limieten. Je kunt de ene bereiken terwijl je onder de andere blijft.

Controleer welke organisatie voor je aanvraag wordt gebruikt

Als je bij meerdere organisaties hoort, controleer dan of je aanvragen de bedoelde organisatie en het bedoelde project gebruiken.

Als je API-sleutel een standaardorganisatie gebruikt, controleer dan de instelling voor je standaardorganisatie. Organisaties kunnen verschillende factureringsregelingen en gebruiksniveaus hebben.

Tijdelijke fouten door volumelimieten verminderen

Spreid aanvragen en voorkom pieken

Spreid aanvragen in de tijd in plaats van er veel tegelijk te versturen.

Volumelimieten kunnen worden toegepast over kortere perioden dan het weergegeven interval. Een limiet van 60 aanvragen per minuut kan bijvoorbeeld ook per periode van 1 seconde worden toegepast. Een korte piek kan daardoor een fout veroorzaken, zelfs als je gemiddelde gebruik onder de limiet per minuut lijkt te liggen.

Lange prompts en onnodig ruime limieten voor outputtokens kunnen ook bijdragen aan fouten met het tokenvolume.

Probeer het na een wachttijd opnieuw

Bij tijdelijke fouten door volumelimieten:

  1. Controleer of de respons een Retry-After-header bevat.

  2. Als de header een geldige wachttijd bevat, wacht dan minstens zo lang voordat je het opnieuw probeert.

  3. Als de header ontbreekt of ongeldig is, gebruik dan exponentiële back-off met jitter: verleng de wachttijd na elke mislukte poging en voeg een korte willekeurige vertraging toe.

  4. Beperk zowel het aantal nieuwe pogingen als de totale tijd die je eraan besteedt.

Officiële OpenAI-SDK's proberen geschikte fouten door volumelimieten al opnieuw en houden rekening met Retry-After als deze header aanwezig is. Houd rekening met die pogingen voordat je zelf nog een lus voor nieuwe pogingen toevoegt.

Mislukte aanvragen tellen mee voor de limieten per minuut. Als je dezelfde aanvraag voortdurend opnieuw verstuurt, kan het probleem langer aanhouden.

Zie de handleiding voor API-volumelimieten voor implementatieadvies en voorbeelden. Beoordeel bibliotheken van derden voor nieuwe pogingen voordat je ze in je toepassing gebruikt.

Controleer de grootte van prompts en output

Verwijder overbodige instructies, herhaalde context en voorbeelden uit je prompts. Test de aangepaste prompt om te controleren of deze nog steeds het gewenste resultaat oplevert.

Gebruik de parameter voor outputtokens die door je endpoint en model wordt ondersteund:

  • Chat Completions gebruikt max_completion_tokens.

  • Responses gebruikt max_output_tokens.

Stel geen veel ruimere limiet in dan nodig is voor de aanvraag. Deze parameters omvatten zowel redeneringstokens als zichtbare output. Houd dus rekening met beide als je een redenerend model gebruikt.

Controleer je gebruiksniveau

Als de fouten aanhouden nadat je pieken hebt verminderd en het tokengebruik hebt gecontroleerd, bekijk dan op de pagina Limieten hoe je de limieten kunt verhogen.

Naarmate de API-bestedingen toenemen, kan OpenAI een organisatie automatisch naar een hoger gebruiksniveau promoveren. Hierdoor stijgen doorgaans de volumelimieten voor de meeste modellen.

Je goedgekeurde maandelijkse gebruikslimiet staat los van de volumelimieten voor aanvragen en tokens. Een verhoging van de ene limiet bevestigt niet dat de andere ook is gewijzigd.

Als het probleem aanhoudt

Voordat je het probleem escaleert

Houd de exacte foutmelding, eventuele foutcode, relevante aanvraag-ID's, het tijdstip van de fout met je tijdzone en de relevante limiet in je account bij de hand. Noteer welke stappen je al hebt geprobeerd.

Contact opnemen met OpenAI Support

Neem via het helpcentrum contact op met OpenAI Support als je het probleem niet kunt oplossen nadat je de gemelde limiet hebt gecontroleerd. Vermeld geen API-sleutels of andere authenticatiegeheimen.

Was dit artikel nuttig?