Anfragefehlersuche

AI-API-Fehler: 401, 429, 5xx und Zeitüberschreitungen

Authentifizierung, Kontingent, Limits und vorübergehende Fehler für OpenAI, Claude und Gemini API trennen. Vor Wiederholungsentscheidung Fehlerdetails nutzen.

Kurze Antwort

Ein API-Fehler allein belegt keinen Anbieterausfall. Lesen Sie Fehlertext und Anfrage-ID und prüfen Sie die passende Statuskomponente. Authentifizierungs- und Abrechnungsprobleme erfordern Konfigurationsänderungen; vorübergehende Fehler können begrenzte Wiederholungen rechtfertigen.

Mit Fehlerkategorie beginnen

Tabelle für erste Prüfung nutzen. Bedeutung/Lösung hängt von Anbieter, Endpunkt und Fehlertext ab.

Was Sie sehenErste PrüfungWas es nicht belegt
400 / 404 / 413Anfrageformat, Endpunkt, Ressource und Größe; Anbieterfehler lesenEin allgemeiner Dienstausfall
401 / 403Zugangsdaten, Berechtigungen und anbieterspezifische EinschränkungenDass alle Nutzer blockiert sind
429Limit-Header, Kontingent, Guthaben und AusgabenlimitsDass sofortiges Wiederholen funktioniert
500 / 503 / 529Anbieterfehlerdetails und passende offizielle KomponenteEin bestätigtes weltweites Ereignis
Zeitüberschreitung / VerbindungsfehlerClientfrist, DNS, TLS, Proxy und AnfragedauerWelche Seite den Fehler verursachte

OpenAI: 429 kann verschiedene Limits bedeuten

Prüfen Sie error.code, nicht nur HTTP 429. OpenAI trennt Anfragerate von Guthaben und Organisations-/Projektlimits. Abrechnungs- und Kontingentfehler lösen Wiederholungen nicht. Bei vorübergehenden Limits oder Überlastung Retry-After beachten und begrenzt wiederholen.

OpenAI API-Eintrag für API-Komponenten. ChatGPT-App bestätigt weder API-Ergebnis noch bestimmtes GPT-Modell.

Claude: Überlastung und Ausgabenlimits unterscheiden sich

Claude dokumentiert 529 als Überlastung, 401 als Authentifizierungsfehler und 403 als Berechtigungsfehler. 429 kann Limits oder Ausgabenobergrenzen bedeuten. Ein Nutzungstarif-Ausgabenlimit mit 429 hat keinen Retry-After-Header und schlägt bis zur Wiederfreigabe fehl. Lesen Sie den gesamten Fehler vor Wahl der Wiederholungsrichtlinie.

Claude dokumentiert Streamfehler nach HTTP 200. Prüfen Sie Abschluss und Fehlerereignisse; Antwortheader allein belegen keine erfolgreiche Generierung.

Gemini: Entwicklerendpunkt verifizieren

Google empfiehlt begrenzte exponentielle Wartezeiten mit Zufallsanteil bei vorübergehenden Fehlern. Prüfen Sie auch API-Version, Modell und Parameter. Nutzen Sie den eigenen Entwickler-API-Bericht; Gemini-App-Ereignisse decken Gemini API oder AI Studio nicht ab.

Wiederholungsbudget festlegen

Legen Sie als Anwendungsentscheidung maximale Versuche und ein Gesamtzeitbudget fest. Berücksichtigen Sie SDK-Wiederholungen. Verwenden Sie für vom Anbieter als vorübergehend eingestufte Fehler exponentielle Wartezeiten mit Zufallsanteil und beachten Sie geltende Retry-Header.

Prüfen Sie vor Wiederholung einer unterbrochenen Anfrage, ob sie bereits Ausgabe, Kosten oder Folgeaktionen erzeugt haben könnte. Modellanfragen und Agent-Toolaktionen erneut auszuführen sind separate Entscheidungen. Bewahren Sie Anfrage-IDs zur Diagnose und stoppen Sie bei ausgeschöpftem Budget automatische Wiederholungen.

Bestimmte Antwort untersuchen

Passenden Fehlerleitfaden nutzen. Diese Seiten erklären Anfragefehler, keine Kontolimitüberwachung.

Verwandte Dienstseiten

Jeder Eintrag zeigt seine Erfassungsabdeckung. Ein verlinkter Dienst wird nicht zwingend automatisch erfasst.

Redaktionelles Prüfdatum gilt für diesen Leitfaden. Live-Erfassungszeiten stehen auf Dienstseiten.