AI-API-Fehler: 401, 429, 5xx und Zeitüberschreitungen
Authentifizierung, Kontingent, Limits und vorübergehende Fehler für OpenAI, Claude und Gemini API trennen. Vor Wiederholungsentscheidung Fehlerdetails nutzen.
Kurze Antwort
Ein API-Fehler allein belegt keinen Anbieterausfall. Lesen Sie Fehlertext und Anfrage-ID und prüfen Sie die passende Statuskomponente. Authentifizierungs- und Abrechnungsprobleme erfordern Konfigurationsänderungen; vorübergehende Fehler können begrenzte Wiederholungen rechtfertigen.
Mit Fehlerkategorie beginnen
Tabelle für erste Prüfung nutzen. Bedeutung/Lösung hängt von Anbieter, Endpunkt und Fehlertext ab.
| Was Sie sehen | Erste Prüfung | Was es nicht belegt |
|---|---|---|
| 400 / 404 / 413 | Anfrageformat, Endpunkt, Ressource und Größe; Anbieterfehler lesen | Ein allgemeiner Dienstausfall |
| 401 / 403 | Zugangsdaten, Berechtigungen und anbieterspezifische Einschränkungen | Dass alle Nutzer blockiert sind |
| 429 | Limit-Header, Kontingent, Guthaben und Ausgabenlimits | Dass sofortiges Wiederholen funktioniert |
| 500 / 503 / 529 | Anbieterfehlerdetails und passende offizielle Komponente | Ein bestätigtes weltweites Ereignis |
| Zeitüberschreitung / Verbindungsfehler | Clientfrist, DNS, TLS, Proxy und Anfragedauer | Welche Seite den Fehler verursachte |
OpenAI: 429 kann verschiedene Limits bedeuten
Prüfen Sie error.code, nicht nur HTTP 429. OpenAI trennt Anfragerate von Guthaben und Organisations-/Projektlimits. Abrechnungs- und Kontingentfehler lösen Wiederholungen nicht. Bei vorübergehenden Limits oder Überlastung Retry-After beachten und begrenzt wiederholen.
OpenAI API-Eintrag für API-Komponenten. ChatGPT-App bestätigt weder API-Ergebnis noch bestimmtes GPT-Modell.
Claude: Überlastung und Ausgabenlimits unterscheiden sich
Claude dokumentiert 529 als Überlastung, 401 als Authentifizierungsfehler und 403 als Berechtigungsfehler. 429 kann Limits oder Ausgabenobergrenzen bedeuten. Ein Nutzungstarif-Ausgabenlimit mit 429 hat keinen Retry-After-Header und schlägt bis zur Wiederfreigabe fehl. Lesen Sie den gesamten Fehler vor Wahl der Wiederholungsrichtlinie.
Claude dokumentiert Streamfehler nach HTTP 200. Prüfen Sie Abschluss und Fehlerereignisse; Antwortheader allein belegen keine erfolgreiche Generierung.
Gemini: Entwicklerendpunkt verifizieren
Google empfiehlt begrenzte exponentielle Wartezeiten mit Zufallsanteil bei vorübergehenden Fehlern. Prüfen Sie auch API-Version, Modell und Parameter. Nutzen Sie den eigenen Entwickler-API-Bericht; Gemini-App-Ereignisse decken Gemini API oder AI Studio nicht ab.
Wiederholungsbudget festlegen
Legen Sie als Anwendungsentscheidung maximale Versuche und ein Gesamtzeitbudget fest. Berücksichtigen Sie SDK-Wiederholungen. Verwenden Sie für vom Anbieter als vorübergehend eingestufte Fehler exponentielle Wartezeiten mit Zufallsanteil und beachten Sie geltende Retry-Header.
Prüfen Sie vor Wiederholung einer unterbrochenen Anfrage, ob sie bereits Ausgabe, Kosten oder Folgeaktionen erzeugt haben könnte. Modellanfragen und Agent-Toolaktionen erneut auszuführen sind separate Entscheidungen. Bewahren Sie Anfrage-IDs zur Diagnose und stoppen Sie bei ausgeschöpftem Budget automatische Wiederholungen.
Bestimmte Antwort untersuchen
Passenden Fehlerleitfaden nutzen. Diese Seiten erklären Anfragefehler, keine Kontolimitüberwachung.
Verwandte Dienstseiten
Jeder Eintrag zeigt seine Erfassungsabdeckung. Ein verlinkter Dienst wird nicht zwingend automatisch erfasst.
Redaktionelles Prüfdatum gilt für diesen Leitfaden. Live-Erfassungszeiten stehen auf Dienstseiten.