INCIDENT OFFICIEL ARCHIVÉ

Actions delays in starting runs

GitHub · Dernier état fournisseur enregistré : resolved

Rapport actuel du service →

Le texte de la source officielle est affiché dans sa langue d’origine.

Il s’agit d’éléments historiques.

Le dernier état enregistré d’un événement n’est pas l’état actuel du service. Les listes des sources peuvent être incomplètes et la disparition d’une source ne confirme pas la reprise. Consultez le rapport actuel ou la source officielle pour des éléments plus récents.

Détails d’événement enregistrés

État du fournisseur
resolved
Impact du fournisseur
minor
Enregistrement fournisseur créé
24 Aug 2026, 13:56:54 UTC
Enregistrement fournisseur mis à jour
25 Aug 2026, 01:36:32 UTC
Début explicite du fournisseur
24 Aug 2026, 13:56:54 UTC
Fin explicite du fournisseur
24 Aug 2026, 14:34:42 UTC

Composants affectés signalés par le fournisseur

  • Actions br0l2tvcx85d

Ces associations décrivent le périmètre signalé de l’événement. Elles ne prouvent pas la disponibilité actuelle des composants ou des dépendances vérifiées.

L’heure de création d’un enregistrement n’est pas nécessairement le début d’une panne. Les heures non signalées restent indisponibles. Nous ne calculons pas la durée d’indisponibilité à partir des heures de collecte.

Mises à jour fournisseur dans les révisions enregistrées

Plus récentes en premier. Nous affichons jusqu’à 100 mises à jour distinctes parmi les 20 dernières révisions de contenu enregistrées. Les formulations révisées au même horodatage fournisseur sont conservées séparément.

  1. resolved

    On August 24, 2026, between 13:33 UTC and 14:04 UTC, 3.8% of Actions runs experienced start delays over 5 minutes with 1.25% of Actions runs failing outright. <br /> <br />The incident was caused by a disk failure on a node hosting one of many service instances responsible for processing runner assignment events. Typically, pods on unhealthy nodes are removed and replaced automatically without impact. In this case, although the node was severely degraded and unable to perform disk operations, it continued sending healthy signals, preventing the system from immediately moving its work elsewhere. During this period, events assigned to the affected component accumulated until an automatic rebalance redirected processing to healthy components at 13:54 UTC. The queue backlog was cleared at 14:00 UTC, and processing returned to normal by 14:04 UTC. <br /><br />To prevent a recurrence, we are improving detection and automated remediation for unhealthy nodes that aren’t fully offline. We are also strengthening application-level resiliency, so stalled consumers are automatically removed quickly and their work reassigned without waiting for the affected node to recover.

    Vu dans une révision enregistrée à 06 Oct 2026, 13:58:39 UTC
  2. monitoring

    The degradation affecting Actions has been mitigated. We are monitoring to ensure stability.

    Vu dans une révision enregistrée à 06 Oct 2026, 13:58:39 UTC
  3. investigating

    Failures while queuing and running Actions jobs for a subset of customers are now resolving. We are monitoring for full recovery.

    Vu dans une révision enregistrée à 06 Oct 2026, 13:58:39 UTC
  4. investigating

    We are investigating reports of degraded performance for Actions

    Vu dans une révision enregistrée à 06 Oct 2026, 13:58:39 UTC