INCIDENT OFICIAL ARCHIVADO

Actions delays in starting runs

GitHub · Último estado guardado del proveedor: resolved

Informe actual del servicio →

El texto de la fuente oficial se muestra en su idioma original.

Es evidencia histórica.

El último estado guardado de un evento no es el estado actual del servicio. Las listas de fuentes pueden ser incompletas, y desaparecer de una fuente no confirma recuperación. Abre el informe actual o la fuente oficial para obtener evidencia más reciente.

Detalles de evento guardados

Estado del proveedor
resolved
Impacto del proveedor
minor
Registro del proveedor creado
24 Aug 2026, 13:56:54 UTC
Registro del proveedor actualizado
25 Aug 2026, 01:36:32 UTC
Inicio explícito del proveedor
24 Aug 2026, 13:56:54 UTC
Fin explícito del proveedor
24 Aug 2026, 14:34:42 UTC

Componentes afectados reportados por el proveedor

  • Actions br0l2tvcx85d

Estas asociaciones describen el alcance reportado del evento. No establecen disponibilidad actual de componentes ni dependencias verificadas.

La hora de creación de un registro no es necesariamente el inicio de una interrupción. Las horas no reportadas siguen sin estar disponibles. No calculamos el tiempo de inactividad a partir de las horas de recopilación.

Actualizaciones del proveedor en revisiones guardadas

Más recientes primero. Mostramos hasta 100 actualizaciones distintas de las últimas 20 revisiones de contenido guardadas. Las modificaciones de redacción a la misma hora del proveedor se conservan por separado.

  1. resolved

    On August 24, 2026, between 13:33 UTC and 14:04 UTC, 3.8% of Actions runs experienced start delays over 5 minutes with 1.25% of Actions runs failing outright. <br /> <br />The incident was caused by a disk failure on a node hosting one of many service instances responsible for processing runner assignment events. Typically, pods on unhealthy nodes are removed and replaced automatically without impact. In this case, although the node was severely degraded and unable to perform disk operations, it continued sending healthy signals, preventing the system from immediately moving its work elsewhere. During this period, events assigned to the affected component accumulated until an automatic rebalance redirected processing to healthy components at 13:54 UTC. The queue backlog was cleared at 14:00 UTC, and processing returned to normal by 14:04 UTC. <br /><br />To prevent a recurrence, we are improving detection and automated remediation for unhealthy nodes that aren’t fully offline. We are also strengthening application-level resiliency, so stalled consumers are automatically removed quickly and their work reassigned without waiting for the affected node to recover.

    Visto en una revisión guardada a las 06 Oct 2026, 13:58:39 UTC
  2. monitoring

    The degradation affecting Actions has been mitigated. We are monitoring to ensure stability.

    Visto en una revisión guardada a las 06 Oct 2026, 13:58:39 UTC
  3. investigating

    Failures while queuing and running Actions jobs for a subset of customers are now resolving. We are monitoring for full recovery.

    Visto en una revisión guardada a las 06 Oct 2026, 13:58:39 UTC
  4. investigating

    We are investigating reports of degraded performance for Actions

    Visto en una revisión guardada a las 06 Oct 2026, 13:58:39 UTC