INCIDENT OFICIAL ARQUIVADO

Actions delays in starting runs

GitHub · Último status salvo do provedor: resolved

Relatório atual do serviço →

O texto da fonte oficial é exibido no idioma original.

São evidências históricas.

O último status salvo de um evento não é o status atual do serviço. As listas das fontes podem ser incompletas, e desaparecer de uma fonte não confirma recuperação. Abra o relatório atual ou a fonte oficial para evidências mais recentes.

Detalhes de evento salvos

Status do provedor
resolved
Impacto do provedor
minor
Registro do provedor criado
24 Aug 2026, 13:56:54 UTC
Registro do provedor atualizado
25 Aug 2026, 01:36:32 UTC
Início explícito do provedor
24 Aug 2026, 13:56:54 UTC
Fim explícito do provedor
24 Aug 2026, 14:34:42 UTC

Componentes afetados informados pelo provedor

  • Actions br0l2tvcx85d

Essas associações descrevem o escopo relatado do evento. Não estabelecem disponibilidade atual dos componentes ou dependências verificadas.

A hora de criação de um registro não é necessariamente o início de uma interrupção. Horários não informados permanecem indisponíveis. Não calculamos o tempo de indisponibilidade a partir das horas de coleta.

Atualizações do provedor em revisões salvas

Mais recentes primeiro. Exibimos até 100 atualizações distintas das últimas 20 revisões de conteúdo salvas. Alterações de texto no mesmo horário do provedor são mantidas separadamente.

  1. resolved

    On August 24, 2026, between 13:33 UTC and 14:04 UTC, 3.8% of Actions runs experienced start delays over 5 minutes with 1.25% of Actions runs failing outright. <br /> <br />The incident was caused by a disk failure on a node hosting one of many service instances responsible for processing runner assignment events. Typically, pods on unhealthy nodes are removed and replaced automatically without impact. In this case, although the node was severely degraded and unable to perform disk operations, it continued sending healthy signals, preventing the system from immediately moving its work elsewhere. During this period, events assigned to the affected component accumulated until an automatic rebalance redirected processing to healthy components at 13:54 UTC. The queue backlog was cleared at 14:00 UTC, and processing returned to normal by 14:04 UTC. <br /><br />To prevent a recurrence, we are improving detection and automated remediation for unhealthy nodes that aren’t fully offline. We are also strengthening application-level resiliency, so stalled consumers are automatically removed quickly and their work reassigned without waiting for the affected node to recover.

    Visto em uma revisão salva às 06 Oct 2026, 13:58:39 UTC
  2. monitoring

    The degradation affecting Actions has been mitigated. We are monitoring to ensure stability.

    Visto em uma revisão salva às 06 Oct 2026, 13:58:39 UTC
  3. investigating

    Failures while queuing and running Actions jobs for a subset of customers are now resolving. We are monitoring for full recovery.

    Visto em uma revisão salva às 06 Oct 2026, 13:58:39 UTC
  4. investigating

    We are investigating reports of degraded performance for Actions

    Visto em uma revisão salva às 06 Oct 2026, 13:58:39 UTC