En et-millisekundsfejl stoppede britisk flytrafik. Seks timer.
Kl.
Kl. 10:00 tirsdag den 8. september afbrydes en rutinemæssig squawk-kode anmodning inde i NATS's nationale luftrumssystem (NAS) af en højere prioriteret meddelelse, mens den er halvt igennem en værdiopdatering. Eksponeringstiden er omkring et millisekund. Anmodningen genoptages forkert, flydataene bliver korrupte, og kl. 19:30 er mere end 2.000 britiske flyvninger blevet forsinket, aflyst eller omdirigeret.
Læs den skriftlige udgave (engelsk) ↗
Hvad denne video dækker
- 10:00: én anmodning, afbrudt inden for et 1 ms vindue
- Tidslinje: 10:00 squawk → 10:02 blip → 12:45 afgange stopper → 13:32 forbindelse tabt
- Kuren: genstart hele landets flydata
- Mekanisme: sat på pause midt i en skrivning
- Hvorfor en sikkerhedsfunktion stoppede himlen
Oversat udskrift
Oversat fra den originale engelske fortælling. Tilgængelig lyd og undertekster styres af YouTube.
10:00: én anmodning, afbrudt inden for et 1 ms vindue
0:00 Klokken ti om morgenen, en rutineanmodning i Storbritanniens flydatasystem bliver afbrudt på præcis det forkerte millisekund, og om aftenen er mere end to tusind fly forsinket, aflyst eller omdirigeret. Det er fra den foreløbige rapport fra Nats, Storbritanniens flytrafik tjeneste. Ingen tegn på et angreb, og ingen trykkede på den forkerte knap. Blot en ældre defekt, og et meget specifikt millisekund. Hvordan det skete, hvorfor et millisekund var nok, og hvem der egentlig får skylden. Dette er The Daily Diff, postmortem.
0:31 Klokken ti. Nogen spørger manuelt om en squawk-kode, det firecifrede nummer der
Tidslinje: 10:00 squawk → 10:02 blip → 12:45 afgange stopper → 13:32 forbindelse tabt
0:36 forbinder et radarblip med dets flyveplan. Anmodningen er gyldig, og det er planen også. Ti nul to. Forbindelsen mellem London Area Control og kernesystemet falder, og kommer så tilbage af sig selv efter femogfyrre sekunder. Billetten siger genoprettet, stabil, ingen operationel påvirkning. Tolv toogtredive. Forbindelsen begynder at falde igen, hurtigere hver gang, og kontrolørerne mister noget automatisering.
0:56 Klokken tolv femogfyrre, stopper britiske afgange. Klokken et toogtredive, falder forbindelsen og forbliver nede. Kuren er en kontrolleret genstart, og det er den dyre del,
Kuren: genstart hele landets flydata
1:06 fordi det samme system forsyner kontrolcentre og lufthavne over hele landet. Fejlen lever i Londons luftrum. Restriktionerne dækker hele Storbritannien. Genstarten kører fra et kvart over tre til ti over fire, og opklaringen af de duplikerede flyveplaner tager indtil ti minutter i syv. Så hvorfor var et millisekund nok?
Mekanisme: sat på pause midt i en skrivning
1:23 Systemet jonglerer opgaver efter prioritet, og at sætte en lille opgave på pause for en presserende er normalt. Men denne opgave var halvt igennem en værdiopdatering. Den presserende meddelelse lander inden for det millisekund, og opdateringen stopper midtvejs. Når den genoptages, genoptages den ikke korrekt. De dårlige data lækker derefter ind i nogle af de senere flyopdateringer.
Hvorfor en sikkerhedsfunktion stoppede himlen
1:40 London forsøger at læse en, tager for lang tid og får timeout. En timeout afbryder forbindelsen, som designet, for at beskytte begge systemer. Sikkerhedsfunktionen virker perfekt. Det er problemet. Rapportens egne ord. Var den presserende meddelelse ankommet et millisekund tidligere eller senere, ville opdateringen have været fuldført normalt. På Hacker News kalder en programmør et millisekund for en absolut evighed,
2:02 garanteret at ske inden tirsdag denne uge. Det var en tirsdag.
git blame — legacy code 50 · genstartsplan 30 · 10:02 alarmen 15 · 1 ms 5
2:05 git blame. Den ældre kode, halvtreds procent, for en opdatering der kan sættes på pause halvvejs og kommer forkert tilbage. Genstartsplanen, tredive, fordi en dårlig post i London betyder genstart af hele landets flydata. Ti nul to alarmen, femten, for at reparere sig selv og blive arkiveret som uden påvirkning. Fem procent til millisekundet, for dens timing. Skadesomfang. Nats planlagde omkring otte tusind flyvninger den dag og håndterede
Skadesomfang: 8.000 planlagt, 6.094 håndteret, tredje fejl på tre år
2:27 omkring seks tusind. Britiske afgange stoppede i omkring fire en halv time, og restancen tog over to dage at rydde. Det er Storbritanniens tredje flytrafikfejl på tre år, og administrerende direktør kalder denne fejl meget, meget obskur.
Dom + mandagslinjen: atomiske skrivninger, høje alarmer
2:41 Dom, postmortem: NEEDS REVIEW. Rapporten er hurtig og specifik, og løsningen er skrevet og under test. Men planen er en hurtigere genstart, ikke en mindre. Mandagslinjen: hvis en opgave kan sættes på pause, gør dens skrivning atomisk, og behandl en alarm der reparerer sig selv som en alarm. Send mig den hændelse du stadig ikke må tale om, i kommentarerne, eller på thedailydiff.dev. Og det er The Daily Diff for i dag.
3:02 Jeg er Niko fra Axrisi. SHIP IT ansvarligt.
Kilder
- NATS, Major Incident Preliminary Investigation Report, NAS incident 08 September 2026 (report date Sep 16)www.nats.aero
- NATS press release, "NATS publishes preliminary report on technical incident of 8 September" (Sep 18, 2026)www.nats.aero
- NATS on X, 8 Sepx.com
- BBC, "Flight chaos caused by 'millisecond' software defect, report says"www.bbc.co.uk
- The Guardian (Sep 18, 2026)www.theguardian.com
- Hacker News thread on the reportnews.ycombinator.com



