Google Cloud ഒരു ശൂന്യമായ ഫീൽഡിൽ തകർന്നു. മൂന്ന് മണിക്കൂർ.
കുറച്ച് ശൂന്യമായ ഫീൽഡുകളുള്ള ഒരു പോളിസി നിര ഒരു നൾ പോയിന്ററിൽ തട്ടി, Google Cloud എല്ലാ പ്രദേശങ്ങളിലും ഒരേസമയം തകർന്നു — തുടർന്ന് Cloudflare-ഉം അതിന്റെ കൂടെ തകർന്നു.
കുറച്ച് ശൂന്യമായ ഫീൽഡുകളുള്ള ഒരു പോളിസി നിര ഒരു നൾ പോയിന്ററിൽ തട്ടി, Google Cloud എല്ലാ പ്രദേശങ്ങളിലും ഒരേസമയം തകർന്നു — തുടർന്ന് Cloudflare-ഉം അതിന്റെ കൂടെ തകർന്നു. 2025 ജൂൺ 12, 17:49 UTC: ഓരോ Google Cloud API അഭ്യർത്ഥനയും അംഗീകരിക്കുന്ന ബൈനറിയായ സർവീസ് കൺട്രോൾ, "അനുദ്ദേശിത ശൂന്യമായ ഫീൽഡുകളുള്ള" ഒരു ക്വോട്ടാ-പോളിസി മാറ്റം വായിക്കുന്നു, രണ്ടാഴ്ച മുമ്പ് നൾ ചെക്കോ ഫീച്ചർ ഫ്ലാഗോ ഇല്ലാതെ അയച്ച ഒരു കോഡ് പാത്തിൽ തട്ടി, എല്ലാ പ്രദേശങ്ങളിലും ഒരു ക്രാഷ് ലൂപ്പിലേക്ക് പോകുന്നു — ആ നിര നിമിഷങ്ങൾക്കുള്ളിൽ ആഗോളതലത്തിൽ പകർത്തിയിരുന്നു. ബാഹ്യ API-കൾ മൂന്ന് മണിക്കൂർ 503 നൽകുന്നു; us-central1-ന് 2 മണിക്കൂർ 40 മിനിറ്റ് എടുക്കുന്നു, കാരണം പുനരാരംഭിക്കുന്ന ടാസ്ക്കുകൾ ക്രമരഹിതമായ ബാക്കോഫ് ഇല്ലാതെ അതേ Spanner ടേബിളിൽ കുതിക്കുന്നു. Google-ന്റെ തകരാർ ആരംഭിച്ച് മൂന്ന് മിനിറ്റിനുള്ളിൽ, Cloudflare-ന്റെ Workers KV — "ഒരു മൂന്നാം കക്ഷി ക്ലൗഡ് പ്രൊവൈഡറിൽ" അതിന്റെ വിശ്വാസയോഗ്യമായ ഉറവിടം സ്ഥിതിചെയ്യുന്നു — 90% അഭ്യർത്ഥനകളും നഷ്ടപ്പെടുന്നു, കൂടാതെ Access, WARP, Workers AI, Pages, Stream, Turnstile എന്നിവ 2 മണിക്കൂർ 28 മിനിറ്റ് അതിനോടൊപ്പം തകരുന്നു. Google-ന്റെ സ്റ്റാറ്റസ് പേജ് അതിന്റെ ആദ്യ അപ്ഡേറ്റ് ഒരു മണിക്കൂർ വൈകി പോസ്റ്റ് ചെയ്യുന്നു, കാരണം അത് Google Cloud-ൽ പ്രവർത്തിക്കുന്നു.
എഴുതിയ പതിപ്പ് വായിക്കുക (ഇംഗ്ലീഷ്) ↗
ഈ വീഡിയോയിൽ ഉൾപ്പെടുന്ന കാര്യങ്ങൾ
- ഒരു ശൂന്യമായ ഫീൽഡ്, ഒരു നൾ പോയിന്റർ, എല്ലാ മേഖലയും
- സമയരേഖ: മെയ് 29 → 17:45 → ക്രാഷ് ലൂപ്പ് → റെഡ് ബട്ടൺ → 17:52 Cloudflare
- us-central1: ആൾക്കൂട്ട പ്രഭാവം
- മെക്കാനിസം: അഭ്യർത്ഥന പാതയിൽ പരിശോധിക്കുക, ആഗോള പ്രതികരണം, ഒരു വെണ്ടർ
- git blame — വിഭജനം
വിവർത്തനം ചെയ്ത ട്രാൻസ്ക്രിപ്റ്റ്
യഥാർത്ഥ ഇംഗ്ലീഷ് ആഖ്യാനത്തിൽ നിന്ന് വിവർത്തനം ചെയ്തത്. ലഭ്യമായ ഓഡിയോയും അടിക്കുറിപ്പുകളും YouTube നിയന്ത്രിക്കുന്നു.
ഒരു ശൂന്യമായ ഫീൽഡ്, ഒരു നൾ പോയിന്റർ, എല്ലാ മേഖലയും
0:00 ശൂന്യമായ ഫീൽഡുകളുള്ള ഒരു പോളിസി നിര ഒരു നൾ പോയിന്ററിൽ തട്ടി, Google Cloud തകരുകയും ചെയ്യുന്നു എല്ലാ പ്രദേശങ്ങളിലും ഒരേസമയം — Cloudflare-ഉം അതിന്റെ കൂടെ തകരുന്നു, തുടർന്ന് Google-നെ "ഒരു മൂന്നാം കക്ഷി പ്രൊവൈഡർ" എന്ന് വിളിക്കുന്നു. 2025 ജൂൺ 12, 17:49 UTC. Google-ന്റെ റിപ്പോർട്ട്: ഓരോ API അഭ്യർത്ഥനയും അംഗീകരിക്കുന്ന ബൈനറിയായ സർവീസ് കൺട്രോൾ, മൂന്ന് മണിക്കൂർ ഒരു ക്രാഷ് ലൂപ്പിൽ. Cloudflare-ന്റെ, അതേ ദിവസം വൈകുന്നേരം: Workers KV, തൊണ്ണൂറ് ശതമാനം പരാജയപ്പെടുന്നു, രണ്ട് മണിക്കൂർ ഇരുപത്തിയെട്ട്.
0:23 ഇതെങ്ങനെ സംഭവിച്ചു, ഒരു ശൂന്യമായ ഫീൽഡ് എങ്ങനെ നിമിഷങ്ങൾക്കുള്ളിൽ ആഗോളതലത്തിൽ വ്യാപിച്ചു, ആർക്കാണ് കുറ്റം. ഇത് The Daily Diff, പോസ്റ്റ്മോർട്ടം. മെയ് 29. സർവീസ് കൺട്രോളിന് ഒരു പുതിയ ക്വോട്ടാ പരിശോധന ലഭിക്കുന്നു, ഒരു
സമയരേഖ: മെയ് 29 → 17:45 → ക്രാഷ് ലൂപ്പ് → റെഡ് ബട്ടൺ → 17:52 Cloudflare
0:35 റെഡ് ബട്ടൺ ഉപയോഗിച്ച് ഓരോ പ്രദേശത്തിലും അയച്ചു — പക്ഷെ പുതിയ കോഡ് പാത റോൾഔട്ട് സമയത്ത് ഒരിക്കലും പ്രവർത്തിക്കുന്നില്ല; ഒന്നും ട്രിഗർ ചെയ്യുന്നില്ല ഇതുവരെ. നൾ ചെക്ക് ഇല്ല. ഫീച്ചർ ഫ്ലാഗ് ഇല്ല. 17:45. ശൂന്യമായ ഫീൽഡുകളുള്ള ഒരു പോളിസി മാറ്റം Spanner ടേബിളിൽ എത്തുന്നു. ക്വോട്ട ആഗോളമാണ്, അതിനാൽ നിര നിമിഷങ്ങൾക്കുള്ളിൽ എല്ലായിടത്തും പകർത്തി. ഓരോ സർവീസ് കൺട്രോൾ ബൈനറിയും അത് വായിക്കുന്നു, നൾ പോയിന്ററിൽ തട്ടുന്നു, തകരുന്നു, പുനരാരംഭിക്കുന്നു, വീണ്ടും വായിക്കുന്നു. ഓരോ API കോളും: 503.
0:55 Google വേഗതയുള്ളതാണ്: രണ്ട് മിനിറ്റിനുള്ളിൽ ട്രിയേജ്, പത്ത് മിനിറ്റിനുള്ളിൽ മൂലകാരണം. റെഡ് ബട്ടൺ നാൽപ്പത് മിനിറ്റിനുള്ളിൽ പുറത്താണ്, ചെറിയ പ്രദേശങ്ങൾ ആദ്യം വീണ്ടെടുക്കുന്നു. സ്റ്റാറ്റസ് പേജ് അതിന്റെ ആദ്യ അപ്ഡേറ്റ് ഒരു മണിക്കൂറിനുള്ളിൽ പോസ്റ്റ് ചെയ്യുന്നു, കാരണം അത് Google Cloud-ൽ പ്രവർത്തിക്കുന്നു. 17:52. Cloudflare-ന്റെ WARP ടീം പുതിയ ഉപകരണങ്ങൾ രജിസ്റ്റർ ചെയ്യാൻ പരാജയപ്പെടുന്നത് കാണുന്നു. കൺഫിഗിനും ഐഡന്റിറ്റിക്കും വേണ്ടി Cloudflare-ന്റെ പകുതി ഉപയോഗിക്കുന്ന സ്റ്റോറായ Workers KV, ഒരു മൂന്നാം കക്ഷി ക്ലൗഡിൽ ജീവിക്കുന്നു. Access ഓരോ ലോഗിനും പരാജയപ്പെടുന്നു — രൂപകൽപ്പന പ്രകാരം, അത് അടച്ച് പരാജയപ്പെടുന്നു.
1:20 Workers AI ഓരോ ഇൻഫെറൻസും പരാജയപ്പെടുത്തുന്നു. 19:11, Gergely Orosz: രണ്ട് സ്വതന്ത്ര ക്ലൗഡുകൾ ഒരേസമയം തകർന്നു, മുമ്പൊരിക്കലും കണ്ടിട്ടില്ല. 19:32, Google പിന്തുണ ഒരു ഉപയോക്താവിനോട് അറിയപ്പെടുന്ന തടസ്സങ്ങളൊന്നും ഇല്ലെന്ന് പറയുന്നു — ക്ലിയർ ചെയ്യാൻ ശ്രമിക്കുക നിങ്ങളുടെ കുക്കികൾ. മറ്റെല്ലായിടത്തും 19:48-ഓടെ വീണ്ടെടുക്കുന്നു.
us-central1: ആൾക്കൂട്ട പ്രഭാവം
1:34 us-central1 അങ്ങനെയല്ല: പുനരാരംഭിക്കുന്ന ടാസ്ക്കുകൾ അതേ Spanner ടേബിളിൽ കുതിക്കുന്നു, ക്രമരഹിതമായ ബാക്കോഫ് ഇല്ലാത്തതിനാൽ, Google അവരെ കൈകൊണ്ട് നിയന്ത്രിക്കുന്നു. രണ്ട് മണിക്കൂർ നാൽപ്പത്. ഒന്ന്: പോളിസി പരിശോധന അഭ്യർത്ഥന പാതയിൽ സ്ഥിതിചെയ്യുന്നു; പരിശോധന മരിക്കുമ്പോൾ,
മെക്കാനിസം: അഭ്യർത്ഥന പാതയിൽ പരിശോധിക്കുക, ആഗോള പ്രതികരണം, ഒരു വെണ്ടർ
1:46 API മരിക്കുന്നു. രണ്ട്: ക്വോട്ട ഡാറ്റ സ്റ്റേജിംഗ് ഇല്ലാതെ ആഗോളമാകുന്നു; ഒരു മോശം നിര ഒരു ആഗോള നിരയാണ്. മൂന്ന്: Cloudflare-ന് അറിയാമായിരുന്നു. Workers KV അതിന്റെ സ്വന്തം R2-ലേക്ക് മൈഗ്രേഷൻ നടത്തുന്നതിനിടയിലായിരുന്നു, ഒരു പ്രൊവൈഡറിലേക്ക് — ദി പോസ്റ്റ്മോർട്ടം അതിനെ കവറേജിലെ ഒരു വിടവെന്ന് വിളിക്കുന്നു.
git blame — വിഭജനം
2:00 git blame. Google, അമ്പത്തിയഞ്ച് ശതമാനം: നൾ ചെക്ക് ഇല്ല, ഫീച്ചർ ഫ്ലാഗ് ഇല്ല, ബാക്കോഫ് ഇല്ല — ഒരു ഫ്ലാഗ് സ്റ്റേജിംഗിൽ അത് കണ്ടെത്തുമായിരുന്നു എന്ന് അവരുടെ റിപ്പോർട്ട് പറയുന്നു. ആഗോള പ്രതികരണം, ഇരുപത്: ഒരു നിര, എല്ലാ പ്രദേശവും, സെക്കൻഡുകൾ. Cloudflare, ഇരുപത്: ഒരു വെണ്ടറുടെ സ്റ്റോറിൽ ഒരു ഉൽപ്പന്ന നിരയുടെ പകുതി, കൂടാതെ Google എന്ന് ഒരിക്കലും പറയാത്ത ഒരു പോസ്റ്റ്മോർട്ടം. സ്റ്റാറ്റസ് പേജ്, അഞ്ച്, അത് റിപ്പോർട്ട് ചെയ്യുന്നതിൽ ജീവിക്കുന്നതിന്. സ്ഫോടന പരിധി: എഴുപത് Google Cloud ഉൽപ്പന്നങ്ങൾ, പത്ത് Workspace ആപ്പുകൾ,
സ്ഫോടന പരിധി
2:23 ഓരോ പ്രദേശവും. മൂന്ന് മണിക്കൂർ. Cloudflare-ൽ: Access, WARP, Workers AI, Pages, Stream — രണ്ടര. Hacker News, ആയിരത്തിനാനൂറ് പോയിന്റുകൾ; മികച്ച കമന്റ്: സ്റ്റാറ്റസ് പേജ് പച്ചയാണ്.
വിധി + തിങ്കളാഴ്ച ലൈൻ
2:33 വിധി, പോസ്റ്റ്മോർട്ടം: SHIP IT. രണ്ട് പോസ്റ്റ്മോർട്ടങ്ങളും മുപ്പത് മണിക്കൂറിനുള്ളിൽ എത്തുന്നു, രണ്ടും സ്വയം കുറ്റപ്പെടുത്തുന്നു, Google-ന്റെ പരിഹാരങ്ങൾ വ്യക്തമാണ്: fail open, ഫ്ലാഗുകൾ ഡിഫോൾട്ടായി ഓഫ്, എക്സ്പോണൻഷ്യൽ ബാക്കോഫ്. തിങ്കളാഴ്ച ലൈൻ: ഓഫ് ആകുന്ന ഒരു ഫ്ലാഗിന് പിന്നിലെ പുതിയ കോഡ്, കൂടാതെ ഡാറ്റ വരുന്നിടത്ത് ഒരു നൾ ചെക്ക്. നിങ്ങൾക്ക് ഇപ്പോഴും സംസാരിക്കാൻ അനുവാദമില്ലാത്ത സംഭവം എനിക്ക് അയയ്ക്കുക, കമന്റുകളിൽ, അല്ലെങ്കിൽ the daily diff dot dev-ൽ. അതാണ് ഇന്നത്തെ വ്യത്യാസം.
2:53 ഞാൻ Axrisi-യിൽ നിന്നുള്ള Niko ആണ്. ഉത്തരവാദിത്തത്തോടെ ലയിപ്പിക്കുക.
ഉറവിടങ്ങൾ
- Google Cloud Service Health, Incident Report (Jun 13, 2025) + Mini Incident Report (Jun 12)status.cloud.google.com
- Cloudflare, "Cloudflare service outage June 12, 2025" (Jun 12, 2025, 22:00 UTC)blog.cloudflare.com
- Cloudflare Status, "Broad Cloudflare service outages" (18:19–21:31 UTC)www.cloudflarestatus.com
- Gergely Orosz, 19:11 UTC, "Their infra is fully independent AFAIK"x.com
- @Google support, 19:32 UTC, "there aren't any known service disruptions"x.com
- Thomas Kurian (Google Cloud CEO), Jun 13 01:35 UTCx.com
- Hacker News, "GCP Outage" (1,468 points)news.ycombinator.com
- Hacker News, "Cloudflare was down" (341 points)news.ycombinator.com
- Hacker News, "Google Cloud Incident Report – 2025-06-13" (209 points)news.ycombinator.com



