Augusztus 17-én (ismét) lerohadt a GitHub, a műszaki igazgató most személyesen magyarázkodik és ígérget
HUP
2026-08-23 06:25
Az augusztus 17-i, közel nyolcórás GitHub-leállás után Vlad Fedorov, a GitHub műszaki igazgatója személyesen próbálja megmagyarázni , mi történt és mit tesznek azért, hogy ne ismétlődjön meg. A hiba a github.com mellett többek közt az authentikációt, az API-kat, a GitHub Actionst és a Copilotot is érintette.
A közvetlen ok egy olyan forgalmi csúcs volt, amelyet több kritikus infrastruktúra-komponens már nem tudott megfelelően kezelni. A helyzetet hibás autoscaling policy-k és agresszív retry mechanizmusok tovább rontották. A Copilot egyik szolgáltatásánál például a normál 7-9 ezer kérés/másodperces forgalom 70-100 ezer RPS környékére ugrott.
Fedorov szerint április óta a havi commitok száma 1,4 milliárdról 2,9 milliárdra nőtt. Ezt azonban ő maga sem tekinti mentségnek. A kellemetlenebb rész az, hogy a GitHub már korábban is sorozatos rendelkezésre állási problémákkal küzdött és hónapok óta arról kommunikál, hogy javítja a platform megbízhatóságát.
Most ismét jönnek az ígéretek: nagyobb kapacitás, jobb monitoring, biztonságosabb rolloutok, egységes retry limitek, a kritikus rendszerek jobb izolációja és kevesebb közös függőség. Mindez helyes irány, de egy olyan szolgáltatásnál, amelyre fejlesztési és üzleti folyamatok tömege épül, ezeknek nem egy újabb többórás leállás után kellene prioritássá válniuk. Innentől kevésbé az ígéretek, sokkal inkább az uptime lesz érdekes.
On August 17, GitHub experienced a significant outage that disrupted developers and organizations around the world. If you were trying to ship software that day, we let you down.I posted in March and April about the steps we’re taking to make GitHub more reliable. The work is…
— Vlad F (@Vlad_GitHub) August 20, 2026
(A cikk nyomokban Mesterséges Intelligencia által szolgáltatott adatokat tartalmaz, így a tartalmát érdemes duplán ellenőrizni!)