GitHub ระบุสาเหตุการล่ม 7 ชั่วโมงในวันที่ 17 สิงหาคม 2026 เกิดจากทราฟฟิกเพิ่มขึ้น 2 เท่าใน 4 เดือน ส่งผลให้โครงสร้างพื้นฐานศูนย์ข้อมูล Central US รองรับไม่ไหว ลากให้ระบบอื่นล่มตาม โดยไม่ใช่ปัญหาคอนฟิกเดี่ยว แต่เป็นความล้มเหลวด้านความจุ (capacity failure) พร้อมเผยตัวเลข commit ต่อเดือนเพิ่มจาก 1.4 พันล้านครั้ง (เมษายน) เป็น 2.9 พันล้านครั้ง (สิงหาคม) ขณะนี้ GitHub ขยายฮาร์ดแวร์เพิ่ม CPU 3 ล้านคอร์ สตอเรจ 120PB และย้ายระบบไป Azure 58% แต่เหตุการณ์นี้แสดงให้เห็นว่ายังต้องปรับโครงสร้างระบบให้แยกส่วนมากขึ้น เพื่อรับมือกับการเติบโตของทราฟฟิก Vlad Fedorov ซีทีโอของ GitHub อธิบายว่า การล่มเกิดจากทราฟฟิกสร้างสถิติใหม่ จนทำให้โครงสร้างพื้นฐานในศูนย์ข้อมูล Central US ล้มเหลว ลากให้ระบบอื่นล่มตามไปด้วย เนื่องจากระบบของ GitHub ผูกพันกัน การกู้ระบบกลับมาจึงต้องตัดทราฟฟิกของระบบส่วนที่มีปัญหาก่อน แล้วค่อยฟื้นบริการทีละขั้น แต่ระหว่างฟื้นฟูระบบ ไคลเอนต์ที่เชื่อมต่อไม่ได้จะวนเช็คไปเรื่อยๆ ส่งผลให้ทราฟฟิกเพิ่มขึ้นอีก ทั้งนี้ GitHub ยืนยันว่าการล่มไม่ใช่ปัญหาคอนฟิกเดี่ยว แต่เป็นความล้มเหลวด้านความจุ พร้อมระบุว่าต้องปรับวิธีการทำงานภายในใหม่ ปรับระบบที่เชื่อมโยงกันให้แยกจากกันมากขึ้น เพื่อลดปัญหา "ลากกันล่ม" อย่างที่เกิดขึ้น
สรุปด้วย MAF Local AI · เนื้อหาต้นฉบับเป็นของแหล่งข่าว