
Масштабний збій хмарних сервісів Microsoft Azure
Хмарні сервіси Microsoft Azure та інші хмарні сервіси, розміщені на Західному узбережжі США, зазнали багатогодинного збою у четвер, 23 липня. Причиною стала відмова мережевого з'єднання. Хоча сервіси, що працювали повністю в межах регіону Microsoft West US, не постраждали, будь-який трафік, що входив або виходив з цих об'єктів, був порушений.
Деталі інциденту та його причина
Згідно з опублікованим Microsoft Попереднім звітом про інцидент (PIR), з'єднання було втрачено на п'ять годин – з 14:44 UTC (7:44 ранку за тихоокеанським часом) до 19:41 UTC. Проблема виникла через помилкове видалення набору IP-маршрутів під час ізоляції пристрою для планового обслуговування.
Перед початком робіт з обслуговування Microsoft перевірила, що принаймні один з двох резервних шляхів до об'єкта залишався функціональним. Однак, коли роботи розпочалися, автоматизовані системи включили до периметра ізоляції деякі додаткові пристрої та видалили IP-маршрути, які не були включені до початкової оцінки.
Реакція та рекомендації
Клієнти швидко виявили проблеми, а інженери Microsoft ідентифікували проблему протягом першої години та розпочали відновлення сервісів. Microsoft заявила, що збій був спричинений "недавньою діяльністю з обслуговування оптоволокна".
Для мінімізації ризику подібних помилок у майбутньому, Microsoft порадила організаціям, які працюють з критично важливими даними, розглянути підхід з використанням кількох регіонів. Цей збій Azure став другим значним для Microsoft цього року; у лютому вже відбулося 10-годинне порушення роботи в регіонах US West та US East.
Що це означає для розробників
Цей інцидент підкреслює важливість архітектурних рішень для забезпечення стійкості. Розробникам, які працюють з критично важливими даними, слід розглянути впровадження багаторегіонального підходу для своїх додатків, щоб мінімізувати ризики збоїв, спричинених локальними проблемами інфраструктури.
Ключові факти
-
Хмарні сервіси Microsoft Azure на Західному узбережжі США зазнали п'ятигодинного збою 23 липня.
-
Причиною стало помилкове видалення IP-маршрутів під час планового обслуговування.
-
Автоматизовані системи включили додаткові пристрої та видалили маршрути, не передбачені початковою оцінкою.
-
Microsoft рекомендує використовувати багаторегіональний підхід для критично важливих даних.
-
Це другий значний збій для Microsoft цього року.
Джерела
Джерело
ComputerworldMaxwell Cooter
Microsoft’s Californian outage: unplug it and plug it back in again24 липня 2026
Попередні статті

Сім принципів агентної розробки програмного забезпечення
Дослідження виявило сім ключових принципів агентної розробки ПЗ, що охоплюють короткі цикли, розподіл ролей між людьми та агентами, важливість якісного вхідного матеріалу та керовану автоматизацію.

Україна призначила нового командувача ЗСУ на тлі протестів та технологічних змін
Михайло Драпатий очолив Збройні сили України, замінивши Олександра Сирського. Призначення відбулося після тижня протестів та на тлі дискусій про технологічний підхід до ведення війни.

Андрій Карпатий радить «базікати» з великими мовними моделями для кращих результатів
Провідний дослідник ШІ Андрій Карпатий ділиться незвичайним методом взаємодії з LLM: він пропонує просто «базікати» з ними голосом до 10 хвилин, щоб отримати кращі відповіді.
Наступні статті

Акції Intel впали попри сильні фінансові результати та оптимістичний прогноз
Акції Intel знизилися в п'ятницю, винагородивши "коротких" продавців, незважаючи на перевершення оцінок за другий квартал та покращений прогноз на третій квартал.

Кібербезпека виходить за межі інструментів: фокус на стратегії та управлінні
Нове дослідження підкреслює, що накопичення інструментів кібербезпеки більше не є ефективним. Ключовими є стратегічна архітектурна узгодженість, модернізоване управління та інтеграція ШІ.

Акції Figma впали на 16% на тлі занепокоєння інвесторів щодо ШІ-конкуренції
Акції Figma впали на 16,5% цього тижня, оскільки інвестори стурбовані впливом штучного інтелекту та прямою конкуренцією з боку нових ШІ-продуктів.