Düşünce Liderleri
Bir Sonraki Bulut Arızası İçin Şimdi Hazırlanmaya Başlayın

Bu hafta AWS’den gördüğümüz gibi büyük bulut olayları kaçınılmazdır. Bu dört yöntem, şirketinizin devam etmesine yardımcı olabilir.
Kaybedilen sayısız saatlik üretkenlikle, milyonlarca kullanıcı için finansal sistemlerin bozulması ve potansiyel olarak yüz milyarlarca dolarlık kayıp ile bu haftaki AWS arızası,全球 IT ekipleri için şüphesiz bir şekilde korkunç bir gün oldu. Elbette, bu aynı zamanda son büyük bulut felaketinden bu yana sonuncusu… ve bir sonraki olana kadar.
AWS, GCP, Azure veya herhangi bir başka platformda olmanız önemli değil, büyük arızalar bulut bilişim gerçekliğinin bir parçasıdır. Peki, şirketiniz bu darbeyi nasıl yumuşatabilir? Aşağıda, ekibinizin hemen uygulayabileceği dört adımı sunacağım.
Şüpheci olun ve ödevinizi yapın.
Sık sık, ekipler bulut anlaşmalarına girerken büyük bulut şirketlerinin doğal olarak güvenilir olduğu varsayımıyla felakete yol açarlar. Elbette, en güvenilir şirketler, bu nedenle itibarlarını kazanmışlardır. Aynı zamanda, her bulut ve hiperscaler, 31 Availability Zones ve 31 Edge Network Locations dahil olmak üzere geniş bir altyapı seçeneği sunar ve bazı seçenekler diğerlerinden çok daha güveniliridir.
Gerçekten, bu haftaki arızanın nedeni olan AWS’nin US-EAST-1 Bölgesi, 2020, 2021 ve 2023’te büyük kesintilere neden olmuş ve belirli IT çevrelerinde en az güvenilir bölge olarak biliniyordu. Birçok şirket muhtemelen durumu anladı, ancak bölgenin düşük maliyeti ve bol sunucuları nedeniyle hesaplanmış bir risk aldı. Ancak arızanın kapsamı göz önüne alındığında, kaç şirketin tamamen sürprizle karşılaştığını ve daha güvenilir bölgeleri seçmiş olabileceğini düşünmemek mümkün değil. US-EAST-1’de geçmişte kötü deneyimler yaşayan IT liderleriyle şahsen tanıştım.
Buradaki ders, bulut altyapı seçenekleri söz konusu olduğunda ödevinizi yapmaktır. Başlayabileceğiniz yerler arasında cloudprice, Cloudping ve hyperscaler tarafından sağlanan Cloud Service Health araçlarından tarihsel olay görünümleri gibi ücretsiz araçlar bulunur.
Bulut yerel yerine taşınabilir seçin.
Bulut yapılandırmalarını tasarladığınızda, daha basit yol bulut yerelini seçmektir. Ancak, bulut sağlayıcısı tarafından hazırlanmış uygulamaları seçmek kolaydır, ancak bu, bulutunuz gittiğinde daha fazla maruz kalmanıza neden olur.
Ekstra bir bulut bağımlılığı katmanından kaçınmak için, mümkün olduğunda bağımsız ve/veya açık kaynaklı ürünleri seçin. Bazı örnekler şunlardır:
|
Kategori |
Yerel Sunulan Örnek |
Açık Kaynaklı Alternatifler İçerir… |
|
Kimlik Doğrulama ve Kimlik |
AWS Cognito |
Keycloak |
|
Arama |
Azure İzleyici |
Elasticsearch |
|
İlişkisel Veritabanları |
Google Cloud SQL |
PostgreSQL |
|
NoSQL Veritabanları |
AWS DynamoDB |
MongoDB |
|
Konteynır Orkestrasyonu |
Azure Kubernetes Service (AKS) |
Kubernetes |
|
İzleme ve Gözlemlenebilirlik |
Google Cloud İzleme |
Prometheus + Grafana |
|
İleti Kuyrukları |
AWS SQS/SNS |
Apache Kafka |
|
Nesne Depolama |
Azure Blob Depolama |
MinIO |
|
API Ağ Geçidi |
Google Cloud API Ağ Geçidi |
Kong |
Elbette, bulut yığınınızın daha fazlasını sıfırdan oluşturmak, ekipleriniz için daha fazla iş anlamına gelir. Ancak, altyapıyı kurduktan sonra, kurulu bir altyapıya yük eklemek ile bulut yerelinde çalışmak arasında neredeyse hiçbir fark yoktur. Ve esneklik açısından faydaları, bulut kilidini azaltması açısından da son derece önemlidir.
Arızaya karşı mühendislik yapın.
Bulut arızalarının olacağı düşünülürse, ürünlerinizi bulut arızalarını göz önünde bulundurarak tasarlayın. Bir örnek olarak Datadog’u inceleyebilirsiniz: 2023’te, şirket aniden üretimdeki Kubernetes düğümlerinin yarısından fazlasına erişimi kaybetti ve felaket yaklaşımını tamamen yeniden tasarladı. Değişiklikler, mimari tıkanıklıkların giderilmesi ve teknik borcun ele alınması, kısmi arızaların sistem boyunca yayılmasını önlemek, veri alımı ve depolama için daha fazla veri kullanılabilirliği sağlamak ve büyük ölçekli otomatik kurtarma sistemleri oluşturmak için yapıldı. Yolculuğunuzda başlayabileceğiniz iyi bir yer, Datadog’un “son kullanıcı için önemli olanı düşünerek başlamak” önerisidir ve en önemli şeyleri korumak için güvenlik önlemleri oluşturun.
En az iki bulutta çalışın.
Elbette, bulut arızalarına bağımlı olmamanın en iyi yolu, çoklu bulut yedekliliğidir. Gerçek çoklu bulut akışkanlığını elde etmek, birçok şirket için büyük bir girişimdir, çünkü bir buluttan diğerine altyapıyı çevirmek çok zordur. Ancak, sadece iki bulutta altyapı oluşturmak, güçlü ve genellikle yapılabilir bir başlangıç noktasıdır. Bunu çalışır hale getirmek için, her çalıştığınız bulut için uzman bir ekibe sahip olmak çok önemlidir.
Elbette, hiçbir şey şirketleri, bu hafta gördüğümüz gibi büyük bir arızanın etkisinden tamamen korumaz. Ancak, doğru ödev, bulut taşınabilir bir yaklaşım, arızaya karşı mühendislik ve “çift bulut”u gerçek çoklu buluta bir geçiş taşı olarak kullanarak, şirketler bir sonraki büyük bulut olayında çok daha çevik olabilir.












