Düşünce Liderleri

Bir Sonraki Bulut Arızası İçin Şimdi Hazırlanmaya Başlayın

mm
Unite.AI sitesini Google'daki tercih ettiğiniz kaynaklara ekleyin

Bu hafta AWS’den gördüğümüz gibi büyük bulut olayları kaçınılmazdır. Bu dört yöntem, şirketinizin devam etmesine yardımcı olabilir.

Kaybedilen sayısız saatlik üretkenlikle, milyonlarca kullanıcı için finansal sistemlerin bozulması ve potansiyel olarak yüz milyarlarca dolarlık kayıp ile bu haftaki AWS arızası,全球 IT ekipleri için şüphesiz bir şekilde korkunç bir gün oldu. Elbette, bu aynı zamanda son büyük bulut felaketinden bu yana sonuncusu… ve bir sonraki olana kadar.

AWS, GCP, Azure veya herhangi bir başka platformda olmanız önemli değil, büyük arızalar bulut bilişim gerçekliğinin bir parçasıdır. Peki, şirketiniz bu darbeyi nasıl yumuşatabilir? Aşağıda, ekibinizin hemen uygulayabileceği dört adımı sunacağım.

Şüpheci olun ve ödevinizi yapın.

Sık sık, ekipler bulut anlaşmalarına girerken büyük bulut şirketlerinin doğal olarak güvenilir olduğu varsayımıyla felakete yol açarlar. Elbette, en güvenilir şirketler, bu nedenle itibarlarını kazanmışlardır. Aynı zamanda, her bulut ve hiperscaler, 31 Availability Zones ve 31 Edge Network Locations dahil olmak üzere geniş bir altyapı seçeneği sunar ve bazı seçenekler diğerlerinden çok daha güveniliridir.

Gerçekten, bu haftaki arızanın nedeni olan AWS’nin US-EAST-1 Bölgesi, 2020, 2021 ve 2023’te büyük kesintilere neden olmuş ve belirli IT çevrelerinde en az güvenilir bölge olarak biliniyordu. Birçok şirket muhtemelen durumu anladı, ancak bölgenin düşük maliyeti ve bol sunucuları nedeniyle hesaplanmış bir risk aldı. Ancak arızanın kapsamı göz önüne alındığında, kaç şirketin tamamen sürprizle karşılaştığını ve daha güvenilir bölgeleri seçmiş olabileceğini düşünmemek mümkün değil. US-EAST-1’de geçmişte kötü deneyimler yaşayan IT liderleriyle şahsen tanıştım.

Buradaki ders, bulut altyapı seçenekleri söz konusu olduğunda ödevinizi yapmaktır. Başlayabileceğiniz yerler arasında cloudprice, Cloudping ve hyperscaler tarafından sağlanan Cloud Service Health araçlarından tarihsel olay görünümleri gibi ücretsiz araçlar bulunur.

Bulut yerel yerine taşınabilir seçin.

Bulut yapılandırmalarını tasarladığınızda, daha basit yol bulut yerelini seçmektir. Ancak, bulut sağlayıcısı tarafından hazırlanmış uygulamaları seçmek kolaydır, ancak bu, bulutunuz gittiğinde daha fazla maruz kalmanıza neden olur.

Ekstra bir bulut bağımlılığı katmanından kaçınmak için, mümkün olduğunda bağımsız ve/veya açık kaynaklı ürünleri seçin. Bazı örnekler şunlardır:

Kategori

Yerel Sunulan Örnek

Açık Kaynaklı Alternatifler İçerir…

Kimlik Doğrulama ve Kimlik

AWS Cognito

Keycloak

Arama

Azure İzleyici

Elasticsearch

İlişkisel Veritabanları

Google Cloud SQL

PostgreSQL

NoSQL Veritabanları

AWS DynamoDB

MongoDB

Konteynır Orkestrasyonu

Azure Kubernetes Service (AKS)

Kubernetes

İzleme ve Gözlemlenebilirlik

Google Cloud İzleme

Prometheus + Grafana

İleti Kuyrukları

AWS SQS/SNS

Apache Kafka

Nesne Depolama

Azure Blob Depolama

MinIO

API Ağ Geçidi

Google Cloud API Ağ Geçidi

Kong

Elbette, bulut yığınınızın daha fazlasını sıfırdan oluşturmak, ekipleriniz için daha fazla iş anlamına gelir. Ancak, altyapıyı kurduktan sonra, kurulu bir altyapıya yük eklemek ile bulut yerelinde çalışmak arasında neredeyse hiçbir fark yoktur. Ve esneklik açısından faydaları, bulut kilidini azaltması açısından da son derece önemlidir.

Arızaya karşı mühendislik yapın.

Bulut arızalarının olacağı düşünülürse, ürünlerinizi bulut arızalarını göz önünde bulundurarak tasarlayın. Bir örnek olarak Datadog’u inceleyebilirsiniz: 2023’te, şirket aniden üretimdeki Kubernetes düğümlerinin yarısından fazlasına erişimi kaybetti ve felaket yaklaşımını tamamen yeniden tasarladı. Değişiklikler, mimari tıkanıklıkların giderilmesi ve teknik borcun ele alınması, kısmi arızaların sistem boyunca yayılmasını önlemek, veri alımı ve depolama için daha fazla veri kullanılabilirliği sağlamak ve büyük ölçekli otomatik kurtarma sistemleri oluşturmak için yapıldı. Yolculuğunuzda başlayabileceğiniz iyi bir yer, Datadog’un “son kullanıcı için önemli olanı düşünerek başlamak” önerisidir ve en önemli şeyleri korumak için güvenlik önlemleri oluşturun.

En az iki bulutta çalışın.

Elbette, bulut arızalarına bağımlı olmamanın en iyi yolu, çoklu bulut yedekliliğidir. Gerçek çoklu bulut akışkanlığını elde etmek, birçok şirket için büyük bir girişimdir, çünkü bir buluttan diğerine altyapıyı çevirmek çok zordur. Ancak, sadece iki bulutta altyapı oluşturmak, güçlü ve genellikle yapılabilir bir başlangıç noktasıdır. Bunu çalışır hale getirmek için, her çalıştığınız bulut için uzman bir ekibe sahip olmak çok önemlidir.

Elbette, hiçbir şey şirketleri, bu hafta gördüğümüz gibi büyük bir arızanın etkisinden tamamen korumaz. Ancak, doğru ödev, bulut taşınabilir bir yaklaşım, arızaya karşı mühendislik ve “çift bulut”u gerçek çoklu buluta bir geçiş taşı olarak kullanarak, şirketler bir sonraki büyük bulut olayında çok daha çevik olabilir.

Harshit Omar, FluidCloud'un Kurucu Ortağı ve CTO'su, burada çok bulut ortamları arasında iş yüklerini sorunsuz bir şekilde göç ettirmeye, çoğaltmaya ve optimize etmeye olanak tanıyan bir bulut altyapısı geleceği inşa ediyor. Önceden Accurics'te ilk mühendisti ve politika motoru ve bulut güvenliği platformu üzerinde core geliştirme çabalarının liderliğini yaptı.

Go, Kubernetes, Terraform ve bulut uyumluluğu konularında derin uzmanlığa sahip olan Harshit, AWS, Azure ve GCP boyunca dayanıklı sistemler tasarlamak için on yılı aşkın bir süredir çalıştı.

Şimdiki misyonu, bulut kilidini ortadan kaldırmak ve altyapıyı kod kadar taşınabilir ve dayanıklı hale getirmektir.