Düşünce Liderleri
Yukarı/Aşağı’nın Ötesinde: Karmaşık Altyapıda ‘Normal’i Tanımlamanın Daha İyi Bir Yolu

Yukarı/aşağı izleme konusunda uzun bir yol katettik. Fabrika zeminlerinden modern企业 altyapısına, IT yöneticileri artık bir web sitesinin veya uygulamanın kullanıcıları hizmet verebilip veremeyeceğini belirlemek için basit bir kontrole ihtiyaç duyduklarından çok daha fazla bilgi gerektirirler. Elbette, temel “yukarı” veya “aşağı” durumunu görmek faydalıdır, ancak bu, teknolojinin beklenen iş değerini nasıl teslim ettiğinin toàn hikayesini anlatmaz. Ayrıca, IT ve OT ortamları birleşip ekosistemler daha dinamik ve geçici hale geldikçe, bu uyarılar temel çizgileri doğru bir şekilde kurmaz veya yansıtmaz.
Bugünkü karmaşık altyapıda, ‘normal’in ne olduğu, performans modellerini öğrenme ve pahalı kapalı zamanları önleme gibi fonksiyonlar hayati önem taşır. Özellikle tehdit aktörleri giderek daha sofistike araçlar kullanarak daha az şey yapma yeteneğine sahipken ve modern birbirine bağlı altyapı yeni zafiyetler yaratırken bu durum geçerlidir.
Bu manzara içinde, AI destekli izleme, altyapı yönetimini ‘normal’ ve ‘normal olmayan’ davranışlar hakkında bilgi sağlayarak dönüştürür, böylece kötü temel çizgileri ve uyarı yorgunluğunu ortadan kaldırır. Bu, reaktif yangın söndürme yerine proaktif önleme yönelik izleme evrimini nasıl işaret ettiğini keşfetmek için ilerleyelim.
Yeni Normal’i Keşfetmek
‘Normal’ nedir? Bu, sunucular, ağ cihazları, uygulamalar ve veritabanlarını denetleyen altyapı ekiplerinin yıllardır sorduğu bir sorudur. Neden? Çünkü ‘normal’i tanımlamak, dinamik ve giderek daha dağınık ortamlarda çeşitli sistemleri izlemek için karmaşık ve hatalıdır. Cevap, belirli iş modellerinize ve teknolojilerinize bağlı olacaktır. Ayrıca, izleme teknolojinize ve yapılandırmanıza bağlı olacaktır, çünkü statik eşik değerleri birçok sorunu yakalamaz. Bunun yerine, beklediğiniz bir şey olduğunda size iyi bir fikir verir, ancak beklemediğiniz sorunları yakalamaya yardımcı olmaz, bu da yanlış pozitifler, uyarı yorgunluğu ve görünürlük açıklarına yol açar.
Örneğin, bir imalat tesisini düşünün, burada trafiği突然 olarak Salı günü saat 14.00’te artar. Geleneksel izleme, önceden belirlenmiş bir eşik değerini aştığı için bir uyarı tetikleyebilir, ancak bu gerçekten bir sorun mudur? Daha derin veriler ve tanılar olmadan bunu bilemeyiz. Trafik artışı, yeni bir vardiya çizelgesi veya bir teslim tarihini karşılamak için artan üretim gibi meşru iş faaliyetini gösterebilir. Alternatif olarak, veri sızdırma veya tehlikeye açık bir sistem gibi ciddi bir güvenlik tehdidini işaret edebilir.
Burada, AI destekli anomalie tespiti, altyapı izlemesinin zekasını artırır. Bu ortaya çıkan yöntem, akıllı temel çizgiler oluşturmak için sürekli olarak histórik verileri analiz eder ve değişen koşullara otomatik olarak uyum sağlar. Bu yaklaşım, IT yöneticileri ve DevOps ekiplerinin sorunu hafifletmeden önce daha proaktif bir şekilde müdahale etmelerine olanak tanıyan daha proaktif uyarılara olanak tanır.
Ağ trafiği izleme, bunun bir örneğidir. Altyapı izleme sistemleri, günlükler ve ölçümler gibi çeşitli sinyalleri toplar. Bir günlük, bir sistem tarafından oluşturulan bir olaydır, bir ölçüm ise bir ölçümdür. Zaman içinde, bu ölçümler toplanır ve bir zaman serisi olarak temsil edilir, benzer şekilde gün boyunca sıcaklık ölçülür. Ağ koşullarını izlemek için toplanan veriler, gelen ve giden yayın paket oranları, atık ve hata sayısı ve toplam trafik verimliliği gibi ölçümeleri içerir. Bir şey normal performanstan farklıysa, akıllı izleme, doğru uyarıların verilmesini ve yanlış pozitiflerin önlenmesini sağlar.
Bu nedenle, altyapı ekipleri, sürekli olarak uyarı ayarlarını ayarlamak ve olmayabilecek sorunları söndürmek yerine iş değerini teslim etmeye odaklanabilir.
Uyarı Çoğaltmasını Önleme
İzlemeyi ikiye katlamak, ek zorluklar yaratmak için daha fazla uyarı oluşturabilir. İzleme, yeni projeler için izleme eklenmesi veya hata ayıklama veya test sırasında ek izleme oluşturulmasıyla zaman içinde karmaşık hale gelebilir. Kısa sürede, temiz ve basit bir izleme kurulumu, spurious veya冗余 uyarılarla dolu bir labirent haline gelebilir, bu da sorunları aydınlatmak yerine bulutlandırır.
Örneğin, IT ekipleri, aynı aşırı yüklenen sunucudan yüksek CPU kullanımı, yavaş uygulama yanıt süreleri ve ağ tıkanıklığı için uyarı alabilir. İlişkileri anlamadan, ekipler üç ayrı sorunu investigación edebilir.
Modern AI teknolojileri, izleme ile birleştirildiğinde, benzer izleme yapılandırmalarının otomatik olarak tespitini sağlar. Fuzzy matematik ve heuristics gibi teknikleri kullanarak, bu yaklaşım davranışsal modelleri analiz eder ve benzer izlemenin arasındaki gizli bağlantılar ortaya çıkarır.
Bu, iki ana neden için önemlidir. İlk olarak, uyarı gürültüsünü azaltır. Bir sorun için üç ayrı uyarı almak yerine, ekipler bir uyarı alır ve neye dikkat etmesi gerektiğini ve nedenini anlar. İkincisi,冗余 izlemeyi ortadan kaldırır. Bu, daha yönetilebilir bir kurulum oluşturur, panelleri basitleştirir ve bilişsel yükü azaltır.
Akıllı İzlemenin Geleceği
Diğer ağ ve siber güvenlik gelişmeleri de karmaşıklığın üssel olarak artmaya devam ettiği için artan izlemeye olan ihtiyacı desteklemektedir. Bir zamanlar ayrı, hava boşluğu ile ayrılmış endüstriyel ağlar şimdi empresa sistemleriyle bağlantılıdır, bu da bir ağ sorunu hem üretim hatlarını hem de iş uygulamalarını etkileyebilen hibrit ortamları oluşturur. Ve bunu modern yığında görüyoruz.
Endüstriyel IoT sensörleri, kenar ağ geçitleri ve OT cihazları artık standart IT protokollerinin yanı sıra iletişim kurar. Bu çeşitli sistemler sorun yaşadığında, yöneticiler, her birini ayrı bir silo olarak tedavi etmek yerine, ekosistem boyunca ilişkileri anlayan bir izlemeye ihtiyaç duyar. Dikkat, üretimi durdurabilir, pahalı ekipmanları hasar verebilir ve güvenlik riskleri oluşturabilir, bu nedenle dikkatli olunması zorunludur. Aslında, planlanmamış kapalı zaman şimdi Fortune Global 500 şirketlerine yıllık gelirlerinin %11’ine mal oluyor, bu da akıllı izlemenin maliyetinin, manuel hata ayıklama ve kayıp verimlilik maliyetinden önemli ölçüde daha düşük olduğunu vurguluyor.
Öte yandan, siber güvenlik defterinin diğer tarafındaki saldırganlar, bu teknolojiyi bir verimlilik đột break olarak kullanarak büyük ölçekli saldırılar düzenlemektedir. Ücretsiz veya ucuz generatif AI büyük dil modelleri (LLM’ler), saldırganların saldırıları minimal maliyetle oluşturmasına ve değiştirmesine olanak tanır. Ve zamanla, kötü aktörlerin AI’yi bir oyun değiştirici olarak gördüğü açıkça görülüyor. Bugün, 7 saldırganın 10’u, teknolojinin ve çeşitli araçlarının saldırı vektörünü artırdığına inanıyor, bu oran 2023’te sadece 2 saldırgandan 10 saldırgana karşılık geliyordu.
Bugün kullanılan anomalie tespiti algoritmaları, on yıllar önce iyi kurulmuş matematik ve istatistiklere dayanmaktadır. Bu teknoloji işler, ancak AI ve LLM’lerin metric izlemeye uygulanması oyun değiştiricidir. İlk kez, zaman serisi tabanlı LLM’lerin piyasaya sürüldüğünü görüyoruz ve bu, anomalie tespitini önümüzdeki iki yıl içinde dönüştürecek. Bu yeni modellerin birçoğu mükemmel doğruluk ve ilerleme gösteriyor.
Şimdi, IT ve operasyon ekiplerinin, ekosistemlerini en iyi nasıl denetleyecekleri ve tehditlere karşı nasıl karşı koyacakları konusunda bir seçim yapmaları gerekiyor. İyi haber, otomatik anomalie tespiti ve temel çizgi izlemenin, varlıkları daha iyi korumaya yardımcı olabileceği, öğrenmeye, adapte olmaya ve optimize etmeye yardımcı olabileceği, bu da daha etkili kapasite planlaması ve kaynak optimizasyonu sağlar. Temel yukarı/aşağı kontroller hala değerli, ancak bir sorun IT, OT ve IoT sistemleri boyunca yayılabiliyorsa, bu temel üzerine akıllı bağlam gerekir. Altyapı savunucuları, görünürlüklerini buna göre artırarak anı karşılayabilir.












