Ana içeriğe geç

Kurs

R ile Anomali Tespitine Giriş

Orta Düzey4 sa

Aykırı değerleri belirlemek için istatistiksel testleri ve gelişmiş anomali puanlama algoritmalarını kullanmayı öğrenin.

R4 sa13 video47 Egzersiz3,900 XP7,370Başarı belgesi

Ücretsiz Hesabınızı Oluşturun

Google ile devam edin
veya
Devam ederek, Kullanım Koşullarımızı ve Gizlilik Politikamızı kabul etmiş ve verilerinizin ABD'de saklandığını onaylamış olursunuz.

Binlerce şirketteki öğrenenler tarafından beğenildi

Bir Ekibe mi Eğitim Veriyorsunuz?

İşletmeler İçin Deneyin →

Kurs Açıklaması

Verinde hatalı ya da şüpheli kayıtlar olduğundan endişe ediyor ama nereden başlayacağını bilmiyor musun? Anomaly detection algoritmaları işine yarayabilir! Anomaly detection, olağan dışı veri noktalarını belirlemek için tasarlanmış tekniklerin bir bütünüdür ve dolandırıcılığı tespit etmek ile bilgisayar ağlarını kötü amaçlı etkinliklere karşı korumak için kritiktir. Bu derste, aykırı değerleri belirlemek için istatistiksel testleri inceleyecek ve local outlier factor ile isolation forest gibi gelişmiş anomali puanlama algoritmalarını kullanmayı öğreneceksin. UCI Wine kalite veri kümesinde sıra dışı şarapları belirlemek ve anormal hormon ölçümlerinden tiroit hastalığı vakalarını tespit etmek için anomaly detection algoritmalarını uygulayacaksın.

Ön Koşullar

Müfredat

Kurs planı

1

İstatistiksel aykırı değer tespiti

Bu bölümde, sayısal ve görsel özetlerin veride olağan dışı noktalar olup olmadığını gayriresmî olarak değerlendirmek için nasıl kullanılabileceğini öğreneceksin. Bir noktanın aykırı değer olup olmadığını kontrol etmek için Grubbs testi adı verilen istatistiksel bir yöntemi kullanacak ve veriler zaman serisi olduğunda aykırı değerleri belirlemeye yardımcı olabilen Mevsimsel-Hibrit ESD algoritmasını öğreneceksin.
Bölüme Başla
2

Uzaklık ve yoğunluk temelli anomali tespiti

Bu bölümde, veride birden çok özellik olduğunda her veri noktası için sürekli anomali puanları oluşturmakta kullanılan k-en yakın komşu uzaklığını ve local outlier factor’ü nasıl hesaplayacağını öğreneceksin. Ayrıca yerel ve küresel anomaliler arasındaki farkı ve her iki durumda da bu iki algoritmanın nasıl yardımcı olabileceğini öğreneceksin.
Bölüme Başla
3

Isolation forest

k-en yakın komşu uzaklığı ve local outlier factor, her noktayı puanlamak için en yakın komşuların uzaklığını veya göreli yoğunluğunu kullanır. Bu bölümde, isolation forest olarak adlandırılan alternatif bir ağaç tabanlı yaklaşımı inceleyeceksin; bu, veriyi giderek daha küçük bölgelere rastgele bölerek noktaların ne kadar kolay ayrılabildiğini ölçen, hızlı ve sağlam bir anomali tespit yöntemidir.
Bölüme Başla
4

Performans karşılaştırma

Artık anomali puanlama için birkaç farklı algoritmayla tanıştın. Bu son bölümde, etiketli anomalilerin mevcut olduğu durumlarda algoritmaların tespit performansını karşılaştırmayı öğreneceksin. Bir anomali puanı için precision ve recall istatistiklerini nasıl hesaplayıp yorumlayacağını ve algoritmaları kategorik özellik içeren verileri de kapsayacak şekilde nasıl uyarlayacağını öğreneceksin.
Bölüme Başla
R

R ile Anomali Tespitine Giriş

Kurs
Tamamlandı

Başarı Belgesi Kazanın

Şimdi Kaydol

DataCamp for Mobile ile veri becerilerinizi geliştirin

Mobil kurslarımız ve günlük 5 dakikalık kodlama görevlerimizle hareket halindeyken ilerleyin.