ข้ามไปยังเนื้อหาหลัก

คอร์ส

การตรวจจับความผิดปกติใน Python

ขั้นกลาง4 ชม.

ตรวจจับความผิดปกติในการวิเคราะห์ข้อมูลของคุณและขยายชุดเครื่องมือสถิติ Python ของคุณในคอร์ส 4 ชั่วโมงนี้

Python4 ชม.16 วิดีโอ59 แบบฝึกหัด4,950 XP7,413หนังสือรับรองความสำเร็จ

สร้างบัญชีฟรีของคุณ

ดำเนินการต่อด้วย Google
หรือ
เมื่อดำเนินการต่อ ถือว่าคุณยอมรับ ข้อกำหนดการใช้งานและ นโยบายความเป็นส่วนตัว และยอมรับว่าข้อมูลของคุณจะถูกจัดเก็บในสหรัฐอเมริกา

ได้รับความไว้วางใจจากผู้เรียนในบริษัทหลายพันแห่ง

กำลังฝึกอบรมทีมอยู่ใช่ไหม?

ทดลองใช้สำหรับองค์กร

รายละเอียดคอร์ส

ค้นหาความผิดปกติในการวิเคราะห์ข้อมูลของคุณ


ค่าที่สุดโต่งหรือความผิดปกติมีอยู่ในแทบทุกชุดข้อมูล และเป็นสิ่งสำคัญอย่างยิ่งที่จะต้องตรวจจับและจัดการกับสิ่งเหล่านี้ก่อนดำเนินการสำรวจทางสถิติต่อไป หากปล่อยไว้โดยไม่จัดการ ความผิดปกติอาจรบกวนการวิเคราะห์ของคุณและบิดเบือนประสิทธิภาพของโมเดลแมชชีนเลิร์นนิงได้อย่างง่ายดาย

เรียนรู้การใช้งานตัวประมาณค่าอย่าง Isolation Forest และ Local Outlier Factor


ในหลักสูตรนี้ คุณจะใช้ Python เพื่อพัฒนาและนำวิธีการตรวจจับความผิดปกติหลากหลายรูปแบบไปใช้งาน คุณจะสังเกตเห็นค่าที่สุดโต่งได้ด้วยสายตา และใช้เทคนิคทางสถิติที่ผ่านการทดสอบแล้ว เช่น Median Absolute Deviation สำหรับชุดข้อมูลแบบตัวแปรเดียว สำหรับข้อมูลหลายตัวแปร คุณจะได้เรียนรู้การใช้ตัวประมาณ เช่น Isolation Forest, k-Nearest-Neighbors และ Local Outlier Factor คุณจะได้เรียนรู้วิธีรวมตัวจำแนกค่าผิดปกติหลายตัวเข้าด้วยกันเป็นตัวประมาณสุดท้ายที่มีความเสี่ยงต่ำด้วย คุณจะได้ติดตัวไปด้วยเครื่องมือสำคัญด้านวิทยาศาสตร์ข้อมูล: การตรวจจับความผิดปกติด้วย Python

ขยายชุดเครื่องมือสถิติ Python ของคุณ


การตรวจจับความผิดปกติที่ดีขึ้นหมายถึงการเข้าใจข้อมูลของคุณได้ดีขึ้น และโดยเฉพาะอย่างยิ่ง หมายถึงการวิเคราะห์หาสาเหตุรากเหง้าได้ดีขึ้น และการสื่อสารเกี่ยวกับพฤติกรรมของระบบได้ดีขึ้น การเพิ่มทักษะนี้เข้าไปในชุดทักษะ Python ที่คุณมีอยู่แล้วจะช่วยคุณในการทำความสะอาดข้อมูล การตรวจจับการฉ้อโกง และการระบุความผิดปกติของระบบ

ข้อกำหนดเบื้องต้น

หลักสูตร

โครงร่างคอร์ส

2

Isolation Forest ด้วย PyOD

ในบทนี้ จะได้เรียนรู้การทำงานของอัลกอริทึม Isolation Forest อย่างละเอียด ตั้งแต่วิธีสร้าง Isolation Tree พารามิเตอร์สำคัญของ IForest ใน PyOD และการปรับแต่งค่าเหล่านั้น ไปจนถึงการตีความผลลัพธ์ของ IForest ด้วยคะแนนความน่าจะเป็นของค่าผิดปกติ
เริ่มบท
3

อัลกอริทึมแบบระยะทางและความหนาแน่น

หลังจากเรียนรู้ตัวจำแนกค่าผิดปกติแบบ tree-based แล้ว จะได้สำรวจกลุ่มตัวตรวจจับแบบระยะทางและความหนาแน่น ทั้ง KNN และ Local Outlier Factor ได้รับการพิสูจน์แล้วว่ามีประสิทธิภาพสูงในด้านนี้ และจะได้เรียนรู้วิธีนำไปใช้งานจริง
เริ่มบท
4

การตรวจจับความผิดปกติในอนุกรมเวลาและ Outlier Ensemble

ในบทนี้ จะได้เรียนรู้การตรวจจับความผิดปกติบนชุดข้อมูลอนุกรมเวลา และการทำให้การพยากรณ์มีความเสถียรและน่าเชื่อถือมากขึ้นด้วย outlier ensemble
เริ่มบท

การตรวจจับความผิดปกติใน Python

เรียนคอร์สจบแล้ว

รับใบรับรองความสำเร็จ

ลงทะเบียนเลย

พัฒนาทักษะด้านข้อมูลของคุณด้วย DataCamp for Mobile

เรียนรู้ได้ทุกที่ด้วยคอร์สบนมือถือและโจทย์เขียนโค้ด 5 นาทีประจำวัน