Handling Imbalanced Data Classification Problems

4.6
별점
49개의 평가
제공자:
Coursera Project Network
학습자는 이 안내 프로젝트에서 다음을 수행하게 됩니다.

Understand the business problem and the dataset to choose best evaluation metric for the problem

Create imbalanced data classification model using SMOTE data resampling technique

Compute to ROC curve and use to adjust probability threshold

Clock2 hours
Intermediate중급
Cloud다운로드 필요 없음
Video분할 화면 동영상
Comment Dots영어
Laptop데스크톱 전용

In this 2-hour long project-based course on handling imbalanced data classification problems, you will learn to understand the business problem related we are trying to solve and and understand the dataset. You will also learn how to select best evaluation metric for imbalanced datasets and data resampling techniques like undersampling, oversampling and SMOTE before we use them for model building process. At the end of the course you will understand and learn how to implement ROC curve and adjust probability threshold to improve selected evaluation metric of the model. Note: This course works best for learners who are based in the North America region. We’re currently working on providing the same experience in other regions.

개발할 기술

  • Predictive Modelling
  • SMOTE
  • Data Resampling
  • Imbalanced Data
  • Receiver Operating Characteristic (ROC)

단계별 학습

작업 영역이 있는 분할 화면으로 재생되는 동영상에서 강사는 다음을 단계별로 안내합니다.

  1. Loading and understanding the dataset

  2. Exploring the dataset

  3. Evaluation metric selection

  4. Creating a baseline model

  5. Resampling techniques for imbalanced datasets

  6. Implementing ROC curve

  7. Adjusting probability threshold

안내형 프로젝트 진행 방식

작업 영역은 브라우저에 바로 로드되는 클라우드 데스크톱으로, 다운로드할 필요가 없습니다.

분할 화면 동영상에서 강사가 프로젝트를 단계별로 안내해 줍니다.

검토

HANDLING IMBALANCED DATA CLASSIFICATION PROBLEMS의 최상위 리뷰

모든 리뷰 보기

자주 묻는 질문

자주 묻는 질문

궁금한 점이 더 있으신가요? 학습자 도움말 센터를 방문해 보세요.