Ga naar hoofdinhoud

Cursus

Mixture Models in R

Gevorderd beginner4 u

Leer over mengmodellen: een handig en formeel statistisch kader voor probabilistische clustering en classificatie.

R4 u14 video's47 oefeningen3,600 XP5,216Bewijs van voltooiing

Maak je gratis account aan

Ga verder met Google
of
Door verder te gaan accepteer je onze Gebruiksvoorwaarden, onze Privacybeleid en dat uw gegevens in de VS worden opgeslagen.

Geliefd bij learners van duizenden bedrijven

Cursusbeschrijving

Mixture modeling is een manier om populaties te beschrijven wanneer we geïnteresseerd zijn in hun heterogeniteit. Mixture models gebruiken bekende kansverdelingen (bijv. Gaussisch, Poisson, Binomiaal) om een handig maar formeel statistisch kader te bieden voor clusteren en classificatie. In tegenstelling tot standaard clusteringbenaderingen kunnen we de kans schatten dat een observatie tot een cluster behoort en conclusies trekken over de subpopulaties. In een marketingcontext wil je bijvoorbeeld verschillende klantgroepen clusteren en hun respectieve kansen bepalen om specifieke producten te kopen, zodat je ze gerichter kunt benaderen met maatwerkacties. Bij het toepassen van natural language processing op een grote set documenten wil je documenten wellicht in onderwerpen clusteren en begrijpen hoe belangrijk elk onderwerp is binnen elk document. In deze cursus leer je wat Mixture Models zijn, hoe ze worden geschat en wanneer het passend is om ze toe te passen!

Vereisten

Curriculum

Cursusoverzicht

1

Introduction to Mixture Models

2

Structure of Mixture Models and Parameters Estimation

In dit hoofdstuk maak je kennis met de hoofdstructuur van Mixture Models, hoe je met deze aanpak verschillende typen data benadert en hoe je de betrokken parameters schat. Voor de schatting leer je een iteratieve methode kennen: het Expectation-Maximization-algoritme.
Start hoofdstuk
4

Mixture Models Beyond Gaussians

In deze module leer je hoe Mixture Models worden uitgebreid naar kansverdelingen anders dan de Gaussische en hoe deze modellen met `flexmix` worden gefit. De datasets zijn afbeeldingen van handgeschreven cijfers en het aantal misdrijven in de stad Chicago. Voor de eerste gegevensset vind je clusters die de handgeschreven cijfers samenvatten en voor de tweede gegevensset vind je clusters van buurten waar het meer of minder gevaarlijk is om te wonen.
Start hoofdstuk
R

Mixture Models in R

Cursus
voltooid

Verdien een Statement of Accomplishment

Nu inschrijven

Verbeter je datavaardigheden met DataCamp voor mobiel

Blijf onderweg bezig met onze mobiele cursussen en dagelijkse programmeeruitdagingen van 5 minuten.