Ga naar hoofdinhoud

Cursus

Multi-modale modellen met Hugging Face

Gevorderd beginner4 u

Combineer tekst, afbeeldingen, audio en video met de nieuwste AI-modellen van Hugging Face en maak nieuwe afbeeldingen en video's!

Python4 u14 video's45 oefeningen3,800 XP1,939Bewijs van voltooiing

Maak je gratis account aan

Ga verder met Google
of
Door verder te gaan accepteer je onze Gebruiksvoorwaarden, onze Privacybeleid en dat uw gegevens in de VS worden opgeslagen.

Geliefd bij learners van duizenden bedrijven

Cursusbeschrijving

Maak gebruik van de kracht van multimodale AI

Duik in de supermoderne wereld van multimodale AI-modellen, waar tekst, afbeeldingen en spraak samenkomen om krachtige toepassingen te maken. Ontdek hoe je de enorme verzameling modellen van Hugging Face kunt gebruiken die kunnen zien, horen en begrijpen als nooit tevoren. Of je nou social media-content analyseert, spraakassistenten bouwt of de nieuwste AI-apps maakt, multimodale modellen zijn je sleutel om verschillende soorten data soepel te verwerken.

Leer de belangrijkste multimodale technieken

Check de nieuwste modellen uit, zoals CLIP voor het begrijpen van beeld en tekst, SpeechT5 voor spraaksynthese en het Qwen2 Vision Language-model voor multimodale sentimentanalyse. Door middel van praktische oefeningen leer je de technieken die toonaangevende AI-bedrijven gebruiken om geavanceerde multimodale systemen te bouwen.

Zorg dat je AI-vaardigheden klaar zijn voor de toekomst

Deze cursus geeft je een handige toolkit om met multimodale AI-taken om te gaan. Je leert verschillende soorten data goed te verwerken en te combineren, vooraf getrainde modellen aan te passen voor je eigen toepassingen, en de prestaties van modellen voor verschillende soorten data te beoordelen en te verbeteren.

Vereisten

Curriculum

Cursusoverzicht

1

Toegang krijgen tot Hugging Face-modellen en -datasets

2

Unimodale modellen voor visie, audio en tekst

Leer individuele modaliteiten beheersen met state-of-the-art modellen. Verdiep je in computervisie voor beeldclassificatie en segmentatie, ontdek spraakherkenning en tekst-naar-spraaksynthese, en leer effectieve fine-tuningtechnieken. Bouw praktische vaardigheden op met voorgetrainde modellen uit de transformers-bibliotheek van Hugging Face.
Start hoofdstuk
3

Multi-modale modellen voor classificatie

Leer visuele, tekstuele en audio-informatie te combineren voor rijkere AI-toepassingen. Beheers technieken zoals CLIP voor zero-shotclassificatie, bouw sentimentanalyses die kunnen zien én lezen, en maak emotiedetectors die gezichtsuitdrukkingen met stem combineren. Breng je AI-modellen verder dan één enkele modaliteit.
Start hoofdstuk
4

Multi-modale generatie

Maak van ideeën realiteit! Beheers geavanceerde AI-technieken om visuele content te genereren en te bewerken met tekstprompts. Maak verbluffende afbeeldingen, bewerk foto’s slim, en bouw krachtige vraag-antwoordsystemen voor afbeeldingen en documenten. Zet je creatieve visie om in digitale realiteit met multi-modale AI.
Start hoofdstuk

Multi-modale modellen met Hugging Face

Cursus
voltooid

Verdien een Statement of Accomplishment

Nu inschrijven

Verbeter je datavaardigheden met DataCamp voor mobiel

Blijf onderweg bezig met onze mobiele cursussen en dagelijkse programmeeruitdagingen van 5 minuten.