700+ courses, half price
Program Açıklaması
Pekiştirmeli Öğrenme Python'da
Takviyeli öğrenmenin (RL) temellerinde ustalaşın ve robotik ve video oyunlarında sıklıkla bulunan karmaşık ortamlarda gezinmek için nasıl modeller oluşturacağınızı keşfedin.Pekiştirmeli öğrenme konusunda yeniyseniz veya makine öğreniminin bir dalı olarak pekiştirmeli öğrenme konusunda uzmanlaşmak istiyorsanız, burası başlamak için ideal bir yerdir.Markov karar süreçleri, keşif/kullanım değiş tokuşları ve dinamik programlama algoritmaları gibi temel pekiştirmeli öğrenme kavramlarını öğrenerek başlayacaksınız. Gymnasium kütüphanesinden sıradağlarda ve donmuş göllerde gezinmek için Q-öğrenme, SARSA ve diğer yöntemleri uygulamayı öğreneceksiniz.Derin öğrenme ve pekiştirmeli öğrenmeyi birleştirecek ve aracıları çok az denetimle son derece karmaşık ortamlarda gezinmek üzere eğitmek için kullanılabilecek derin pekiştirmeli öğrenmeyi keşfedeceksiniz.Yol boyunca, bu teknikleri taksi rotalarını optimize etmek ve hisse senedi alım satım simülasyonu gibi gerçek dünya projelerinin üstesinden gelmek için uygulayacaksınız.Bu pekiştirmeli öğrenme araçları elinizdeyken, pekiştirmeli öğrenme için heyecan verici yeni bir uygulamayı ele almaya hazırsınız: insan geri bildiriminden pekiştirmeli öğrenme (RLHF). RLHF, LLM çıktılarını, yanıtlarına yönelik insan geri bildirimi üzerine eğitim vererek iyileştirmek için kullanılabilir.Pekiştirmeli öğrenme yolculuğunuza bugün başlayın!
Ön Koşullar
Bu program için herhangi bir önkoşul yoktur