Mga Batayan ng Reinforcement Learning at Paggawa ng Desisyon

Unawain ang mga pangunahing konsepto ng sunud-sunod na paggawa ng desisyon, mula sa utility theory at multi-armed bandits hanggang sa modernong Reinforcement Learning algorithms.

4.4 (24) ⏱ 1 oras 17 min 📚 3 aralin 🎧 Audio version

Tungkol sa kursong ito

Ang pag-unawa kung paano gumagawa ng pinakamainam na pagpili ang mga automated na sistema sa kumplikado at nagbabagong kapaligiran ay isang kritikal na kasanayan sa modernong artificial intelligence. Ang Reinforcement Learning ay nagbibigay ng balangkas ng matematika para sa pagsasanay ng mga ahente upang mapakinabangan ang mga gantimpala sa pamamagitan ng pagsubok at pagkakamali. Sa kursong ito na nagtatatag ng pundasyon, susuriin mo ang mekanika ng sunud-sunod na paggawa ng desisyon. Magsisimula ka sa mga pangunahing prinsipyo ng utility theory at magpapatuloy sa pagbuo ng mga algorithm na nagpapahintulot sa mga matatalinong ahente na matuto mula sa kanilang kapaligiran, na binabalanse ang paggalugad (exploration) at pagsasamantala (exploitation). Ano ang matututunan mo: • Unawain ang pangunahing terminolohiya, utility theory, at kung paano imodelo ang mga kagustuhan ng makina. • Lutasin ang mga simpleng hamon sa paggawa ng desisyon gamit ang mga diskarte ng multi-armed bandit. • Imodello ang mga kumplikadong kapaligiran gamit ang finite Markov Decision Processes (MDPs). • Ilapat ang mga diskarte ng dynamic programming upang suriin at pagbutihin ang mga patakaran sa paggawa ng desisyon. • Sanayin ang pagbuo ng mga pangunahing algorithm gamit ang modernong Python simulation environments. • Galugarin ang mga pangunahing konsepto na nag-uugnay sa mga klasikong tabular methods sa modernong deep reinforcement learning. Ang kurikulum ay dumadaloy mula sa mga batayang depinisyon at modelong pangmatematika patungo sa praktikal na disenyo ng algorithm. Babasahin mo ang sunud-sunod na nakasulat na paliwanag at pag-aaralan ang malinaw na mga code snippet na nagsasalin ng mga abstract na teorya sa gumaganang lohika. Ang kursong ito ay idinisenyo para sa mga nagsisimula sa artificial intelligence; hindi kinakailangan ang naunang karanasan sa Reinforcement Learning. Simulan ang iyong paglalakbay sa matalinong paggawa ng desisyon ngayon at itayo ang pundasyon para sa modernong pagpapaunlad ng AI.

Ang makukuha mo

  • 📜 Certificate ng pagtatapos
    Idagdag sa LinkedIn profile mo
  • 🎧 Kasama ang audio version
    Mag-aral kahit saan — hindi kailangan ng screen
  • ♾️ Lifetime access
    Bumalik anumang oras, walang expiry
  • 📱 Telepono o computer
    Gumagana saanman, kahit anong device
  • 💸 30-day refund
    Walang tanong
  • Maikli at focused
    1 oras 17 min ng practical content

Mga Review

Wala pang review — ikaw ang unang magbahagi.

Magsulat ng review

Hihilingin naming mag-sign in ka pagkatapos — ligtas ang draft mo.

Kinuha rin ng iba

Mga madalas itanong

Ano ang kailangan ko para sa kursong ito? +

Telepono o computer na may internet lang. Walang install, walang special hardware.

Paano ako magbabayad? +

Sa pamamagitan ng card via Stripe, o cryptocurrency. Hindi namin iniimbak ang detalye ng card — secure na hinahawakan ng Stripe.

Pwede ba akong mag-refund? +

Oo — full refund sa loob ng 30 araw, walang tanong.

Hanggang kailan ang access ko? +

Habang buhay. Sa pagbili, sa iyo na ang course — balikan mo kahit kailan.

Makakakuha ba ako ng certificate? +

Oo. Pagkatapos, makakatanggap ka ng certificate na maidadagdag sa LinkedIn profile mo.

Para sa mga learner sa
Tech Design Finance Marketing Healthcare Edukasyon Hospitality Manufacturing