การเรียนรู้แบบเสริมแรงลึกในภาษาไพทอน: การแนะนำแบบสมัยใหม่
เรียนรู้พื้นฐานการฝึกสายลับอัจฉริยะ ใช้ภาษาไพทอน, ไพทอร์ช และอัลกอริทึมการเรียนรู้แบบเสริมแรงสมัยใหม่ เช่น A2C และ DDPG
-
💬
ผู้สอน AI
ถามเกี่ยวกับบทเรียนใดก็ได้ แล้วรับคำตอบที่ชัดเจนทันที ทุกเมื่อ -
🕐
เริ่มเมื่อไรก็ได้
ไม่มีตารางหรือเดดไลน์ — เรียนตามจังหวะของคุณ เมื่อไรก็ได้ -
🌐
เป็นภาษาไทย
บทเรียน แบบฝึกหัด และใบรับรอง — ทั้งหมดเป็นภาษาของคุณอย่างครบถ้วน
เกี่ยวกับคอร์สนี้
ระบบปัญญาประดิษฐ์สมัยใหม่เรียนรู้ที่จะตัดสินใจในสภาพแวดล้อมที่ซับซ้อนและเปลี่ยนแปลงได้อย่างไร?
ในวิชานี้ คุณจะเรียนรู้การสร้างระบบการเรียนรู้แบบเสริมแรง (reinforcement learning) ด้วยภาษาไพธอน คุณจะเรียนรู้การสร้างโครงสร้างของสภาพแวดล้อม ออกแบบระบบการตอบแทน และฝึกระบบประสาทให้สามารถตัดสินใจได้ดีที่สุด
คุณจะเรียนรู้อะไร
เข้าใจหลักการของการเรียนรู้แบบเสริมแรง รวมถึง กระบวนการตัดสินใจของมารคอฟ และสมการของเบลแมน
- สร้างและฝึกกลยุทธ์ของระบบประสาท ใช้กฎของ PyTorch สมัยใหม่
- ใช้วิธีการปรับนโยบายขั้นสูง รวมถึง Advantage Actor-Critic (A2C) และ Deep Deterministic Policy Gradient (DDPG)
- ใช้กลยุทธ์วิวัฒนาการ เป็นทางเลือก ในการเรียนรู้แบบเสริมแรงแบบดั้งเดิม
- ปรับแต่งสภาพแวดล้อมการจำลอง ใช้ไลบรารี Gymnasium สมัยใหม่
สำรวจพื้นฐานของแนวคิด การเรียนรู้จากการเสริมสร้างจากผลตอบรับของมนุษย์ (RLHF) ขับเคลื่อนแบบจำลองภาษาสมัยใหม่
เริ่มต้นด้วยการอธิบายและความคิดพื้นฐานก่อนที่จะไปสู่การปฏิบัติการโค้ดของอัลกอริทึมคลาสสิกและอัลกอริทึมที่ทันสมัยที่สุด คุณจะวิเคราะห์คำอธิบายที่เขียนไว้และศึกษาโค้ด Python สมัยใหม่เพื่อสร้างแบบจำลองทางจิตใจที่ใช้ได้จริงในการฝึกอบรมตัวแทน
หลักสูตรนี้ถูกออกแบบมาสำหรับผู้เริ่มต้นในการเรียนรู้แบบเสริมแรง ซึ่งมีความเข้าใจพื้นฐานเกี่ยวกับภาษาไพธอนและระบบประสาท โดยไม่ต้องมีประสบการณ์ก่อนหน้านี้กับอัลกอริทึมการเรียนรู้แบบเสริมแรง
เริ่มสร้างสายลับที่ฉลาด เรียนรู้ได้เองวันนี้
สิ่งที่คุณจะได้รับ
-
📜
ใบประกาศนียบัตร
เพิ่มในโปรไฟล์ LinkedIn ของคุณ -
💬
ติวเตอร์ AI ส่วนตัว
ติดขัดในบทเรียน? ถามติวเตอร์ในตัวของคุณได้ทุกอย่าง ทุกเวลา -
🎧
รวมเวอร์ชันเสียง
เรียนได้ทุกที่ ไม่ต้องดูจอ -
♾️
เข้าถึงตลอดชีพ
กลับมาเรียนได้ตลอด ไม่มีหมดอายุ -
📱
โทรศัพท์หรือคอมพิวเตอร์
ใช้งานได้ทุกที่ ทุกอุปกรณ์ -
💸
คืนเงิน 14 วัน
ไม่ต้องอธิบาย -
⚡
กระชับและตรงประเด็น
2 ชม. 36 นาที เนื้อหาเชิงปฏิบัติ
รีวิว
ยังไม่มีรีวิว — เป็นคนแรกที่แชร์ประสบการณ์
ผู้เรียนคนอื่นเรียน
💼 พร้อมสำหรับงาน
🎓 มีใบรับรอง
การจัดเรียง LLM: การเรียนรู้แบบเสริมกำลังจากข้อเสนอแนะของมนุษย์ (RLHF)
ใบรับรอง
ลงมือทำ
฿539
→
⚡ เหมาะสำหรับผู้เริ่มต้น
🎓 มีใบรับรอง
Reinforcement Learning: จาก Q-Learning สู่ Deep Policy Gradients
ใบรับรอง
ลงมือทำ
฿539
→
💼 พร้อมสำหรับงาน
🎓 มีใบรับรอง
การเรียนรู้แบบเสริมกำลังสำหรับโปรแกรมเมอร์: สร้างเอเจนต์ AI ของคุณเอง
ใบรับรอง
ลงมือทำ
฿539
→
🏆 ยอดนิยมมากที่สุด
🎓 มีใบรับรอง
บทนำสู่ Reinforcement Learning: พื้นฐานและอัลกอริทึม
ใบรับรอง
ลงมือทำ
฿539
→
คำถามที่พบบ่อย
ฉันต้องใช้อะไรในการเรียนคอร์สนี้? +
แค่โทรศัพท์หรือคอมพิวเตอร์ที่มีอินเทอร์เน็ต ไม่ต้องติดตั้งหรือใช้อุปกรณ์พิเศษ
ฉันชำระเงินอย่างไร? +
ผ่านบัตรด้วย Stripe เราไม่เก็บข้อมูลบัตร — Stripe จัดการอย่างปลอดภัย
ฉันขอคืนเงินได้ไหม? +
ใช่ — คืนเงินเต็มจำนวนใน 14 วัน ไม่ต้องอธิบาย
ฉันมีสิทธิ์เข้าถึงนานเท่าไร? +
ตลอดไป เมื่อซื้อแล้วคอร์สเป็นของคุณ กลับมาเรียนได้ตลอด
ฉันจะได้ใบประกาศนียบัตรไหม? +
ได้ เมื่อเรียนจบจะได้รับใบประกาศนียบัตรที่เพิ่มในโปรไฟล์ LinkedIn ได้
ออกแบบสำหรับผู้เรียนใน
เทคโนโลยี
ดีไซน์
การเงิน
การตลาด
สาธารณสุข
การศึกษา
ธุรกิจการบริการ
อุตสาหกรรม