Skip to main content
บ้าน
ข้อความเป็น IPA
เสียงพูดเป็น IPA
IPA เป็นคำ
ตัวอ่าน IPA
Beta
แผนภูมิ IPA
ภาษาอังกฤษแบบอังกฤษ
ภาษาอังกฤษแบบอเมริกัน
ภาษาจีนกลาง
แผนภูมิ IPA
A–Z
บล็อก
toIPA
บ้าน
ข้อความเป็น IPA
เสียงพูดเป็น IPA
IPA เป็นคำ
ตัวอ่าน IPA
Beta
แผนภูมิ IPA
เต็ม
ภาษาอังกฤษแบบอังกฤษ
ภาษาอังกฤษแบบอเมริกัน
ภาษาจีนกลาง
แผนภูมิ IPA
A–Z
บล็อก
🇹🇭 ไทย
🇺🇸 English
🇨🇳 中文
🇯🇵 日本語
🇩🇪 Deutsch
🇫🇷 Français
🇪🇸 Español
🇮🇳 हिन्दी
🇸🇦 العربية
🇧🇩 বাংলা
🇵🇹 Português
🇮🇩 Bahasa Indonesia
🇵🇰 اردو
🇷🇺 Русский
🇻🇳 Tiếng Việt
🇹🇷 Türkçe
🇰🇷 한국어
🇮🇹 Italiano
🇳🇴 Norsk bokmål
🇳🇱 Nederlands
🇵🇱 Polski
🇸🇪 Svenska
🇬🇷 Ελληνικά
🇮🇱 עברית
🇮🇷 فارسی
🇹🇭 ไทย
🇺🇦 Українська
🇨🇿 Čeština
🇧🇾 Беларуская
บ้าน
Proximal Policy Optimization
Proximal Policy Optimization
model-free reinforcement learning algorithm
en-US
/ˈpɹɑksəməl ˈpɑlɪsi ɑptɪmɪˈzeɪʃən/
en-GB
/ˈpɹɒksɪməl ˈpɒləsɪ ɒptɪmaɪzeɪʃn/
หมวดหมู่:
policy-gradient method
model-free reinforcement learning