Skip to main content
ホーム
テキストからIPAへ
音声からIPAへ
IPAから単語検索
IPAリーダー
Beta
IPAチャート
イギリス英語
アメリカ英語
中国語
IPAチャート
A–Z
ブログ
toIPA
ホーム
テキストからIPAへ
音声からIPAへ
IPAから単語検索
IPAリーダー
Beta
IPAチャート
完全版
イギリス英語
アメリカ英語
中国語
IPAチャート
A–Z
ブログ
🇯🇵 日本語
🇺🇸 English
🇨🇳 中文
🇯🇵 日本語
🇩🇪 Deutsch
🇫🇷 Français
🇪🇸 Español
🇮🇳 हिन्दी
🇸🇦 العربية
🇧🇩 বাংলা
🇵🇹 Português
🇮🇩 Bahasa Indonesia
🇵🇰 اردو
🇷🇺 Русский
🇻🇳 Tiếng Việt
🇹🇷 Türkçe
🇰🇷 한국어
🇮🇹 Italiano
🇳🇴 Norsk bokmål
🇳🇱 Nederlands
🇵🇱 Polski
🇸🇪 Svenska
🇬🇷 Ελληνικά
🇮🇱 עברית
🇮🇷 فارسی
🇹🇭 ไทย
🇺🇦 Українська
🇨🇿 Čeština
🇧🇾 Беларуская
ホーム
Proximal Policy Optimization
Proximal Policy Optimization
model-free reinforcement learning algorithm
en-US
/ˈpɹɑksəməl ˈpɑlɪsi ɑptɪmɪˈzeɪʃən/
en-GB
/ˈpɹɒksɪməl ˈpɒləsɪ ɒptɪmaɪzeɪʃn/
カテゴリ:
policy-gradient method
model-free reinforcement learning