首页
›
答案
›
题库
›
学富五车
在强化学习中,以下哪种奖励函数设计更有利于长期目标的实现?
在强化学习中,以下哪种奖励函数设计更有利于长期目标的实现?
A.稀疏奖励
B.密集奖励
C.基于策略的奖励
D.基于价值的奖励
正确答案:A
答案解析:稀疏奖励通常更有利于强化学习模型学习到长期目标的实现策略。
标签:
AI人工智能知识竞赛
策略
目标
上一条:
自然语言处理中的机器翻译通常基于以下哪种架构?
下一条:
以下哪种AI技术常用于图像目标跟踪?