注意:因为学习平台题目是随机,选择题选项也是随机,一定注意答案对应的选项,同学们在本页按“Ctrl+F”快捷搜索题目中“关键字”就可以快速定位题目,还是不懂的话可以看这个:快速答题技巧
一、2026年春江苏开放大学神经网络与深度学习作业三单选题答案
1、强化学习⼤体上可以分为基于值函数的⽅法和基于策略函数的⽅法,则下列说法中错误的是()
A、Actor-Critic算法融合了基于值函数和策略函数两种⽅法,收敛性更好
B、基于策略函数的⽅法在策略更新时会更加平稳
C、基于值函数的⽅法策略更新时可能会导致值函数的改变⽐较⼤,影响收敛性
D、基于值函数的⽅法容易收敛到局部最优解
正确答案:D
2、PyTorch中的基本数据结构为?
A、tensor
B、torch
C、ndarray
D、dataframE
正确答案:A
3、下图是⼀个简单的⻢尔可夫过程,以下选项中对该过程描述错误的是()

A、与刚下⾬时相⽐,下⾬⼀⼩时后天⽓放晴的概率更⼤
B、⽆论是晴天还是⾬天,保持当前状态的概率都⽐相互转化的概率要⼤
C、下⾬的概率⽐天⽓晴朗的概率⼤
D、下⾬天去散步的概率和晴天打扫房屋的概率⼀样⼤
正确答案:A
4、下列端到端的⽹络结构中,表示Decoder过程的是?

A、都不是
B、B
C、A
D、C
正确答案:D
5、下列关于⻢尔可夫决策过程的叙述,错误的是()
A、⻢尔可夫决策过程的⽬标是得到回报的期望最⼤
B、⻢尔可夫决策过程的主要元素包括所有状态的集合,所有动作的集合,转移概率算⼦以及奖励函数
C、许多强化学习问题都可以转化为⻢尓可夫决策过程来描述
D、⻢尔可夫决策过程综合了过去所有的动作来决定下⼀时刻的动作
正确答案:D
6、在Q-Learning中,所谓的Q函数是指()
A、奖励函数
B、状态-动作值函数
C、策略函数
D、状态值函数
正确答案:B
7、下列关于W-GAN的论述,错误的是()
A、W-GAN模型使⽤Wasserstein距离替代JS距离
B、W-GAN保证了⽣成样本的多样性
C、W-GAN可以避免传统GAN中存在的梯度消失问题
D、W-GAN中可以直接求解Wasserstein距离
正确答案:D
8、⽣成对抗⽹络(GAN)是⼀个具有开创意义的深度⽣成模型,关于GAN下列说法错误的是()
A、在GAN的训练过程中,需要平衡判别器与⽣成器两者的能⼒
B、判别器的⽬的是判断⼀个样本是⽣成器产⽣的还是真实样本
C、GAN的训练过程稳定
D、GAN中⽣成器与判别器的训练⽬标正好相反
正确答案:C
9、下图有两个翻译模型A和B,其中⽤到attention机制的模型是?

A、A和B都是
B、A
C、A和B都不是
D、B
正确答案:D
10、RNN在⾃然语⾔处理领域中被⼴泛应⽤,下⾯⼀句话中:我的⼿机坏了,我打算_______⼀部新⼿机。如果想要预测横线中⽂字的内容,最合适使⽤下列哪个模型()
A、双向循环神经⽹络
B、基本循环神经⽹络
C、GRU
D、LSTM
正确答案:A
11、有如下LSTM结构图,下列选项中哪⼀项是计算遗忘⻔?


正确答案:A
12、下列关于状态值函数vπ(s)和动作值函数qπ(s,a)的叙述,说法正确的是()
A、给定初始状态s时,状态值函数可以使⽤动作值函数表示,即vπ(s)=Ea(qπ(s,a))
B、状态值函数vπ(s)表示从状态s出发,执⾏动作a后再使⽤策略π带来的回报期望
C、动作值函数qπ(s,a)表示从状态s出发,使⽤策略π带来的回报期望
D、最优值函数v∗(s)与最优状态值函数q∗(s,a)的值相同
未经授权,禁止转载,发布者:形考达人
,出处:https://www.xingkaowang.com/36086.html
免责声明:本站不对内容的完整性、权威性及其观点立场正确性做任何保证或承诺!付费为资源整合费用,前请自行鉴别。
免费答案:形考作业所有题目均出自课程讲义中,可自行学习寻找题目答案,本站内容可作为临时参考工具,但不应完全依赖,建议仅作为辅助核对答案的工具,而非直接使用!