简答题无人驾驶自主决策系统需要的输入信息包括 : A、任务信息和先验地图信息 B、车辆位姿信息 C、实时环境感知信息 D、车辆状态信息简答题深度Q网络(Deep Q Network, DQN)算法是一种 强化学习算法。 A、离线学习策略 B、在线学习策略 C、基于概率 D、基于价值简答题无人驾驶自主决策系统通过先验驾驶地图与关键点路网文件进行全局路径规划,搜索出到达目的地的全局最优行驶路线。全局路径规划又称为 : A、二次路径规划 B、一次路径规划 C、动态规划 D、静态规划简答题DQN目标网络的参数更新方式为:实时地复制评估网络的参数。 A、正确 B、错误简答题Q Learning、Deep Q Network、Policy Gradients 强化学习算法都是基于价值的强化学习算法。 A、正确 B、错误简答题强化学习与监督学习的区别,在于监督学习一般有标签信息,而且是单步决策问题;强化学习没有标签信息,而且一般是多步决策。 A、正确 B、错误简答题强化学习算法通过与环境交互学习行为策略,但需要样本数据才能学习驾驶策略。 A、正确 B、错误简答题无人驾驶自主决策系统的局部路径规划包括行为决策子模块、运动规划子模块,行为决策主要解决的是无人车目标状态问题,运动规划解决的是无人车处于目标状态中具体的运动规划。 A、正确 B、错误简答题局部路径规划中的运动规划是自主决策系统和控制执行系统之间的接口,其主要负责将 转化为期望的路径点序列和期望速度。 A、行为指令 B、一次路径 C、定位信息 D、感知信息简答题无人驾驶自主决策系统中的局部路径规划又称为 : A、二次路径规划 B、一次路径规划 C、动态规划 D、静态规划