
简介
该用户还未填写简介
擅长的技术栈
可提供的服务
暂无可提供的服务
思路:用policy network来近似策略函数 \piπ ,用policy gradient算法来训练这个网络
思路:用policy network来近似策略函数 \piπ ,用policy gradient算法来训练这个网络
介绍了强化学习的基本术语、如何使用强化学习,以及标准库OpenAI Gym
ubuntu18.04服务器装gpu版tensorflow1.5.0。步骤:1. 更新电脑显卡驱动;2. 更改gcc和g++版本;3. 安装CUDA;4. 安装cuDNN;5. 最后安装Tensorflow-gpu
比较如下几个问题,求出结果,并谈谈你的见解。a)李叔叔有两个孩子,两个孩子都是女孩的概率是多少?b)李叔叔有两个孩子,其中一个是女孩,两个孩子都是女孩的概率是多少?c)李叔叔有两个孩子,至少有一个孩子是在星期日出生的女孩,两个孩子都是女孩的概率是多少?
首先要明确,下载sklearn之前,需要先下载numpy、matplotlib、scipy但如果文件来源不同,可能会出现错误:导入sklearn 报错,找不到相关模块我是用pip安装的,由于官网的下载速度实在太慢,就自己下了一部分whl文件,不知道是不是因为来源不同,在import的时候出现了下面的报错:后来按链接里的方法卸载了一遍:pip uninstall scikit-lear...
基于田玉平等《自动控制原理》,依据学习经验重述,内容:1.背景和思路 2.李雅普诺夫第二方法 3.李雅普诺夫稳定性分析 4.例题
用梅森公式求信号流图的传递函数表达式:数前向通道->数回路->找不接触回路->求系统特征式->求$\triangle_i(s)$->结果表示
什么是矩阵的舒尔补?为什么是这个形式?它有什么用?







