
简介
该用户还未填写简介
擅长的技术栈
可提供的服务
暂无可提供的服务
看到一个喜欢的项目点watch,接收all activate然后你就可以在未读中找到你关注的项目
自己的文件没有加入到编译文件里面,maven clean一下,然后重新启动即可。parent的文件是不是被成功加载到maven中。
需要知道的一些概念马尔科夫决策过程马尔科夫链马尔科夫奖励过程马尔科夫中的价值函数马尔科夫决策过程的控制:policy iteration value iteration基于价值函数的agent:不使用决策函数,在价值函数中推测police基于police的agent:不使用价值函数两个都用通过模型使用不同分类:看会否有环境转移模型马尔科夫决策过程是强化学习的基本框架,环境是全部可以观测如果说状态转
目录深度学习每次结果不一致深度学习每次结果不一致使用定值随机种子比较好随机数种子设置?一共有三个随机数种子,random,numpy和深度学习库的gpu种子,不过我三个都设置了,在gpu上还是会结果不一样,cpu每次都一样的,我用的dynet。可以直接取最好值进行汇报,更严谨的话做10次取平均的。...
【机器学习笔记】第三章:线性模型

需要知道的一些概念马尔科夫决策过程马尔科夫链马尔科夫奖励过程马尔科夫中的价值函数马尔科夫决策过程的控制:policy iteration value iteration基于价值函数的agent:不使用决策函数,在价值函数中推测police基于police的agent:不使用价值函数两个都用通过模型使用不同分类:看会否有环境转移模型马尔科夫决策过程是强化学习的基本框架,环境是全部可以观测如果说状态转
目录深度学习每次结果不一致深度学习每次结果不一致使用定值随机种子比较好随机数种子设置?一共有三个随机数种子,random,numpy和深度学习库的gpu种子,不过我三个都设置了,在gpu上还是会结果不一样,cpu每次都一样的,我用的dynet。可以直接取最好值进行汇报,更严谨的话做10次取平均的。...









