logo
publist
写文章

简介

该用户还未填写简介

擅长的技术栈

可提供的服务

暂无可提供的服务

Spring Cloud 2.2.2 源码之四十五nacos客户端服务发现任务解析二

Spring Cloud 2.2.2 源码之四十五nacos客户端服务发现原理三服务发现任务图SwitchRefresher故障转移刷新FailoverReactor初始化备份DiskFileWriterPushReceiver服务发现任务图SwitchRefresher故障转移刷新查看缓存目录下的/failover/00-00---000-VIPSRV_FAILOVER_SWITCH-0...

#服务发现
sentinel 1.8之nacos持久化之授权与热点规则序列化问题

sentinel 1.8之nacos持久化之授权与热点规则序列化问题sentinel持久化之nacos原理授权与热点规则序列化问题AuthorityRuleNacosProvider的publish问题AuthorityRuleNacosProvider的getRules问题持久化配置的5种规则客户端debug推到的规则sentinel持久化之nacos原理上图就是官方的图,其实原理就是通过sen

#sentinel
Spring Cloud 2.2.2 源码之四十nacos配置动态刷新原理二

Spring Cloud 2.2.2 源码之四十nacos配置动态刷新原理二RefreshScope注解类实例化基本流程ConfigurationPropertiesRebinder配置属性类重新绑定ConfigurationPropertiesRebinder的rebind重新绑定rebind绑定RefreshScope的refreshAllRefreshScope注解类实例化基本流程Co...

Spring Cloud 2.2.2 源码之二十六nacos客户端获取配置原理一

Spring Cloud 2.2.2 源码之二十六nacos客户端获取配置原理一NacosConfigService大致的结构NacosConfigManagercreateConfigService创建配置服务NacosConfigProperties的assembleConfigServiceProperties一些初始化配置NacosFactory的createConfigServiceNa

李宏毅机器学习系列-循环伸进网络RNN

深度学习-李宏毅机器学习之RNN-1神经网络可能也需要记忆RNN简介LSTM总结最近做语音研究,可能要用到RNN,所以把李宏毅老师的RNN看了下,顺便做下记录吧,方便以后自己回顾和大家学习。前面有偏比较直觉的讲RNN的,有兴趣的也可以看下。神经网络可能也需要记忆首先来看个例子,加入我们有句话,需要提取出两个slot(可以看做特征吧),一个是目的地,一个是到达时间,比如上面这句话,目的地是T...

#深度学习#机器学习
李宏毅机器学习系列-强化学习之Q-Learning

李宏毅机器学习系列-强化学习之Q-Learning评判家(Critic)怎么衡量$V^\pi(s)$蒙特卡洛法(MC)时序差分算法(TD)MC和TD对比另一种评判$Q^\pi(s,a)$Q-Learning目标网络的训练探索缓存(Replay Buffer)算法总结评判家(Critic)评判家基于价值的一种学习方式,我们前面说的是基于策略的。评判家在评判什么呢,他不想策略决定我们要用什么ac...

#深度学习
Unity3D ML-Agent-0.8.1 学习四(模仿学习)

Unity3D Ml-Agent-0.8.1 学习四(模仿学习)写的目的场景设置修改配置并训练总结写的目的本篇介绍模仿学习,即玩家边玩,代理边学习,主要分为在线学习和离线学习,在线就是跟着师傅一起学,离线就是看是师傅录制的资料学习,我们主要讲在线学习,就是玩家边玩,AI边学习,可以实时观察学习的效果,离线学习只是记录玩家信息,产生生成一个文件,命令行学习文件即可,不多做介绍。场景设置可以...

#深度学习
李宏毅机器学习系列-强化学习之Q-Learning

李宏毅机器学习系列-强化学习之Q-Learning评判家(Critic)怎么衡量$V^\pi(s)$蒙特卡洛法(MC)时序差分算法(TD)MC和TD对比另一种评判$Q^\pi(s,a)$Q-Learning目标网络的训练探索缓存(Replay Buffer)算法总结评判家(Critic)评判家基于价值的一种学习方式,我们前面说的是基于策略的。评判家在评判什么呢,他不想策略决定我们要用什么ac...

#深度学习
李宏毅机器学习系列-分类-概率生成模型

李宏毅机器学习系列-分类:概率生成模型分类及其应用宝可梦分类案例用回归来做分类概率模型先验概率多元高斯模型极大似然估计改进后验概率总结分类及其应用分类简单来说就是你输入一个x,经过一个函数,给你输出一个值n,即属于哪个类,n是个离散的数值:主要应用有:信用评分:比如你去贷款,他会根据你的收入,存款,职业,年龄等因素来评估是否要贷款给你。医疗诊断:根据当前的症状,年龄,以往病史,来推断可...

#分类#机器学习#深度学习
李宏毅机器学习系列-强化学习之近端策略优化PPO

李宏毅机器学习系列-强化学习之近端策略优化策略梯度的另一个问题策略梯度的另一个问题上一篇深度强化学习介绍到,我们的奖励梯度是这个样子:这个就意味着,在同一场游戏里不同的sts_tst​下,采取某个ata_tat​的权重有一个相同的R(τn)R(\tau^n)R(τn),这显然是有问题的。比如如果某个R(τn)R(\tau^n)R(τn)好,并不意味着他里面的a都好,要提高出现的概率,相反R...

#深度学习
    共 43 条
  • 1
  • 2
  • 3
  • 4
  • 5
  • 请选择