logo
publist
写文章

简介

该用户还未填写简介

擅长的技术栈

可提供的服务

暂无可提供的服务

神经网络中激活函数选择法则

激活函数选择法则:1.首先尝试ReLU,速度快,但要注意训练的状态.2.如果ReLU效果欠佳,尝试Leaky ReLU或Maxout等变种。3.尝试tanh正切函数(以零点为中心,零点处梯度为1)4.sigmoid/tanh在RNN(LSTM、注意力机制等)结构中有所应用,作为门控或者概率值.5.在浅层神经网络中,如不超过4层的,可选择使用多种激励函数,没有太大的影响。...

ffmpeg将视频转换为gif格式

ffmpeg 是一个自由软件,认为是视频界的手术刀,可以运行音频和视频多种格式的录影、转换、流功能,包含了libavcodec——这是一个用于多个项目中音频和视频的解码器库,以及libavformat——一个音频与视频格式转换库。 “FFmpeg”这个单词中的“FF”指的是“Fast Forward”1.将视频 MP4 转化为 GIFffmpeg -i OUTPUT_VIDEO.mp4 OUT..

图像分割中类别极度不均衡的loss处理方式

(https://blog.csdn.net/m0_37477175/article/details/83004746)

人体姿态估计算法之open pose

一,openpose是一种自底向上的算法:OpenPose人体姿态识别项目是美国卡耐基梅隆大学(CMU)基于卷积神经网络和监督学习并以Caffe为框架开发的开源库。可以实现人体动作、面部表情、手指运动等姿态估计。适用于单人和多人,具有极好的鲁棒性。是世界上首个基于深度学习的实时多人二维姿态估计应用,基于它的实例如雨后春笋般涌现。检测所有的关键点,再group成不同的人,是当前比较流行的人体姿...

opencv-python与opencv-contrib-python的区别

1.opencv-python包含opencv的主模块。下载地址https://pypi.org/project/opencv-python/#files2.opencv-contrib-python属于加强版,除了主模块,还包含一些增强模块及以下测试的新算法,验证成熟后,再加入主模块。下载地址https://pypi.org/project/opencv-contrib-python/...

SE-ResNet介绍

一,SE:Squeeze-and-Excitation的缩写,特征压缩与激发的意思。可以把SENet看成是channel-wise的attention,可以嵌入到含有skip-connections的模块中,ResNet,VGG,Inception等等。二,SE实现的过程1.Squeeze: 如下图的红框。把每个input feature map的spatial dimension 从H ...

Normalization 之AdaIN Normalization

一,Adaptive Instance Normalization (AdaIN Normalization)自适应实例归一化(AdaIN)层。主要用于图像风格转换的自编码结构网络。二,AdaIN 输入为内容编码(content input x )与风格编码 (style input y), 对于每个channel,将x的通道级(channel-wise)均值和标准差匹配到y的通道级均值和标准..

人体姿态估计算法之open pose

一,openpose是一种自底向上的算法:OpenPose人体姿态识别项目是美国卡耐基梅隆大学(CMU)基于卷积神经网络和监督学习并以Caffe为框架开发的开源库。可以实现人体动作、面部表情、手指运动等姿态估计。适用于单人和多人,具有极好的鲁棒性。是世界上首个基于深度学习的实时多人二维姿态估计应用,基于它的实例如雨后春笋般涌现。检测所有的关键点,再group成不同的人,是当前比较流行的人体姿...

    共 11 条
  • 1
  • 2
  • 请选择