logo
publist
写文章

简介

该用户还未填写简介

擅长的技术栈

可提供的服务

暂无可提供的服务

深度网络架构的设计技巧(三)之ConvNeXt:打破Transformer垄断的纯CNN架构

正当其时的“2020s”年代,从Transformer开始,引爆了一股“咆哮”的热潮,各种框架层出不穷,借用凯明一句话“without bells and whistles”,沉淀下来的实用性如何?本文作者长篇分析设计CNN架构的若干技巧,对照Swin Transformer的设计理念,渐进式“现代化”改造ResNet,取得了良好的效果,对深度网络的设计具有较大的参考价值。 ConvNeXt在CN

文章图片
#transformer#网络#cnn
计算机视觉、图像等领域一些著名牛人和实验室(附网址)

以下链接是本人整理的关于计算机视觉(ComputerVision, CV)相关领域的网站链接,其中有CV牛人的主页,CV研究小组的主页,CV领域的paper,代码,CV领域的最新动态,国内的应用情况等等。打算从事这个行业或者刚入门的朋友可以多关注这些网站,多了解一些CV的具体应用。搞研究的朋友也可以从中了解到很多牛人的研究动态、招生情况等。总之,我认为,知识只有分享才能产生更大的价值,真诚希望..

#计算机视觉#人工智能#机器学习
三维人脸实践:基于Face3D的人脸生成、渲染与三维重建 <一>

这里尝试去实现有关三维人脸的一些基础功能,如处理网格数据mesh data、基于morphable model的人脸生成,基于单张人脸图片及其关键点的三维人脸重构,带有不同光照效果的人脸渲染等操作。该工程大部分代码基于python,但有些功能如rasterization使用C++实现循环渲染会快很多,并使用Cython编译供python环境使用,该工具轻量而运行快。

文章图片
#3d#重构#python
计算机视觉、图像等领域一些著名牛人和实验室(附网址)

以下链接是本人整理的关于计算机视觉(ComputerVision, CV)相关领域的网站链接,其中有CV牛人的主页,CV研究小组的主页,CV领域的paper,代码,CV领域的最新动态,国内的应用情况等等。打算从事这个行业或者刚入门的朋友可以多关注这些网站,多了解一些CV的具体应用。搞研究的朋友也可以从中了解到很多牛人的研究动态、招生情况等。总之,我认为,知识只有分享才能产生更大的价值,真诚希望..

#计算机视觉#人工智能#机器学习
Yolov12手把手安装配置教程,非常容易!

最新的 YOLOv12 已正式发布!作为目标检测领域的前沿模型,它带来了更高的检测精度与更快的推理速度。本文将简要介绍如何安装并使用 YOLOv12,帮助大家快速上手,体验这一最新版本的强大性能。

文章图片
三维人脸实践:基于Face3D的人脸生成、渲染与三维重建 <二>

这里主要介绍基于3DMM模型的前向与反向过程。前向过程,基于3DMM,给出参数的情况下,生产三维对象和二维人脸;反向过程,给出人脸关键点的情况下,估计形状和颜色参数等,形成对应的三维人脸建模。

文章图片
#3d#重构
深度网络的设计技巧(四)之CBAM:通道注意力与空间注意力

不少纯CNN架构借助Transformer的设计思想也能表现良好。而在纯CNN的时代里,以卷积运算为基础的模块在关注其他维的注意力上如通道注意力、空间注意力等。这篇文章回顾经典,通道注意力和空间注意力,哪个先关注呢?......

文章图片
#网络#深度学习#python
android中各种传感器的应用与编程实例

android中自带传感器的接口与函数,主要有加速度、方向、压力、光、温度传感器,不同android机可能有的传感器没有,可以使用PC机和虚拟机互联的方式来模拟,此方法主要是调用模拟传感器的接口与函数,两者无大区别。本例程建立在真机调试的情况。    1.

微软小娜开发系列教程<一>

1. 认识小娜自win10发布后,微软小娜已成为一大亮点,吸引了众多使用者、开发者去使用。定位于微软的第一款全球个人智能服务助手,小娜确实以高情商、高智商的表现受到好评。小娜成功的背后离不开微软强大的技术支持,采用机器学习、模式识别、自然语言理解、深度学习、大数据为核心的数据+算法模式,是微软尝试进入人工智能领域的尝试。1.1小娜的功能简介欲取之,先了解之。我们先来了解小娜有哪些功能?- 个人

Ubuntu桌面卡成狗,如何有效解决卡顿问题

Ubuntu桌面打开一个很大的文本文件,卡得桌面动不了,点击鼠标无效,等待很久都没好转,别着急!

#linux
到底了