logo
publist
写文章

简介

该用户还未填写简介

擅长的技术栈

可提供的服务

暂无可提供的服务

【论文阅读+代码梳理】Multimodal Diffusion Transformer: Learning Versatile Behavior from Multimodal Goals

问题:现有的绝大多数模仿学习的方法只从个别的目标模态中学习,例如语言和图像。但是现有的大规模模仿学习数据集仅部分标注了语言标注,是的现有方法无法充分利用这些数据集中学习语言条件化行为。解决方案:MDT引入在多模态目标指令上同时训练的潜在目标条件状态表示来解决。CLIP将图像和语言的目标嵌入对齐,通过两个自监督辅助任务进行训练,让目标嵌入能够编码足够的信息预测未来状态。效果:在包含不到2%的语言注释

文章图片
#论文阅读#transformer#深度学习
ubuntu不能联网或者错误:1 http://mirrors.aliyun.com/ubuntu focal InRelease 暂时不能解析域名“mi

ubuntu连不上网了。wifi图标在,但是搜不到可以用的网络。可以重启解决

#ubuntu#linux#运维
记录ubuntu启动卡在logo界面有鼠标进不了桌面的经历,以及安装ubuntu踩的坑

记录自己ubuntu启动卡在logo界面,有鼠标,进不了系统的经历。和自己重装系统的经历。

#ubuntu#linux#服务器
结合李沐动手学深度学习配置环境

windows:从官网上下载对应版本的anaconda,。(大家安装完了千万不用pip install jupyter在一个虚拟环境里,我上一个anaconda就是这样没的。回到正题,就是运行下载的.exe文件,next,I agree ,Just me,选择安装路径,记住自己选择的安装路径。

文章图片
#深度学习#python#tensorflow
使用自己数据集复现U-Net,R2U-Net,Att U-net,Att R2U-net过程。(代码参考: LeeJunHyun / Image_Segmentation )

主要是怎么改成自己的数据集,注意文件路径和文件类型,进行修改即可。main.py的参数根据自己的需要进行修改。

文章图片
#python#opencv#计算机视觉
U-Net及其变体

U-net是一种主要为图像分割任务开发的图像分割技术,在医学图像分割领域有很高的实用性。U-net的变体之后更新。

文章图片
#计算机视觉#深度学习
到底了