logo
publist
写文章

简介

该用户还未填写简介

擅长的技术栈

可提供的服务

暂无可提供的服务

Diffusion 与 Flow Matching 数学原理及其在 VLA Action 生成中的应用

本文系统介绍了扩散模型(Diffusion Models)和流匹配(Flow Matching)的数学原理及其在视觉-语言-动作(VLA)生成中的应用。扩散模型通过前向加噪和反向去噪过程学习数据分布,训练目标是去噪评分匹配,采样可通过DDPM或DDIM实现。流匹配则通过常微分方程直接学习从噪声到数据的概率路径,具有采样步数少、理论简洁的优势。在VLA任务中,这两种方法能有效建模连续多模态的动作空间

#自动驾驶
VLA(Vision-Language-Action)最新研究进展报告

2026年1月VLA研究进展速览 本周VLA领域呈现五大趋势:多模态融合(触觉/力觉)、动态场景适应、效率优化、安全性提升和新应用拓展。重点研究包括:DynamicVLA框架解决动态物体操作难题;AIR-VLA实现首个空中操作系统;CoFreeVLA通过风险评估增强双臂操作安全性;MoE-ACT改进手术机器人策略;AC²-VLA提出自适应计算框架降低延迟。另有研究探索LLM替代方案、触觉力对齐方法

#机器人
VLA(Vision-Language-Action)最新研究进展报告

2026年1月VLA研究进展速览 本周VLA领域呈现五大趋势:多模态融合(触觉/力觉)、动态场景适应、效率优化、安全性提升和新应用拓展。重点研究包括:DynamicVLA框架解决动态物体操作难题;AIR-VLA实现首个空中操作系统;CoFreeVLA通过风险评估增强双臂操作安全性;MoE-ACT改进手术机器人策略;AC²-VLA提出自适应计算框架降低延迟。另有研究探索LLM替代方案、触觉力对齐方法

#机器人
OpenCV 3D显示Viz模块

目录1. OpenCV Viz 模块是什么2. 如何编译3. 如何使用4. Result5. 参考1. OpenCV Viz 模块是什么OpenCV_Viz 模块是OpenCV的3D 可视化模块,存在于OpenCV 2.4.9 or later 版本中;它是依赖于VTK(Visualization Toolkit) 进行显示的。2. 如何编译官方发布的Opencv 安装包中并没有编译...

#opencv
工业相机及镜头的选型

相机镜头的选型1 焦距(Focal Length)记为f。从镜头中心点到胶平面上所形成的清晰影像之间的距离。一般 情况下,焦距越大,工作距离越大,视角越小;焦距越小,工作距离越小,视角越大。f/WD= Sensor Size(V) or(H)/FOV(V) or (H)2 CCD芯片的尺寸(Sensor Size)正常的 1英寸=25.4

#计算机视觉
VS2015 一调试就崩溃

问题描述最近VS2015 一调试(F5)就崩溃重启,直接运行程序就正常,repair 和重装都没能解决问题,最后在这里找到了方法。解决方法可能会因人而异,我的解决方案是在1) 进入到devenv.exe 所在目录,我的是在C:\Program Files (x86)\Microsoft Visual Studio 14.0\Common7\IDE2)打开Windows PowerSh...

到底了