登录社区云,与社区用户共同成长
邀请您加入社区
该用户还未填写简介
暂无可提供的服务
π0.5 是一款面向家庭移动操作场景的视觉-语言-动作(VLA)模型,通过预训练加后训练的两段式流程,将高层推理与低层执行融进同一个模型。它结合离散与连续动作表示,在全新真实住宅中展现出强大的多阶段任务泛化能力,并显著优于现有 VLA 模型。