logo
publist
写文章

简介

该用户还未填写简介

擅长的技术栈

可提供的服务

暂无可提供的服务

【ECCV 2026】HSImul3R:物理在环的仿真就绪人-场景交互重建|从具身智能物理仿真视角

HSImul3R(ECCV 2026)把物理仿真器当作主动监督者,双向优化人体运动与场景几何:场景目标 RL + DSRO 微调生成先验,HSIBench 300 实例评测,Easy 稳定性 10.52%→53.68%、穿透率 22.9%,可直接部署 Unitree G1 人形机器人。

文章图片
【arXiv 2026】HSImul3R 论文解读:物理在环重建仿真就绪人-场景交互|从物理AI具身智能视角

【arXiv 2026】HSImul3R 论文解读:物理在环双向优化重建仿真就绪人-场景交互。Stability-HSI 达 53.68%(HSfM 仅 10.52%),场景穿透率从 69.51% 降至 22.9%,并可部署到 Unitree G1 人形机器人。

文章图片
#人工智能
【ICML 2026 (Oral)】JitRL 论文解读:无梯度更新的 LLM Agent 持续强化学习,98 美元替代 3500 美元 GPU 训练

JitRL 提出训练时零梯度更新的 LLM Agent 持续强化学习框架:动态非参数记忆存储轨迹,Jaccard 检索 + k-NN 估计优势,再以闭式公式 z'=z+β 直接调制 logit——被证明是 KL 约束 RL 的精确闭式解。WebArena Avg 46.98% / Jericho Zork1 Final 69 双 SOTA,成本 98 美元 vs WebRL 3500+ 美元(3

文章图片
#人工智能
【COLM 2025】AIOS:LLM 智能体操作系统,内核化资源管理与调度|从智能体系统架构视角

解读 COLM 2025 论文 AIOS(LLM Agent Operating System):三层架构把 LLM 与工具资源隔离进内核,调度器管理系统调用,并发 250→2000 智能体近似线性扩展,吞吐最高提升 2.1 倍。

文章图片
【NeurIPS 2025】扩散模型为何不失忆:训练中的隐式动力学正则化|从生成式AI与统计物理交叉视角

NeurIPS 2025 Oral 论文解读:扩散模型训练存在双时间尺度——泛化时间 τ_gen 恒定、记忆化时间 τ_mem 随数据量 n 线性增长,早停即可避免记忆化。随机特征谱分析与 U-Net 实验三方验证。

文章图片
【arXiv 2026】Continual Harness:面向具身智能体的免重置自改进外骨骼论文解读|从智能体在线自改进视角

本文解读 arXiv 2026 论文 Continual Harness:免重置自改进外骨骼框架,在宝可梦 Red/Emerald 上以 130 美元中位成本达成 100% 里程碑(较基线成本削减约 40%),并驱动开源 Gemma-4 在线共学习持续进步。

文章图片
【ICRA 2025】WMP:基于世界模型的视觉足式运动感知|从四足机器人具身智能视角

【ICRA 2025】WMP:基于世界模型的视觉足式运动感知。RSSM 世界模型压缩视觉历史替代特权学习,仿真六地形超越 Student,真机 A1 跨越 85cm 沟壑、55cm 高台、22cm 低矮通道。

文章图片
【arXiv 2026】RoboTTT:把机器人策略的视觉运动上下文扩展到 8000 步|从具身智能上下文缩放视角

【arXiv 2026】RoboTTT 论文解读:用测试时训练(TTT)快速权重把机器人视觉运动上下文缩放到 8K 步,平均任务完成度 79%、比单步基线高 87%,首次观察到预训练上下文长度的稳定缩放规律。

文章图片
【CoRL 2022】DayDreamer:物理机器人的世界模型学习|从机器人世界模型专家视角

DayDreamer 把 Dreamer 世界模型直接搬到真实机器人:无需模拟器与示范,四足 1 小时学会行走、双臂 8–10 小时抓放逼近人类、同一套超参通吃 4 台机器人。

文章图片
【AAAI 2026】ReconVLA:以重建式视觉监督实现精准机器人操纵|从机器人视觉表征对齐视角

【AAAI 2026】ReconVLA 论文解读:通过重建目标操纵区域(gaze region)的隐式视觉监督,让 VLA 学会聚焦关键区域。CALVIN ABC→D 第 5 子任务 64.1%、ABCD→D 平均完成 4.23/5,真机未见目标泛化显著优于 OpenVLA。

文章图片
    共 53 条
  • 1
  • 2
  • 3
  • 6
  • 请选择