
简介
该用户还未填写简介
擅长的技术栈
可提供的服务
暂无可提供的服务
【ICML 2026】SOMA 给 VLA 装上持久空间记忆:真机 5 类视野外抓放任务平均成功率 28.3%(基线 18.5%),行为指标改善 40–60%;全可见的 RoboCasa GR1 达 49.3%、SimplerEnv 达 63.2%。

SONIC 论文解读(Science Robotics 2026):把运动跟踪确立为人形控制的可规模化任务,用 1 亿帧动捕与 128 卡训练出通用全身控制策略——test-content 成功率 99.6%、PHUMA 97.2%、速度跟踪生存率 98.5%,真机 124 条动作 99.2%。

ICLR 2026 论文 MEMENTO 解读:12 场景 438 episodes 的受控评测显示,GPT-4o 联合记忆任务成功率骤降 30.5pp,全模型单记忆掉幅超 20pp;论文定位出信息过载与协同失败两大瓶颈,并用层级知识图式用户画像记忆双双改善。

【CVPR 2026 Highlight】WorldMM 提出三类互补记忆(情节/语义/视觉)+ 自适应检索智能体,让长视频推理五基准平均达 69.5%,超最强基线 8.4 个点,检索 tIoU 10.09 远超 HippoRAG 的 4.00。

【CoRL 2025】Enter the Mind Palace 论文解读:把跨天跨月的机器人观测压缩为分层场景图「记忆宫殿」,让记忆检索与主动探索共用一张图规划。答案正确率 65.0%、超最强基线 12.1pp,检索图像比 VLM 方案少 77.14%。

【ICLR 2026】ELMUR 论文解读:给 Transformer 每一层外挂 LRU 可重写的外部记忆,只有 10 步上下文却在一百万步 T-Maze 上保持 100% 成功,MIKASA-Robo 聚合成功率从 5.42 提到 9.24(约 +70%),POPGym-48 总分 10.41 居首。

RSS 2026 论文 HALO 解读:长时程机器人控制中的记忆检索。用 VLM 生成的视频问答监督引导「检索什么」、用 top-k 稀疏注意力限制「读多少」,ReMemBench 仿真平均成功率 0.41(比最强基线高 7 个点),真机五任务平均 0.55,最长支持 8 分钟历史。

NeurIPS 2025 Spotlight 论文 G-Memory 解读:把多智能体冗长的协作轨迹组织成 insight / query / interaction 三层图,检索时向上取洞见、向下取协作片段,再按 agent 角色分发。5 基准 × 3 MAS × 3 骨干上几乎全胜,具身行动最高 +20.89%、知识问答 +10.12%,token 仅增约 1.4e6。
【EMNLP 2025 (Oral)】MemoryOS(Memory OS of AI Agent)论文解读:把操作系统的分段分页与热度换页搬进对话记忆,用三级存储 STM/MTM/LPM + 对话链 + persona 抽取,让大模型在 300 轮长对话中同时保住细节与长期偏好。LoCoMo 上 F1 平均提升 49.11%、BLEU-1 提升 46.18%,token 消耗仅为 MemGPT
【EMNLP 2025 (Oral)】MemoryOS(Memory OS of AI Agent)论文解读:把操作系统的分段分页与热度换页搬进对话记忆,用三级存储 STM/MTM/LPM + 对话链 + persona 抽取,让大模型在 300 轮长对话中同时保住细节与长期偏好。LoCoMo 上 F1 平均提升 49.11%、BLEU-1 提升 46.18%,token 消耗仅为 MemGPT







