
简介
该用户还未填写简介
擅长的技术栈
未填写擅长的技术栈
可提供的服务
暂无可提供的服务
【Agentic RL / 强化学习 / OPD】OpenClaw-RL 源码阅读笔记 --- (5)--- 异步处理
【Agentic RL / 强化学习 / OPD】OpenClaw-RL 源码阅读笔记 — (5)— 异步处理 引言:从同步到异步的进化在强化学习中,环境交互是训练的核心环节。传统的同步处理方式中,智能体(Agent)与环境(Environment)按顺序交互:智能体发出动作 → 环境返回状态和奖励 → 智能体更新策略。这种方式简单直接,但在复杂任务中会面临瓶颈:如果环境模拟耗时较长(如机器人仿真
阿里云ECS的CPU100%排查
不过这个现象有点奇怪,ECS2和ECS1在一样的机房一样的配置一样的网络环境,一样的操作系统,一样的服务,一样的容器,为什么一个有问题,一个没问题呢?其二,第一次遇到问题的时候,重启之后没有问题,过了一天之后积累到一定的程度才爆发,这里已经引导了我的思路是积累的问题,那就是缓存不断积累了)docker容器的bug,那也不可能的,每个都是我亲自写脚本,亲自编译,亲自构建的,关键是我关掉了docker
到底了







