
简介
该用户还未填写简介
擅长的技术栈
可提供的服务
暂无可提供的服务
本文系统拆解Diffusion Policy的动作扩散、训练推理与滚动时域控制,并对比ACT和π0,厘清具身智能动作生成范式。

GPT-3.5的涌现能力,为什么纯商业公司养不出来?商业化之后,OpenAI剪掉了哪些研究型方向?非功利环境和商业化之间,到底有没有平衡?目前Agent盈利模式不多,代码Agent是一种,那么其他模式的护城河在哪里?Harness算不算?本文是我对这些问题的零散但认真的思考。

Agent记忆不只是存对话历史。本文从工程落地角度,给出了一套完整的记忆架构设计:包括记忆时效分类、记忆存储策略、记忆更新管理、记忆检索读取和优化方向。

本文系统拆解ACT的动作分块、CVAE、Transformer与时序集成,厘清它和VLA、扩散策略的结构差异及闭环控制逻辑。

DeepSeek V3以MLA低秩压缩KV缓存,结合DSA闪电索引器动态筛选Top-k Token做稀疏注意力,将复杂度从O(L²)降至O(Lk)。DeepSeek V4进一步提出HCA+CSA混合架构:HCA以128:1激进压缩并采用FP4精度存储,CSA以4:1保守压缩后索引筛选再做MLA,两者交替堆叠,在百万Token长上下文下实现FLOPs降至27%、KVCache降至10%

主要介绍claude code常用的快捷键。

这篇文章系统复盘了大模型全量SFT、LoRA、QLoRA微调与AWQ/GPTQ量化技术的底层原理、显存精算及工程落地决策。

本文介绍了 Codex Skills 的安装与使用,并精选18个常用技能包,帮你提升编码、设计、自动化和内容生产效率。

本文整理2026年7月的AI技术知识与思考,涵盖具身智能、扩散模型、FPGA、世界模型和持续学习,并记录独立判断与长期主义的实践。

本文系统拆解RT-2如何通过动作Token化、Co-Fine-Tuning与闭环控制,把VLM的视觉语言知识迁移为机器人动作。








