
简介
该用户还未填写简介
擅长的技术栈
可提供的服务
暂无可提供的服务
本文跳过基础科普,直击2025年大模型检索技术在生产环境的真实痛点。万字拆解纯向量检索为何被混合架构全面取代、LazyGraphRAG如何打下99.9%的成本,并深度复盘Agentic RAG高达90%生产失败率背后的技术陷阱,为你提供一份直接能用的RAG框架选型与工程落地指南。

速通DeepSeek论文mHC:给大模型装上物理阀门的架构革命

Google DeepMin最新论文揭示了一个反常识发现:训练大模型时随机跳过约一半的参数更新,效果竟然比老老实实全量更新更好

LLM只能说,VLM能看能说,VLA能看能说还能动手干活。本文从LLM工程师视角出发,帮你30分钟建立对VLA的完整认知:四类模型对比、传统Pipeline痛点、架构三大模块拆解、从RT-2到pi0.5的里程碑速览。动作token就是新的文本token,你的LLM经验可以直接迁移。

面向非算法岗的大模型可解释性系统梳理。以四阶段脉络串起 2020–2026 年核心成果:叠加现象(为什么神经元读不懂)→ SAE(3400 万特征与金门大桥实验)→ 归因图(虚假思维链、跨语言思维、多跳推理)→ 人格向量(AI 性格的物理开关与助手轴)。不堆公式,附五条实用启示。

本文围绕 Subquadratic 发布的 SubQ 1M-Preview 与 SSA(Subquadratic Sparse/Selective Attention)架构展开分析,拆解其“1200万 Token 上下文”“52倍 prefill 加速”“成本低于 Opus 5%”等核心宣称背后的技术含义与边界。文章重点讨论 dense attention 的平方复杂度瓶颈、SSA selecto

【硬核干货】Anthropic 2026年7月最新研究突破:大模型内部的中间状态第一次变得“可读、可改、可干预”!本文深度拆解 J-space(动态共享工作台)与 J-lens(内部表征尺子)的核心机制,通过心算、因果替换、消融实验与敲诈高管案例,厘清“模型内部状态”与“主观意识”的界限。不写繁复公式,带你透视 LLM 黑盒可解释性领域的重大范式转移。

近期不少文章将 OpenAI 的 Codex 新公告解读为“全面开源 Codex Harness”,但 Codex CLI、codex exec、SDK 与 App Server 其实早已在公开工程体系中持续演进。本文从源码边界、调用架构和实际使用场景出发,详细说明 Codex Harness、Codex SDK、codex app-server 与 codex exec 的区别,并分析此次更新真

近期不少文章将 OpenAI 的 Codex 新公告解读为“全面开源 Codex Harness”,但 Codex CLI、codex exec、SDK 与 App Server 其实早已在公开工程体系中持续演进。本文从源码边界、调用架构和实际使用场景出发,详细说明 Codex Harness、Codex SDK、codex app-server 与 codex exec 的区别,并分析此次更新真

近期不少文章将 OpenAI 的 Codex 新公告解读为“全面开源 Codex Harness”,但 Codex CLI、codex exec、SDK 与 App Server 其实早已在公开工程体系中持续演进。本文从源码边界、调用架构和实际使用场景出发,详细说明 Codex Harness、Codex SDK、codex app-server 与 codex exec 的区别,并分析此次更新真








