logo
publist
写文章

简介

该用户还未填写简介

擅长的技术栈

可提供的服务

暂无可提供的服务

从 LangGraph 回到 Model-Tool Loop:更聪明的模型,正在让 Agent 架构重新变简单

在 Web 开发里,我们不会为了加日志、鉴权、限流、压缩、异常处理,就重新设计 HTTP 请求流程。它可能不按格式输出,可能跳过步骤,可能忘记系统提示,可能随便编工具参数,可能在应该调用工具的时候直接胡说,可能在应该等待人工确认的时候擅自执行。但随着模型越来越能遵循指令、理解 Skill、使用工具、处理长上下文,过度复杂的图结构会越来越像一种历史包袱。银行转账、库存扣减、权限校验、订单状态机,都应

#架构#java#大数据
ay 0 部署:昇腾 910B DeepSeek-V4 部署指南与压测表现

GPUStack 支持可插拔的推理引擎架构,允许自定义推理后端及其版本,用于引入 GPUStack 未内置的 vLLM / SGLang / MindIE 版本,或接入其他自定义推理引擎镜像。为了部署模型,需要添加 vLLM Ascend 最新发布的v0.13.0rc3版本。vLLM在推理后端菜单,编辑 vLLM,在版本配置中选择添加版本配置值版本0.13.0rc3镜像名称框架CANN覆盖镜像入口

#前端
00多行代码实现一个最简单的Agent(用ReAct)

ReAct 拆开来 ,就是 Re + Act,Reasoning + Acting。先思考(我要做什么)→ 再行动(调用工具 / 回答)→观察结果→ 继续思考→ 再行动→观察结果,... ...,直到完成任务。

#react.js#前端#前端框架
ay 0 部署:昇腾 910B DeepSeek-V4 部署指南与压测表现

GPUStack 支持可插拔的推理引擎架构,允许自定义推理后端及其版本,用于引入 GPUStack 未内置的 vLLM / SGLang / MindIE 版本,或接入其他自定义推理引擎镜像。为了部署模型,需要添加 vLLM Ascend 最新发布的v0.13.0rc3版本。vLLM在推理后端菜单,编辑 vLLM,在版本配置中选择添加版本配置值版本0.13.0rc3镜像名称框架CANN覆盖镜像入口

#前端
ay 0 部署:昇腾 910B DeepSeek-V4 部署指南与压测表现

GPUStack 支持可插拔的推理引擎架构,允许自定义推理后端及其版本,用于引入 GPUStack 未内置的 vLLM / SGLang / MindIE 版本,或接入其他自定义推理引擎镜像。为了部署模型,需要添加 vLLM Ascend 最新发布的v0.13.0rc3版本。vLLM在推理后端菜单,编辑 vLLM,在版本配置中选择添加版本配置值版本0.13.0rc3镜像名称框架CANN覆盖镜像入口

#前端
ay 0 部署:昇腾 910B DeepSeek-V4 部署指南与压测表现

GPUStack 支持可插拔的推理引擎架构,允许自定义推理后端及其版本,用于引入 GPUStack 未内置的 vLLM / SGLang / MindIE 版本,或接入其他自定义推理引擎镜像。为了部署模型,需要添加 vLLM Ascend 最新发布的v0.13.0rc3版本。vLLM在推理后端菜单,编辑 vLLM,在版本配置中选择添加版本配置值版本0.13.0rc3镜像名称框架CANN覆盖镜像入口

#前端
到底了