
简介
该用户还未填写简介
擅长的技术栈
可提供的服务
暂无可提供的服务
上一篇《多智能体协作框架实战》讲的是"怎么把多个 Agent 组织起来干活"。但一旦 Agent 能调用工具、读写文件、发邮件、动数据库,它就从"聊天机器人"变成了"有执行权的数字员工"——攻击面瞬间爆炸。这一篇把智能体安全(Agent Security)从概念拉到工程:四类核心威胁(提示注入 / 越狱 / 工具滥用 / 数据泄露)→ 攻击链路拆解 → 防御分层方案 → 最小可运行防护代码 → 红
用 llama.cpp 把 13B 模型塞进 8GB 显存:GGUF 量化部署实战(含完整命令)
用 llama.cpp 把 13B 模型塞进 8GB 显存:GGUF 量化部署实战(含完整命令)
智能体面试准备(八):LangChain / LlamaIndex / CrewAI 深度对比——架构哲学、代码范式与选型答题框架
27届大模型岗面试准备(九):模型量化实战——INT8/INT4/GPTQ/AWQ 原理、误差账与手写模拟量化
智能体面试准备(十四):代码实例——MCP client/server 实战,把工具做成即插即用的标准服务
在高并发的业务场景中,响应速度往往直接决定了用户体验的上限。无论是客服系统的即时问答,还是大促期间的商品详情生成,传统的人工处理模式早已难以应对指数级增长的数据洪流。很多开发者和产品负责人都面临过这样的困境:资源有限,但需求无限;既要保证内容的质量与个性化,又要控制成本和延迟。这种矛盾在电商、教育、内容创作等领域尤为突出,单纯依靠堆砌人力不仅效率低下,还容易因为疲劳导致错误率上升。幸运的是,随着大
用 llama.cpp 把 13B 模型塞进 8GB 显存:GGUF 量化部署实战(含完整命令)
从 Prompt 工程到 Context 工程:2026 年提示词方法论的范式迁移
用 PEFT + LoRA 微调你的第一个领域模型:以中文客服问答为例(附完整代码)







