logo
publist
写文章

简介

该用户还未填写简介

擅长的技术栈

可提供的服务

暂无可提供的服务

AI SDK 总览:一个 TypeScript 工具包,如何把“接大模型“这件事变简单

技术选型不能只看设计漂亮,还得看有没有人用。周下载量约2000 万+GitHub26k+star、680+贡献者支持100+模型、16+provider(OpenAI、Anthropic、Google、xAI 等)官方支持 React / Next.js / Vue / Svelte / Node.js,Python 版在 beta在 JS/TS 生态里,它基本是做 AI 应用的事实标准。生态成熟

文章图片
#人工智能#typescript#javascript
三个 Agent 框架,我用同一个项目各实现了一遍

一句话定位。特点。Standard model interface(统一的模型接口)。一套接口覆盖 chat model、embedding 等,跨各家 provider。换模型只需要很小的代码改动,需求演进时应用仍然是可移植的。Highly configurable harness(高度可配置的 harness)。从这个最小 harness 起步,通过 middleware 增量地加能力——护栏

#网络#人工智能
LangChain Agent深度实践:编写可自主调用天气、搜索和计算器的智能体

第5/8篇|LangChain学习实录系列|所有代码在 Ubuntu 22.04 + Python 3.11.9 + LangChain 0.3.7 + Ollama 0.4.7 下逐行验证通过前四篇我们完成了链式调用、Prompt工程、本地知识库问答和FastAPI服务化部署。但真实请求常含隐式状态依赖与跨域操作——例如:这类请求无法靠静态Prompt覆盖:LLM需在运行时动态判断是否调用工具、

从0到1实战:LangChain+Ollama+FastAPI部署可运行的私有AI助手

实例生命周期 = Uvicorn worker进程存活时间。时,所有session共享同一store字典;时,每个worker持独立storesession_id无法跨进程路由。这是开发期明确的性能权衡:牺牲横向扩展性,换取调试确定性。若需多worker支持,必须引入外部存储(如第6篇SQLite方案),否则session_id在负载均衡下必然丢失。本文交付的是一个可嵌入CI/CD、可被curlf

#fastapi
LangChain项目工程化:模块拆分、测试驱动开发(TDD)与CI/CD集成实战

本文通过模块拆分、TDD和CI/CD,将LangChain应用从原型升级为工程化项目。模块化是大型项目的基础,需明确职责边界。例如将和分离,便于替换向量数据库(如从Chroma切换到FAISS)。TDD能显著提升代码质量,但需平衡测试粒度。单元测试应覆盖边界条件(如空文件输入),而集成测试需模拟外部依赖。CI/CD自动化流程可减少人为错误,建议结合监控(如Prometheus)和日志分析(如ELK

#驱动开发#tdd
LangChain Agent深度实践:编写可自主调用天气、搜索和计算器的智能体

第5/8篇|LangChain学习实录系列|所有代码在 Ubuntu 22.04 + Python 3.11.9 + LangChain 0.3.7 + Ollama 0.4.7 下逐行验证通过前四篇我们完成了链式调用、Prompt工程、本地知识库问答和FastAPI服务化部署。但真实请求常含隐式状态依赖与跨域操作——例如:这类请求无法靠静态Prompt覆盖:LLM需在运行时动态判断是否调用工具、

零基础入门LangChain:5分钟搭建你的第一个LLM聊天应用

《零基础5分钟搭建LLM聊天应用:LangChain避坑指南》 本文记录了作者从零搭建LangChain应用的实战经验,重点解决本地LLM调用中的常见问题。通过Ollama和LangChain组合,实现对话历史管理、类型安全调用和响应解析。关键步骤包括:创建虚拟环境、安装必要依赖(强调langchain-community必须显式安装)、拉取phi3:mini模型,以及10行核心代码实现带上下文的

#python
手把手复现:用LangChain构建本地知识库问答系统(支持PDF/Markdown)

`retriever.invoke("Q3")`返回空列表 | 对着终端发呆20分钟 | 先`curl http://localhost:11434/api/embeddings -d '{"model":"nomic-embed-text","input":"Q3"}'`,没返回向量说明Ollama没起来 |- **PDF解析选PyMuPDF**:`pypdf`遇到表格直接变乱码,而PyMuPD

生产级优化指南:LangChain缓存、流式响应与错误重试机制实操

本文所有补丁均基于 LangChain 0.3.7 公开 API,未使用_private缓存补丁通过重写实现参数敏感哈希,key 可直接用于 Redis;流式补丁用封装降级逻辑,兼容现有 Chain 结构;重试补丁接管,实现状态码级精准控制。实测 72 小时:P95 延迟从 2.4s → 0.8s,超时率从 12.7% → 0.3%,重试成功率 99.2%。这些不是“锦上添花”,而是生产环境存活的

#缓存
手把手复现:用LangChain搭个「能摸得着」的本地知识库(PDF+Markdown全支持)

让解析可见直接看到切块效果,不用猜PyMuPDF到底抠出了啥;让向量可验curl调用Ollama API,亲眼确认“Q3”被转成了,不是黑盒;让检索可控返回原文片段,能人工判断“为啥这个chunk没被召回”。真正的工程化,不是堆组件,是让每个环节都经得起质问。下一章(第4篇),我们就把这套能摸得着的系统,打包成FastAPI服务——解决并发请求排队、模型热加载、错误熔断这些生产级问题。字数:152

    共 26 条
  • 1
  • 2
  • 3
  • 请选择