logo
publist
写文章

简介

该用户还未填写简介

擅长的技术栈

可提供的服务

暂无可提供的服务

Agent里的耗时任务老超时?改成异步回调就好了

如果你的Agent里有一步要跑很久——生成一份长报告、批量处理几百条数据、调一个慢吞吞的外部接口——还在同步等结果,迟早会撞超时。这篇讲怎么改成异步回调,带最小代码。

文章图片
#人工智能
用讯飞星辰搭“论文研读 Agent“踩坑实录:RAG 为什么还在瞎编,以及我怎么把它治住

RAG 幻觉、知识库召回不准、论文研读助手、讯飞星辰 Agent、向量检索、Prompt 约束、引用溯源

文章图片
#人工智能#深度学习#计算机视觉
把请假、会议室预定这类重复审批做成对话式自助:案例拆解

我们行政和 HR 每天被一堆鸡毛蒜皮的审批咨询缠着:"我还剩几天年假""下周二下午 3 号会议室空吗""请半天走哪个流程"。这些问题答案都在系统里,但用户懒得点进 OA 翻,宁可直接戳人。我花了两个下午把这摊事做成了一个对话式自助助手,这篇拆给你看。

文章图片
#人工智能
大模型抽取字段总缺漏怎么补全校验

把结论甩出来:大模型做结构化字段抽取漏字段,八成不是模型笨,是你没给它"漏了也得交差"的兜底。补全靠两步——(缺的字段也得吐出来、标 null)+。下面按我踩过的具体场景编号说,每个场景配一个能直接抄的解法。我背景:做了三年多企业内部的发票/合同/工单解析,从 GPT-3.5 那会儿就开始拿大模型抽字段,被缺漏坑到怀疑人生过。下面这些都是真在生产里栽过的。

文章图片
#python#开发语言
embedding加缓存,省一半向量调用

顺带提一句,这套问答小助手我没自己写多少胶水,是在一个零代码就能拖配智能体的平台上搭的,知识库 RAG、模型挂载它都包了,我主要就管这层 embedding 缓存的优化。模型名必须带上,因为 text-embedding-3-small 和换个模型出来的向量维度、数值都不一样,混在一个缓存里就是灾难——这个坑我是真栽过,换模型那天检索结果全乱,查了俩小时才定位到是缓存没隔离。没到夸张的九成,因为我

文章图片
#缓存
给智能体挂MCP Server加外部能力实操(联网查天气)

智能体只会聊天没用,得能动手干活。这篇记录我怎么给一个智能体挂上 MCP Server,让它能联网、能查实时天气、能调外部工具,全程零代码,照着步骤就能复现。先说 MCP 是啥,一句话:一套让大模型调用外部工具的标准协议。以前每接一个工具要写一遍适配代码,现在工具方按 MCP 暴露能力,智能体这边直接挂,不用写胶水代码。

文章图片
#java#前端#linux
给智能体挂MCP Server加外部能力实操(联网查天气)

智能体只会聊天没用,得能动手干活。这篇记录我怎么给一个智能体挂上 MCP Server,让它能联网、能查实时天气、能调外部工具,全程零代码,照着步骤就能复现。先说 MCP 是啥,一句话:一套让大模型调用外部工具的标准协议。以前每接一个工具要写一遍适配代码,现在工具方按 MCP 暴露能力,智能体这边直接挂,不用写胶水代码。

文章图片
#java#前端#linux
到底了