logo
publist
写文章

简介

该用户还未填写简介

擅长的技术栈

可提供的服务

暂无可提供的服务

AI怎么把一句话变成能用的小程序

很多人第一次看到「说一句中文就生成一个能用的小程序」,第一反应是:这不扯吗,中间那么多代码,一句话怎么可能变出来。我一开始也不信,后来把原理大致捋明白了,写篇大白话讲讲背后发生了什么。不涉及太硬的术语,看完你大概能明白它能干什么、干不了什么。

文章图片
#人工智能#小程序
NL2SQL让Agent查库,怎么防注入防删库

先把结论甩前面:让智能体把人话翻成SQL去查库,最该防的不是它写不对查询,是它在你没盯着的时候,把一句"帮我清理下过期数据"执行成了真的DELETE。下面这几个坑,我都是踩过血才知道要拦在哪一层。起因是上个月,运营那帮人天天来找我跑数。"看看上周华东区退款单多少""把昨天注册没下单的用户拉给我"——一天七八次,我SQL写到手软。后来我花了俩晚上,拿一个零代码就能配智能体的工具,搭了个"查数小助手"

文章图片
大模型流式输出怎么实时拦截敏感内容

但流式(SSE)是一个字一个字往外推的,用户体验好,可审核就尴尬了——你不可能等全部生成完,那就失去流式的意义了;流式输出做内容安全,最容易栽的坑是:等模型把整段话生成完再审,那前面已经流给用户的字早就看到了,拦了个寂寞。我把审核放进流水线,模型继续往缓冲区生成,审核异步处理已凑齐的窗口,前端推送跟着审核结果走。整套流式审核管线,我是在一个零代码搭智能体、还能直接发布成 API 的平台上配的——缓

文章图片
function calling调工具,后端问我最多的问题

我现在用一个零代码平台搭这种会调工具的智能体,工具是在界面上配的,连参数、连描述,拖一下就挂上去了,模型什么时候调、调完结果怎么接回来,平台都接好了。我吃过亏:一个工具我描述写得太笼统,"处理订单相关",结果用户问退款、查物流,模型全往这一个工具上怼。用户说"查我上周那个订单","上周"模型得自己换算成日期,偶尔会算岔。A:模型本身调不了,它没那本事。准确说是——你提前把可用的工具(比如"查订单接

文章图片
#java#前端#服务器
多轮对话上下文超长怎么截断

聊到一定长度,把要丢弃的早期对话先让模型压缩成一段简短摘要,把摘要塞进"关键事实区",再丢原文。我只在比较重的客服场景才上摘要,普通闲聊不值当,加了反而慢。二是摘要这条路径,摘要本身也占 token,别让摘要越滚越长,我有次摘要套摘要,滚到比原文还长,离谱。我的做法是把系统提示、人设、还有用户一开始交代的关键信息(比如"我的订单号是 xxx")单独存一份,每轮都强制带上,不参与滑动窗口的丢弃。我用

文章图片
embedding选错召回全废:嵌入模型怎么选

embedding就是把文字压成一串数字(向量),语义相近的文字,向量距离就近。如果这个模型对你的领域语义理解得糙,"社保缴费基数"和"医保报销比例"在它眼里挨得很近,那召回就会把不相关的块捞上来。后面大模型再强,喂的料是错的,答案必然废。我是在一个零代码就能配智能体、知识库里能切换embedding的平台上做的对比,换嵌入模型是下拉选一下、重建索引就行,不用改代码。维度是工程权衡,不是越大越牛。

文章图片
#算法
定时触发Agent:每天早八自动给我推一份行业摘要

我每天上班第一件事是刷行业新闻,大概要花二十分钟扫一圈各个源头。烦了之后我搭了个小助手,让它每天早上八点自己跑一遍,把当天值得看的几条整理成一段话,推到我企业微信。现在我喝口咖啡就看完了。说说怎么搭的。

文章图片
#github
function calling调工具,后端问我最多的问题

我现在用一个零代码平台搭这种会调工具的智能体,工具是在界面上配的,连参数、连描述,拖一下就挂上去了,模型什么时候调、调完结果怎么接回来,平台都接好了。我吃过亏:一个工具我描述写得太笼统,"处理订单相关",结果用户问退款、查物流,模型全往这一个工具上怼。用户说"查我上周那个订单","上周"模型得自己换算成日期,偶尔会算岔。A:模型本身调不了,它没那本事。准确说是——你提前把可用的工具(比如"查订单接

文章图片
#java#前端#服务器
给Agent加缓存,一个月省了一半token

直说结论:如果你的 Agent 线上有大量重复或相似的问题,。我有个客服 Agent,上线第一个月账单出来我差点没绷住,一看日志,30% 的问题都是"营业时间""怎么退款""客服电话"这种翻来覆去的。次次喂模型,纯纯浪费。后来加了两层缓存,token 消耗砍了快一半。这篇讲讲怎么加、坑在哪。

文章图片
#人工智能
给 AI Agent 做回归测试:用“效果测评“搭一道质量门,别让它越改越差

做过 Agent 的人迟早会遇到这个尴尬:调 Prompt 时按下葫芦浮起瓢——为了修好 A 类问题改了指令,结果 B 类问题悄悄退化了,上线才被用户发现。这本质是个的问题。传统软件改完跑测试套件就知道有没有破坏存量功能,Agent 也该有这么一道门。这篇讲讲我怎么用平台的"效果测评"功能给 Agent 搭回归测试,给同样要对 Agent 质量负责的测试/后端同学参考。

文章图片
#kotlin#android#开发语言
    共 14 条
  • 1
  • 2
  • 请选择