logo
publist
写文章

简介

该用户还未填写简介

擅长的技术栈

可提供的服务

暂无可提供的服务

Vibe Coding--初识AI编程

智能体(Agent)是一个能够自主完成任务的AI系统。智能体的工作循环是感知(读取项目代码、理解需求) → 推理(分析问题,制定计划) → 行动 (修改文件、运行命令、安装依赖)→ 反馈(检查结果、发现新问题)Claude Code 就是一个典型的编程智能体 —— 你告诉它"帮我添加一个用户注册功能",它会自己读懂项目代码,自己创建文件,自己写代码并运行测试。参数量:模型的"大脑"大小你可能听说过

#人工智能
AI Agent 从 Demo 到生产:被低估的四个工程问题

短任务没问题,任务一长就会撞上两堵墙:上下文窗口被占满,以及——更隐蔽的——关键信息被淹没在噪声里,模型开始"忘事"。上面四个问题——状态外置、工具容错、循环控制、轨迹观测——单拎出来都不算高深,但要全部做扎实、还能稳定支撑多个 Agent 并发跑、横跨多个业务系统,工作量并不小。比如比孚科技的 Bizfocus ADP,就是一款国产的企业级智能体平台,上面这些状态管理、工具编排、执行控制、链路追

#前端#服务器#数据库
你的显卡能跑多少算子?用 55 个检查项,给 PyTorch GPU 环境做一次冒烟测试

如果某个操作直接报错,或者输出跑到了 CPU,那就值得深挖一下。

#pytorch#人工智能#python
k8s gateway

这里的address是空的,原因是刚刚创建的gateway的svc的类型是loadBalancer,而我们不是云上的环境,没有提供loadBalancer的能力,所以这里没有被分配到地址。要注意的是,博客里面的地址段你得写一个你真正能通的,比如你的k8s节点的地址是192.168.88.0/24的,那么你最好将loadBalancer的地址段也写成这个。此时你会发现,根本无法访问,或者访问出来的内

#kubernetes#gateway#容器
一篇搞定:用 curl 测试私有部署模型联通性

这里可以先把关注点放在两件事上:一是地址 http://[已脱敏IP] 是否能访问,二是端口 8000 和 8002 是否分别有服务响应。这条命令对应的是 8002 端口,请求模型为 qwen3-embedding,输入是一段测试文本,用来验证向量生成接口是否可用。分别测试 /v1/chat/completions 和 /v1/embeddings,确认聊天能力和向量能力都能正常接入。curl h

#c##开发语言
三步将 AI(大模型--智谱)RAG-增强检索-- 整合进 Spring Boot项目,

在开始三步集成前,先确保你已准备好以下基础环境:JDK 17+:Spring Boot 3 和 Spring AI 基于较新的 Java 版本,确保你的 JDK 版本不低于 17。Maven 或 Gradle:本文以 Maven 为例,它是我们管理项目依赖的得力助手。一个顺手的 IDE:选择你最熟悉的 IDE 即可,本文以 IntelliJ IDEA 为例。一个 LLM厂商的 API Key:本文

#人工智能#spring boot#后端
Java + Spring实现Hermes Agent之龙虾、Skills、Mcp和沙箱代码执行环境思路

Agent 跑工具调用经常一轮接一轮,要是只把最终回答推给前端,用户那边就是十几秒甚至几十秒的空白,体验很差,出问题也没法排查。我们的做法是把整个工具调用循环里发生的事情都拆成事件吐到 SSE 流里——token 在出、思考在写、工具被调了、工具返回了什么,前端按事件类型渲染就行。记忆解决了"它记得",但 Agent 还差一块——"它能在你不在的时候干活"。JobRunr 要把这条 lambda

#java#spring#开发语言
使用 UEFI 图形输出协议 GOP 在屏幕上显示图像的方法

GOP(Graphics Output Protocol,图形输出协议)是 UEFI 规范中的一个核心接口,用来在操作系统启动前接管显卡并显示图形界面。接下来我们分两部分来介绍,首先用最简单的语言来说明 GOP 控制显示的原理,然后分析一下 UEFI 中 GOP 的源码定义。我们在屏幕上看到的一幅完整图片是由有限的特定像素点组成的,比如常见的 1920*1080 分辨率。每个像素点通过红绿蓝三原色

#人工智能#算法#网络
到底了