
简介
该用户还未填写简介
擅长的技术栈
可提供的服务
暂无可提供的服务
我的配置 RTX 4060 Laptop + 8GB 显存 + 16GB 内存PID。

💡 本文基于 Spring Boot + Ollama 实战,手把手教你用 Token 缓存机制降低大模型 API 调用成本。适合有 Java 后端基础、想接入 AI 能力的开发者。
💡 本文手把手用 Spring Boot + Ollama 搭建 RAG 知识库,让大模型只基于你的业务数据回答,告别"幻觉"。适合有 Java 基础、想让 AI 落地到实际业务的后端开发者。
调用大模型接口,等 10 秒才返回完整答案,用户以为页面卡死了。改成 SSE(Server-Sent Events)流式输出后,模型边生成边推送,首字响应从 10 秒降到 0.3 秒。本文用 Spring AI + Ollama 完整实现,代码可直接运行。
💡 本文手把手用 Spring Boot + Ollama 搭建 RAG 知识库,让大模型只基于你的业务数据回答,告别"幻觉"。适合有 Java 基础、想让 AI 落地到实际业务的后端开发者。
我的配置 RTX 4060 Laptop + 8GB 显存 + 16GB 内存PID。

💡 本文从源码角度拆解 HashMap 的核心机制,包含 put/get 流程、扩容策略、红黑树转换、哈希冲突解决。附面试高频问题 + 代码实测。适合 Java 后端开发者和面试备战者。
💡 本文基于 Spring Boot + Ollama 实战,手把手教你用 Token 缓存机制降低大模型 API 调用成本。适合有 Java 后端基础、想接入 AI 能力的开发者。
调用大模型接口,等 10 秒才返回完整答案,用户以为页面卡死了。改成 SSE(Server-Sent Events)流式输出后,模型边生成边推送,首字响应从 10 秒降到 0.3 秒。本文用 Spring AI + Ollama 完整实现,代码可直接运行。
本文适合:写过 @Async 但没深究过线程池行为、或在线上遇到任务堆积/OOM 的后端开发者。读完你能收获:搞懂 4 种拒绝策略的触发时机与底层原理、掌握生产环境线程池参数怎么调、学会用监控数据定位问题。阅读时间约 8 分钟。







