
简介
该用户还未填写简介
擅长的技术栈
可提供的服务
暂无可提供的服务
本文系统介绍了 Java 项目接入大模型的三种主流方案。从最轻量的直接调用 API,到提供打字机体验的流式响应 + SSE,再到功能完整的 Spring AI 框架,详细分析了每种方案的实现方式、适用场景与优缺点,并提供了具体的代码示例。文章旨在帮助开发者根据自身业务需求,选择最合适的接入路径,快速在 Spring Boot 项目中集成 AI 能力。

本文系统阐述了大模型API调用中的容错与高可用设计。核心思路是将大模型API视为不可靠的外部依赖,通过四层防护机制保障系统稳定性:1)线程池隔离,避免慢响应拖垮业务线程;2)智能重试,针对超时和限流进行指数退避重试;3)熔断降级,当失败率过高时自动切断调用链路;4)多Provider切换,在主模型不可用时自动降级到备用模型。文章结合Spring生态的@Retryable、Resilience4j

本文通过一个面试场景引入,深入浅出地讲解了 Spring AI 中 Function Calling 的核心概念、实现方式与生产实践要点。文章首先阐明 Function Calling 是让大模型自主调用外部 Java 方法的能力,将其比喻为 CEO 的智能助理。接着详细介绍了两种实现方式:使用 @Tool 注解的声明式注册和利用 ToolCallback 的动态注册。针对多工具场景,文章解释了模

文章摘要: 本文深入解析了大模型应用中的Agent技术,将其与RAG(检索增强生成)和Function Calling(函数调用)进行对比。Agent通过赋予大模型自主规划能力,实现了复杂任务的多步骤执行,核心机制采用ReAct模式(推理+行动循环)。作者通过出差规划案例展示了Agent如何自主调用天气查询、机票搜索等工具,并详细说明了循环终止条件。针对复杂场景,提出多Agent协作架构,通过主管

摘要: ClaudeCode的“失忆”问题源于每次新会话不继承历史信息,但可通过CLAUDE.md(项目记忆)和memory(全局记忆)解决。CLAUDE.md位于项目根目录,记录技术栈、代码规范等,使AI快速适应项目;memory配置在用户设置中,保存个人编码偏好,适用于所有项目。两者优先级明确:项目特定规则用CLAUDE.md,通用习惯用memory。进阶用法包括拆分模块化记忆文件或为子目录单

文章摘要: ClaudeCode的Subagent机制允许将独立任务拆分为多个子代理并行执行,显著提升效率。适用于无依赖、可合并结果的批量任务(如多文件检查、单元测试编写等)。每个子代理拥有独立上下文,避免主代理的上下文挤占问题。使用时需确保任务自包含、无依赖,并注意API消耗。合理拆分可节省75%以上时间,如6个单元测试任务从25分钟缩短至6分钟。关键点:任务独立、明确指令、结果抽查,避免依赖型

文章摘要: ClaudeCode的Subagent机制允许将独立任务拆分为多个子代理并行执行,显著提升效率。适用于无依赖、可合并结果的批量任务(如多文件检查、单元测试编写等)。每个子代理拥有独立上下文,避免主代理的上下文挤占问题。使用时需确保任务自包含、无依赖,并注意API消耗。合理拆分可节省75%以上时间,如6个单元测试任务从25分钟缩短至6分钟。关键点:任务独立、明确指令、结果抽查,避免依赖型

文章摘要: ClaudeCode的Subagent机制允许将独立任务拆分为多个子代理并行执行,显著提升效率。适用于无依赖、可合并结果的批量任务(如多文件检查、单元测试编写等)。每个子代理拥有独立上下文,避免主代理的上下文挤占问题。使用时需确保任务自包含、无依赖,并注意API消耗。合理拆分可节省75%以上时间,如6个单元测试任务从25分钟缩短至6分钟。关键点:任务独立、明确指令、结果抽查,避免依赖型

摘要: ClaudeCode的“失忆”问题源于每次新会话不继承历史信息,但可通过CLAUDE.md(项目记忆)和memory(全局记忆)解决。CLAUDE.md位于项目根目录,记录技术栈、代码规范等,使AI快速适应项目;memory配置在用户设置中,保存个人编码偏好,适用于所有项目。两者优先级明确:项目特定规则用CLAUDE.md,通用习惯用memory。进阶用法包括拆分模块化记忆文件或为子目录单

摘要: ClaudeCode的“失忆”问题源于每次新会话不继承历史信息,但可通过CLAUDE.md(项目记忆)和memory(全局记忆)解决。CLAUDE.md位于项目根目录,记录技术栈、代码规范等,使AI快速适应项目;memory配置在用户设置中,保存个人编码偏好,适用于所有项目。两者优先级明确:项目特定规则用CLAUDE.md,通用习惯用memory。进阶用法包括拆分模块化记忆文件或为子目录单








